إصدار ما قبل الإطلاق / بناء مستمر: هذا بناء تجريبي، وليس إصداراً مستقراً.
ggml-openvino: إصلاح اختبارات CI؛ إصلاح تراجعات GPU. (#30037) * ggml-openvino: تخطي فروع الرسم البياني غير المحددة ودعم DUP يضيف الإصدار الأعلى #29622 فرعاً مختلطاً من token/embd إلى كل رسم بياني لتضمين المدخلات عبر ggml_build_forward_select(). عُقده غير معلمة للحساب، لكن الخلفية ترجمتها على أي حال، ولم يكن DUP في ذلك الفرع مدعوماً، لذا قام المجدول بتقسيم الرسم البياني ومرر التضمينات عبر التقسيم بعدد رموز ثابت. فشل فك الترميز الأول أحادي الرمز بعدها (test-thread-safety على CPU وGPU). ابنِ نموذج OV من عقد الحساب فقط، وترجم DUP متجاوراً من نفس النوع مثل CONT حتى يبقى الرسم البياني على خلفية واحدة. * ggml-openvino: اجعل بُعد الرموز في inp_scale_rows ديناميكياً ينقل #29622 أيضاً مقياس التضمين لكل رمز (gemma3 وgemma3n و gemma4) إلى مدخل جديد [1, n_tokens]. امنحه بُعد رموز ديناميكياً واحشره لكل جزء على المسار الثابت (NPU). * ggml-openvino: تخطَّ اختبارات عمليات GPU MUL_MAT بأوزان Q4_1/Q4_K غير المقيدة تبني اختبارات العمليات أوزان Q4_1/Q4_K كـ u4 بنقطة صفر f16. يفشل إضافة GPU في ترجمة تلك الصيغة لبعض أعداد الصفوف مع "clFinish, error code: -5 CL_OUT_OF_RESOURCES"، مما يجهض test-backend-ops في حالات MUL_MAT المضافة في #29869 (مثل m=1000, n=2, k=1024). أوزان النماذج تستخدم نقطة صفر u4 وغير متأثرة. أبلغ عن هذه الحالات كغير مدعومة على GPU حتى تُصلح الإضافة. وتحقق اختبارات العمليات من الدعم قبل التخصيص، لذا يطابق الفحص الأوزان غير المقيدة فقط؛ يفحص تحميل النموذج باستخدام مخزن مؤقت وهمي ويبقي أوزانه على GPU. * ggml-openvino: أنشئ FILL في نوع الإخراج كان translate_fill يبني دائماً ثابتاً من نوع f32، لذا أنتج FILL من نوع f16 بيانات f32 وتجاوز النسخ العكسي مخزن الإخراج f16. استخدم نوع الإخراج للثابت. * ggml-openvino: ارفض CONCAT من نوع كمي تُزال تكميم المدخلات الكمية عند ترجمتها، لذا لا تستطيع الخلفية كتابة ناتج CONCAT كمي. أبلغ عنه كغير مدعوم، كما هو الحال مع CPY إلى نوع كمي. * ggml-openvino: تعامل مع تجميع الحالة التكرارية الوحيد في build_rs غيّر #29856 الـ build_rs لتجميع جميع الحالات التكرارية بـ GET_ROWS واحدة على ورقة s_copy وأخذ الـ ubatch والحالات الإضافية كمناظر منها. كان المسار الحافظ يطابق فقط الصيغة السابقة، GET_ROWS لكل منظر من مناظر s_copy، لذا فشل Qwen3.5 مع التنفيذ الحافظ على CPU وGPU ("is_axis_valid(axis, r)" في Concat). بالنسبة لذاكرة مخبأ أحادية الفتحة، عامل GET_ROWS على ورقة s_copy على أنه تجميع الحالة النشطة، واحتفظ بترتيب الرتبة-4 لإعادة التشكيل التي تقرأ منظر منها، واربط نسخ منظر الحالات الإضافية الفارغ بمكتبة الكتابة العكسية للفتحة الأحادية. لا تحذر عن البعد الديناميكي للمناظر الفارغة. * openvino: حاذِ رتب معاملات eltwise للتغلب على عيب في إضافة GPU * openvino: طابق دمج MoE على الرسم البياني الحافظ ذي الرتبة-3 * ggml-openvino: لا تفك ضغط ناتج معيار RMS في AlignEltwiseOperandRanks تفك هذه المرحلة ضغط المعامل الأدنى رتبةً في Add/Multiply/Subtract تختلف رتب معاملاته. في gemma-3 المعامل الأدنى رتبةً في جمع البواقي بعد الانتباه هو ناتج المعيار، وفك ضغطه يجعل إضافة GPU تحسب الطبقة بشكل خاطئ: تعيد gemma-3 إجابات فارغة على GPU مع التنفيذ الحافظ. تجاوز إعادة الكتابة عندما يكون المعامل الأدنى رتبةً ناتج معيار RMS. * docs : تحديث نماذج OpenVINO المعتمدة --------- Co-authored-by: Mustafa Cavusالموقع الإلكتروني: - https://llama.app
الشهادات: - https://github.com/ggml-org/llama.cpp/attestations/53122299
macOS/iOS: - macOS Apple Silicon (arm64) - macOS Apple Silicon (arm64، مع تمكين KleidiAI) معطل - macOS Intel (x64) - iOS XCFramework
لينكس: - Ubuntu x64 (CPU) - Ubuntu arm64 (CPU) - Ubuntu s390x (CPU) - Ubuntu x64 (Vulkan) - Ubuntu arm64 (Vulkan) - Ubuntu x64 (CUDA 12) - مكتبات CUDA 12.8 - Ubuntu x64 (CUDA 13) - مكتبات CUDA 13.4 - Ubuntu arm64 (CUDA 13) - مكتبات CUDA 13.4 - Ubuntu x64 (ROCm 10.0) - Ubuntu x64 (OpenVINO) - Ubuntu x64 (SYCL FP32) - Ubuntu x64 (SYCL FP16) - لينكس arm64 (Snapdragon: CPU, Adreno GPU, Hexagon NPU) - دليل الإعداد
أندرويد: - أندرويد arm64 (CPU) - أندرويد arm64 (Snapdragon: CPU, Adreno GPU, Hexagon NPU) - دليل الإعداد
ويندوز: - Windows x64 (CPU) - Windows arm64 (CPU) - Windows arm64 (OpenCL Adreno) - Windows x64 (CUDA 12) - ملفات DLL الخاصة بـ CUDA 12.4 - Windows x64 (CUDA 13) - ملفات DLL الخاصة بـ CUDA 13.4 - Windows arm64 (CUDA 13) - ملفات DLL الخاصة بـ CUDA 13.4 - Windows x64 (Vulkan) - Windows arm64 (Vulkan) - Windows x64 (OpenVINO) - Windows x64 (SYCL) - Windows x64 (ROCm 10.0)
openEuler: - معطّل - openEuler x86 (310p) - openEuler x86 (910b، ACL Graph) - openEuler aarch64 (310p) - openEuler aarch64 (910b، ACL Graph)
واجهة المستخدم: - واجهة المستخدم