إصدار ما قبل الإطلاق / بناء مستمر: هذا بناء تجريبي، وليس إصداراً مستقراً.
metal : ضرب مصفوفات MMA بعدد صفوف قليل لأنواع src0 المتبقية (#30065) تعمل نواة MMA ذات الصفوف القليلة العامة مع أي نوع يمتلك مزيل تكميم بوزن 16، لذا فهي تتعامل الآن أيضاً مع BF16 وQ1_0 وQ2_0 وMXFP4 وQ2_K وQ3_K وTQ2_0 وأنواع IQ. يبدأ كل نوع عند عدد الصفوف الذي يتفوق عنده على النوى الحالية على جهاز M3 Ultra: 5 صفوف لـ TQ2_0، و4 لـ BF16، و3 لـ MXFP4 وQ2_0 وQ2_K وIQ4_NL، و2 للأنواع الأخرى. test-backend-ops perf -o MUL_MAT, m=4096, k=14336, M3 Ultra، زمن هذا التغيير مقارنةً بالفرع الرئيسي (متوسط تشغيلين متداخلين لكل منهما): 0.23 إلى 0.98 من العتبة إلى 8 صفوف، و0.24 إلى 0.33 عند 9 إلى 16 صفاً، و0.99 إلى 1.01 عند 1 صف و512 صفاً.الموقع الإلكتروني: - https://llama.app
شهادات التوثيق: - https://github.com/ggml-org/llama.cpp/attestations/53605242
macOS/iOS: - macOS Apple Silicon (arm64) - macOS Apple Silicon (arm64، مع تفعيل KleidiAI) معطّل - macOS Intel (x64) - iOS XCFramework
لينكس: - أوبونتو x64 (CPU) - أوبونتو arm64 (CPU) - أوبونتو s390x (CPU) - أوبونتو x64 (Vulkan) - أوبونتو arm64 (Vulkan) - أوبونتو x64 (CUDA 12) - مكتبات CUDA 12.8 - أوبونتو x64 (CUDA 13) - مكتبات CUDA 13.4 - أوبونتو arm64 (CUDA 13) - مكتبات CUDA 13.4 - أوبونتو x64 (ROCm 10.0) - أوبونتو x64 (OpenVINO) - أوبونتو x64 (SYCL FP32) - أوبونتو x64 (SYCL FP16) - لينكس arm64 (Snapdragon: CPU، Adreno GPU، Hexagon NPU) - دليل الإعداد
أندرويد: - أندرويد arm64 (CPU) - أندرويد arm64 (Snapdragon: CPU، Adreno GPU، Hexagon NPU) - دليل الإعداد
ويندوز: - Windows x64 (CPU) - Windows arm64 (CPU) - Windows arm64 (OpenCL Adreno) - Windows x64 (CUDA 12) - ملفات CUDA 12.4 DLLs - Windows x64 (CUDA 13) - ملفات CUDA 13.4 DLLs - Windows arm64 (CUDA 13) - ملفات CUDA 13.4 DLLs - Windows x64 (Vulkan) - Windows arm64 (Vulkan) - Windows x64 (OpenVINO) - Windows x64 (SYCL) - Windows x64 (ROCm 10.0)
openEuler: - معطَّل - openEuler x86 (310p) - openEuler x86 (910b، ACL Graph) - openEuler aarch64 (310p) - openEuler aarch64 (910b، ACL Graph)
واجهة المستخدم: - واجهة المستخدم