llama.cpp Releases

[إصدار تجريبي قبل النشر / بناء مستمر] b11516

[إصدار تجريبي قبل النشر / بناء مستمر] hexagon: إصلاح تجاوز حلقة DMA في IM2COL patch-embed (#30189) * hexagon: إصلاح تجاوز حلقة DMA في IM2COL patch-embed تقوم نواة IM2COL DMA ذات التجزئة الدقيقة (stride == kernel، بدون…

إصدار تجريبي قبل النشر / بناء مستمر: هذا بناء تجريبي وليس إصداراً مستقراً.

hexagon: إصلاح تجاوز حلقة DMA في IM2COL patch-embed (#30189) * hexagon: إصلاح تجاوز حلقة DMA في IM2COL patch-embed تقوم نواة IM2COL DMA ذات التجزئة الدقيقة (stride == kernel، بدون pad/dilation) بإصدار IC*KH واصف DDR->VTCM لكل صف إخراج دون التحقق من القيمة المرجعة لـ dma_queue_push()، ثم تجري IC*KH عملية pop. حلقة DMA الخاصة بكل خيط تتسع لـ 256 إدخالاً، والدفع إلى حلقة ممتلئة يعيد false ويسقط النقل، لذا عندما تكون IC*KH > 255 لا تُكتب الصفوف المتبقية من مخزن VTCM المؤقت أبداً وتتسرب بيانات قديمة (غالباً NaN/inf) إلى الإخراج. الحل هو إنهاء أقدم واصف عند امتلاء الحلقة، تماماً كما تفعل النواة المحجوبة في نفس الملف بالفعل، والانتظار باستخدام dma_queue_flush(). لأغراض الاختبار، أُضيفت حالات اختبار بالتجزئة الدقيقة مع IC*KH > 256 (‏2D 1x1، و2D 2x2 patch embed و1D، وبوجه F16 وF32)، وهي تفشل على HTP دون هذا الإصلاح. * تطبيق اقتراح من @max-krasnyansky --------- تمت المساهمة المشتركة بواسطة: Max Krasnyansky

الموقع الإلكتروني: - https://llama.app

الإشعارات الموثقة (Attestations): - https://github.com/ggml-org/llama.cpp/attestations/54222989

macOS/iOS: - macOS Apple Silicon (arm64) - macOS Apple Silicon (arm64، مع تمكين KleidiAI) معطَّل - macOS Intel (x64) - إطار XCFramework لنظام iOS

لينكس: - Ubuntu x64 (المعالج المركزي CPU) - Ubuntu arm64 (المعالج المركزي CPU) - Ubuntu s390x (المعالج المركزي CPU) - Ubuntu x64 (Vulkan) - Ubuntu arm64 (Vulkan) - Ubuntu x64 (CUDA 12) - مكتبات CUDA 12.8 - Ubuntu x64 (CUDA 13) - مكتبات CUDA 13.4 - Ubuntu arm64 (CUDA 13) - مكتبات CUDA 13.4 - Ubuntu x64 (ROCm 10.0) - Ubuntu x64 (OpenVINO) - Ubuntu x64 (SYCL FP32) - Ubuntu x64 (SYCL FP16) - لينكس arm64 (Snapdragon: المعالج المركزي CPU، معالج Adreno الرسومي، وحدة Hexagon NPU العصبية) - دليل الإعداد

أندرويد: - أندرويد arm64 (المعالج المركزي CPU) - أندرويد arm64 (Snapdragon: المعالج المركزي CPU، معالج Adreno الرسومي، وحدة Hexagon NPU العصبية) - دليل الإعداد

ويندوز: - Windows x64 (CPU) - Windows arm64 (CPU) - Windows arm64 (OpenCL Adreno) - Windows x64 (CUDA 12) - حزم DLL الخاصة بـ CUDA 12.4 - Windows x64 (CUDA 13) - حزم DLL الخاصة بـ CUDA 13.4 - Windows arm64 (CUDA 13) - حزم DLL الخاصة بـ CUDA 13.4 - Windows x64 (Vulkan) - Windows arm64 (Vulkan) - Windows x64 (OpenVINO) - Windows x64 (SYCL) - Windows x64 (ROCm 10.0)

openEuler: - معطَّل - openEuler x86 ‏(310p) - openEuler x86 ‏(910b، ACL Graph) - openEuler aarch64 ‏(310p) - openEuler aarch64 ‏(910b، ACL Graph)

واجهة المستخدم: - واجهة المستخدم

المصدر الأصلي

llama.cpp Releases

ملاحظات المحتوى

النشر الأصلي والحقوق تعود إلى المصدر.

ترجمة آلية · يُرجى الرجوع إلى الأصل