إصدار ما قبل الإطلاق / بناء مستمر: هذا بناء تجريبي، وليس إصدارًا مستقرًا.
llama: إصلاح سباق البيانات في تشتيت k-pool على التسلسلات المشتركة (#29994) * llama: إعادة تجميع كل عنصر rep مشترك في k-pool مرة واحدة عند وجود خلايا مشتركة، يُعاد تجميع كل pool، وبما أن المفاتيح المجمعة scattered دائمًا، فإن pools التي يشاركها seq_cp بين التسلسلات كتبت نفس صف الـ rep من عدة مدخلات تشتيت، وهو سباق بيانات على واجهة CPU الخلفية. وسم كل rep مرة واحدة: التسلسلات المشتركة تقرأ نفس الصف عبر pool_cells. * llama: التحقق من أن seq_cp يشمل تسلسلًا كاملًا في ذاكرة idx الهجينة تُنسخ الحالة المتكررة (recurrent) دائمًا كاملةً أيًا كان النطاق، وخلية k-pool مشتركة عبر نسخة جزئية يمكن أن تحمل تجميعين pool مختلفين مع صف مجمّع واحد. كل المستدعين ينسخون تسلسلات كاملة، لذا نرفض النطاقات الجزئية بدلًا من دعمها. * llama: إزالة وضع cache_safe في k-pool مع seq_cp للتسلسل الكامل، التسلسلات التي تشارك الخلايا تشارك pools الخاصة بها أيضًا، وبالتالي فإن الصف المجمّع لـ rep مشترك صالح لجميعها. وسم كل rep مرة واحدة في كل ubatch بدلًا من إعادة تجميع كل شيء ما دامت الخلايا مشتركة، ما يزيل مسح المشاركة وحلول stale-all المؤقتة في seq_rm وstate_read وstate_drop. لم يعد seq_cp يُفسد سوى الوجهة.الموقع الإلكتروني: - https://llama.app
شهادات التحقق: - https://github.com/ggml-org/llama.cpp/attestations/53070668
macOS/iOS: - macOS Apple Silicon (arm64) - macOS Apple Silicon (arm64، مع تفعيل KleidiAI) معطّل - macOS Intel (x64) - iOS XCFramework
لينكس: - أوبونتو x64 (CPU) - أوبونتو arm64 (CPU) - أوبونتو s390x (CPU) - أوبونتو x64 (Vulkan) - أوبونتو arm64 (Vulkan) - أوبونتو x64 (CUDA 12) - مكتبات CUDA 12.8 - أوبونتو x64 (CUDA 13) - مكتبات CUDA 13.4 - أوبونتو arm64 (CUDA 13) - مكتبات CUDA 13.4 - أوبونتو x64 (ROCm 10.0) - أوبونتو x64 (OpenVINO) - أوبونتو x64 (SYCL FP32) - أوبونتو x64 (SYCL FP16) - لينكس arm64 (Snapdragon: CPU، Adreno GPU، Hexagon NPU) - دليل الإعداد
أندرويد: - أندرويد arm64 (CPU) - أندرويد arm64 (Snapdragon: CPU، Adreno GPU، Hexagon NPU) - دليل الإعداد
نظام Windows: - Windows x64 (المعالج المركزي) - Windows arm64 (المعالج المركزي) - Windows arm64 (رسوميات OpenCL Adreno) - Windows x64 (بتقنية CUDA 12) - ملفات DLL الخاصة بـ CUDA 12.4 - Windows x64 (بتقنية CUDA 13) - ملفات DLL الخاصة بـ CUDA 13.4 - Windows arm64 (بتقنية CUDA 13) - ملفات DLL الخاصة بـ CUDA 13.4 - Windows x64 (بتقنية Vulkan) - Windows arm64 (بتقنية Vulkan) - Windows x64 (بتقنية OpenVINO) - Windows x64 (بتقنية SYCL) - Windows x64 (بتقنية ROCm 10.0)
openEuler: - معطّل - openEuler x86 (إصدار 310p) - openEuler x86 (إصدار 910b، ACL Graph) - openEuler aarch64 (إصدار 310p) - openEuler aarch64 (إصدار 910b، ACL Graph)
واجهة المستخدم: - واجهة المستخدم