llama.cpp Releases

[إصدار ما قبل النشر / بناء مستمر] b11509

[إصدار ما قبل النشر / بناء مستمر] CUDA: إصلاح حارس إصدار CCCL الذي ينكسر عند تجاوز رقم الإصدار الرئيسي (#29453) * CUDA: إصلاح حارس إصدار CCCL الذي ينكسر عند تجاوز رقم الإصدار الرئيسي كان الحارس يقارن مكوّنَي الإصدار…

إصدار ما قبل النشر / بناء مستمر: هذا بناء تجريبي، وليس إصدارًا مستقرًا.

CUDA: إصلاح حارس إصدار CCCL الذي ينكسر عند تجاوز رقم الإصدار الرئيسي (#29453) * CUDA: إصلاح حارس إصدار CCCL الذي ينكسر عند تجاوز رقم الإصدار الرئيسي كان الحارس يقارن مكوّنَي الإصدار الرئيسي والفرعي بشكل مستقل: CCCL_MAJOR_VERSION >= 3 && CCCL_MINOR_VERSION >= 1 يتصفّر المكوّن الفرعي إلى 0 كلما تم قطع سلسلة رئيسية جديدة، لذا على CCCL 4.x يُقيَّم هذا الشرط كـ 4 >= 3 && 0 >= 1، أي كاذب. STRIDED_ITERATOR_AVAILABLE يتوقف عن التعريف ويرجع argsort بصمت إلى مسار init_offsets. لا شيء يحذّر ويستمر البناء بنجاح، لذا فإن التراجع هو خسارة أداء صامتة وليس خطأ تجميع. يعرض CCCL بالفعل الإصدار كعدد صحيح واحد مُعبَّأ بصيغة MMMmmmpp، وهو ما يستخدمه ملف ترويسة الإصدار الخاص به: CCCL_VERSION = MAJOR * 1000000 + MINOR * 1000 + PATCH وبالتالي 3.4.3 هي 3004003 و">= 3.1" هي ببساطة ">= 3001000". مقارنة واحدة، دون أي حسابات على المكونات يمكن أن تخطئ فيها. تم التحقق بمقارنته مع مرجع مكتوب يدويًا لـ "version >= 3.1" على الإصدارات 2.9.9 و3.0.0 و3.1.0 و3.1.99 و3.2.0 و3.4.3 و3.9.9 و3.99.99 و4.0.0 و4.2.7 و5.0.0: لا توجد أي اختلافات. خالف الحارس القديم عند 4.0.0 و5.0.0. تم التحقق على RTX 4070 (sm_89)، CUDA 13.4، CCCL 3.4.3: - cmake --build build --config Release: exit 0 - test-backend-ops test -o ARGSORT -b CUDA0: 98/98 passed, CUDA0 OK لاحظ أن نجاح اختبار التراجع لا يثبت من تلقاء نفسه أن الحارس لا يزال مُتخذًا، لأن مسار الاحتياط ينجح أيضًا. المعالجة الأولية لوحدة الترجمة الحقيقية تؤكد أن فرع المكرر المتخطى (strided-iterator) هو المُجمَّع فعليًا: counting_iterator موجود، وinit_offsets غير موجود. Signed-off-by: Heitor * Update ggml/src/ggml-cuda/argsort.cu * Apply suggestion from @ORippler --------- Signed-off-by: Heitor Co-authored-by: Oliver Simons

الموقع الإلكتروني: - https://llama.app

الشهادات (Attestations): - https://github.com/ggml-org/llama.cpp/attestations/53997029

macOS/iOS: - macOS Apple Silicon (arm64) - macOS Apple Silicon (arm64، مع تمكين KleidiAI) DISABLED - macOS Intel (x64) - iOS XCFramework

لينكس: - أوبونتو x64 (CPU) - أوبونتو arm64 (CPU) - أوبونتو s390x (CPU) - أوبونتو x64 (Vulkan) - أوبونتو arm64 (Vulkan) - أوبونتو x64 (CUDA 12) - مكتبات CUDA 12.8 - أوبونتو x64 (CUDA 13) - مكتبات CUDA 13.4 - أوبونتو arm64 (CUDA 13) - مكتبات CUDA 13.4 - أوبونتو x64 (ROCm 10.0) - أوبونتو x64 (OpenVINO) - أوبونتو x64 (SYCL FP32) - أوبونتو x64 (SYCL FP16) - لينكس arm64 (Snapdragon: CPU، Adreno GPU، Hexagon NPU) - دليل الإعداد

أندرويد: - أندرويد arm64 (CPU) - أندرويد arm64 (Snapdragon: CPU، Adreno GPU، Hexagon NPU) - دليل الإعداد

ويندوز: - Windows x64 (CPU) - Windows arm64 (CPU) - Windows arm64 (OpenCL Adreno) - Windows x64 (CUDA 12) - ملفات CUDA 12.4 DLLs - Windows x64 (CUDA 13) - ملفات CUDA 13.4 DLLs - Windows arm64 (CUDA 13) - ملفات CUDA 13.4 DLLs - Windows x64 (Vulkan) - Windows arm64 (Vulkan) - Windows x64 (OpenVINO) - Windows x64 (SYCL) - Windows x64 (ROCm 10.0)

openEuler: - معطّل - openEuler x86 (310p) - openEuler x86 (910b، ACL Graph) - openEuler aarch64 (310p) - openEuler aarch64 (910b، ACL Graph)

الواجهة: - الواجهة

المصدر الأصلي

llama.cpp Releases

ملاحظات المحتوى

النشر الأصلي والحقوق تعود إلى المصدر.

ترجمة آلية · يُرجى الرجوع إلى الأصل