llama.cpp Releases更新日

[プレリリース / 継続的ビルド] b11417

[プレリリース / 継続的ビルド] CUDA: NVFP4 型の mmq における累積処理の最適化 (#29857) * ggml_cuda: パフォーマンス向上のため mmq_vec_dot_fp4_fp4_mma の累積処理を最適化 * 空白を削除 * 修正: mma_block_scaled_fp4 ループのインデントを修正 **Website:** - **Attestations:** - **macOS/iOS:**…

プレリリース / 継続的ビルド: これは実験的なビルドであり、安定版リリースではありません。

CUDA: NVFP4 型の mmq における累積処理の最適化 (#29857) * ggml_cuda: パフォーマンス向上のため mmq_vec_dot_fp4_fp4_mma の累積処理を最適化 * 空白を削除 * 修正: mma_block_scaled_fp4 ループのインデントを修正

ウェブサイト: - https://llama.app

Attestations: - https://github.com/ggml-org/llama.cpp/attestations/52836411

macOS および iOS: - macOS Apple Silicon (arm64) 向け - macOS Apple Silicon (arm64、KleidiAI が有効) ディセーブル - macOS Intel (x64) 向け - iOS 向け XCFramework

Linux: - Ubuntu x64 (CPU) - Ubuntu arm64 (CPU) - Ubuntu s390x (CPU) - Ubuntu x64 (Vulkan) - Ubuntu arm64 (Vulkan) - Ubuntu x64 (CUDA 12) - CUDA 12.8 ライブラリ - Ubuntu x64 (CUDA 13) - CUDA 13.4 ライブラリ - Ubuntu arm64 (CUDA 13) - CUDA 13.4 ライブラリ - Ubuntu x64 (ROCm 10.0) - Ubuntu x64 (OpenVINO) - Ubuntu x64 (SYCL FP32) - Ubuntu x64 (SYCL FP16) - Linux arm64 (Snapdragon: CPU、Adreno GPU、Hexagon NPU) - セットアップガイド

Android: - Android arm64(CPU) - Android arm64(Snapdragon:CPU、Adreno GPU、Hexagon NPU) - セットアップガイド

Windows向け: - Windows x64(CPU 版) - Windows arm64(CPU 版) - Windows arm64(OpenCL Adreno 版) - Windows x64(CUDA 12 版) - CUDA 12.4 DLLファイル - Windows x64(CUDA 13 版) - CUDA 13.4 DLLファイル - Windows arm64(CUDA 13 版) - CUDA 13.4 DLLファイル - Windows x64(Vulkan 版) - Windows arm64(Vulkan 版) - Windows x64(OpenVINO 版) - Windows x64(SYCL 版) - Windows x64(ROCm 10.0 版)

openEuler: - DISABLED - openEuler x86 (310p) 向け - openEuler x86 (910b、ACL Graph) 向け - openEuler aarch64 (310p) 向け - openEuler aarch64 (910b、ACL Graph) 向け

UI: - UI

原文の出典

llama.cpp Releases

内容について

原文の公開と権利は出典元に帰属します。

機械翻訳 · 原文をご参照ください