Pre-release / 継続的ビルド: これは実験的なビルドであり、安定版リリースではありません。
metal : 残りの src0 型に対する少数行 MMA 行列乗算 (#30065) 汎用の少数行 MMA カーネルは、16 重みの 逆量子化器を持つ任意の型で動作するため、BF16、Q1_0、Q2_0、MXFP4、Q2_K、Q3_K、 TQ2_0 および IQ 型にも対応しました。各型は、M3 Ultra 上で現在のカーネルを上回る 行数から適用されます: TQ2_0 は 5 行、BF16 は 4 行、 MXFP4、Q2_0、Q2_K、IQ4_NL は 3 行、その他は 2 行からです。 test-backend-ops perf -o MUL_MAT, m=4096, k=14336、M3 Ultra、この変更の master 比 (それぞれ 2 つの交互実行の平均): 閾値から 8 行までで 0.23 から 0.98、 9 から 16 行で 0.24 から 0.33、 1 行および 512 行で 0.99 から 1.01。Website: - https://llama.app
Attestations: - https://github.com/ggml-org/llama.cpp/attestations/53605242
macOS/iOS 用: - macOS Apple Silicon(arm64)用 - macOS Apple Silicon(arm64、KleidiAI 有効) DISABLED(無効) - macOS Intel(x64)用 - iOS 向け XCFramework
Linux: - Ubuntu x64(CPU) - Ubuntu arm64(CPU) - Ubuntu s390x(CPU) - Ubuntu x64(Vulkan) - Ubuntu arm64(Vulkan) - Ubuntu x64(CUDA 12) - CUDA 12.8 ライブラリ - Ubuntu x64(CUDA 13) - CUDA 13.4 ライブラリ - Ubuntu arm64(CUDA 13) - CUDA 13.4 ライブラリ - Ubuntu x64(ROCm 10.0) - Ubuntu x64(OpenVINO) - Ubuntu x64(SYCL FP32) - Ubuntu x64(SYCL FP16) - Linux arm64(Snapdragon: CPU、Adreno GPU、Hexagon NPU) - セットアップガイド
Android: - Android arm64(CPU) - Android arm64(Snapdragon: CPU、Adreno GPU、Hexagon NPU) - セットアップガイド
Windows向け: - Windows x64(CPU向け) - Windows arm64(CPU向け) - Windows arm64(OpenCL Adreno向け) - Windows x64(CUDA 12向け) - CUDA 12.4 DLL - Windows x64(CUDA 13向け) - CUDA 13.4 DLL - Windows arm64(CUDA 13向け) - CUDA 13.4 DLL - Windows x64(Vulkan向け) - Windows arm64(Vulkan向け) - Windows x64(OpenVINO向け) - Windows x64(SYCL向け) - Windows x64(ROCm 10.0向け)
openEuler: - DISABLED - openEuler の x86(310p) - openEuler の x86(910b、ACL Graph) - openEuler の aarch64(310p) - openEuler の aarch64(910b、ACL Graph)
UI: - UI