llama.cpp Releases

[プレリリース / 継続的ビルド] b11411

[プレリリース / 継続的ビルド] kv-cache: 厳密なローテーションメタデータを保存することで、一致しないKVキャッシュのローテーションの復元を修正 (#28498) * kv-cache: 厳密なKVローテーションメタデータを保存し、一致しないローテーションの復元を拒否 * tests : 状態ローテーションのテストをtest-save-load-stateへ移動…

プレリリース / 継続的ビルド: これは実験的なビルドであり、安定版リリースではありません。

kv-cache: 厳密なローテーションメタデータを保存することで、一致しないKVキャッシュのローテーションの復元を修正 (#28498) * kv-cache: 厳密なKVローテーションメタデータを保存し、一致しないローテーションの復元を拒否 * tests : 状態ローテーションのテストをtest-save-load-stateへ移動 このテストはsave/loadテストマトリクスの一部となり、スイートの他のテストと同様に、 テスト対象のすべてのモデルに対して実行されます。 このテストはモデルがサポートするKVキャッシュタイプの組み合わせを調べ、 attention rotationを使用しないモデルは自明に合格として扱います。 Assisted-by: pi:llama.cpp/Qwen3.8-27B * cont : 未対応のKVキャッシュをスキップ --------- Co-authored-by: Georgi Gerganov

ウェブサイト: - https://llama.app

Attestations: - https://github.com/ggml-org/llama.cpp/attestations/52781521

macOS/iOS 向け: - macOS Apple Silicon (arm64) 向け - macOS Apple Silicon (arm64、KleidiAI を有効化) 無効 - macOS Intel (x64) 向け - iOS 向け XCFramework

Linux: - Ubuntu x64(CPU) - Ubuntu arm64(CPU) - Ubuntu s390x(CPU) - Ubuntu x64(Vulkan) - Ubuntu arm64(Vulkan) - Ubuntu x64(CUDA 12) - CUDA 12.8 ライブラリ - Ubuntu x64(CUDA 13) - CUDA 13.4 ライブラリ - Ubuntu arm64(CUDA 13) - CUDA 13.4 ライブラリ - Ubuntu x64(ROCm 10.0) - Ubuntu x64(OpenVINO) - Ubuntu x64(SYCL FP32) - Ubuntu x64(SYCL FP16) - Linux arm64(Snapdragon:CPU、Adreno GPU、Hexagon NPU) - セットアップガイド

Android: - Android arm64(CPU) - Android arm64(Snapdragon:CPU、Adreno GPU、Hexagon NPU) - セットアップガイド

Windows版: - Windows x64(CPU)用 - Windows arm64(CPU)用 - Windows arm64(OpenCL Adreno)用 - Windows x64(CUDA 12)用 - CUDA 12.4 DLLファイル - Windows x64(CUDA 13)用 - CUDA 13.4 DLLファイル - Windows arm64(CUDA 13)用 - CUDA 13.4 DLLファイル - Windows x64(Vulkan)用 - Windows arm64(Vulkan)用 - Windows x64(OpenVINO)用 - Windows x64(SYCL)用 - Windows x64(ROCm 10.0)用

openEuler: - DISABLED ・openEuler x86(310p) ・openEuler x86(910b、ACL Graph) ・openEuler aarch64(310p) ・openEuler aarch64(910b、ACL Graph)

UI: - UI

原文の出典

llama.cpp Releases

内容について

原文の公開と権利は出典元に帰属します。

機械翻訳 · 原文をご参照ください