llama.cpp Releases

[Pre-release / 連続ビルド] b11440

[Pre-release / 連続ビルド] llama : nextn 抽出フラグの変更時にスケジューラを再予約する (#30020) 推測的 MTP init は、ターゲットとドラフトの両コンテキストが作成されスケジューラが予約された後に、NextN…

Pre-release / 連続ビルド: これは実験的なビルドであり、安定版リリースではありません。

llama : nextn 抽出フラグの変更時にスケジューラを再予約する (#30020) 推測的 MTP init は、ターゲットとドラフトの両コンテキストが作成され スケジューラが予約された後に、NextN 抽出を有効化します。マスクなし 抽出ではトランクグラフが出力行に切り詰められず最終層までのすべての トークンを保持するため、最初のデコードでそのバッチの形状に再割り当て が行われ、次のより広いバッチで GGML_SCHED_DEBUG_REALLOC が トリガーされます。フラグの変更時に予約を無効化し、次の計算で新しい グラフ形状で再予約されるようにします。 Assisted-by: Claude

ウェブサイト: - https://llama.app

Attestations: - https://github.com/ggml-org/llama.cpp/attestations/53181663

macOS/iOS 向け: - macOS Apple Silicon(arm64)向け - macOS Apple Silicon(arm64、KleidiAI を有効化) 無効(ディセーブル) - macOS Intel(x64)向け - iOS XCFramework 向け

Linux: - Ubuntu x64(CPU) - Ubuntu arm64(CPU) - Ubuntu s390x(CPU) - Ubuntu x64(Vulkan) - Ubuntu arm64(Vulkan) - Ubuntu x64(CUDA 12) - CUDA 12.8 ライブラリ - Ubuntu x64(CUDA 13) - CUDA 13.4 ライブラリ - Ubuntu arm64(CUDA 13) - CUDA 13.4 ライブラリ - Ubuntu x64(ROCm 10.0) - Ubuntu x64(OpenVINO) - Ubuntu x64(SYCL FP32) - Ubuntu x64(SYCL FP16) - Linux arm64(Snapdragon:CPU、Adreno GPU、Hexagon NPU) - セットアップガイド

Android: - Android arm64(CPU) - Android arm64(Snapdragon:CPU、Adreno GPU、Hexagon NPU) - セットアップガイド

Windows向け: - Windows x64(CPU)向け - Windows arm64(CPU)向け - Windows arm64(OpenCL Adreno)向け - Windows x64(CUDA 12)向け - CUDA 12.4用のDLL - Windows x64(CUDA 13)向け - CUDA 13.4用のDLL - Windows arm64(CUDA 13)向け - CUDA 13.4用のDLL - Windows x64(Vulkan)向け - Windows arm64(Vulkan)向け - Windows x64(OpenVINO)向け - Windows x64(SYCL)向け - Windows x64(ROCm 10.0)向け

openEuler: - DISABLED - openEuler x86(310p向け) - openEuler x86(910b向け、ACL Graph) - openEuler aarch64(310p向け) - openEuler aarch64(910b向け、ACL Graph)

UI: - UI

原文の出典

llama.cpp Releases

内容について

原文の公開と権利は出典元に帰属します。

機械翻訳 · 原文をご参照ください