llama.cpp Releases

[Pre-release / 継続的ビルド] b11403

[Pre-release / 継続的ビルド] CUDA: 小バッチサイズにおいて薄い f16/bf16 の mul_mat に MMVF を使用 (#29633) * CUDA: 小バッチサイズにおいて薄い f16/bf16 の mul_mat に MMVF を使用 Signed-off-by: ynankani * カーネル選択ロジックを調整 --------- Signed-off-by: ynankani…

Pre-release / 継続的ビルド: これは実験的なビルドであり、安定版リリースではありません。

CUDA: 小バッチサイズにおいて薄い f16/bf16 の mul_mat に MMVF を使用 (#29633) * CUDA: 小バッチサイズにおいて薄い f16/bf16 の mul_mat に MMVF を使用 Signed-off-by: ynankani * カーネル選択ロジックを調整 --------- Signed-off-by: ynankani Co-authored-by: Johannes Gäßler

ウェブサイト: - https://llama.app

Attestations: - https://github.com/ggml-org/llama.cpp/attestations/52714313

macOS/iOS用: - macOS Apple Silicon (arm64) 版 - macOS Apple Silicon (arm64、KleidiAI が有効) 無効 - macOS Intel (x64) 版 - iOS 用 XCFramework

Linux: - Ubuntu x64 (CPU) - Ubuntu arm64 (CPU) - Ubuntu s390x (CPU) - Ubuntu x64 (Vulkan) - Ubuntu arm64 (Vulkan) - Ubuntu x64 (CUDA 12) - CUDA 12.8 ライブラリ - Ubuntu x64 (CUDA 13) - CUDA 13.4 ライブラリ - Ubuntu arm64 (CUDA 13) - CUDA 13.4 ライブラリ - Ubuntu x64 (ROCm 10.0) - Ubuntu x64 (OpenVINO) - Ubuntu x64 (SYCL FP32) - Ubuntu x64 (SYCL FP16) - Linux arm64 (Snapdragon: CPU、Adreno GPU、Hexagon NPU) - セットアップガイド

Android: - Android arm64(CPU) - Android arm64(Snapdragon:CPU、Adreno GPU、Hexagon NPU) - セットアップガイド

Windows 向け: - Windows x64(CPU)向け - Windows arm64(CPU)向け - Windows arm64(OpenCL Adreno)向け - Windows x64(CUDA 12)向け - CUDA 12.4 DLL ファイル - Windows x64(CUDA 13)向け - CUDA 13.4 DLL ファイル - Windows arm64(CUDA 13)向け - CUDA 13.4 DLL ファイル - Windows x64(Vulkan)向け - Windows arm64(Vulkan)向け - Windows x64(OpenVINO)向け - Windows x64(SYCL)向け - Windows x64(ROCm 10.0)向け

openEuler: - DISABLED - openEuler x86(310p 向け) - openEuler x86(910b、ACL Graph 向け) - openEuler aarch64(310p 向け) - openEuler aarch64(910b、ACL Graph 向け)

UI: - UI

原文の出典

llama.cpp Releases

内容について

原文の公開と権利は出典元に帰属します。

機械翻訳 · 原文をご参照ください