llama.cpp Releases

[プレリリース / 継続的ビルド] b11494

[プレリリース / 継続的ビルド] ggml-cuda: warpごとに4つのGDN状態列を割り当てる (#30087) * ggml-cuda: warpごとに2つのGDN状態列を割り当てる * ggml-cuda: S_v=128の場合にwarpごとに4つのGDN状態列を使用する * ggml-cuda: cols_per_warp=4をデフォルトに * ggml-cuda: GDNレビューの軽微な指摘に対応…

プレリリース / 継続的ビルド: これは実験的なビルドであり、安定版リリースではありません。

ggml-cuda: warpごとに4つのGDN状態列を割り当てる (#30087) * ggml-cuda: warpごとに2つのGDN状態列を割り当てる * ggml-cuda: S_v=128の場合にwarpごとに4つのGDN状態列を使用する * ggml-cuda: cols_per_warp=4をデフォルトに * ggml-cuda: GDNレビューの軽微な指摘に対応

Website: - https://llama.app

Attestations: - https://github.com/ggml-org/llama.cpp/attestations/53870081

macOS・iOS: - macOS Apple Silicon (arm64) 向け - macOS Apple Silicon (arm64、KleidiAI 有効) 向け ディセーブル(無効) - macOS Intel (x64) 向け - iOS XCFramework 向け

Linux: - Ubuntu x64 (CPU) - Ubuntu arm64 (CPU) - Ubuntu s390x (CPU) - Ubuntu x64 (Vulkan) - Ubuntu arm64 (Vulkan) - Ubuntu x64 (CUDA 12) - CUDA 12.8 ライブラリ - Ubuntu x64 (CUDA 13) - CUDA 13.4 ライブラリ - Ubuntu arm64 (CUDA 13) - CUDA 13.4 ライブラリ - Ubuntu x64 (ROCm 10.0) - Ubuntu x64 (OpenVINO) - Ubuntu x64 (SYCL FP32) - Ubuntu x64 (SYCL FP16) - Linux arm64 (Snapdragon: CPU、Adreno GPU、Hexagon NPU) - セットアップガイド

Android: - Android arm64(CPU) - Android arm64(Snapdragon:CPU、Adreno GPU、Hexagon NPU) - セットアップガイド

Windows版: - Windows x64 (CPU) 版 - Windows arm64 (CPU) 版 - Windows arm64 (OpenCL Adreno) 版 - Windows x64 (CUDA 12) 版 - CUDA 12.4 DLLファイル - Windows x64 (CUDA 13) 版 - CUDA 13.4 DLLファイル - Windows arm64 (CUDA 13) 版 - CUDA 13.4 DLLファイル - Windows x64 (Vulkan) 版 - Windows arm64 (Vulkan) 版 - Windows x64 (OpenVINO) 版 - Windows x64 (SYCL) 版 - Windows x64 (ROCm 10.0) 版

openEuler: - DISABLED - openEuler x86(310p 向け) - openEuler x86(910b 向け、ACL Graph) - openEuler aarch64(310p 向け) - openEuler aarch64(910b 向け、ACL Graph)

UI: - UI

原文の出典

llama.cpp Releases

内容について

原文の公開と権利は出典元に帰属します。

機械翻訳 · 原文をご参照ください