llama.cpp Releases

[Pre-release / 継続的ビルド] b11490

[Pre-release / 継続的ビルド] hexagon: alloc_buffer_n を有効化 (#30126) * hex-bufs: alloc_buffer_n のサポートを追加 * hex-bufs: 大きなテンソルを複数のバッファに分割するサポートを追加 * hex-bufs: GGML_HEXAGON_MBUF が dyn,static,total の 3 つの値を受け付けるように更新 * hex-bufs…

Pre-release / 継続的ビルド: これは実験的なビルドであり、安定版リリースではありません。

hexagon: alloc_buffer_n を有効化 (#30126) * hex-bufs: alloc_buffer_n のサポートを追加 * hex-bufs: 大きなテンソルを複数のバッファに分割するサポートを追加 * hex-bufs: GGML_HEXAGON_MBUF が dyn,static,total の 3 つの値を受け付けるように更新 * hex-bufs: 128MB では大きな MOE で性能低下が生じるため、dyn. のデフォルトを 512MB に引き上げ * hex-run: 必要なデバイスでコマンドラインを簡単にするため --no-embd-offload オプションを追加 * scripts/snapdragon/run.py を更新 Co-authored-by: Jhen-Jie Hong --------- Co-authored-by: Jhen-Jie Hong

ウェブサイト: - https://llama.app

Attestations: - https://github.com/ggml-org/llama.cpp/attestations/53811782

macOS/iOS 向け: - macOS Apple Silicon (arm64) 向け - macOS Apple Silicon (arm64、KleidiAI を有効化) 無効 - macOS Intel (x64) 向け - iOS 向け XCFramework

Linux: - Ubuntu x64 (CPU) - Ubuntu arm64 (CPU) - Ubuntu s390x (CPU) - Ubuntu x64 (Vulkan) - Ubuntu arm64 (Vulkan) - Ubuntu x64 (CUDA 12) - CUDA 12.8 ライブラリ - Ubuntu x64 (CUDA 13) - CUDA 13.4 ライブラリ - Ubuntu arm64 (CUDA 13) - CUDA 13.4 ライブラリ - Ubuntu x64 (ROCm 10.0) - Ubuntu x64 (OpenVINO) - Ubuntu x64 (SYCL FP32) - Ubuntu x64 (SYCL FP16) - Linux arm64 (Snapdragon: CPU、Adreno GPU、Hexagon NPU) - セットアップガイド

Android: - Android arm64 (CPU) - Android arm64 (Snapdragon: CPU、Adreno GPU、Hexagon NPU) - セットアップガイド

Windows向け: - Windows x64(CPU)版 - Windows arm64(CPU)版 - Windows arm64(OpenCL Adreno)版 - Windows x64(CUDA 12)版 - CUDA 12.4用 DLL - Windows x64(CUDA 13)版 - CUDA 13.4用 DLL - Windows arm64(CUDA 13)版 - CUDA 13.4用 DLL - Windows x64(Vulkan)版 - Windows arm64(Vulkan)版 - Windows x64(OpenVINO)版 - Windows x64(SYCL)版 - Windows x64(ROCm 10.0)版

openEuler: - 無効 ・openEuler x86(310p) ・openEuler x86(910b、ACL Graph) ・openEuler aarch64(310p) ・openEuler aarch64(910b、ACL Graph)

UI: - UI

原文の出典

llama.cpp Releases

内容について

原文の公開と権利は出典元に帰属します。

機械翻訳 · 原文をご参照ください