llama.cpp Releases

[사전 릴리스 / 지속 빌드] b11450

[사전 릴리스 / 지속 빌드] RPC: `-sm tensor` 추가 (#26610) * rpc: -sm tensor 허용 * apple rdma용 flush 수정 * graph_uids를 rpc_dispatcher로 이동 * cont : 충돌 수정 * cont: dispatcher 스레드 스피닝 중지 * meta backend 변경 제거 * 로직 단순화를 위한 TODO 추가 * rpc…

사전 릴리스 / 지속 빌드: 안정 버전이 아닌 실험적 빌드입니다.

RPC: `-sm tensor` 추가 (#26610) * rpc: -sm tensor 허용 * apple rdma용 flush 수정 * graph_uids를 rpc_dispatcher로 이동 * cont : 충돌 수정 * cont: dispatcher 스레드 스피닝 중지 * meta backend 변경 제거 * 로직 단순화를 위한 TODO 추가 * rpc: major 버전 bump --------- Co-authored-by: Georgi Gerganov

웹사이트: - https://llama.app

증명(Attestations): - https://github.com/ggml-org/llama.cpp/attestations/53303187

macOS/iOS: - macOS Apple Silicon (arm64) - macOS Apple Silicon (arm64, KleidiAI 활성화) 비활성화됨 - macOS Intel (x64) - iOS XCFramework

Linux: - Ubuntu x64 (CPU) - Ubuntu arm64 (CPU) - Ubuntu s390x (CPU) - Ubuntu x64 (Vulkan) - Ubuntu arm64 (Vulkan) - Ubuntu x64 (CUDA 12) - CUDA 12.8 라이브러리 - Ubuntu x64 (CUDA 13) - CUDA 13.4 라이브러리 - Ubuntu arm64 (CUDA 13) - CUDA 13.4 라이브러리 - Ubuntu x64 (ROCm 10.0) - Ubuntu x64 (OpenVINO) - Ubuntu x64 (SYCL FP32) - Ubuntu x64 (SYCL FP16) - Linux arm64 (Snapdragon: CPU, Adreno GPU, Hexagon NPU) - 설정 가이드

Android: - Android arm64 (CPU) - Android arm64 (Snapdragon: CPU, Adreno GPU, Hexagon NPU) - 설정 가이드

윈도우(Windows): - 윈도우(Windows) x64 (CPU) - 윈도우(Windows) arm64 (CPU) - 윈도우(Windows) arm64 (OpenCL Adreno) - 윈도우(Windows) x64 (CUDA 12) - CUDA 12.4 DLL - 윈도우(Windows) x64 (CUDA 13) - CUDA 13.4 DLL - 윈도우(Windows) arm64 (CUDA 13) - CUDA 13.4 DLL - 윈도우(Windows) x64 (Vulkan) - 윈도우(Windows) arm64 (Vulkan) - 윈도우(Windows) x64 (OpenVINO) - 윈도우(Windows) x64 (SYCL) - 윈도우(Windows) x64 (ROCm 10.0)

openEuler: - DISABLED - openEuler x86 (310p) 환경 - openEuler x86 (910b, ACL Graph) 환경 - openEuler aarch64 (310p) 환경 - openEuler aarch64 (910b, ACL Graph) 환경

UI: - UI

원문 출처

llama.cpp Releases

내용 안내

원문 발행 및 권리는 출처에 있습니다.

기계 번역 · 원문을 참고하세요