llama.cpp Releases更新于

[预发布 / 持续构建版本] b11455

[预发布 / 持续构建版本] vocab : 实现 PLaMo-3 分词器预分段 (#30045) * vocab : 实现 PLaMo-3 分词器预分段 PLaMo-3 分词器在运行 Unigram DP 之前会插入硬边界,围绕看起来像 < |plamo:...|> 的文本,以及围绕至少 4 个相同字符或 2 个空格的连续序列。如果没有这些边界,llama.cpp 对代码缩进和重复标点的分词会与参考实现不同。在…

预发布 / 持续构建版本:这是一个实验性构建,不是稳定版本。

vocab : 实现 PLaMo-3 分词器预分段 (#30045) * vocab : 实现 PLaMo-3 分词器预分段 PLaMo-3 分词器在运行 Unigram DP 之前会插入硬边界,围绕看起来像 <|plamo:...|> 的文本,以及围绕至少 4 个 相同字符或 2 个空格的连续序列。如果没有这些边界,llama.cpp 对代码 缩进和重复标点的分词会与参考实现不同。 在 llm_tokenizer_plamo2 中通过对每个分段独立编码来重现那两次 re.sub() 处理。 * 添加 vocab 类型 "plamo3" * Update src/llama-vocab.cpp Co-authored-by: Sigbjørn Skjæret * misc change --------- Co-authored-by: Sigbjørn Skjæret

网站: - https://llama.app

Attestations: - https://github.com/ggml-org/llama.cpp/attestations/53332190

macOS/iOS: - macOS Apple Silicon (arm64) - macOS Apple Silicon (arm64, KleidiAI enabled) 已禁用 - macOS Intel (x64) - iOS XCFramework

Linux: - Ubuntu x64 (CPU) - Ubuntu arm64 (CPU) - Ubuntu s390x (CPU) - Ubuntu x64 (Vulkan) - Ubuntu arm64 (Vulkan) - Ubuntu x64 (CUDA 12) - CUDA 12.8 库 - Ubuntu x64 (CUDA 13) - CUDA 13.4 库 - Ubuntu arm64 (CUDA 13) - CUDA 13.4 库 - Ubuntu x64 (ROCm 10.0) - Ubuntu x64 (OpenVINO) - Ubuntu x64 (SYCL FP32) - Ubuntu x64 (SYCL FP16) - Linux arm64 (Snapdragon: CPU、Adreno GPU、Hexagon NPU) - 安装指南

Android: - Android arm64 (CPU) - Android arm64 (Snapdragon: CPU、Adreno GPU、Hexagon NPU) - 安装指南

Windows: - Windows x64(CPU 版) - Windows arm64(CPU 版) - Windows arm64(OpenCL Adreno 版) - Windows x64(CUDA 12 版) - CUDA 12.4 DLL 文件 - Windows x64(CUDA 13 版) - CUDA 13.4 DLL 文件 - Windows arm64(CUDA 13 版) - CUDA 13.4 DLL 文件 - Windows x64(Vulkan 版) - Windows arm64(Vulkan 版) - Windows x64(OpenVINO 版) - Windows x64(SYCL 版) - Windows x64(ROCm 10.0 版)

openEuler: - 已禁用 - openEuler x86 架构(310p) - openEuler x86 架构(910b,ACL Graph) - openEuler aarch64 架构(310p) - openEuler aarch64 架构(910b,ACL Graph)

UI: - UI

原始出处

llama.cpp Releases

内容说明

原始发布及相关权利归来源方。

机器翻译 · 请以原文为准