The Decoder更新于

Aleph Alpha 发布 Kolibri,一个开放权重模型,为欧洲 AI 主权提供了有力论据

Aleph Alpha发布开源权重模型Kolibri,这是一个德英双语模型,拥有78 billion参数,通过mixture-of-experts架构每token约激活three billion参数。公司称其德语数据占21.3 percent,并为此搭建专门德语数据管线,权重以Apache 2.0许可在Hugging Face提供。文章还提到该模型面向公共管理、航空和工业,但性能对比主要来自公司自身说法。

Matthias Bastian
配图来源 · The Decoder

Aleph Alpha releases Kolibri,一个证明欧洲 AI 主权可行性的开放权重模型

Matthias Bastian Matthias Bastian 查看 Matthias Bastian 的 LinkedIn 个人资料 2026 年 10 月 5 日

Aleph Alpha 发布了 Kolibri,这是一个德英语言模型,拥有 78 billion 参数,通过混合专家架构,每个 token 约激活 three billion 参数。 Aleph Alpha 声称 Kolibri 在两种语言中都处于质量与运行成本的帕累托前沿,在任一指标上都优于所比较的类似架构模型,其中一些模型明显更旧(2026 年 3 月、4 月)。德语占训练数据的 21.3%,这得益于公司为该项目构建的 专用德语数据管道 。 还使用了中文模型 来生成合成训练数据。

Kolibri 在德语基准测试中得分 71%,同时解码速度快于 GPT OSS A5B、Qwen 3.6 A3B 和 Gemma 4 A4B 等同类模型。| 图片来源:Aleph Alpha

据 Aleph Alpha 称,Kolibri 面向公共行政、航空和工业领域。该模型依据欧洲法律开发,并将欧盟《人工智能法案》(EU AI Act)纳入考量,支持多达一百万 token 的上下文窗口,并在德国和芬兰使用 768 块 B200 GPU 训练,据 技术报告。权重以 Apache 2.0 许可证发布于 Hugging Face.

Ad

AI 新闻,没有炒作——由人工精选

订阅 THE DECODER,享受无广告阅读、每周 AI 简报、每年六期的独家 "AI Radar" 前沿报告、完整档案访问权限以及评论区访问权限。

来源: Model Card | Blog
原始出处

The Decoder

内容说明

原始发布及相关权利归来源方。

机器翻译 · 请以原文为准