The Decoder

谷歌的 Gemini 4 “Carbon” 模型据说与 Anthropic 的 Opus 5.5 编码性能相当

据Business Insider获得的内部文件,谷歌正在内部编码平台Jetski测试代号Carbon的Gemini 4变体,有员工将其编程能力与Anthropic的Opus 5.5相比。但该说法仍需更多测试,Gemini 4也没有官方发布日期。

Matthias Bastian
配图来源 · The Decoder

据报道,谷歌的 Gemini 4 “Carbon” 模型与 Anthropic 的 Opus 5.5 编码性能相当

Matthias Bastian Matthias Bastian 查看 Matthias Bastian 的 LinkedIn 个人资料 2026年10月10日 Image description Google

Gemini 4 “Argon” 甚至还没有上市,已经有关于下一次性能更新的传闻了。

根据被查看的文档、截图和内部聊天记录显示 商业内幕Google正在测试几种名为Argon、Barium和Carbon的Gemini 4版本。过去几天里,Carbon已部署在Google的内部编码平台Jetski上,据说在编程任务方面比Argon表现更好。

一位员工将 Carbon 与 Anthropic 最强大的编码模型 Opus 5.5 进行了比较,不过它仍需要更多测试。相比之下,早期的 Argon 版本则让另一位员工在某些编码任务中想起更旧的 Opus 5,尽管整体内部反馈是积极的。

氩气是 Google 的前沿推理模型

早期的传言认为,Argon 是一款注重速度而非峰值性能的 Flash 模型。Google Workspace 中使用的 Gemini 代理的公告则证实了这一点。Google 将各模型与特定角色对应起来:“Argon 用于前沿推理,Flash 用于速度和数据处理量,Omni 用于生成式媒体,Gemma 则用于轻量级、开放权重边缘工作负载,”该公司写道。

因此,Argon 绝对是 Google 最强大的推理模型,可与 Anthropic 的 Opus 或 OpenAI 的 Astra 相媲美。Carbon 和 Barium 很可能是 Argon 系列中的检查点或更新,而非独立的模型层级。内部一名员工将 Carbon 称为“Gemini pro next model”,表明它将以 Argon 的名称发布。这与内部文件相符,其中显示现在尚未公开的 Argon 之前被称为“Barium-B”。Carbon 是作为 Argon 的更新还是独立模型发布,目前仍不清楚。

快速更新速度——与 Google 在 Flash 模型上的做法类似——表明 Google 在利用 AI 构建新模型方面取得了进步。Google Deepmind 员工 Vedant Misra在 Business Insider 的 X 平台报道中回应说:“你听说过递归自我改进吗?”他指的是利用 AI 来构建更优秀的 AI。OpenAI 和 Anthropic 也报告了类似的进展。

Google Deepmind员工Vedant Misra指出,递归式自我改进是模型快速迭代背后的关键因素。 | 通过 X 平台

谷歌正在为 Gemini 4 的发布做准备

目前仍然没有官方的 Gemini 4 发布日期,但 Google 已经正在调整其应用。Gemini 应用现在为 3 系列模型提供了新的“自动”模式,并且可以调节从低到高的推理强度。Google AI Studio 也推出了新的“Ultra”模式,承诺提供“高级技能和工具”。Google 的 Logan Kilpatrick 确认说团队正在努力充分发挥 Argon 的优势。

广告

AI新闻——无炒作,由人类整理

订阅 THE DECODER,即可享受无广告阅读体验、每周人工智能通讯、每年六次的独家“AI Radar”前沿报告、完整档案访问权限,以及评论区访问权。

来源:Business Insider | 通过 X
原始出处

The Decoder

内容说明

原始发布及相关权利归来源方。

机器翻译 · 请以原文为准