MarkTechPost

OrcaRouter发布具备1M上下文的OrcaCyber Zero 1.5网络安全模型

OrcaRouter发布了OrcaCyber Zero 1.5,一个面向授权漏洞研究的门控网络安全模型,具备1M-token上下文窗口、原生函数调用与结构化输出,厂商自报Cybench达100%、24个可评测任务的CVE-Bench子集达95.8%,价格为每1M tokens输入3.00、输出7.50美元;所有结果均为厂商自报,尚无技术报告。

OrcaRouter已发布 OrcaCyber Zero 1.5,一个面向授权漏洞研究的模型。该模型是 OrcaCyber Zero 1.0的后续版本,后者于2026年9月17日发布。OrcaCyber Zero 1.5是一个经过后训练的Orca模型,用于漏洞复现、漏洞利用开发和渗透测试。它配备1M token的上下文窗口、原生函数调用和结构化输出。对于安全团队而言,该模型传递了一个简单的信息: 更少的报告,更多经过验证和修复的漏洞.

TL;DR

  • 规模: 参数数量未披露。1M token上下文,128K最大输出,文本输入文本输出。
  • 运行方式: 仅通过OrcaRouter的托管API运行。无权重开放,无量化变体,硬件未披露。
  • 性能: 厂商报告的分数在网络安全基准测试中接近上限,在编程方面表现强劲。
  • 最佳: Cybench上100%(39/39项任务,无限制的代理执行)。
  • 最差: SWE-bench Pro V2上76.5%,为其已公布的最低分数。
  • 底线(最佳): 顶级网络安全分数,价格为每1M token 3.00美元/7.50美元。
  • 底线(最差): 所有数字均为自报,且CVE-Bench仅使用了24个可评估任务。

什么是OrcaCyber Zero 1.5?

OrcaCyber Zero 1.5是一个 前沿网络安全模型,也是Zero 1.0的后续版本。Orca团队表示,该模型针对安全研究和授权安全工程进行了后训练。列出的用途包括漏洞复现、漏洞利用开发、渗透测试、安全审计和网络推理。

3个设计目标:

  • 发现他人遗漏的问题: 未知缺陷,如RCE、沙箱逃逸、身份验证绕过、权限提升和攻击链。
  • 超越检测: 推理攻击路径、挑战自身假设,并按可演示的可利用性对漏洞进行排序。
  • 为自主智能体构建: 1M-token 上下文、原生工具调用以及针对大型代码库的扩展推理能力。

OrcaCyber Zero 1.5 在基准测试中表现如何?

该 模型页面 列出了4项供应商报告的结果,最近评估日期为2026年10月10日:

  • Cybench: 100%(39/39,无限制智能体执行)。
  • CVE-Bench: 95.8%(23/24个可评估任务)。
  • HumanEval+: 93.9%.
  • SWE-bench Pro V2: 76.5%.

Cybench 包含40个专业 CTF 任务,因此100%的成绩涵盖了其中的39个。 CVE-Bench 基于40个严重级别的 Web CVE 构建。Orca 的95.8%涵盖了24个任务的可评估子集。该 SWE-bench Pro V2 分数与标准 SWE-bench Pro 结果不具直接可比性。

它与其他网络安全模型相比如何?

特性OrcaCyber Zero 1.5OrcaCyber Zero 1.0Claude Mythos PreviewGPT-5.5-CyberSakana Fugu-Cyber
开发者Orca (OrcaRouter)Orca (OrcaRouter)AnthropicOpenAISakana AI
发布日期2026年10月10日2026年9月17日2026年4月7日2026年6月22日(完整版)2026年7月21日
类型后训练模型后训练编码模型通用前沿模型针对网络安全的 GPT-5.5多智能体编排
参数量未披露未披露未披露未披露未披露
上下文1M1M未披露未披露未披露
CyberGym未披露98.07%(harness,pass@1)83.1%85.6%86.9%
其他头条分数Cybench 100%未披露SWE-bench Pro 77.8%未披露CTI-REALM 72.1%
价格(每1M 输入/输出)$3.00 / $7.50$3.00 / $7.50抵扣后25美元 / 125美元未披露未披露
访问方式受门控的 Security Research 层级受门控的封闭测试Glasswing 合作伙伴仅限经审核的防御者申请审核

所有竞品数据均来自各厂商自己的公告,均非独立复现。

开发者如何访问 OrcaCyber Zero 1.5?

该模型使用 OpenAI 兼容 API。开发者将 base_url 设置为 https://api.orcarouter.ai/v1 并调用 orca/orcacyber-zero-1.5.

访问受限于 Security Research 层级。Orca 列出的要求包括一份合作协议、一个 passkey 以及接受相关条款。该层级面向受信任的安全研究人员、红队和授权测试。

定价为每1M 输入 token 3.00美元、每1M 输出 token 7.50美元。缓存读取费用为每1M token 0.75美元。过去7天内,p50 首 token 延迟为500 ms,p95 为2.36 s。该样本较小,仅有1.3K token 的流量。

Zero 1.0 在大得多的流量窗口内记录了3.43 s 的 p50。这2个延迟数据不具备干净的对比性。

要点总结

  • OrcaCyber Zero 1.5 是一个门控的、1M 上下文的网络安全模型,托管在 OrcaRouter 上。
  • 它报告在 Cybench 上达到100%,在24项任务的 CVE-Bench 子集上达到95.8%。
  • 定价为每1M token 3.00美元 / 7.50美元,远低于 Mythos Preview 的25美元 / 125美元。
  • 98% 的 CyberGym 成绩属于 Orca 自己 harness 中的 Zero 1.0。
  • 所有结果均由供应商报告,目前尚无技术报告。


请查看 模型页面、 X 上的发布文章 以及 OrcaRouter 文档。所有功劳归于该项目的研究者。另外,欢迎在 Twitter 上关注我们,别忘了加入我们的 150k+ ML SubReddit 并订阅 我们的通讯。等等!你在用 Telegram 吗? 现在你也可以在 Telegram 上加入我们。

这篇文章 OrcaRouter 发布具有 1M 上下文的 OrcaCyber Zero 1.5 网络安全模型 首发于 MarkTechPost.

原始出处

MarkTechPost

内容说明

原始发布及相关权利归来源方。

机器翻译 · 请以原文为准