Anthropic更新于

扩展网络验证计划

我们将推出新的、扩展版的 Cyber Verification Program(CVP),该版本能够让符合条件的安全专业人员获得先进的网络防护能力以及更高效的阻断分类工具。

配图来源 · Anthropic
公告

扩展网络验证计划

2026年10月6日

我们将推出新版、扩展版的 Cyber Verification Program(CVP),该程序将让合格的安全专业人员能够使用先进的网络防护能力及更高效的拦截分类器。该计划现在包含三个访问等级,使安全团队可以根据自身工作需求选择最合适的访问级别。每个等级都提供对最强大的模型的访问权限,包括 Claude Opus 5.5、Claude Sonnet 5.5、Claude Mythos 5.1以及未来推出的新模型。有意向的客户可以在此处申请。

网络安全具有双重用途:那些使安全团队能够发现并修复漏洞的能力,也可能被恶意行为者利用。因此,我们那些普遍可用的模型,如 Claude Opus 5.5、Claude Fable 5.1以及 Claude Sonnet 5.5,都配备了严格的网络安全防护措施,能够阻止大多数网络攻击行为。这样做是为了限制恶意行为者利用我们的模型所进行的有害活动,同时我们也在努力减少安全编码中的误报情况。

但防御方也需要使用最优秀的工具和最强大的功能来保障其系统安全。过去六个月里,我们通过两个项目实现了可信访问:Project Glasswing以及CVP。前者让一些组织能够获得对 Claude Mythos 的最关键软件访问权限;后者则让经过审核的安全团队能够使用更宽松的防护措施来操作 Claude Opus 和 Claude Sonnet 模型。

现在,我们将这些程序整合为一套扩展服务,旨在让更多安全组织能够获得保护系统所需的各项功能。


新的访问层级

更新的访问等级使得安全专业人员能够根据其网络工作范围获得特定模型的功能。每种等级都有不同的验证要求和安全控制措施。

防御访问用于防御工作,包括安全运营中心及事件响应任务、恶意软件的逆向工程,以及漏洞的分析与验证。符合条件的组织示例包括:拥有或维护系统的公司、非营利组织、大学和政府机构的安全团队;任何规模的关键基础设施运营商,如地区医院或市政公用设施;较小的安全公司;开源项目维护者;以及有已报告漏洞记录的个人研究人员。

我们预计许多从事防御性网络安全工作的组织都能获得此级别资格。我们计划在几天内对申请进行回复。

Red Team Access 在上述防御性用途之外,还增加了经授权的渗透测试与红队活动。符合要求的组织示例包括内部红队、政府红队以及安全与渗透测试公司。该级别的组织只能对其有权测试的系统进行对抗性测试,包括关键行业中的 IT 系统。用户仍会遇到实时限制,无法执行可能导致身体伤害或大规模破坏的行为,例如部署勒索软件、损坏物理系统或对高风险安全系统进行渗透测试。

由于资格要求和安全控制更加严格,我们预计该级别的应用程序需要几周时间进行审核。符合条件的组织将被纳入防御访问体系。 在我们审查他们的红队访问应用时,属于此级别。目前,该级别仅适用于组织;个人研究人员不符合资格。

专业访问权限,其网络限制最少,仅保留给少数经过验证的机构使用。这些机构被授权测试可能影响人们生活或扰乱市场的安全系统,例如飞行操作系统、电力网、电信网络、银行间转账基础设施以及政府行政网络。

对于这一级别,我们目前与美国政府合作对每个组织进行全面审查。Project Glasswing 的现有成员将转入该级别,且当前模式无需重新审批。

我们那些普遍可用的模型仍可以继续用于诸如代码审查、修复已知问题、在自有源代码中查找漏洞以及安全警报分类等任务。

参与该项目的组织必须保留数据,以便我们能够监控网络滥用行为。一旦Enterprise Frontier Safeguards(EFS)这种将零数据保留与可靠保护措施相结合的新型解决方案在今年秋季推出,符合条件的组织即可在其控制的云基础设施中存储数据。在 EFS 正式推出之前,拥有 Claude Fable 5.1 或 Claude Mythos 5.1 且实行零数据保留的组织也可以使用 CVP 实现零数据保留。若想注册对 EFS 的兴趣,请填写此表格。

下面我们将介绍每个 CVP 访问级别可使用的内容,以及安全和隐私控制的相关要求:

网络验证计划各层级概述。


测试我们层的有效性

为了评估我们的 CVP 保护措施的有效性,我们使用 Claude Opus 5.5 在 CyScenarioBench 中进行测试——该测试旨在评估模型是否能够在现实约束条件下规划并执行多阶段网络操作——同时针对不同的 CVP 层级调整了防护措施。 由于此评估涉及复杂的互动式攻击场景,我们预计 Claude 在通用模型和防御访问层级上会遇到严重的障碍,而在红队访问和专业访问层级则不会遇到任何障碍。

在每个访问层级下的10个CyScenarioBench挑战中,针对每次尝试,我们发现:

  • 没有 CVP 访问权限,每个任务在第一个提示时都被阻止了;
  • 在防御访问层级中,50次试验中有46次在挑战过程中某阶段被中断,而剩余的4项任务则成功完成;
  • 在红色团队访问层级中,没有出现任何阻塞情况,Claude Opus 5.5 成功完成了 50 项任务中的 34 项——这相当于该模型在无需任何保护措施的情况下达到了 67.6% 的成功率(代表专业访问级别)。

这些评估让我们有信心能够安全地将先进的网络能力提供给更多防御方,从而扩展我们通过 Glasswing 项目开始开展的防御工作。我们将继续随着时间不断优化基于等级的分类系统。

在 CyScenarioBench 上,我们的保护机制在 Claude Opus 5.5 的 Defense Access 层级中阻止了 50 项任务中的 46 项,而 Claude Opus 5.5 的 Red Team Access 层级则没有阻止任何任务,并且完成了 50 项中的 34 项——与未应用保护机制时的完成率相同。

让防御方获得优势

通过 Glasswing 项目,我们发现 Claude Mythos 模型显著提高了组织识别系统漏洞的能力。通过该计划,我们的合作伙伴在 2026 年 4 月至 7 月期间发现了至少 129,000 个已验证的软件漏洞。而通过我们自己的开源扫描工作,在 2026 年 4 月至 10 月期间又发现了另外 5,500 个已验证的软件漏洞。 在这些已验证的漏洞中,超过33,000个被评定为严重或高严重级别。这可能是一个低估,因为数据仅基于 Glasswing 合作伙伴中的一小部分样本调查所得。因此,我们预计实际影响至少是高出的五倍。

当被问及没有 Claude Mythos 模型时,他们找到相同数量的安全漏洞需要多久时,几位合作伙伴表示,这些模型使他们发现漏洞的速度提高了数月甚至数年。更多内容可参阅 Booz Allen 和 Comcast 关于其经验的报道。

这些结果反映了该程序对第三方代码影响的下限,因为它们基于33份合作伙伴报告以及Anthropic的开源合作项目中的部分数据。数据方面的限制包括各组织在处理优先级时采用不同的方式,且不到50%的合作伙伴提供了补丁数量,通常是因为他们的修复工作仍在进行中,因此补丁率被显著低估了。

我们今天对网络验证计划所做的调整,旨在让 Glasswing 项目的影响覆盖更多网络防护人员。我们还将继续努力帮助保护开源软件和关键基础设施。在接下来的几周里,我们将进一步分享关于这项工作的细节以及我们的收获,以便持续为防护人员提供长期优势。

申请访问权限

感兴趣的组织可以在此申请 CVP 资格。在申请过程中,我们将对所有申请人进行审核,并要求提供相关访问级别所需的安全控制证明。现有的 CVP 会员将保留其之前的设置,并将通过更新后的计划自动获得访问 Claude Opus 5.5、Claude Sonnet 5.5 和 Claude Mythos 5.1 的权限。管理员需按照这些步骤将访问权限分配至特定工作区。

CVP可在 Claude 平台、Google Cloud 的 Vertex AI 以及 Microsoft Foundry 上使用。CVP仅在 Amazon Bedrock 上对符合 Enterprise Frontier Safeguards条件的客户可用。

如果您在工作中被阻止了本应允许的操作,您可以在此报告。关于每个级别的详细信息,可查看我们的帮助中心。

相关内容

Anthropic 投资了 1 亿美元,用于培养 10,000 名工程师,解决企业人工智能人才短缺问题

Anthropic 计划投资 1 亿美元于 Claude Frontier Academy,在 2027 年底之前培训 10,000 名 Frontier Deployed 工程师,目前来自 Accenture、Bain、CBA、Deloitte、McKinsey、Morgan Stanley 和 Novo Nordisk 的项目已展开进行。

阅读更多

巴克莱银行将克劳德提升职位,以升级运营并改善客户体验

巴克莱银行,这家英国综合银行,正在与 Anthropic 开展战略合作,以在其全球业务中整合安全、企业级人工智能系统。

阅读更多

克劳德发现了一种具有 CRISPR 类似重复结构的新型酶系统

我们在 Anthropic 宣布成立一个新的生命科学研究小组和实验室。这篇帖子介绍了该团队的成员,并分享了初步成果——Claude 发现了一种具有 CRISPR 类似特性的新型酶系统,我们的科学家仅提供了高层指导。

阅读更多
原始出处

Anthropic

内容说明

原始发布及相关权利归来源方。

机器翻译 · 请以原文为准