IT之家 10 月 7 日の報道によると、ロイター通信の報じるところによれば、Anthropic は審査を経たサイバーセキュリティ専門家が、より少ないセーフガードのもとで同社最強のAIモデルをテストできるようにする計画を拡大している。同社の「Project Glasswing(玻璃翼計画)」は、今年すでに10万件を超えるソフトウェア脆弱性の発見に貢献していた。

IT之家の把握した情報によると、玻璃翼計画は世界中の重要ソフトウェアの安全を保障することを目的としている。この計画のパートナーは 4 月から 7 月までの期間に、少なくとも 129000 件の検証済み脆弱性を発見した。また、Anthropic 自身が実施したオープンソースのスキャン作業では、4 月から 10 月の間にさらに 5500 件の脆弱性を追加で発見した。
これまでに、33000 件を超える脆弱性が「重大」または「高リスク」レベルと評価されている。
Anthropic は、これらのデータには統計上の抜けが含まれている可能性が高く、実際の影響は少なくとも現在のデータの5倍に達するとしている。これは、このデータが限られた数のパートナーへの調査に基づくものだからである。
新版サイバー検証プログラム(Cyber Verification Program、略称 CVP)は、現地時間の火曜日に正式に公開され、Anthropic が過去半年間運用してきた2つのプロジェクトを統合したものである。
1つ目は玻璃翼計画で、重要ソフトウェアの安全防護を担当する機関に Claude Mythos の利用権限を開放した。これは Anthropic 傘下でサイバーセキュリティ能力が最も強いモデルシリーズである。2つ目は旧版のサイバー検証プログラムで、資格審査を経たセキュリティチームに、防護制限を引き下げた Claude Opus および Claude Sonnet モデルを開放していた。
同社が 4 月に Claude Mythos Preview を発表した際には、AIがソフトウェアのセキュリティ強化が完了する前にハッキング攻撃を仕掛ける可能性があるという懸念を引き起こしていた。
新たに設立されるプログラムは全部で3つの階層に分かれており、各階層には対応する資格審査要件と安全管理措置が設けられている。3つの階層すべてで Claude Opus 5.5、Claude Sonnet 5.5、Claude Mythos 5.1 および今後登場する新モデルを利用できる。
ディフェンス階層は、インシデント対応、マルウェア解析といった業務に適用される。セキュリティチーム、重要インフラ運営者、オープンソースプロジェクトのメンテナー、脆弱性報告の実績を持つ研究者なら誰でも申請できる。
レッドチーム階層はこれに加えて、許可されたペネトレーションテストとレッドチーム演習の権限を盛り込んでいるが、機関からの申請のみを受け付ける。
スペシャリスト階層は制約が最も少なく、一部の機関にのみ開放されている。これらの機関は、送電網、航空機の飛行システム、銀行の銀行間送金インフラなど、安全に関わる重要システムへのテストを実施する許可を得ている。
Anthropic は米国政府とともに参加メンバー1人ひとりの資格を審査し、玻璃翼計画の既存メンバーはこのスペシャリスト階層に編入される。
