OrcaRouterは OrcaCyber Zero 1.5をリリースしました。これは承認された脆弱性研究向けのモデルです。このモデルは、2026年9月17日にリリースされた OrcaCyber Zero 1.02026年9月17日にリリースされたもので、OrcaCyber Zero 1.5は、脆弱性の再現、エクスプロイト開発、ペネトレーションテスト向けにポストトレーニングされたOrcaモデルです。1Mトークンのコンテキストウィンドウ、ネイティブの関数呼び出し、構造化出力を備えて出荷されます。セキュリティチームにとって、このモデルがもたらすのはシンプルなメッセージです。 報告数は減らし、検証・修正済みの脆弱性を増やす.
TL;DR
- サイズ: パラメータ数は非公開。1Mトークンのコンテキスト、最大128Kの出力、テキスト入力・テキスト出力。
- 動作環境: OrcaRouterのホスト型APIのみ。重みなし、量子化バリアントなし、ハードウェア非公開。
- パフォーマンス: ベンダー報告のスコアはサイバーベンチマークでほぼ上限に達し、コーディングでも強力。
- 最良: Cybenchで100%(39/39タスク、制限なしエージェント実行)。
- 最悪: SWE-bench Pro V2で76.5%、公開されている中で最低スコア。
- 結論(最良): 1Mトークンあたり$3.00 / $7.50でトップクラスのサイバー性能。
- 結論(最悪): すべての数値が自己報告であり、CVE-Benchは評価可能な24タスクのみを使用。
OrcaCyber Zero 1.5とは?
OrcaCyber Zero 1.5は、 Zero 1.0の後継となるフロンティアサイバーセキュリティモデルです。Orcaチームは、セキュリティ研究と承認されたセキュリティエンジニアリング向けにポストトレーニングされたと述べています。想定される用途には、脆弱性の再現、エクスプロイト開発、ペネトレーションテスト、セキュリティ監査、サイバー推論が含まれます。
3つの設計目標:
- 他者が見逃すものを発見する: RCE、サンドボックス脱出、認証バイパス、権限昇格、攻撃チェーンなどの未知の欠陥。
- 検出を超える: 攻撃経路を推論し、自らの仮説に挑戦し、実証可能な悪用性に基づいて脆弱性をランク付けします。
- 自律エージェント向けに設計: 1Mトークンのコンテキスト、ネイティブなツール呼び出し、大規模コードベース向けの拡張推論。
OrcaCyber Zero 1.5はベンチマークでどの程度の性能を発揮しますか?
この モデルページ には、2026年10月10日に最後に評価されたベンダー報告の結果が4件記載されています:
- Cybench: 100%(39/39、制限のないエージェント実行)。
- CVE-Bench: 95.8%(23/24の評価可能なタスク)。
- HumanEval+: 93.9%.
- SWE-bench Pro V2: 76.5%.
Cybench には40のプロフェッショナルなCTFタスクが含まれており、100%はそのうち39をカバーしています。 CVE-Bench は、重大度がクリティカルな40のWeb CVEに基づいて構築されています。Orcaの95.8%は、24タスクの評価可能なサブセットをカバーしています。SWE-bench Pro V2のスコアは、標準のSWE-bench Proの結果と直接比較できません。
他のサイバーモデルとどう比較されますか?
| 機能 | OrcaCyber Zero 1.5 | OrcaCyber Zero 1.0 | Claude Mythos Preview | GPT-5.5-Cyber | Sakana Fugu-Cyber |
|---|---|---|---|---|---|
| 開発者 | Orca (OrcaRouter) | Orca (OrcaRouter) | Anthropic | OpenAI | Sakana AI |
| リリース | 2026年10月10日 | 2026年9月17日 | 2026年4月7日 | 2026年6月22日(フル版) | 2026年7月21日 |
| 種類 | ポストトレーニング済みモデル | ポストトレーニング済みコーディングモデル | 汎用フロンティアモデル | サイバー調整済み GPT-5.5 | マルチエージェントオーケストレーション |
| パラメータ | 非公開 | 非公開 | 非公開 | 非公開 | 非公開 |
| コンテキスト | 1M | 1M | 非公開 | 非公開 | 非公開 |
| CyberGym | 非公開 | 98.07%(ハーネス、pass@1) | 83.1% | 85.6% | 86.9% |
| その他の主要スコア | Cybench 100% | 非公開 | SWE-bench Pro 77.8% | 非公開 | CTI-REALM 72.1% |
| 価格(入力 / 出力、1Mあたり) | $3.00 / $7.50 | $3.00 / $7.50 | クレジット適用後 $25 / $125 | 非公開 | 非公開 |
| アクセス | 限定された Security Research ティア | 限定、クローズドベータ | Glasswing パートナー | 審査済みの防御担当者のみ | 申請審査 |
競合の数値はすべて各ベンダー自身の発表によるものであり、独立した再検証結果はありません。
開発者は OrcaCyber Zero 1.5 にどのようにアクセスできますか?
このモデルは OpenAI互換APIを使用します。開発者は base_url を https://api.orcarouter.ai/v1 に設定し、 orca/orcacyber-zero-1.5.
を呼び出します。アクセスは Security Research ティアに限定されています。Orca は要件として、契約(engagement)、パスキー、利用規約への同意を挙げています。このティアは、信頼されたセキュリティ研究者、レッドチーム、および許可されたテストを対象としています。
価格は入力トークン1Mあたり $3.00、出力トークン1Mあたり $7.50 です。キャッシュ読み取りは1Mトークンあたり $0.75 です。過去 7 日間で、最初のトークンまでの時間の p50 は 500 ミリ秒、p95 は 2.36 秒でした。このサンプルは 1.3K トークンのトラフィックしかなく、規模が小さいものです。
Zero 1.0 ははるかに大きなトラフィック期間で p50 3.43 秒を記録していました。この 2 つのレイテンシ数値は単純に比較できるものではありません。
重要なポイント
- OrcaCyber Zero 1.5 は、OrcaRouter 上の gated 型 1M コンテキストのサイバーセキュリティモデルです。
- Cybench で 100%、24タスクの CVE-Bench サブセットで 95.8% を報告しています。
- 価格は1Mトークンあたり $3.00 / $7.50 で、Mythos Preview の $25 / $125 をはるかに下回っています。
- 98% の CyberGym の主張は、Orca のハーネス内での Zero 1.0 によるものです。
- すべての結果はベンダー報告によるものであり、技術レポートはまだ発表されていません。
チェックしてみてください: モデルページ、 X上のローンチ投稿 およびその OrcaRouter ドキュメント「本プロジェクトの研究者に全ての功績があります。また、ぜひ私たちをフォローしてください:」 Twitter また、私どもの次のイベントへのご参加もお忘れなく。 150k+ ML SubReddit 「and Subscribe to」→「および登録するには」 当社のニュースレター。待ってください!Telegram を使っていますか? 「telegramでもご参加いただけるようになりました。」
この記事 OrcaRouter、1Mコンテキスト対応のサイバーセキュリティモデル「OrcaCyber Zero 1.5」をリリース の元記事は MarkTechPostに掲載されました.