OrcaRouter a lancé OrcaCyber Zero 1.5, un modèle destiné à la recherche de vulnérabilités autorisée. Le modèle succède à OrcaCyber Zero 1.0, qui est sorti le 17 septembre 2026. OrcaCyber Zero 1.5 est un modèle Orca post-entraîné pour la reproduction de vulnérabilités, le développement d'exploits et les tests d'intrusion. Il est livré avec une fenêtre de contexte de 1M de tokens, l'appel de fonctions natif et des sorties structurées. Pour les équipes de sécurité, ce modèle apporte un message simple : moins de rapports, plus de vulnérabilités validées et corrigées.
TL;DR
- Taille : Nombre de paramètres non divulgué. Contexte de 1M de tokens, 128K de sortie maximale, texte en entrée et texte en sortie.
- Fonctionne sur : API hébergée uniquement via OrcaRouter. Aucun poids, aucune variante quantifiée, matériel non divulgué.
- Performance : Les scores rapportés par le fournisseur sont proches du plafond sur les benchmarks de cybersécurité et solides en programmation.
- Le meilleur : 100% sur Cybench (39/39 tâches, exécution d'agent sans restriction).
- Le pire : 76.5% sur SWE-bench Pro V2, son score publié le plus bas.
- En résumé (le meilleur) : Des scores cyber de premier plan à 3,00 $ / 7,50 $ par 1M de tokens.
- En résumé (le pire) : Chaque chiffre est auto-déclaré, et CVE-Bench n'a utilisé que 24 tâches évaluables.
Qu'est-ce qu'OrcaCyber Zero 1.5 ?
OrcaCyber Zero 1.5 est un modèle de cybersécurité de pointe et le successeur de Zero 1.0. L'équipe Orca indique qu'il a été post-entraîné pour la recherche en sécurité et l'ingénierie de sécurité autorisée. Les usages répertoriés incluent la reproduction de vulnérabilités, le développement d'exploits, les tests d'intrusion, l'audit de sécurité et le raisonnement cyber.
Les 3 objectifs de conception :
- Trouver ce que les autres manquent : des failles inconnues comme les RCE, les évasions de sandbox, les contournements d'authentification, les élévations de privilèges et les chaînes d'attaque.
- Aller au-delà de la détection : raisonner sur les chemins d'attaque, remettre en question ses propres hypothèses et classer les failles selon leur exploitabilité démontrable.
- Conçu pour les agents autonomes : contexte de 1M de tokens, appel d'outils natif et raisonnement étendu pour les grandes bases de code.
Comment OrcaCyber Zero 1.5 se comporte-t-il sur les benchmarks ?
La page du modèle liste 4 résultats rapportés par le fournisseur, dernièrement évalués le 10 octobre 2026 :
- Cybench : 100 % (39/39, exécution d'agent sans restriction).
- CVE-Bench : 95,8 % (23/24 tâches évaluables).
- HumanEval+ : 93.9%.
- SWE-bench Pro V2 : 76.5%.
Cybench contient 40 tâches CTF professionnelles, donc le 100 % couvre 39 d'entre elles. CVE-Bench est construit sur 40 CVE web de criticité élevée. Les 95,8 % d'Orca couvrent un sous-ensemble évaluable de 24 tâches. Le score SWE-bench Pro V2 n'est pas directement comparable aux résultats standards de SWE-bench Pro.
Comment se compare-t-il aux autres modèles cyber ?
| Caractéristique | OrcaCyber Zero 1.5 | OrcaCyber Zero 1.0 | Claude Mythos Preview | GPT-5.5-Cyber | Sakana Fugu-Cyber |
|---|---|---|---|---|---|
| Développeur | Orca (OrcaRouter) | Orca (OrcaRouter) | Anthropic | OpenAI | Sakana AI |
| Sortie | 10 oct. 2026 | 17 sept. 2026 | 7 avr. 2026 | 22 juin 2026 (complète) | 21 juil. 2026 |
| Type | Modèle post-entraîné | Modèle de codage post-entraîné | Modèle général de pointe | GPT-5.5 optimisé pour la cybersécurité | Orchestration multi-agents |
| Paramètres | Non communiqués | Non communiqués | Non communiqués | Non communiqués | Non communiqués |
| Contexte | 1M | 1M | Non communiqué | Non communiqué | Non communiqué |
| CyberGym | Non communiqué | 98.07% (harness, pass@1) | 83.1% | 85.6% | 86.9% |
| Autre score phare | Cybench 100% | Non divulgué | SWE-bench Pro 77,8% | Non divulgué | CTI-REALM 72,1% |
| Prix (entrée / sortie par 1M) | $3.00 / $7.50 | $3.00 / $7.50 | 25 $ / 125 $ après crédits | Non divulgué | Non divulgué |
| Accès | Palier Security Research avec accès contrôlé | Bêta fermée, accès contrôlé | Partenaires Glasswing | Défenseurs vérifiés uniquement | Examen des candidatures |
Toutes les figures des concurrents proviennent des annonces de chaque fournisseur. Aucune n’est une réplication indépendante.
Comment les développeurs accèdent-ils à OrcaCyber Zero 1.5 ?
Le modèle utilise une API compatible OpenAI. Les développeurs définissent base_url sur https://api.orcarouter.ai/v1 et appellent orca/orcacyber-zero-1.5.
L’accès est limité au palier Security Research. Orca mentionne un engagement, une clé d’accès (passkey) et l’acceptation des conditions comme prérequis. Ce palier cible les chercheurs en sécurité de confiance, les équipes red team et les tests autorisés.
Le prix est de 3,00 $ par 1M de tokens d’entrée et 7,50 $ par 1M de tokens de sortie. Les lectures de cache coûtent 0,75 $ par 1M de tokens. Au cours des 7 derniers jours, le délai médian jusqu’au premier token (p50) était de 500 ms et le p95 de 2,36 s. Cet échantillon est faible, avec 1,3K tokens de trafic.
Zero 1.0 affichait un p50 de 3,43 s sur une fenêtre de trafic bien plus importante. Ces 2 chiffres de latence ne constituent pas une comparaison fiable.
Points clés
- OrcaCyber Zero 1.5 est un modèle de cybersécurité à contexte de 1M, en accès contrôlé, sur OrcaRouter.
- Il affiche 100% sur Cybench et 95,8% sur un sous-ensemble de 24 tâches de CVE-Bench.
- Le prix est de 3,00 $ / 7,50 $ par 1M de tokens, bien en dessous des 25 $ / 125 $ de Mythos Preview.
- La revendication de 98% sur CyberGym appartient à Zero 1.0 dans le harness d’Orca.
- Tous les résultats sont fournis par le fournisseur, sans rapport technique pour l'instant.
Découvrez la page du modèle, le post de lancement sur X et la documentation d'OrcaRouter. Tout le crédit revient au chercheur de ce projet. N'hésitez pas également à nous suivre sur Twitter et n'oubliez pas de rejoindre notre 150k+ML SubReddit et de vous abonner à notre Newsletter. Attention ! êtes-vous sur telegram ? vous pouvez maintenant nous rejoindre également sur telegram.
L'article OrcaRouter lance le modèle de cybersécurité OrcaCyber Zero 1.5 avec un contexte de 1M est apparu en premier sur MarkTechPost.