OrcaRouter가 출시했습니다 OrcaCyber Zero 1.5, 이는 승인된 취약점 연구를 위한 모델입니다. 이 모델은 2026년 9월 17일에 출시된 OrcaCyber Zero 1.0, 2026년 9월 17일에 출시되었습니다. OrcaCyber Zero 1.5는 취약점 재현, 익스플로잇 개발 및 침투 테스트를 위해 후학습(post-trained)된 Orca 모델입니다. 1M 토큰 컨텍스트 윈도우, 네이티브 함수 호출 및 구조화된 출력을 함께 제공합니다. 보안 팀을 위해 이 모델이 전하는 메시지는 간단합니다: 더 적은 보고서, 더 많은 검증되고 수정된 취약점.
요약
- 크기: 파라미터 수 비공개. 1M 토큰 컨텍스트, 128K 최대 출력, 텍스트 입력 및 텍스트 출력.
- 실행 환경: OrcaRouter를 통한 호스팅 API 전용. 가중치 없음, 양자화 변형 없음, 하드웨어 비공개.
- 성능: 벤더 보고 점수는 사이버 벤치마크에서 천장 수준이며 코딩에서도 강력합니다.
- 최고: Cybench 100% (39/39 작업, 무제한 에이전트 실행).
- 최저: SWE-bench Pro V2에서 76.5%, 공개된 점수 중 최저치.
- 결론 (최고): 1M 토큰당 $3.00 / $7.50의 가격으로 최상위 사이버 점수.
- 결론 (최악): 모든 수치는 자체 보고이며, CVE-Bench는 평가 가능한 24개 작업만 사용했습니다.
OrcaCyber Zero 1.5란 무엇인가?
OrcaCyber Zero 1.5는 최첨단 사이버보안 모델이자 Zero 1.0의 후속작입니다. Orca 팀은 보안 연구 및 승인된 보안 엔지니어링을 위해 후학습되었다고 밝혔습니다. 명시된 용도에는 취약점 재현, 익스플로잇 개발, 침투 테스트, 보안 감사 및 사이버 추론이 포함됩니다.
3가지 설계 목표:
- 다른 사람들이 놓치는 것 찾기: RCE, 샌드박스 탈출, 인증 우회, 권한 상승 및 공격 체인과 같은 미지의 결함.
- 탐지를 넘어서: 공격 경로를 추론하고, 자신의 가설에 스스로 반박하며, 실증 가능한 악용 가능성을 기준으로 결함의 순위를 매길 수 있습니다.
- 자율 에이전트를 위해 설계됨: 1M 토큰 컨텍스트, 네이티브 도구 호출 및 대규모 코드베이스를 위한 확장된 추론 기능.
OrcaCyber Zero 1.5는 벤치마크에서 어떤 성능을 보이나요?
그 모델 페이지 4개 업체가 보고한 결과를 나열하며, 마지막 평가일은 2026년 10월 10일입니다:
- Cybench: 100% (39/39, 무제한 에이전트 실행).
- CVE-Bench: 95.8% (평가 가능한 24개 작업 중 23개).
- HumanEval+: 93.9%.
- SWE-bench Pro V2: 76.5%.
Cybench 40개의 전문 CTF 문제를 포함하고 있어서 100%는 그중 39개를 다룹니다. CVE-Bench 40개의 치명적 심각도 웹 CVE를 기반으로 구축되었습니다. Orca의 95.8%는 24개 작업으로 평가 가능한 하위 집합을 대상으로 합니다. SWE-bench Pro V2 점수는 표준 SWE-bench Pro 결과와 직접 비교할 수 없습니다.
다른 사이버 보안 모델과 비교하면 어떠한가요?
| 기능 | OrcaCyber Zero 1.5 | OrcaCyber Zero 1.0 | Claude Mythos 미리보기 | GPT-5.5-Cyber | Sakana Fugu-Cyber |
|---|---|---|---|---|---|
| 개발자 | Orca (OrcaRouter) | Orca (OrcaRouter) | Anthropic | OpenAI | Sakana AI |
| 출시 | 2026년 10월 10일 | 2026년 9월 17일 | 2026년 4월 7일 | 2026년 6월 22일 (전체) | 2026년 7월 21일 |
| 유형 | 사후 학습(post-trained) 모델 | 사후 학습 코딩 모델 | 범용 프론티어 모델 | 사이버 특화 GPT-5.5 | 멀티 에이전트 오케스트레이션 |
| 파라미터 | 공개되지 않음 | 공개되지 않음 | 공개되지 않음 | 공개되지 않음 | 공개되지 않음 |
| 컨텍스트 | 1M | 1M | 공개되지 않음 | 공개되지 않음 | 공개되지 않음 |
| CyberGym | 공개되지 않음 | 98.07% (harness, pass@1) | 83.1% | 85.6% | 86.9% |
| 기타 주요 점수 | Cybench 100% | 미공개 | SWE-bench Pro 77.8% | 미공개 | CTI-REALM 72.1% |
| 가격 (입력 / 출력, 1M당) | $3.00 / $7.50 | $3.00 / $7.50 | $25 / $125 (크레딧 적용 후) | 미공개 | 미공개 |
| 접근 방식 | Security Research 티어 게이팅 | 게이팅된 비공개 베타 | Glasswing 파트너 | 검증된 방어자 전용 | 신청 심사 |
모든 경쟁사 수치는 각 벤더의 자체 발표에서 나온 것입니다. 독립적인 재현 검증은 없습니다.
개발자는 OrcaCyber Zero 1.5에 어떻게 접근하나요?
이 모델은 OpenAI 호환 API를 사용합니다. 개발자는 base_url 을(를) https://api.orcarouter.ai/v1 (으)로 설정하고 orca/orcacyber-zero-1.5.
을(를) 호출합니다. 접근은 Security Research 티어로 게이팅되어 있습니다. Orca는 계약 체결, 패스키, 약관 동의를 요건으로 명시합니다. 해당 티어는 신뢰할 수 있는 보안 연구자, 레드팀, 승인된 테스팅을 대상으로 합니다.
가격은 입력 토큰 1M당 $3.00, 출력 토큰 1M당 $7.50입니다. 캐시 읽기는 1M 토큰당 $0.75입니다. 지난 7일간 p50 첫 토큰 도달 시간은 500 ms였고 p95는 2.36 s였습니다. 해당 샘플은 1.3K 토큰의 트래픽으로 규모가 작습니다.
Zero 1.0은 훨씬 더 큰 트래픽 기간에 걸쳐 3.43 s p50을 기록했습니다. 이 2개의 지연 시간 수치는 깨끗한 비교가 아닙니다.
핵심 요약
- OrcaCyber Zero 1.5는 OrcaRouter에서 제공되는 게이팅된 1M 컨텍스트 사이버보안 모델입니다.
- Cybench에서 100%, 24개 작업으로 구성된 CVE-Bench 하위 집합에서 95.8%를 보고했습니다.
- 가격은 1M 토큰당 $3.00 / $7.50로, Mythos Preview의 $25 / $125보다 훨씬 낮습니다.
- 98%라는 CyberGym 주장은 Orca의 harness 내부에서 측정된 Zero 1.0의 것입니다.
- 모든 결과는 벤더가 보고한 것으로, 아직 기술 보고서는 없습니다.
다음을 확인해 보세요: 모델 페이지, X의 출시 게시물 , 그리고 OrcaRouter 문서. 모든 크레딧은 이 프로젝트의 연구자에게 돌아갑니다. 또한 저희를 Twitter 에서 팔로우하고 150k+ML SubReddit 에 가입하며 저희 뉴스레터를 구독하는 것도 잊지 마세요. 잠깐! 텔레그램을 사용하고 계신가요? 이제 텔레그램에서도 저희와 함께하실 수 있습니다.
다음 글 OrcaRouter, 1M 컨텍스트를 갖춘 OrcaCyber Zero 1.5 사이버보안 모델 출시 는 다음에서 처음 게시되었습니다: MarkTechPost.