인공 분석 사이버 인덱스에 신뢰할 수 있는 접근 모델을 도입합니다
GPT-6 Sol (Daybreak Blue)이 이제 사이버 인덱스에서 선두를 차지하고 있습니다
인공 분석 사이버 인덱스 연맹은 산업 파트너들을 모아 AI 모델이 기업의 사이버 방어 작업에서 어떻게 작동하는지를 평가합니다. 이 인덱스는 공개적으로 접근 가능한 모델만으로 시작되었으며, 사용자들에게 에이전트형 사이버 방어에 대한 공개된 능력에 대한 최선의 정보를 제공합니다. 이제 우리는 사이버 보호 장벽이 적은 모델을 포함시켜 리더보드를 확장하고, 최신 모델의 사이버 능력을 보다 넓은 관점에서 파악할 수 있게 됩니다. 이 중 첫 번째는 GPT-6 Sol(Daybreak Blue, 최대)로, 이는 OpenAI의 Daybreak 프로그램을 통해서만 접근할 수 있습니다.

GPT-6 Sol (Daybreak Blue, 최대)이 현재 인덱스를 이끌고 있으며, 비용 대 역량 파레토 경계선에 위치하고 있습니다. 전체 인덱스에서 어떠한 안전 장벽도 만나지 않았으며, 공개된 GPT-6 Sol (최대)에 비해 전체 점수가 32점 증가했습니다.
작업당 비용이 $1.77인 이 모델은 Grok 4.7 (xhigh)과 같은 다른 주요 모델들보다 더 경제적이며, Grok 4.7의 비용은 작업당 $11.67입니다.

공개된 GPT-6 Sol 모델과 비교했을 때, Daybreak Blue 모델은 CyberGym-E2E에서 가장 큰 성능 향상을 보였습니다. 이는 우리가 가장 많은 안전 거부 사례를 관찰한 벤치마크 테스트입니다.

우리는 공개적으로 이용 가능한 모델과 신뢰할 수 있는 접근 모델 모두를 포함하도록 인공 분석 사이버 인덱스를 계속 확장할 것입니다.
전체 평가 결과는 여기를 참조하세요: https://artificialanalysis.ai/evaluations/artificial-analysis-cyber-index
