Claude Haiku 5.5 소개: 지금까지 우리가 출시한 것 중 가장 저렴하고, 가장 빠르며, 가장 뛰어난 소형 모델입니다.
Claude Haiku 5.5는 대용량의 비용 민감도가 높은 작업을 위해 설계되었습니다. 요약, 컴팩션, 데이터베이스 쿼리, 분류 요청과 같은 빠르고 반복적인 워크로드를 안정적으로 처리합니다. 코딩 작업에서는 Opus 5.5 및 Sonnet 5.5와 서브에이전트로 잘 결합됩니다. 그리고 지금까지 우리의 가장 빠른 모델이기도 하므로, 실시간 고객 지원 및 브라우저 사용과 같이 속도에 민감한 작업에 특히 적합합니다.¹
Haiku 5.5는 Haiku 4.5보다 훨씬 낮은 가격에 제공됩니다. 평균적으로 이제 실행 비용이 약 75% 더 저렴합니다.²
이번 출시와 함께 우리는 모델 라인업의 가치를 개선하고 있습니다. Claude Sonnet 5.5의 캐시 읽기 가격을 절반으로 인하하여, 이제 Sonnet 5.5가 대부분의 에이전트 작업에서 약 20% 더 저렴하게 실행됩니다. 또한 Claude Max 및 Team 구독자를 위한 새로운 월간 API 크레딧을 도입하여, Claude Platform에서 실행되는 새로운 에이전트와 애플리케이션을 구축하는 사용자를 지원하고자 합니다.
성능
Claude Haiku 5.5가 다양한 벤치마크에서 수행되는 모습은 다음과 같습니다:
| Haiku 5.5 | Haiku 4.5 | GPT-6 Luna | Sonnet 5.5참고용 | |
|---|---|---|---|---|
| 지식 작업GDPval-AA v2.1 | 1620 | 735 | 1437 | 1840 |
| 지식 작업AA-Briefcase v1.1 | 1578 | 614 | 1336 | 1824 |
| 컴퓨터 사용OSWorld 2.1 | 72.4%오프라인 하위 집합 | 15.7%오프라인 하위 집합 | 48.9%오프라인 하위 집합 | 83.9%오프라인 하위 집합 |
| 다분야 추론Humanity’s Last Exam | 45.9%도구 없음 | 10.2%도구 없음 | — | 56.9%도구 없음 |
| 57.4%도구 사용 | 18.7%도구 사용 | — | 64.5%도구 사용 | |
| 에이전트 코딩Terminal-Bench 4.0 | 39.2% | 0.0% | 16.4% | 70.6% |
| 에이전트 코딩FrontierCode 1.1 (Main) | 46.4% | — | 42.4% | 52.1%Xhigh |
| 시각적 추론Chartography | 46.4%도구 없음 | 6.4% 도구 없음 | 29.1% 도구 없음 | 61.6% 도구 없음 |
평가를 진행하는 방식에 대한 자세한 내용은 다음을 참조하세요: Haiku 5.5 시스템 카드.
Haiku 5.5는 조절 가능한 노력(effort) 설정을 갖춘 최초의 Haiku급 모델입니다. 즉, 다른 모델과 마찬가지로 사용자가 비용과 지능 중 무엇을 우선할지 결정할 수 있습니다. 아래 차트는 각 노력 설정에서 세 가지 벤치마크에 대한 Haiku 5.5의 성능을 보여줍니다:
OSWorld 2.1은 에이전트가 실제 컴퓨터를 조작하여 길고 다단계인 작업을 얼마나 잘 완료할 수 있는지를 측정합니다.
Artificial Analysis의 GDPval-AA v2.1은 44개 직군에 걸친 실제 전문 업무에 대해 에이전트를 평가합니다.
Humanity’s Last Exam(HLE)은 전문가 수준의 학술 지식과 추론 능력을 시험하는 테스트입니다.
초기 테스트에서 고객들은 위에 나타난 성능 및 비용 개선과 일치하는 결과를 보고했습니다. 새 모델에 대해 고객들이 말한 내용은 다음과 같습니다:
인용문회사 Asana 작성자 Aaron Vinh, Staff Software Engineer“Claude Haiku 5.5, 특히 그 속도에 매우 감명받았습니다. 저희는 AI 에이전트 제품인 AI Teammates용 평가 스위트를 통해 이 모델을 테스트했으며, 여기에는 버그 분류, 프로젝트 설정, 대규모 포트폴리오를 검색하여 고위험 또는 기한 초과 작업을 식별하는 등의 사용 사례가 포함되었습니다. 현재 사용 중인 모델과 비교했을 때, 작업 완료 시 지연 시간이 30% 이상 감소했고 에이전트 턴당 추론 속도가 최대 2.5배 빨라졌습니다. 체감상 확연히 더 빠른 경험입니다.”
가격
아래 표는 Claude Haiku 5.5의 가격을 다른 모델들과 비교하여 보여줍니다. Haiku 5.5는 프롬프트가 100,000 토큰 이하인 작업에 사용할 때 특히 가성비가 뛰어나며, 이러한 작업은 이전 Haiku 모델에 대한 요청의 약 90%를 차지합니다.
| 100만 토큰당 가격 | Haiku 5.5 100k 이하 / 초과 프롬프트 | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|
| 캐시 읽기 | $0.01 / $0.05 | $0.10 | $0.10 |
| 캐시 쓰기 | $0.125 / $0.625 | $1.25 | $2.50 |
| 입력 토큰 | $0.10 / $0.50 | $1.00 | $2.00 |
| 출력 토큰 | $0.50 / $2.50 | $5.00 | $10.00 |
안전성
정렬(alignment). Claude Haiku 5.5는 Haiku 4.5에 비해 거의 모든 정렬 평가에서 큰 개선을 보여줍니다. 특히 정렬되지 않은 행동의 사례가 훨씬 적었고, 오용에 협조하려는 성향도 낮았습니다. 이 모델의 시스템 카드 에서 저희의 평가 과정과 결과를 더 자세히 설명합니다.
안전장치. 역량에 부합하도록 Haiku 5.5의 사이버보안 안전장치는 Haiku 4.5의 것보다 더 엄격하지만, 최근 다른 모델에 적용한 안전장치보다는 다소 덜 엄격합니다. 사이버보안 분야에서 이 안전장치는 Sonnet 5.5를 위한 안전장치보다 더 넓은 범위의 방어 작업을 허용하지만, 여전히 침투 테스트 및 공격자가 사용할 가능성이 더 높은 기타 기법은 차단합니다.
Haiku 5.5의 생물학 안전장치는 Sonnet 5, Sonnet 5.5, Opus 5의 것과 동일합니다. 이 안전장치는 연구 목적의 생물학 질문은 허용하지만, 해를 끼칠 가능성이 있다고 판단되는 요청에 대한 접근은 제한합니다. 더 폭넓은 생물학 및 사이버 활동을 수행하는 조직은 당사의 Life Sciences Verification Program 및 Cyber Verification Program.
가용성
Claude Haiku 5.5는 Amazon Web Services, Google Cloud, Microsoft Azure를 포함한 모든 플랫폼에서 지금 이용할 수 있습니다. Claude Platform에서 개발자는 다음을 통해 시작할 수 있습니다: claude-haiku-5-5.
자세한 내용은 당사의 마이그레이션 가이드 를 참조하십시오.
추가 업데이트
Claude Haiku 5.5의 새로운 가격 책정과 함께, 우리는 모델과 제품의 가치를 더욱 개선하고 있습니다.
첫째, 오늘부터 우리는 Claude Sonnet 5.5의 캐시 읽기 가격을 인하합니다. 캐시 읽기 비용이 이제 50% 낮아져 기존 $0.20 대신 백만 토큰당 $0.10입니다. 캐시 읽기는 모델의 토큰 소비에서 큰 비중을 차지하기 때문에, 이로써 대부분의 에이전틱 작업에서 Sonnet 5.5의 비용이 약 20% 절감됩니다.
예를 들어, 이번 가격 인하가 Terminal-Bench 4.0에서 Sonnet 5.5의 성능 대비 비용에 어떤 의미를 갖는지 보여주는 차트는 다음과 같습니다:
Terminal-Bench 4.0은 모델이 커맨드라인 인터페이스 내에서 복잡한 다단계 전문 작업을 얼마나 잘 완료할 수 있는지를 측정합니다.
이 차트는 Haiku 5.5와 우리의 더 큰 모델들 간의 중요한 차이를 보여줍니다. Sonnet 5.5와 Opus 5.5는 Terminal-Bench 4.0에서 측정되는 것과 같은 복잡한 에이전틱 코딩 작업에 여전히 더 나은 선택입니다. 반면 Haiku 5.5는 이전 버전의 Claude에서는 비용상 감당하기 어려웠을 수 있는, 컴팩션(compaction), 요약 또는 서브에이전트 작업과 같이 더 좁은 범위의 작업에 가장 적합합니다.
둘째, 이번 주에 우리는 Max 및 Team 구독자 모두에게 Claude Platform에서 사용할 수 있는 새로운 월간 API 크레딧을 제공할 예정입니다. Max 5x 사용자는 매월 $100의 크레딧을, Max 20x 사용자는 $200을 받게 되며, Team 구독자는 사용자들 전체에 걸쳐 공동으로 사용할 수 있는 최대 $500을 받게 됩니다. 이 크레딧은 사용자들이 우리 API를 호출하는 도구, 앱, 에이전트를 만들어 볼 수 있도록 설계되었습니다. 모든 모델에서 사용할 수 있습니다. 자세한 내용은 헬프 센터 문서를 참조하세요.
또한 개발자를 위해 Claude Python 및 TypeScript SDK를 업데이트하여 컴퓨터 사용(computer use)과 브라우저 사용(browser use)에 대한 베타 지원을 추가합니다 . Haiku 5.5는 속도, 성능, 가격의 조합 덕분에 이러한 작업에 특히 적합합니다. 이에 대해 자세히 알아보려면 Claude Platform 문서를 참조하세요.
각주
1 Claude Haiku 5.5는 각 모델의 표준 속도 기준으로 지금까지 우리가 만든 가장 빠른 모델입니다. 다만 Fast Mode에서는 Opus 모델보다 덜 빠르게 실행됩니다.
2 Claude Haiku 5.5는 100,000 토큰 이하의 요청에 대해 Claude Haiku 4.5보다 90% 낮은 가격으로 책정되며, 100,000 토큰을 초과하는 요청에 대해서는 50% 낮은 가격입니다. Haiku 4.5에서는 90%의 요청이 전자 범주에 속했습니다. 이 계산에는 주어진 작업을 완료하는 데 사용되는 토큰 수에서 Haiku 4.5와 Haiku 5.5 사이의 변화도 반영됩니다. Haiku 5.5는 업데이트된 토크나이저(Sonnet 5.5 및 Opus 5.5의 것과 유사)를 사용하므로, 작업당 약간 더 많은 토큰을 사용합니다.
