Claude Haiku 5.5, 대폭적인 가격 인하와 함께 등장... AI 가격 경쟁이 한창 진행 중임을 입증
Matthias Bastian
Matthias Bastian의 LinkedIn 프로필 보기
2026년 10월 7일
Nano Banana Pro, THE DECODER가 프롬프트 입력
핵심 요약
- Anthropic이 데이터 조회 및 고객 지원과 같은 대용량 작업을 위해 구축된 가장 빠르고 저렴한 소형 모델인 Claude Haiku 5.5를 출시했습니다.
- Haiku 5.5는 최대 90퍼센트 낮은 토큰 가격으로 Haiku 4.5 대비 주요 벤치마크 성능 향상을 보여줍니다. 또한 에이전틱 코딩과 같은 분야에서 OpenAI의 보급형 모델 GPT-6 Luna를 능가합니다.
- Haiku 5.5는 현재 AWS, Google Cloud, Azure에서 이용할 수 있습니다. Anthropic은 또한 Sonnet 5.5 캐시 읽기 비용을 절반으로 줄이고 구독자를 위한 월별 API 크레딧을 제공합니다.
Anthropic이 회사 역사상 가장 빠르고 저렴한 소형 모델인 Claude Haiku 5.5를 출시했습니다. 벤치마크 결과는 전작 대비 주요 성능 도약을 보여주며, Anthropic은 Sonnet 5.5의 가격도 인하하고 있습니다.
Anthropic에 따르면 Haiku 5.5는 요약, 데이터베이스 조회, 분류, 실시간 고객 지원과 같은 대용량이고 비용에 민감한 작업을 위해 설계되었습니다. 이 모델은 평균적으로 Haiku 4.5보다 약 75퍼센트 저렴합니다. Anthropic이 이전 Haiku 요청의 약 90퍼센트를 차지한다고 밝힌 100,000 토큰까지의 프롬프트 요청의 경우 가격이 최대 90퍼센트까지 하락합니다. 100,000 토큰이 넘는 프롬프트는 5배의 비용이 듭니다.
| 100만 토큰당 가격 | Haiku 5.5 (프롬프트 100k 이하 / 초과) | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|
| 캐시 읽기 | $0.01 / $0.05 | $0.10 | $0.10 |
| 캐시 쓰기 | $0.125 / $0.625 | $1.25 | $2.50 |
| 입력 토큰 | $0.10 / $0.50 | $1.00 | $2.00 |
| 출력 토큰 | $0.50 / $2.50 | $5.00 | $10.00 |
Anthropic은 Haiku 5.5가 전작보다 작업당 약간 더 많은 토큰을 소비하는 업데이트된 토크나이저를 사용한다고 지적합니다. 동일한 일이 Opus 4.x 모델에서 발생했으며, 이 경우 토크나이저 변경만으로 토큰 사용량이 약 30퍼센트 증가했습니다. 실제 절감 효과는 토큰당 가격이 시사하는 바보다 작을 가능성이 높습니다.
벤치마크는 Haiku 4.5 대비 큰 도약을 보여줍니다
Haiku 5.5는 지식 벤치마크 GDPval-AA v2.1에서 1,620점을 기록하며 전작의 735점을 두 배 이상 상회합니다. Humanity's Last Exam에서는 도구 없이 45.9퍼센트, 도구 사용 시 57.4퍼센트를 기록하며 이전의 10.2퍼센트와 18.7퍼센트에서 상승했습니다.Ad
가장 큰 도약은 컴퓨터 사용분야로, 이 분야에서 모델은 스스로 컴퓨터를 작동합니다. 컴퓨터 사용은 대량의 토큰을 소모하기 때문에 Haiku 5.5 같은 저렴하고 빠른 모델이 자연스럽게 적합합니다. 이 모델은 OSWorld-2.1에서 72.4퍼센트를 기록하며 이전의 15.7퍼센트에서 상승했습니다. 에이전틱 코딩 벤치마크 Terminal-Bench 4.0에서는 39.2퍼센트에 도달한 반면 Haiku 4.5는 0점을 기록했습니다.
Anthropic은 또한 OpenAI의 보급형 모델인 GPT-6 Luna를 나열합니다 비교 대상으로 제시되었으며, Haiku 5.5는 테스트된 모든 카테고리에서 선두를 차지합니다. 다만 Sonnet 5.5의 참고 점수를 보면 Haiku 5.5는 여전히 Anthropic의 더 큰 모델에는 크게 뒤처져 있습니다.
| Haiku 5.5 | Haiku 4.5 | GPT-6 Luna | Sonnet 5.5 | |
|---|---|---|---|---|
| 지식 노무 / GDPval-AA v2.1 | 1,620 | 735 | 1,437 | 1,840 |
| 지식 노무 / AA-Briefcase v1.1 | 1,578 | 614 | 1,336 | 1824 |
| 컴퓨터 사용 / OSWorld 2.1 | 72.4% (오프라인 하위 집합) | 15.7% (오프라인 하위 집합) | 48.9% (오프라인 하위 집합) | 83.9% (오프라인 하위 집합) |
| 융합 추론 / Humanity's Last Exam | 45.9% (도구 없음) | 10.2% (도구 없음) | — | 56.9% (도구 없음) |
| 57.4% (도구 사용 시) | 18.7% (도구 사용 시) | — | 64.5% (도구 사용 시) | |
| 에이전트 코딩 / Terminal-Bench 4.0 | 39.2% | 0.0% | 16.4% | 70.6% |
| 에이전틱 코딩 / FrontierCode 1.1 (Main) | 46.4% | — | 42.4% | 52.1% (Xhigh) |
| 시각 추론 / 도표 작성(Chartography) | 46.4% (도구 없음) | 6.4% (도구 없음) | 29.1% (도구 미사용) | 61.6% (도구 없음) |
첫 Haiku 모델을 통해 사용자는 비용과 성능 사이에서 절충할 수 있습니다
Haiku 5.5는 조절 가능한 추론 수준을 갖춘 최초의 Haiku급 모델로, 사용자가 비용과 품질의 균형을 조정할 수 있습니다. Anthropic은 이 모델이 압축(compaction), 요약 또는 하위 에이전트 작업과 같이 범위가 좁은 작업에 가장 적합하다고 밝혔습니다. 복잡한 에이전트 코딩에는 Sonnet 5.5와 Opus 5.5가 여전히 더 나은 선택입니다.
사이버 보안 보호장치는 이전 모델보다 강화되었으나 Sonnet 5.5보다는 더 폭넓은 방어 작업을 허용하는데, 부분적으로는 이 모델이 전반적으로 덜 유능하기 때문입니다. 침투 테스트는 여전히 차단됩니다. 더 폭넓은 수요를 가진 조직은 신청할 수 있습니다 Anthropic의 생명과학 및 사이버보안 검증 프로그램.Ad
Haiku 5.5은 이제 Amazon Web Services, Google Cloud, Microsoft Azure를 포함한 모든 플랫폼에서 이용할 수 있습니다.
Sonnet 5.5도 가격이 인하되고, Anthropic이 API 크레딧을 제공합니다
Haiku 출시와 함께 Anthropic은 Sonnet 5.5의 캐시 읽기 비용을 백만 토큰당 $0.20에서 $0.10으로 50퍼센트 인하하고 있습니다. 회사 측은 이를 통해 대부분의 에이전트 작업 비용이 약 20퍼센트 줄어들 것이라고 밝혔습니다. 이번 조치는 거의 틀림없이 다음에 대한 대응입니다. OpenAI의 새로운 GPT-6.1 시리즈, AI 가격 전쟁이 그 어느 때보다 치열하게 벌어지고 있음을 보여준다.
Anthropic은 또한 월별 API 크레딧도 제공합니다. Max-5x 구독자는 100달러, Max-20x 구독자는 200달러, Team 구독자는 월 최대 500달러를 받습니다. 사용자는 이 크레딧을 사용해 API를 통해 도구, 앱, 에이전트를 실험해 볼 수 있습니다.
이 회사는 Python 및 TypeScript SDK도 업데이트하고 있으며, 다음에 대한 베타 지원을 추가하고 있습니다: 컴퓨터 사용 및 브라우저 사용.
과장 없는 AI 뉴스 – 사람이 직접 큐레이션합니다
THE DECODER를 구독하면 광고 없는 읽기, 매주 AI 뉴스레터, 연 6회 독점 "AI Radar" 프론티어 리포트, 전체 아카이브 이용, 그리고 댓글 섹션 접근 권한을 누릴 수 있습니다.
출처: Anthropic