Anthropic이 공개했습니다 Claude Haiku 5.5그중 가장 저렴하고 가장 빠른 소형 모델입니다. 요약, 압축, 분류, 서브에이전트 작업 같은 대량 처리 워크로드를 목표로 합니다. 1M 토큰 컨텍스트 윈도우와 최대 128K 출력 토큰을 유지합니다. 가격은 백만 입력 토큰당 $0.10, 백만 출력 토큰당 $0.50부터 시작합니다. 이는 90% 더 낮은 수준입니다 Claude Haiku 4.5 보다 90% 낮은 가격으로, 100K 토큰까지의 프롬프트에 적용됩니다.
배포 가능한가요? 네, 호스티드 API로 제공됩니다. Haiku 5.5는 Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry, AWS의 Claude Platform에서 정식 출시 되었습니다.
Anthropic이 출시한 것들
Haiku 5.5는 조절 가능한 effort 설정을 갖춘 최초의 Haiku급 모델입니다. Adaptive thinking 이 기본적으로 켜져 있으며, effort 파라미터 의 기본값은 다음과 같습니다. medium.
텍스트와 이미지를 입력으로 받아 텍스트를 출력하며, 지식 기준 시점은 2026년 6월입니다. 배치 작업은 베타 단계에서 최대 300K 출력 토큰을 지원합니다.
두 가지 핵심 사항을 유의할 필요가 있습니다. 기본값이 아닌 temperature, top_p 또는 top_k 값은 400 오류를 반환합니다. 또한 새 토크나이저는 동일한 텍스트를 Haiku 4.5보다 약 30% 더 많은 토큰으로 계산합니다. 마이그레이션 가이드 에서 두 가지 모두 다룹니다.
가격: 2단계 구조
가격은 100K 프롬프트 토큰을 기준으로 나뉩니다. 100K까지는 입력이 백만당 $0.10, 출력이 $0.50입니다. 캐시 읽기는 $0.01, 5분 캐시 쓰기는 $0.125입니다. 100K를 초과하면 요금이 입력 $0.50, 출력 $2.50로 인상됩니다.
Haiku 4.5는 입력 $1, 출력 $5를 청구했습니다. Anthropic에 따르면 Haiku 4.5 요청의 약 90%가 100K 토큰 미만에 머물렀습니다. 토크나이저를 조정한 후, Haiku 5.5는 평균적으로 약 75% 더 저렴하게 실행될 것으로 추정합니다. 배치 처리 를 이용하면 추가로 50% 할인됩니다.
GPT-6 Luna 도 동일한 단기 컨텍스트 요금을 제시합니다. Luna의 상위 요금제는 272K 입력 토큍을 초과할 때만 적용되며, $0.20과 $0.75입니다. 150K 토큰 프롬프트의 경우 Luna가 목록 가격 기준 더 저렴합니다.
벤치마크
아래의 모든 수치는 Anthropic이 보고한 (다음을 참조 시스템 카드):
- OSWorld 2.1 (오프라인 하위 집합): 72.4%, GPT-6 Luna의 경우 48.9%, Haiku 4.5의 경우 15.7%와 비교된다.
- Terminal-Bench 4.0: 39.2%, 반면 Luna는 16.4%, Haiku 4.5는 0.0%를 기록했습니다.
- FrontierCode 1.1 (메인): 46.4%, 반면 Luna는 42.4%였습니다.
- 인류의 마지막 시험: 도구 없이는 45.9%, 도구를 사용하면 57.4%입니다.
- GDPval-AA v2.1: 1620이며, Luna는 1437, Haiku 4.5는 735입니다.
Sonnet 5.5는 Terminal-Bench 4.0에서 70.6%를 기록한 것을 포함해 모든 항목에서 여전히 선두를 유지하고 있습니다. Anthropic 자체적으로도 복잡한 에이전틱 코딩에는 Sonnet 5.5와 Opus 5.5를 권장합니다.
최적 활용 사례
세 가지 워크로드가 Haiku 5.5에 가장 적합합니다:
- 첫 번째는 Opus 5.5 또는 Sonnet 5.5 하위에서의 서브에이전트 작업입니다. Rogo에서는 Haiku 5.5 서브에이전트가 10-K 매출 라인을 가져오는 동안 더 큰 모델이 프레젠테이션 자료를 만듭니다.
- 두 번째는 대용량 문서 질의응답 및 요약입니다. AlphaSense는 주당 약 8M 건의 호출을 처리하는 기능에서 이를 테스트했습니다.
- 세 번째는 실시간 고객 지원과 같은 속도 민감형 업무와 브라우저 사용.
Haiku 5.5 대 최대 경쟁사 비교
| 기능 | Claude Haiku 5.5 | GPT-6 Luna | Gemini 3.5 Flash-Lite |
|---|---|---|---|
| 입력 / 출력 (1M당) | $0.10 / $0.50 | $0.10 / $0.50 | $0.30 / $2.50 |
| 롱 프롬프트 요금 | 100K 초과 시 $0.50 / $2.50 | 272K 초과 시 $0.20 / $0.75 | 정액 요금 |
| 캐시 읽기 (1M당) | $0.01 | $0.01 | $0.03 + 저장 비용 |
| 컨텍스트 창 | 1M 토큰 | 1,050,000 토큰 | 1,048,576 토큰 |
| 최대 출력 | 128K 토큰 | 128,000 토큰 | 65,536 토큰 |
| 입력 | 텍스트, 이미지 | 텍스트, 이미지 | 텍스트, 이미지, 동영상, 오디오, PDF |
| 추론 제어 | 적응형 사고 + 노력 (기본값 medium) | reasoning.effort none부터 max까지 (기본값 medium) | 사고(thinking) 지원 |
| 컴퓨터 사용 | 베타 SDK 지원 | 지원됨 (Responses API) | 지원됨 (Preview) |
| 배치 할인 | 50% | 50% (Batch 및 Flex) | 50% |
| 지식 기준 시점 | 2026년 6월 | 2026년 5월 18일 | 모델 페이지에 기재되지 않음 |
| 실행 환경 | Claude API, Bedrock, Google Cloud, Microsoft Foundry, AWS의 Claude Platform | OpenAI API | Gemini API |
출처: Anthropic 문서, Anthropic 발표, OpenAI 모델 페이지, OpenAI 가격, Google 모델 페이지, Google 가격. 표준 등급 리스트 가격, 2026년 10월 7일 확인.
인터랙티브 해설
핵심 요약
- 100K 토큰까지의 프롬프트에 대해 1M 토큰당 입력 $0.10, 출력 $0.50.
- 1M 컨텍스트, 128K 출력, 노력(effort) 설정이 있는 적응형 사고(기본값
medium). - OSWorld 2.1에서 72.4%, Haiku 4.5는 15.7% (Anthropic 보고 기준).
- GPT-6 Luna와 100K 토큰 이하 짧은 컨텍스트에서 동일한 리스트 가격; 100K 토큰 초과 시 Luna가 더 저렴함.
- Opus 5.5 및 Sonnet 5.5 아래에서 서브에이전트로 포지셔닝되며, 코딩 리드 역할이 아님.
다음을 확인해 보세요: 기술 세부 사항. 모든 크레딧은 이 프로젝트의 연구자에게 돌아갑니다. 또한 저희를 Twitter 에서 팔로우하고 저희 150k+ML SubReddit 에 가입하며 저희 뉴스레터를 구독하는 것도 잊지 마세요. 잠깐! 텔레그램을 사용하시나요? 이제 텔레그램에서도 저희와 함께하실 수 있습니다.
해당 게시물 Anthropic, 백만 입력 토큰당 $0.10에 가격이 책정된 1M 컨텍스트를 갖춘 소형 모델 Claude Haiku 5.5 출시 최초 발표 MarkTechPost.