MarkTechPost수정일

Anthropic, Claude Haiku 5.5 공개: 1M 컨텍스트를 갖춘 소형 모델, 백만 입력 토큰당 $0.10 가격

Anthropic의 Claude Haiku 5.5는 백만 입력 토큰당 $0.10부터 시작하며, 1M 컨텍스트를 유지하고 OSWorld에서 72.4%를 기록했습니다. Anthropic Releases Claude Haiku 5.5: A Small Model With 1M Context Priced at $0.10 per Million Input Tokens라는 글은 먼저…

Anthropic이 공개했습니다 Claude Haiku 5.5그중 가장 저렴하고 가장 빠른 소형 모델입니다. 요약, 압축, 분류, 서브에이전트 작업 같은 대량 처리 워크로드를 목표로 합니다. 1M 토큰 컨텍스트 윈도우와 최대 128K 출력 토큰을 유지합니다. 가격은 백만 입력 토큰당 $0.10, 백만 출력 토큰당 $0.50부터 시작합니다. 이는 90% 더 낮은 수준입니다 Claude Haiku 4.5 보다 90% 낮은 가격으로, 100K 토큰까지의 프롬프트에 적용됩니다.

배포 가능한가요? 네, 호스티드 API로 제공됩니다. Haiku 5.5는 Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry, AWS의 Claude Platform에서 정식 출시 되었습니다.

Anthropic이 출시한 것들

Haiku 5.5는 조절 가능한 effort 설정을 갖춘 최초의 Haiku급 모델입니다. Adaptive thinking 이 기본적으로 켜져 있으며, effort 파라미터 의 기본값은 다음과 같습니다. medium.

텍스트와 이미지를 입력으로 받아 텍스트를 출력하며, 지식 기준 시점은 2026년 6월입니다. 배치 작업은 베타 단계에서 최대 300K 출력 토큰을 지원합니다.

두 가지 핵심 사항을 유의할 필요가 있습니다. 기본값이 아닌 temperature, top_p 또는 top_k 값은 400 오류를 반환합니다. 또한 새 토크나이저는 동일한 텍스트를 Haiku 4.5보다 약 30% 더 많은 토큰으로 계산합니다. 마이그레이션 가이드 에서 두 가지 모두 다룹니다.

가격: 2단계 구조

가격은 100K 프롬프트 토큰을 기준으로 나뉩니다. 100K까지는 입력이 백만당 $0.10, 출력이 $0.50입니다. 캐시 읽기는 $0.01, 5분 캐시 쓰기는 $0.125입니다. 100K를 초과하면 요금이 입력 $0.50, 출력 $2.50로 인상됩니다.

Haiku 4.5는 입력 $1, 출력 $5를 청구했습니다. Anthropic에 따르면 Haiku 4.5 요청의 약 90%가 100K 토큰 미만에 머물렀습니다. 토크나이저를 조정한 후, Haiku 5.5는 평균적으로 약 75% 더 저렴하게 실행될 것으로 추정합니다. 배치 처리 를 이용하면 추가로 50% 할인됩니다.

GPT-6 Luna 도 동일한 단기 컨텍스트 요금을 제시합니다. Luna의 상위 요금제는 272K 입력 토큍을 초과할 때만 적용되며, $0.20과 $0.75입니다. 150K 토큰 프롬프트의 경우 Luna가 목록 가격 기준 더 저렴합니다.

벤치마크

아래의 모든 수치는 Anthropic이 보고한 (다음을 참조 시스템 카드):

  • OSWorld 2.1 (오프라인 하위 집합): 72.4%, GPT-6 Luna의 경우 48.9%, Haiku 4.5의 경우 15.7%와 비교된다.
  • Terminal-Bench 4.0: 39.2%, 반면 Luna는 16.4%, Haiku 4.5는 0.0%를 기록했습니다.
  • FrontierCode 1.1 (메인): 46.4%, 반면 Luna는 42.4%였습니다.
  • 인류의 마지막 시험: 도구 없이는 45.9%, 도구를 사용하면 57.4%입니다.
  • GDPval-AA v2.1: 1620이며, Luna는 1437, Haiku 4.5는 735입니다.

Sonnet 5.5는 Terminal-Bench 4.0에서 70.6%를 기록한 것을 포함해 모든 항목에서 여전히 선두를 유지하고 있습니다. Anthropic 자체적으로도 복잡한 에이전틱 코딩에는 Sonnet 5.5와 Opus 5.5를 권장합니다.

최적 활용 사례

세 가지 워크로드가 Haiku 5.5에 가장 적합합니다:

  • 첫 번째는 Opus 5.5 또는 Sonnet 5.5 하위에서의 서브에이전트 작업입니다. Rogo에서는 Haiku 5.5 서브에이전트가 10-K 매출 라인을 가져오는 동안 더 큰 모델이 프레젠테이션 자료를 만듭니다.
  • 두 번째는 대용량 문서 질의응답 및 요약입니다. AlphaSense는 주당 약 8M 건의 호출을 처리하는 기능에서 이를 테스트했습니다.
  • 세 번째는 실시간 고객 지원과 같은 속도 민감형 업무와 브라우저 사용.

Haiku 5.5 대 최대 경쟁사 비교

기능Claude Haiku 5.5GPT-6 LunaGemini 3.5 Flash-Lite
입력 / 출력 (1M당)$0.10 / $0.50$0.10 / $0.50$0.30 / $2.50
롱 프롬프트 요금100K 초과 시 $0.50 / $2.50272K 초과 시 $0.20 / $0.75정액 요금
캐시 읽기 (1M당)$0.01$0.01$0.03 + 저장 비용
컨텍스트 창1M 토큰1,050,000 토큰1,048,576 토큰
최대 출력128K 토큰128,000 토큰65,536 토큰
입력텍스트, 이미지텍스트, 이미지텍스트, 이미지, 동영상, 오디오, PDF
추론 제어적응형 사고 + 노력 (기본값 medium)reasoning.effort none부터 max까지 (기본값 medium)사고(thinking) 지원
컴퓨터 사용베타 SDK 지원지원됨 (Responses API)지원됨 (Preview)
배치 할인50%50% (Batch 및 Flex)50%
지식 기준 시점2026년 6월2026년 5월 18일모델 페이지에 기재되지 않음
실행 환경Claude API, Bedrock, Google Cloud, Microsoft Foundry, AWS의 Claude PlatformOpenAI APIGemini API

출처: Anthropic 문서, Anthropic 발표, OpenAI 모델 페이지, OpenAI 가격, Google 모델 페이지, Google 가격. 표준 등급 리스트 가격, 2026년 10월 7일 확인.

인터랙티브 해설

핵심 요약

  • 100K 토큰까지의 프롬프트에 대해 1M 토큰당 입력 $0.10, 출력 $0.50.
  • 1M 컨텍스트, 128K 출력, 노력(effort) 설정이 있는 적응형 사고(기본값 medium).
  • OSWorld 2.1에서 72.4%, Haiku 4.5는 15.7% (Anthropic 보고 기준).
  • GPT-6 Luna와 100K 토큰 이하 짧은 컨텍스트에서 동일한 리스트 가격; 100K 토큰 초과 시 Luna가 더 저렴함.
  • Opus 5.5 및 Sonnet 5.5 아래에서 서브에이전트로 포지셔닝되며, 코딩 리드 역할이 아님.


다음을 확인해 보세요: 기술 세부 사항. 모든 크레딧은 이 프로젝트의 연구자에게 돌아갑니다. 또한 저희를 Twitter 에서 팔로우하고 저희 150k+ML SubReddit 에 가입하며 저희 뉴스레터를 구독하는 것도 잊지 마세요. 잠깐! 텔레그램을 사용하시나요? 이제 텔레그램에서도 저희와 함께하실 수 있습니다.

[스폰서] 웹은 대부분의 에이전트가 갖추지 못한 유일한 API입니다. 데이터베이스, 캘린더, 저장소에는 API가 있습니다. 하지만 개방형 웹에는 대체로 없습니다. TinyFish MCP 서버 모든 MCP 클라이언트에 네 가지 도구를 제공합니다: TinySearch, TinyFetch(JavaScript를 포함한 전체 페이지를 마크다운으로 제공), 로그인과 폼 처리를 위한 TinyBrowser, 다단계 작업을 위한 TinyAgent. Search와 Fetch는 무료입니다.

해당 게시물 Anthropic, 백만 입력 토큰당 $0.10에 가격이 책정된 1M 컨텍스트를 갖춘 소형 모델 Claude Haiku 5.5 출시 최초 발표 MarkTechPost.

원문 출처

MarkTechPost

내용 안내

원문 발행 및 권리는 출처에 있습니다.

기계 번역 · 원문을 참고하세요