Anthropic수정일

Claude Haiku 5.5 소개

지금까지 우리가 선보인 가장 빠르고, 가장 저렴하며, 가장 뛰어난 소형 모델입니다. 대용량의 비용 민감도가 높은 작업을 위해 설계되었습니다.

이미지 출처 · Anthropic

Claude Haiku 5.5 소개: 지금까지 우리가 출시한 것 중 가장 저렴하고, 가장 빠르며, 가장 뛰어난 소형 모델입니다.

Claude Haiku 5.5는 대용량의 비용 민감도가 높은 작업을 위해 설계되었습니다. 요약, 컴팩션, 데이터베이스 쿼리, 분류 요청과 같은 빠르고 반복적인 워크로드를 안정적으로 처리합니다. 코딩 작업에서는 Opus 5.5 및 Sonnet 5.5와 서브에이전트로 잘 결합됩니다. 그리고 지금까지 우리의 가장 빠른 모델이기도 하므로, 실시간 고객 지원 및 브라우저 사용과 같이 속도에 민감한 작업에 특히 적합합니다.¹

Haiku 5.5는 Haiku 4.5보다 훨씬 낮은 가격에 제공됩니다. 평균적으로 이제 실행 비용이 약 75% 더 저렴합니다.²

이번 출시와 함께 우리는 모델 라인업의 가치를 개선하고 있습니다. Claude Sonnet 5.5의 캐시 읽기 가격을 절반으로 인하하여, 이제 Sonnet 5.5가 대부분의 에이전트 작업에서 약 20% 더 저렴하게 실행됩니다. 또한 Claude Max 및 Team 구독자를 위한 새로운 월간 API 크레딧을 도입하여, Claude Platform에서 실행되는 새로운 에이전트와 애플리케이션을 구축하는 사용자를 지원하고자 합니다.

성능

Claude Haiku 5.5가 다양한 벤치마크에서 수행되는 모습은 다음과 같습니다:

Haiku 5.5Haiku 4.5GPT-6 LunaSonnet 5.5참고용
지식 작업GDPval-AA v2.1162073514371840
지식 작업AA-Briefcase v1.1157861413361824
컴퓨터 사용OSWorld 2.172.4%오프라인 하위 집합15.7%오프라인 하위 집합48.9%오프라인 하위 집합83.9%오프라인 하위 집합
다분야 추론Humanity’s Last Exam45.9%도구 없음10.2%도구 없음—56.9%도구 없음
57.4%도구 사용18.7%도구 사용—64.5%도구 사용
에이전트 코딩Terminal-Bench 4.039.2%0.0%16.4%70.6%
에이전트 코딩FrontierCode 1.1 (Main)46.4%—42.4%52.1%Xhigh
시각적 추론Chartography46.4%도구 없음6.4% 도구 없음29.1% 도구 없음61.6% 도구 없음

평가를 진행하는 방식에 대한 자세한 내용은 다음을 참조하세요: Haiku 5.5 시스템 카드.

Haiku 5.5는 조절 가능한 노력(effort) 설정을 갖춘 최초의 Haiku급 모델입니다. 즉, 다른 모델과 마찬가지로 사용자가 비용과 지능 중 무엇을 우선할지 결정할 수 있습니다. 아래 차트는 각 노력 설정에서 세 가지 벤치마크에 대한 Haiku 5.5의 성능을 보여줍니다:

OSWorld 2.1 (오프라인 하위 집합) 정확도 vs. 비용

OSWorld 2.1은 에이전트가 실제 컴퓨터를 조작하여 길고 다단계인 작업을 얼마나 잘 완료할 수 있는지를 측정합니다.

GDPval-AA v2.1 정확도 vs. 비용

Artificial Analysis의 GDPval-AA v2.1은 44개 직군에 걸친 실제 전문 업무에 대해 에이전트를 평가합니다.

Humanity’s Last Exam (도구 없음) 정확도 vs. 비용

Humanity’s Last Exam(HLE)은 전문가 수준의 학술 지식과 추론 능력을 시험하는 테스트입니다.

초기 테스트에서 고객들은 위에 나타난 성능 및 비용 개선과 일치하는 결과를 보고했습니다. 새 모델에 대해 고객들이 말한 내용은 다음과 같습니다:

인용문

“Claude Haiku 5.5, 특히 그 속도에 매우 감명받았습니다. 저희는 AI 에이전트 제품인 AI Teammates용 평가 스위트를 통해 이 모델을 테스트했으며, 여기에는 버그 분류, 프로젝트 설정, 대규모 포트폴리오를 검색하여 고위험 또는 기한 초과 작업을 식별하는 등의 사용 사례가 포함되었습니다. 현재 사용 중인 모델과 비교했을 때, 작업 완료 시 지연 시간이 30% 이상 감소했고 에이전트 턴당 추론 속도가 최대 2.5배 빨라졌습니다. 체감상 확연히 더 빠른 경험입니다.”

회사 Asana 작성자 Aaron Vinh, Staff Software Engineer

가격

아래 표는 Claude Haiku 5.5의 가격을 다른 모델들과 비교하여 보여줍니다. Haiku 5.5는 프롬프트가 100,000 토큰 이하인 작업에 사용할 때 특히 가성비가 뛰어나며, 이러한 작업은 이전 Haiku 모델에 대한 요청의 약 90%를 차지합니다.

100만 토큰당 가격Haiku 5.5
100k 이하 / 초과 프롬프트
Haiku 4.5Sonnet 5.5
캐시 읽기$0.01 / $0.05$0.10$0.10
캐시 쓰기$0.125 / $0.625$1.25$2.50
입력 토큰$0.10 / $0.50$1.00$2.00
출력 토큰$0.50 / $2.50$5.00$10.00

안전성

정렬(alignment). Claude Haiku 5.5는 Haiku 4.5에 비해 거의 모든 정렬 평가에서 큰 개선을 보여줍니다. 특히 정렬되지 않은 행동의 사례가 훨씬 적었고, 오용에 협조하려는 성향도 낮았습니다. 이 모델의 시스템 카드 에서 저희의 평가 과정과 결과를 더 자세히 설명합니다.

안전장치. 역량에 부합하도록 Haiku 5.5의 사이버보안 안전장치는 Haiku 4.5의 것보다 더 엄격하지만, 최근 다른 모델에 적용한 안전장치보다는 다소 덜 엄격합니다. 사이버보안 분야에서 이 안전장치는 Sonnet 5.5를 위한 안전장치보다 더 넓은 범위의 방어 작업을 허용하지만, 여전히 침투 테스트 및 공격자가 사용할 가능성이 더 높은 기타 기법은 차단합니다.

Haiku 5.5의 생물학 안전장치는 Sonnet 5, Sonnet 5.5, Opus 5의 것과 동일합니다. 이 안전장치는 연구 목적의 생물학 질문은 허용하지만, 해를 끼칠 가능성이 있다고 판단되는 요청에 대한 접근은 제한합니다. 더 폭넓은 생물학 및 사이버 활동을 수행하는 조직은 당사의 Life Sciences Verification Program 및 Cyber Verification Program.

가용성

Claude Haiku 5.5는 Amazon Web Services, Google Cloud, Microsoft Azure를 포함한 모든 플랫폼에서 지금 이용할 수 있습니다. Claude Platform에서 개발자는 다음을 통해 시작할 수 있습니다: claude-haiku-5-5.

자세한 내용은 당사의 마이그레이션 가이드 를 참조하십시오.

추가 업데이트

Claude Haiku 5.5의 새로운 가격 책정과 함께, 우리는 모델과 제품의 가치를 더욱 개선하고 있습니다.

첫째, 오늘부터 우리는 Claude Sonnet 5.5의 캐시 읽기 가격을 인하합니다. 캐시 읽기 비용이 이제 50% 낮아져 기존 $0.20 대신 백만 토큰당 $0.10입니다. 캐시 읽기는 모델의 토큰 소비에서 큰 비중을 차지하기 때문에, 이로써 대부분의 에이전틱 작업에서 Sonnet 5.5의 비용이 약 20% 절감됩니다.

예를 들어, 이번 가격 인하가 Terminal-Bench 4.0에서 Sonnet 5.5의 성능 대비 비용에 어떤 의미를 갖는지 보여주는 차트는 다음과 같습니다:

Terminal-Bench 4.0 정확도 대비 비용

Terminal-Bench 4.0은 모델이 커맨드라인 인터페이스 내에서 복잡한 다단계 전문 작업을 얼마나 잘 완료할 수 있는지를 측정합니다.

이 차트는 Haiku 5.5와 우리의 더 큰 모델들 간의 중요한 차이를 보여줍니다. Sonnet 5.5와 Opus 5.5는 Terminal-Bench 4.0에서 측정되는 것과 같은 복잡한 에이전틱 코딩 작업에 여전히 더 나은 선택입니다. 반면 Haiku 5.5는 이전 버전의 Claude에서는 비용상 감당하기 어려웠을 수 있는, 컴팩션(compaction), 요약 또는 서브에이전트 작업과 같이 더 좁은 범위의 작업에 가장 적합합니다.

둘째, 이번 주에 우리는 Max 및 Team 구독자 모두에게 Claude Platform에서 사용할 수 있는 새로운 월간 API 크레딧을 제공할 예정입니다. Max 5x 사용자는 매월 $100의 크레딧을, Max 20x 사용자는 $200을 받게 되며, Team 구독자는 사용자들 전체에 걸쳐 공동으로 사용할 수 있는 최대 $500을 받게 됩니다. 이 크레딧은 사용자들이 우리 API를 호출하는 도구, 앱, 에이전트를 만들어 볼 수 있도록 설계되었습니다. 모든 모델에서 사용할 수 있습니다. 자세한 내용은 헬프 센터 문서를 참조하세요.

또한 개발자를 위해 Claude Python 및 TypeScript SDK를 업데이트하여 컴퓨터 사용(computer use)과 브라우저 사용(browser use)에 대한 베타 지원을 추가합니다 . Haiku 5.5는 속도, 성능, 가격의 조합 덕분에 이러한 작업에 특히 적합합니다. 이에 대해 자세히 알아보려면 Claude Platform 문서를 참조하세요.

각주

1 Claude Haiku 5.5는 각 모델의 표준 속도 기준으로 지금까지 우리가 만든 가장 빠른 모델입니다. 다만 Fast Mode에서는 Opus 모델보다 덜 빠르게 실행됩니다.

2 Claude Haiku 5.5는 100,000 토큰 이하의 요청에 대해 Claude Haiku 4.5보다 90% 낮은 가격으로 책정되며, 100,000 토큰을 초과하는 요청에 대해서는 50% 낮은 가격입니다. Haiku 4.5에서는 90%의 요청이 전자 범주에 속했습니다. 이 계산에는 주어진 작업을 완료하는 데 사용되는 토큰 수에서 Haiku 4.5와 Haiku 5.5 사이의 변화도 반영됩니다. Haiku 5.5는 업데이트된 토크나이저(Sonnet 5.5 및 Opus 5.5의 것과 유사)를 사용하므로, 작업당 약간 더 많은 토큰을 사용합니다.

원문 출처

Anthropic

내용 안내

원문 발행 및 권리는 출처에 있습니다.

기계 번역 · 원문을 참고하세요