Anthropic, Claude Haiku 5.5 모델 출시: 저비용 고성능 소형 모델의 새로운 기준 제시
요약
Anthropic이 Claude Haiku 5.5 모델을 출시하며 소형 모델의 가성비와 성능 기준을 높였습니다. 이 모델은 저렴한 비용으로 높은 효율성을 제공하며, 컨텍스트 창 확장 및 다양한 벤치마크에서 뛰어난 성능 향상을 보여주었습니다. 특히 고빈도 트래픽이 발생하는 반복적 작업에 최적화되어 있습니다.
핵심 포인트
- Haiku 5.5는 이전 버전 대비 약 90% 저렴한 비용으로 높은 효율성을 제공합니다.
- 컨텍스트 창은 최대 100만 token까지 확장되었으며, 출력 길이도 증가했습니다.
- OSWorld, Terminal-Bench 등 주요 벤치마크에서 성능이 크게 향상되었습니다.
- 에이전트 개발을 위한 SDK 지원 및 사용자 크레딧 증정이 이루어졌습니다.
Anthropic이 새 모델을 발표했습니다!
지난밤 Claude Haiku 5.5를 공개하며, 소형 모델의 가성비를 완전히 새로운 단계로 끌어올렸습니다. 10만 token 이하 요청에 대해 입력은 $0.10/M, 출력은 $0.50/M으로 책정되어 이전 버전인 Haiku 4.5보다 약 90% 저렴합니다.
컨텍스트 창(context window)은 기존 20만 token에서 최대 100만 token까지 확장되었으며, 최대 출력 길이 역시 6.4만 token에서 12.8만 token으로 증가했습니다.
이 모델의 포지셔닝은 매우 명확합니다: 요약, 압축(compaction), 분류, 데이터베이스 조회, 실시간 고객 서비스 등 고빈도 트래픽이 발생하고 비용 효율성이 중요한 반복적 작업에 최적화되어 있습니다. 또한 Opus 5.5 / Sonnet 5.5를 위한 서브 에이전트로서 코딩 작업을 수행하는 데 적합합니다.
속도는 현재 Claude 전체 라인업 중 가장 빠르며, 특히 브라우저 사용(browser use)이나 컴퓨터 조작과 같이 지연 시간에 민감한 시나리오에 매우 적합합니다.
성능 향상 폭은 상당히 인상적입니다: OSWorld 2.1의 경우 Haiku 4.5 대비 15.7%에서 72.4%로, Terminal-Bench 4.0은 0.0%에서 39.2%로, FrontierCode 1.1에서는 46.4%를 기록했습니다.
Anthropic이 제공한 비교표에 따르면, Haiku 5.5는 모든 공유 벤치마크에서 GPT-6 Luna를 능가합니다. 또한 이 모델은 'effort' 파라미터를 지원하는 최초의 Haiku급 모델로, low / medium / high 중에서 조절할 수 있어 비용과 지능 사이에서 필요에 따라 균형을 맞출 수 있습니다.
동시에 주목해야 할 세 가지 업데이트도 있습니다:
첫째, Sonnet 5.5의 캐시 읽기(cache reads) 비용이 50% 인하되었습니다 (기존 $0.20에서 $0.10/M으로). 이를 통해 에이전트 작업의 전체 비용이 약 20% 절감됩니다.
둘째, Max 5x 사용자에게는 매월 $100 API 크레딧을, Max 20x 사용자에게는 $200, Team 사용자에게는 $500을 제공하여 사용자들이 Claude Platform에서 에이전트와 애플리케이션을 직접 구축하기 용이해졌습니다.
셋째, Python / TypeScript SDK에 컴퓨터 사용(computer use) 및 브라우저 사용(browser use)의 베타 지원 기능이 추가되었습니다.
모델명은 claude-haiku-5-5이며, Claude Platform, AWS, Google Cloud, Azure 등 모든 플랫폼에서 사용할 수 있습니다.
고빈도 분류, 라우팅, 서브 에이전트, 고객 서비스와 같은 시나리오를 운영하는 팀들에게 이전에는 Haiku 4.5의 성능 한계를 감수하거나 Sonnet을 사용하며 비용을 더 지출해야 했지만, 이제는 이러한 고민을 할 필요가 거의 없어졌습니다.
AI 자동 생성 콘텐츠
본 콘텐츠는 X @berryxia (자동 발견)의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기