Claude Haiku 5.5 소개
요약
Anthropic이 저렴하고 빠른 소형 모델인 Claude Haiku 5.5를 출시했습니다. 이 모델은 높은 처리량과 비용 효율성이 중요한 작업에 최적화되었으며, 특히 요약, 분류, 데이터베이스 질의 등 반복적인 워크로드 처리에 강점을 보입니다. Haiku 4.5 대비 실행 비용이 약 75% 감소했으며, 조절 가능한 노력(effort) 설정과 개선된 안전성도 주요 특징입니다.
핵심 포인트
- Claude Haiku 5.5는 저렴하고 빠른 소형 모델로, 높은 처리량에 최적화됨.
- 요약, 분류 등 반복적인 워크로드 처리에 안정적이며 속도가 빠름.
- Haiku 4.5 대비 실행 비용이 약 75% 감소하여 경제성이 크게 향상됨.
- 조절 가능한 노력(effort) 설정으로 비용과 지능 사이의 최적화가 가능함.
가장 저렴하고 빠르며 가장 유능한 소형 모델을 선보이는 Claude Haiku 5.5를 소개합니다.
Claude Haiku 5.5는 높은 처리량과 비용에 민감한 작업을 위해 설계되었습니다. 요약, 압축(compactions), 데이터베이스 질의, 분류 요청과 같은 빠르고 반복적인 워크로드 처리에 안정적입니다. 코딩 작업에서 Opus 5.5 및 Sonnet 5.5와 결합하여 서브 에이전트(subagent)로 활용하기에 좋습니다. 또한, 현재까지 가장 빠른 모델이기 때문에 라이브 고객 지원이나 브라우저 사용과 같은 속도에 민감한 작업에도 특히 잘 작동합니다.¹
Haiku 5.5는 Haiku 4.5보다 훨씬 낮은 가격으로 이용할 수 있습니다. 평균적으로 실행 비용이 약 75% 감소했습니다.²
성능
Claude Haiku 5.5가 다양한 벤치마크에서 어떻게 성능을 보이는지 알려드립니다:
| Haiku 5.5 | Haiku 4.5 | GPT-6 Luna | Sonnet 5.5참고용 |
|---|---|---|---|
| Knowledge workGDPval-AA v2.1 | 1620 | 735 | 1437 |
| ... |
평가 수행 방식에 대한 자세한 내용은 Haiku 5.5 System Card를 참조하십시오.
Haiku 5.5는 조절 가능한 노력(effort) 설정을 갖춘 최초의 Haiku급 모델입니다. 이는 다른 모델들과 마찬가지로 사용자가 비용 최적화와 지능 중 어느 것에 초점을 맞출지 결정할 수 있음을 의미합니다. 아래 차트는 각 노력 설정에서 Haiku 5.5가 세 가지 벤치마크에서 어떻게 성능을 보이는지 보여줍니다:
- OSWorld 2.1: 에이전트(agents)가 실제 컴퓨터를 조작하여 길고 다단계적인 작업을 완료하는 능력을 측정합니다.
- Artificial Analysis의 GDPval-AA v2.1: 44개 직업에 걸쳐 실생활 전문 업무에서 에이전트를 평가합니다.
- Humanity’s Last Exam (HLE): 전문가 수준의 학술 지식과 추론 능력을 테스트하는 시험입니다.
초기 테스트에서 고객들은 위에서 보여준 성능 및 비용 개선과 일치하는 결과를 보고했습니다. 새로운 모델에 대해 그들이 말한 내용은 다음과 같습니다:
가격 책정
아래 표는 Claude Haiku 5.5의 가격이 다른 모델들과 어떻게 비교되는지 보여줍니다. Haiku 5.5는 프롬프트 길이가 최대 100,000 토큰인 작업을 수행할 때 특히 가치가 높으며, 이는 이전 Haiku 모델에 대한 요청 중 약 90%를 차지합니다.
| 1백만 토큰당 가격 | Haiku 5.5 프롬프트 최대 / 초과 100k | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|
| 캐시 읽기 (Cache reads) | $0.01 / $0.05 | $0.10 | $0.10 |
| ... |
안전성 (Safety)
정렬(Alignment). Claude Haiku 5.5는 Haiku 4.5 대비 거의 모든 정렬 평가에서 큰 개선을 보여줍니다. 특히, 잘못된 행동의 사례가 현저히 적고 오용에 협조하려는 의향이 낮다는 것을 발견했습니다. 모델의 시스템 카드에는 저희의 평가 과정과 결과가 더 자세하게 설명되어 있습니다.
안전장치 (Safeguards). 기능성 측면에서 일관되게, Haiku 5.5의 사이버 보안 안전장치는 Haiku 4.5보다 더 제한적이지만, 최근 다른 모델에 적용한 것보다는 다소 덜 제한적입니다. 사이버 보안 분야에서는 Sonnet 5.5의 안전장치보다 더 광범위한 방어 작업을 허용하지만, 공격자가 사용할 가능성이 높은 침투 테스트(penetration testing) 및 기타 기술은 여전히 차단합니다.
Haiku 5.5의 생물학적 안전장치는 Sonnet 5, Sonnet 5.5, Opus 5와 동일합니다. 연구 생물학 질문은 허용하지만, 저희가 유해할 가능성이 높다고 판단하는 요청에 대한 접근은 제한합니다. 더 광범위한 생물학 및 사이버 활동을 수행하는 조직은 당사의 Life Sciences Verification Program과 Cyber Verification Program에 신청할 수 있습니다.
사용 가능성 (Availability)
Claude Haiku 5.5는 Amazon Web Services, Google Cloud, Microsoft Azure를 포함한 모든 플랫폼에서 현재 이용 가능합니다. Claude Platform에서는 개발자들이 claude-haiku-5-5로 시작할 수 있습니다.
자세한 내용은 마이그레이션 가이드(migration guide)를 참고하십시오.
추가 업데이트 (Further updates)
Claude Haiku 5.5에 대한 새로운 가격 책정 외에도, 저희는 모델과 제품의 가치를 더욱 향상시키고 있습니다.
먼저, 오늘부터 Claude Sonnet 5.5의 캐시 읽기(cache reads) 가격을 인하합니다. 캐시 읽기 비용은 기존 $0.20에서 1백만 토큰당 $0.10으로 50% 감소했습니다. 캐시 읽기는 모델의 토큰 소비량에서 큰 비중을 차지하기 때문에, 이는 대부분의 에이전트 작업(agentic tasks)에서 Sonnet 5.5의 비용을 약 20% 절감합니다.
예를 들어, 가격 인하가 Terminal-Bench 4.0에서 Sonnet 5.5의 성능 대비 비용에 어떤 의미인지 살펴보겠습니다:
Terminal-Bench 4.0은 모델이 명령줄 인터페이스(command-line interface) 내에서 복잡하고 다단계적인 전문 작업을 얼마나 잘 완료할 수 있는지 측정합니다.
이 차트는 Haiku 5.5와 저희의 더 큰 모델들 간의 중요한 차이점을 보여줍니다. Sonnet 5.5와 Opus 5.5는 Terminal-Bench 4.0으로 측정되는 것과 같은 복잡한 에이전트 코딩 작업(agentic coding tasks)에 여전히 더 나은 선택지입니다. 반면, Haiku 5.5는 압축, 요약 또는 서브 에이전트 작업처럼 이전 버전의 Claude를 사용하기에는 비용 부담이 되었을 수 있는 보다 범위가 좁은 작업에 가장 적합합니다.
개발자들을 위해 저희는 또한 Claude Python 및 TypeScript SDK를 업데이트하여 컴퓨터 사용(computer use)과 브라우저 사용(browser use) 지원을 베타로 추가하고 있습니다. Haiku 5.5는 속도, 기능성, 가격의 조합 덕분에 이러한 작업에 특히 적합합니다. 자세한 내용은 Claude Platform 문서를 참조하십시오.
각주
1 Claude Haiku 5.5는 현재까지 모델별 표준 속도에서 가장 빠른 모델이지만, Fast Mode에서는 Opus 모델보다 느리게 작동합니다.
2 Claude Haiku 5.5는 최대 100,000 토큰 요청에 대해 Claude Haiku 4.5보다 90% 저렴하며, 100,000 토큰을 초과하는 요청에 대해서는 50% 저렴합니다. Haiku 4.5의 경우, 요청의 90%가 전자의 범주에 속했습니다. 이 계산에는 주어진 작업을 완료하는 데 사용되는 토큰 수에 대한 Haiku 4.5와 Haiku 5.5 간의 변경 사항도 반영되었습니다. 즉, Haiku 5.5는 업데이트된 토크나이저(Sonnet 5.5 및 Opus 5.5와 유사)를 사용하여 작업당 약간 더 많은 토큰을 사용합니다.
AI 자동 생성 콘텐츠
본 콘텐츠는 HN AI Posts의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기