Claude Haiku 5.5는 10만 토큰까지 저렴하다: TypeScript로 작은 가격 게이트 구현하기
요약
Anthropic의 Claude Haiku 5.5가 저렴한 가격으로 출시되었으나, 실제 비용은 토큰 수와 모델의 '노력(effort)' 수준에 따라 달라집니다. 본 문서는 외부 코드를 통해 요청 전 청구서를 계산하는 '가격 게이트' 구현 방법을 제시하며, 단순한 낮은 가격이 항상 효율적인 작업임을 보장하지 않음을 강조합니다.
핵심 포인트
- Haiku 5.5는 최대 10만 토큰까지 저렴하지만, 노력(effort) 수준에 따라 비용이 달라진다.
- 가격 게이트 코드는 실제 API 호출 없이 요청의 적합성과 예상 청구서를 계산한다.
- 토크나이저가 더 많은 토큰을 사용하더라도 낮은 가격일 수 있으므로 주의해야 한다.
2026년 10월 7일, Anthropic은 Claude Haiku 5.5를 출시했습니다. 모델 ID는 claude-haiku-5-5입니다. 최대 100,000 토큰까지의 프롬프트에 대해 입력(input) 비용은 백만 토큰당 $0.10이고 출력(output) 비용은 $0.50입니다. 이는 Haiku 4.5의 $1.00 및 $5.00보다 90% 낮은 수치입니다. 100,000 토큰을 초과하면 요율이 $0.50 및 $2.50으로 변경됩니다. 이는 90% 할인이 아닌 50% 할인에 불과합니다.
Anthropic은 또한 새로운 토크나이저가 동일한 텍스트에 대해 Haiku 4.5보다 약 30% 더 많은 토큰을 사용한다고 밝히고 있습니다. 저렴한 토큰이 반드시 저렴한 작업을 의미하는 것은 아닙니다. 그리고 Haiku 5.5는 노력(effort) 다이얼을 갖춘 최초의 Haiku 모델입니다. API 기본값은 medium입니다. low, high, xhigh, max는 실제 설정 값들입니다. 이들은 모델이 생각하는 정도를 변경하며, 이는 청구서에 영향을 줍니다. 공개된 가격만으로는 이를 알 수 없습니다.
진정으로 유용한 질문은 요청이 나가기 전에 코드가 무엇을 하는지입니다.
게이트(The gate)
이 장난감 프로그램은 Claude를 호출하지 않습니다. 사용자가 이미 가지고 있는 토큰 개수, 작업 이름, 그리고 노력 수준을 이 프로그램에 전달합니다. 그러면 ALLOW, REVIEW, 또는 REFUSE 중 하나로 응답하며, USD 기준으로 공개 가격의 청구서를 출력합니다.
프롬프트 크기는 입력 토큰(input tokens) + 캐시 읽기(cache reads) + 캐시 쓰기(cache writes)입니다. 100,000 토큰 이하일 때는 짧은 요율(short rates)이 적용됩니다. 이 선을 초과하면 긴 요율(long rates)이 적용되며 결정은 REVIEW가 됩니다.
ALLOW는 오직 다섯 가지 제한된 작업(classify, extract, route, summarize, compact)에만 해당합니다. 노력 수준(effort)은 반드시 low 또는 medium이어야 합니다. 만약 노력 수준을 생략하면, 이 모델의 Claude API 기본값인 medium으로 게이트가 설정됩니다.
agentic-coding과 computer-use는 짧은 프롬프트에서도 REVIEW입니다. Anthropic 자체의 Terminal-Bench 4.0 수치는 Haiku 5.5가 39.2%, Sonnet 5.5가 70.6%였습니다. 낮은 가격이 동일한 작업을 의미하지 않습니다. high, xhigh, max 역시 REVIEW입니다. 이 프로그램에는 해당 수준의 비용을 스스로 정당화하는 평가(eval) 기능이 없습니다.
잘못된 토큰 개수나 알 수 없는 레이블은 REFUSE됩니다. 음수의 토큰 개수가 할인이 될 수는 없습니다.
실행하기(Run it)
전체 소스 코드는 아래와 같습니다. src/gate.ts로 저장하세요. Node 22 이상을 사용해야 합니다. 패키지나 API 키는 필요하지 않습니다.
node --experimental-strip-types src/gate.ts
/**
- Claude Haiku 5.5의 가격 게이트(Price gate).
- 네트워크 연결 불필요. API 키 필요 없음. 요금은 백만 토큰당 마이크로달러 기준 리스트 가격입니다.
...
2026년 10월 8일, Node.js 25.6.0에서 확인됨. 총 11개의 체크가 통과했습니다:
classify-short | ALLOW | claude-haiku-5-5 | effort=medium | tier=short | prompt=2000 | haiku55=0.000300 | haiku45=0.003000 | savings_bps=9000 | 짧은 프롬프트, 허용 목록 작업, 노력(effort)이 낮거나 중간
compact-under-limit | ALLOW | claude-haiku-5-5 | effort=low | tier=short | prompt=84000 | haiku55=0.001450 | haiku45=0.014500 | savings_bps=9000 | 짧은 프롬프트, 허용 목록 작업, 노력(effort)이 낮거나 중간
compact-over-limit | REVIEW | claude-haiku-5-5 | effort=medium | tier=long | prompt=110000 | haiku55=0.015500 | haiku45=0.031000 | savings_bps=5000 | 프롬프트가 100,000 토큰을 초과하여 장기(long) 티어 요금이 적용됨
...
savings_bps는 원래 토큰 수를 기준으로 Haiku 4.5 청구서 대비 베이스 포인트(basis points)를 나타냅니다. 9000은 90.00%입니다. 5000은 50.00%입니다. 8760은 87.60%입니다.
이 세 줄을 주의 깊게 읽어보세요.
classify-short는 전단지 사례(brochure case)입니다. 입력 토큰 2,000개와 출력 토큰 200개에 노력(effort)은 medium입니다. Haiku 5.5는 $0.000300입니다. Haiku 4.5는 $0.003000입니다. 같은 토큰 수임에도 불구하고 90% 저렴합니다.
compact-over-limit은 놓치기 쉬운 부분입니다. 새로운 입력 토큰 20,000개와 캐시 읽기 토큰 90,000개를 합친 것이 총 110,000 토큰 프롬프트입니다. 이 작업은 여전히 compact이며 허용 목록에 있고, 노력(effort) 역시 medium입니다. 결정은 REVIEW입니다. Haiku 5.5 비용은 $0.015500이고, Haiku 4.5 비용은 $0.031000입니다. 절감액이 50%인 이유는 장기 티어 요금이 단기 티어 요금의 다섯 배이며, Haiku 4.5의 고정 요율이 단기 티어 요율의 열 배이기 때문입니다.
recount-30은 Haiku 4.5 기준 입력 토큰 10,000개와 출력 토큰 500개에서 시작합니다. 이 게이트는 Haiku 5.5 가격을 산정하기 전에 입력 토큰에 130/100을 곱하므로, 새로운 청구서는 입력 토큰 13,000개를 사용합니다. Haiku 5.5는 $0.001550이고, Haiku 4.5는 $0.012500입니다. 이는 90%가 아닌 87.60% 적은 금액입니다.
마지막 인용구는 경로가 아닙니다. Anthropic은 10월 7일부로 Sonnet 5.5의 캐시 읽기 비용을 백만 토큰당 $0.20에서 $0.10으로 낮췄습니다. 이제 100,000개의 캐시 읽기 토큰은 $0.010000이며 이전에는 $0.020000이었습니다. 게이트가 이를 출력합니다. 이는 작업을 Sonnet으로 전송하는 것이 아닙니다.
이것이 아닌 것들
- API 호출, 키, 또는 지연 시간 측정(latency measurement)은 없습니다.
- 노력(Effort)이 토큰 승수(token multiplier)로 변환되지 않습니다. Anthropic은 더 높은 노력이 더 많이 생각한다는 점을 알려줍니다. 이 프로그램이 정직하게 적용할 수 있는 단일한 승수는 공개하지 않습니다. 분류 작업(classify job)의
max는 여전히 단기 티어 목록 가격을 보여준 다음, 검토(REVIEW)를 수행합니다. - 여기서 프롬프트 크기는 세 가지 카운트가 합산된 것입니다. Anthropic은 "프롬프트(prompts)"라고 말합니다. 청구서에서 다른 하위 집합을 계산한다면, 합계를 변경할 때까지 티어가 잘못될 수 있습니다.
- 30% 재계산은 모델 개요에 있는 "약 30%(approximately 30%)"이라는 구절을 분수 130/100으로 적용한 것입니다. 이는 사용자의 텍스트에 대한 토크나이저 실행(tokenizer run)이 아닙니다.
- 5분 캐시 쓰기 비용은 10월 7일 표의 비율($0.125 및 $0.625/백만)입니다. 1시간 쓰기 비용은 모델 개요에 있는 다른 비율($0.20 및 $1.00)입니다. Haiku 4.5의 1시간 쓰기 비용은 이 비교에 포함되어 있지 않으므로, 해당 항목(fixture)은
haiku45를 비워둡니다. - Batch API는 입력과 출력 모두 50% 할인됩니다. 이 수치들은 표준 요율입니다.
- Asana의 지연 시간 참고 사항이나 HubSpot의 92.8% CRM 점수를 포함하여 출시 페이지의 고객 견적은 Anthropic이 초기 테스트를 보고한 것입니다. 이는 여기에 재현된 것이 아닙니다.
- 위에 제시된 벤치마크는 Anthropic의 수치입니다: OSWorld 2.1 오프라인 하위 집합에서 Haiku 4.5가 15.7%인 반면 72.4%를 기록했으며, GPT-6 Luna는 48.9%, GDPval-AA v2.1 Elo는 735 대 1620, Terminal-Bench 4.0은 0.0% 대 39.2% 및 16.4%입니다.
사용된 요율 (USD/백만 토큰):
| 요율 | Haiku 5.5, 프롬프트 ≤100k | Haiku 5.5, 프롬프트 >100k | Haiku 4.5 |
|---|---|---|---|
| 입력 (Input) | 0.10 | 0.50 | 1.00 |
| ... |
출처 (Sources)
- Claude Haiku 5.5 소개, 2026년 10월 7일
- Claude Haiku 5.5 모델 개요 (모델 ID, 10만 토큰 가격 분할, 1시간 캐시 쓰기, 미디엄 기본값 및 토크나이저 참고 사항 포함)
- Effort (5가지 레벨 및 Haiku 5.5 기본값 포함)
저는 실제 작업을 수행하는 AI 직원인 Roster를 구축하고 있습니다. 더 작은 모델이라도 자신이 지불할 가격을 아는 게이트가 필요합니다.
AI 자동 생성 콘텐츠
본 콘텐츠는 Dev.to AI tag의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기