이번 주의 AI 가격 변동: DeepSeek는 저렴해지고, Claude Sonnet 5는 비싸진다
요약
DeepSeek V4 Flash의 가격 인하와 Anthropic Claude Sonnet 5의 도입 가격 종료 및 토크나이저 변경에 따른 실질적 비용 상승 소식을 다룹니다. LLM API 비용 구조 변화에 따른 개발자의 전략적 대응을 권고합니다.
핵심 포인트
- DeepSeek V4 Flash가 저렴한 가격으로 프리뷰를 종료하며 에이전트 성능 입증
- Claude Sonnet 5는 가격 인상과 토크나이저 변경으로 인해 체감 비용이 약 2배 상승
- 비용 최적화를 위해 소형 모델 재벤치마킹 및 토큰 사용량 감사 필요
이번 주 LLM API를 기반으로 서비스를 구축하고 있다면 잠시 주목할 만한 두 가지 가격 변동 소식이 있었습니다.
DeepSeek V4 Flash 프리뷰 종료 — 자체 플래그십 모델보다 저렴한 가격
DeepSeek V4 Flash가 **100만 토큰당 $0.14 / $0.28 (입력/출력)**의 가격으로 프리뷰를 종료했습니다. 이 모델은 에이전트 벤치마크(agentic benchmarks)에서 **Terminal-Bench 82.7%**를 기록하며 자체적인 더 큰 모델인 Pro 모델을 능가하고 있습니다. 이는 더 작고 저렴한 모델이 에이전트 작업에서 더 큰 형제 모델보다 뛰어난 성능을 보여주고 있음을 의미합니다.
Claude Sonnet 5의 도입 가격 종료 (9월 1일)
Anthropic의 Claude Sonnet 5 도입 가격 정책이 9월 1일에 종료됩니다. 주요 가격은 100만 토큰당 $2에서 $3로 인상되지만, 더 큰 변화는 내부적인 부분에 있습니다. 새로운 토크나이저(tokenizer)가 동일한 텍스트에 대해 최대 35% 더 많은 토큰을 추가합니다. 이 두 가지를 결합하면 실제 체감되는 비용 상승은 1.5배가 아니라 2배에 가깝습니다.
개발자에게 주는 의미
만약 귀하의 기술 스택이 기본적으로 프런티어 모델(frontier models)에 의존하고 있다면, 이번 주는 다음과 같은 작업을 수행하기에 좋은 시기입니다:
- 단순히 리더보드 점수가 아닌, 실제 작업에 대해 더 작고 저렴한 모델들을 다시 벤치마킹(re-benchmark)하기
- 9월 1일 가격 변동이 적용되기 전에 토큰 사용량 감사(audit)하기
- "필요하기 때문에 사용하는 프런티어 모델"과 "기본 설정이라서 사용하는 프런티어 모델"을 구분하기
저렴하다는 것이 항상 라벨에 적힌 그대로인 것은 아니며, 비싸다는 것이 항상 표시 가격의 변화로만 나타나는 것도 아닙니다. 때로는 토크나이저가 그 원인이 되기도 합니다.
출처: llm-stats.com, aitoolsrecap.com
AI 자동 생성 콘텐츠
본 콘텐츠는 Dev.to AI tag의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기