토큰 원장 요약 (The Token Ledger Digest) – 2026-07-30
요약
2026년 7월 30일 기준 주요 AI 모델들의 토큰 가격 변동 사항을 요약합니다. DeepSeek V3의 가격 상승과 함께 Google Gemma 4, Qwen 시리즈 등 다양한 모델의 비용 변화를 다룹니다.
핵심 포인트
- DeepSeek V3의 프롬프트 및 완료 토큰 가격 상승으로 인한 예산 상향 필요
- Google Gemma 4 및 Qwen3 Coder의 토큰 비용 인하로 인한 비용 절감
- inclusionAI, IBM Granite 등 초저가 모델의 시장 현황
- 모델별 가격 변동에 따른 워크로드별 비용 최적화 전략 필요
토큰 원장 요약 (The Token Ledger Digest) – 2026-07-30
가장 큰 비용 영향: DeepSeek DeepSeek V3 – 프롬프트 (prompt) 가격이 $0.20에서 $0.26 / 1M 토큰으로 상승 (+$0.06), 완료 (completion) 가격이 $0.80에서 $1.03 / 1M 토큰으로 상승 (+$0.23). 총 증가액 ≈ $0.29 / 1M 토큰.
관심 대상: DeepSeek V3에서 대량의 채팅 또는 코드 생성 (code-gen) 워크로드를 실행하는 팀; 예산 예측치를 상향 조정해야 함.
기타 가격 변동:
-
Z.ai GLM 5.2 – 프롬프트 (prompt) ↓ $0.74 → $0.70 / 1M (-$0.05); 완료 (completion) ↓ $2.34 → $2.20 / 1M (-$0.14). 총 -$0.19 / 1M.
관심 대상: 소폭의 비용 절감을 경험하는 GLM 5.2 사용자.
-
MoonshotAI Kimi Latest – 프롬프트 (prompt) ↓ $3.00 → $2.90 / 1M (-$0.10); 완료 (completion)는 $15.00 / 1M로 변동 없음. 총 -$0.10 / 1M.
관심 대상: 비용에 민감한 프롬프트 중심 애플리케이션.
-
Google Gemma 4 31B – 프롬프트 (prompt) ↓ $0.14 → $0.10 / 1M (-$0.04); 완료 (completion) ↓ $0.40 → $0.34 / 1M (-$0.06). 총 -$0.10 / 1M.
관심 대상: 지연 시간 (latency)에 민감한 작업에 Gemma 4를 사용하는 개발자.
-
Qwen Qwen3 Coder Next – 프롬프트 (prompt) ↓ $0.18 → $0.12 / 1M (-$0.06); 완료 (completion) ↓ $0.90 → $0.80 / 1M (-$0.10). 총 -$0.16 / 1M.
관심 대상: 낮은 토큰 비용의 혜택을 받는 코딩 어시스턴트.
-
Qwen Qwen3 VL 30B A3B Instruct – 프롬프트 (prompt) ↑ $0.13 → $0.15 / 1M (+$0.02); 완료 (completion) ↑ $0.52 → $0.60 / 1M (+$0.08). 총 +$0.10 / 1M.
관심 대상: 비용이 약간 상승한 시각-언어 (vision-language) 워크로드.
-
Qwen Qwen2.5 7B Instruct – 프롬프트 (prompt) ↑ $0.04 → $0.10 / 1M (+$0.06); 완료 (completion) ↑ $0.10 → $0.20 / 1M (+$0.10). 총 +$0.16 / 1M.
관심 대상: 이제 눈에 띄게 더 비싸진 경량 추론 (inference) 서비스.
오늘 추가되거나 제거된 모델은 없습니다.
사용 가능한 가장 저렴한 모델: inclusionAI Ling-2.6-flash ($0.01 / 1M 프롬프트, $0.03 / 1M 완료), IBM Granite 4.0 Micro ($0.017 / 1M 프롬프트, $0.112 / 1M 완료), Mistral Nemo ($0.019 / 1M 프롬프트, $0.03 / 1M 완료).
추적된 총 모델 수: 367개.
AI 자동 생성 콘텐츠
본 콘텐츠는 Dev.to AI tag의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기