Token Ledger Digest – 2026-07-24
요약
2026년 7월 24일 기준 주요 AI 모델들의 토큰 가격 변동 사항을 정리한 리포트입니다. Qwen3.6 27B의 대폭적인 가격 인하를 포함하여 다양한 모델들의 프롬프트 및 완료 비용 변화를 다룹니다.
핵심 포인트
- Qwen3.6 27B의 프롬프트 및 완료 비용이 대폭 하락하여 비용 효율성 증대
- Ling-3.0-flash 모델이 무료로 제공되어 프로토타이핑에 유리
- Gemma 4 31B 및 GLM 5.2 등 주요 모델들의 가격 인하 추세
- MiniMax M2.7 모델의 경우 프롬프트 및 완료 비용이 상승함
Token Ledger Digest – 2026-07-24
가장 비용 영향이 큰 변화: Qwen: Qwen3.6 27B – 프롬프트 (prompt) 가격이 1M 토큰당 $0.60에서 $0.29로 하락하였고, 완료 (completion) 가격은 1M 토큰당 $3.60에서 $2.40로 하락했습니다.
추가 사항
- Ling-3.0-flash (무료) – 프롬프트 (prompt) $0.00 / 1M, 완료 (completion) $0.00 / 1M. 관심 대상: 비용이 들지 않는 실험이나 프로토타이핑 (prototyping)이 필요한 팀.
가격 변동
-
Tencent: Hy3 – 프롬프트 (prompt) $0.14 → $0.13 / 1M (−$0.01); 완료 (completion) $0.58 → $0.53 / 1M (−$0.05). 관심 대상: 지연 시간 (latency)에 민감한 작업에 Hy3를 사용하여 소폭의 비용 절감을 경험하는 사용자.
-
Z.ai: GLM 5.2 – 프롬프트 (prompt) $0.80 → $0.75 / 1M (−$0.05); 완료 (completion) $2.52 → $2.37 / 1M (−$0.15). 관심 대상: 대규모 GLM 5.2 워크로드를 실행하는 개발자.
-
MoonshotAI: Kimi K2.7 Code – 프롬프트 (prompt) $0.82 → $0.71 / 1M (−$0.11); 완료 (completion) $3.75 → $3.49 / 1M (−$0.26). 관심 대상: 낮은 토큰 비용의 혜택을 받는 코드 생성 (code-generation) 파이프라인.
-
Qwen: Qwen3.6 27B – 프롬프트 (prompt) $0.60 → $0.29 / 1M (−$0.31); 완료 (completion) $3.60 → $2.40 / 1M (−$1.20). 관심 대상: 대량 추론 (bulk inference)을 위해 이 모델을 사용하는 비용 민감형 팀.
-
Google: Gemma 4 31B – 프롬프트 (prompt) $0.12 → $0.10 / 1M (−$0.02); 완료 (completion) 변동 없음 $0.35 / 1M. 관심 대상: 프롬프트 절감이 중요한 가벼운 사용 (light-usage) 시나리오.
-
MiniMax: MiniMax M2.7 – 프롬프트 (prompt) $0.25 → $0.30 / 1M (+$0.05); 완료 (completion) $1.00 → $1.20 / 1M (+$0.20). 관심 대상: 이 변체(variant)의 비용 상승을 주목하는 예산 관리자.
-
Qwen: Qwen3.5-27B – 프롬프트 (prompt) $0.26 → $0.20 / 1M (−$0.06); 완료 (completion) $2.60 → $1.56 / 1M (−$1.04). 관심 대상: 상당한 완료 가격 인하를 경험하는 사용자.
-
Z.ai: GLM 5 – 프롬프트 (prompt) 변동 없음 $0.95 / 1M; 완료 (completion) $3.15 → $2.55 / 1M (−$0.60). 관심 대상: GLM 5에서 비용을 절감하는 완료 (completion) 중심 애플리케이션.
-
MiniMax: MiniMax M2 – 프롬프트 (prompt) $0.30 → $0.26 / 1M (−$0.05); 완료 (completion) $1.20 → $1.02 / 1M (−$0.18). 관심 대상: 프롬프트와 완료 모두에서 중간 정도의 절감을 경험하는 사용자.
-
OpenAI: gpt-oss-20b – prompt $0.03 → $0.03 / 1M (−$0.001); completion $0.13 → $0.14 / 1M (+$0.01). 관심 대상: 거의 중립적인 영향; 완료 (completion) 비용의 미세한 증가.
-
Qwen: Qwen3 Coder 480B A35B – prompt $0.30 → $0.38 / 1M (+$0.08); completion $1.00 → $1.55 / 1M (+$0.55). 관심 대상: 대규모 코드 모델 (large-code-model) 사용자들의 비용 증가.
-
Google: Gemma 3 27B – prompt $0.10 → $0.08 / 1M (−$0.02); completion $0.30 → $0.45 / 1M (+$0.15). 관심 대상: 트레이드오프 (Trade-off): 더 저렴해진 프롬프트 (prompt), 더 비싸진 완료 (completion).
현재 가장 저렴한 모델 (1M 토큰당)
- inclusionAI: Ling-2.6-flash – prompt $0.01, completion $0.03
- IBM: Granite 4.0 Micro – prompt $0.02, completion $0.11
- Mistral: Mistral Nemo – prompt $0.02, completion $0.03
추적 중인 총 모델 수: 343.
AI 자동 생성 콘텐츠
본 콘텐츠는 Dev.to AI tag의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기