The Token Ledger Digest – 2026-08-02
요약
Z.ai의 GLM 5.2와 DeepSeek V4 Flash의 API 가격 인하 소식과 NVIDIA Nemotron 3 Ultra의 가격 인상 소식을 다룹니다. 주요 AI 모델들의 토큰당 비용 변화를 통해 개발 및 운영 비용 최적화 정보를 제공합니다.
핵심 포인트
- Z.ai GLM 5.2 토큰 비용 약 63% 대폭 인하
- DeepSeek V4 Flash 0731 가격 36% 인하 및 최신 모델 추가
- NVIDIA Nemotron 3 Ultra 완성 토큰 비용 64% 인상
- 모델별 가격 변동에 따른 비용 민감형 애플리케이션 대응 필요
The Token Ledger Digest – 2026-08-02
가격 인하 – Z.ai: GLM 5.2
- Prompt (프롬프트): $0.76/1M에서 $0.28/1M로 하락 (-63%).
- Completion (완성): $2.39/1M에서 $0.89/1M로 하락 (-63%).
- 관련 대상: GLM 5.2에서 대규모 추론 (Inference) 또는 미세 조정 (Fine-tuning)을 수행하는 팀은 토큰당 비용을 약 3분의 2 절감할 수 있습니다.
가격 인하 – DeepSeek: DeepSeek V4 Flash 0731
- Prompt (프롬프트): $0.14/1M에서 $0.09/1M로 하락 (-36%).
- Completion (완성): $0.28/1M에서 $0.18/1M로 하락 (-36%).
- 관련 대상: 0731 체크포인트 (Checkpoint) 사용자는 플래시 스타일 (Flash-style) 워크로드에 대해 더 낮은 지연 시간-비용 트레이드오프 (Latency-cost trade-offs)의 혜택을 누릴 수 있습니다.
가격 인상 – NVIDIA: Nemotron 3 Ultra
- Prompt (프롬프트): $0.50/1M에서 $0.60/1M로 상승 (+20%).
- Completion (완성): $2.20/1M에서 $3.60/1M로 상승 (+64%).
- 관련 대상: 완성 작업 (Completion-heavy tasks)을 위해 Nemotron 3 Ultra에 의존하는 비용 민감형 애플리케이션은 눈에 띄게 높은 청구 금액을 보게 될 것입니다.
모델 추가 – DeepSeek V4 Flash Latest
- Prompt (프롬프트): $0.09/1M
- Completion (완성): $0.18/1M
- Context (컨텍스트): 1,048,576 토큰
- 관련 대상: 플래시 수준의 가격으로 초장기 컨텍스트 (Ultra-long context)가 필요한 개발자는 이제 이 최신 변형 모델을 사용할 수 있습니다.
추적된 총 모델 수: 337개.
AI 자동 생성 콘텐츠
본 콘텐츠는 Dev.to AI tag의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기