
deepseek-ai/DeepSeek-V4-Flash-0731
요약
DeepSeek-V4-Flash-0731 모델이 출시되었습니다. 3,040억 개의 파라미터를 보유하고 있으며, 향상된 에이전트 능력과 압도적인 가성비를 바탕으로 높은 지능 대비 비용 효율성을 보여줍니다.
핵심 포인트
- 실질적으로 향상된 에이전트 능력(agentic capabilities) 보유
- 3,040억 개의 파라미터 규모로 체급 대비 뛰어난 성능 발휘
- 지능 대비 비용(value-per-intelligence) 측면에서 매우 높은 경쟁력
- Artificial Analysis 평가에서 MiniMax M3보다 높은 순위 기록
2026년 7월 31일 - Link Blog
deepseek-ai/DeepSeek-V4-Flash-0731 (via) "실질적으로 향상된 에이전트 능력 (agentic capabilities)"을 갖춘 DeepSeek V4 제품군의 최신 출시작입니다. 파라미터 수는 3,040억 개이며 Hugging Face에서 167GB 용량을 차지하지만, 체급을 훨씬 뛰어넘는 성능을 보여주는 것으로 보입니다.
Artificial Analysis는 이 모델을 428B 모델인 MiniMax M3보다 앞선 순위로 평가했습니다. 입력 100만 토큰당 $0.14, 출력 100만 토큰당 $0.27의 가격 책정은 이 모델이 현재 지능 대비 가성비(value-per-intelligence)가 가장 좋은 모델일 수 있음을 의미합니다. '지능 지수 대비 지능당 비용 (Intelligence Index vs. Cost per Intelligence Index)' 작업 차트에서도 매우 좋아 보입니다:

OpenRouter를 통해 기본 추론 수준 (default reasoning level)을 사용하여 펠리컨을 그려달라고 요청했을 때는 실망스러운 결과가 나왔습니다:

하지만 추론 수준 (reasoning level)을 'high'로 높였을 때는 훨씬 더 나은 결과물을 얻었습니다:
llm -m openrouter/deepseek/deepseek-v4-flash-0731 -t pelican -o reasoning_effort high

AI 자동 생성 콘텐츠
본 콘텐츠는 RSS: Simon Willison's Weblog의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기