Anthropic이 Claude의 추론 예산을 조용히 약화시키고 있지만 동일한 모델이라고 말하는 것에 대한 경고
요약
Anthropic의 Claude 모델 사용 분석 결과, 실제 호출에서 '생각 토큰(thinking tokens)' 할당이 급격히 줄어들고 있음이 확인되었습니다. 벤치마크와 달리 실제 중앙값 호출은 매우 낮은 수준을 보이며, 이는 모델의 잠재적 역량에도 불구하고 사용자에게 충분히 전달되지 못하고 있음을 시사합니다.
핵심 포인트
- 실제 Claude Code 호출에서 '생각 토큰' 할당이 급격히 감소하는 추세입니다.
- 벤치마크와 실제 사용 환경 간의 생각 토큰 사용량 격차가 크게 벌어지고 있습니다.
- 모델 자체의 역량은 유지되나, 서비스 제공 측면에서 제약이 발생하고 있을 가능성이 높습니다.
링크: https://x.com/Lon/status/2101034933284417614 43,000개 이상의 Claude Code 호출에 대한 65일 분석 결과, Fable 5 호출의 39%가 '생각 토큰(thinking tokens)'을 받지 못했으며, 중앙값 호출은 단지 123개였습니다. 반면 벤치마크에서는 16K-128K를 사용합니다. 모델당 생각 토큰 점수는 여전히 128K에서 상승하고 있어, 역량 자체는 존재하지만 전달되지 않고 있다는 의미입니다. 지난 8월은 7월 대비 생각 예산이 18~50% 감소했으며, 중앙값 생각이 8월 22일경 약 일주일 동안 문자 그대로 '0'에 도달했습니다. Anthropic은
AI 자동 생성 콘텐츠
본 콘텐츠는 r/ClaudeAI (top/week)의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기