
Claude 사용량이 한 시간 만에 끝난 이유: Pro, Max, Team 구독의 실제 구조
요약
Anthropic의 Claude 구독 플랜(Pro, Max, Team)이 메시지 수가 아닌 토큰 기반의 복합적인 한도 구조를 가지고 있다는 사실이 밝혀졌습니다. 이로 인해 실제 사용량이 광고된 배수보다 훨씬 적다는 불만이 제기되며 Anthropic을 상대로 한 소송이 진행 중입니다.
핵심 포인트
- Claude의 사용량 제한은 메시지 카운트가 아닌 토큰(token) 기반으로 계산됨
- 5시간 단위 윈도우와 주간 한도가 동시에 적용되는 이중 구조
- Claude Code 등 컨텍스트가 큰 작업 시 사용량이 급격히 소모됨
- 광고된 배수(5x, 20x)와 실제 체감 사용량 간의 괴리로 인한 소송 발생
5시간 단위의 윈도우(window)와 주간 한도는 메시지가 아닌 토큰(token)을 계산합니다. 이는 Max 플랜이 Pro 플랜보다 실제로 몇 배 더 유리한지에 대한 계산을 완전히 바꿔 놓습니다.
Claude Max를 20배 더 많이 사용하는 구독자 Karl Kahn은 Anthropic을 상대로 제기한 소송에서 다음과 같은 사례를 설명합니다: 단 한 번의 5시간 세션이 그의 주간 한도의 15%를 소모했습니다. 그의 계산에 따르면, Max 5x의 실제 추가분은 선언된 5배가 아니라 Pro 대비 약 3.5배이며, Max 20x는 20배 대신 6~8배에 불과합니다. 소송은 2025년 4월부터 Max를 구매한 모든 이들에게 환불을 요구합니다. Anthropic은 이에 대한 언급을 거부했습니다. 형식적으로는 반박할 내용이 없기 때문입니다. Pro 도움말은 무료 플랜 대비 "세션당 최소 5배 더 많은 사용량"을 언급하고 있으며, Max 도움말 역시 Pro 대비 5배 및 20배라는 상대적 배수 논리에 따라 약속을 구성할 뿐, 어떠한 절대적인 수치도 명시하지 않으며 작업량(volume of tasks)을 보장하지도 않습니다.
러시아 인터넷 사용자들은 가격표의 수치를 비교하기 위해 주로 "claude 구독"이라는 키워드로 검색하곤 합니다. 하지만 여기서 가격은 부차적인 문제입니다. 핵심은 메커니즘입니다: 2026년부터 Claude의 한도는 메시지 카운터가 아니라, 두 가지 수준에서 동시에 적용되는 토큰 예산입니다. 즉, 이동하는 5시간 단위의 윈도우(window)와 그 위에 얹혀진 주간 한도(ceiling)가 존재하며, 이 둘은 claude.ai의 채팅, Claude Code, Cowork는 물론 CLI와 데스크톱 앱 모두에 공통으로 적용됩니다. 한 번의 긴 에이전트(agent) 실행이 일반적인 하루 분량의 대화보다 더 많은 양을 소모할 수 있으며, 남은 양을 미리 파악하는 것은 공식적으로 불가능합니다. Anthropic은 도움말에서 기존의 가이드라인을 삭제했습니다 — "Max 5x의 경우 5시간 동안 225개 메시지, Max 20x의 경우 900개 메시지"라는 내용은 이제 404 오류 페이지로 연결됩니다.
왜 한 시간이 하루보다 더 많이 소모되는가
Pro 플랜의 제한은 두 단계로 구성됩니다. 첫 번째 메시지부터 시작되는 5시간 단위 세션과, 그 위에 적용되는 모든 모델에 대한 주간 상한선(weekly ceiling)입니다. Max 플랜의 경우 주간 제한이 하나가 아니라 두 개입니다. 모든 모델에 적용되는 공통 제한과 Sonnet에만 국한된 별도의 제한이 있습니다. 즉, Sonnet 할당량(quota) 내에 있더라도 전체 예산에 도달할 수 있고, 그 반대의 경우도 가능합니다. 구조에 대한 설명은 도움말에 나와 있지만 구체적인 수치는 명시되어 있지 않습니다. 사용량은 웹 채팅, IDE, 또는 터미널 중 어디에서 작업하든 상관없이 하나의 카운터로 계산됩니다.
다음은 왜 "한 시간 만에 다 썼다"는 느낌을 받게 되는지에 대한 구체적인 이유입니다. Claude Code는 새로운 메시지를 보낼 때마다 대화 기록 전체를 전송하므로, 아침부터 열어둔 세션에서 던지는 짧은 질문 하나가 지금까지 쌓인 전체 컨텍스트(context) 비용으로 처리됩니다. 비용 관리 문서에서는 세 가지 가속 요인을 더 언급합니다. 첫째, 구독 모델에서 1시간 이상의 휴식 후 발생하는 캐시 미스(cache miss)입니다 (usage credits 및 API 캐시는 단 5분 동안만 유지됩니다). 둘째, 유휴 세션(idle session)에서의 백그라운드 예약 작업(scheduled tasks), 셋째, 압축하려는 내용을 다시 읽어들이는 /compact 명령어 자체입니다. 별도로, 에이전트 팀(agent teams) 기능이 있습니다. 이 기능은 실험적 기능으로 기본적으로 비활성화되어 있으며 CLAUDE_CODE_EXPERIMENTAL_AGENT_TEAMS=1 플래그를 통해 활성화해야 하므로, 일반 구독자의 일반적인 세션 산식과는 무관합니다. 하지만 이 플래그를 설정한 사용자들에게는 양상이 다릅니다. 여러 팀원이 플랜 모드(plan mode)에서 병렬로 작업할 때, 각자 고유한 컨텍스트와 모델 복사본을 가지게 되며, 최소 한 명의 팀원이 활성 상태인 동안 총 사용량은 일반 세션 대비 약 7배까지 치솟습니다. 여기에 7월 24일 출시된 Opus 5(Max 플랜의 기본 모델)가 더해지는데, 여기서 공백이 발생합니다. 이 모델이 구독 제한 소모 속도에 정확히 어떤 영향을 미치는지에 대해 Anthropic은 게시일 기준으로 어디에도 명시하지 않았습니다.
누가 옳은가: Anthropic 엔지니어인가, 원고인가
Anthropic의 입장은 2026년 3월, Claude Code의 엔지니어 Thariq Shihipar를 통해 나왔습니다. 그는 새로운 피크 세션 제한(peak session limits)이 약 7%의 사용자에게만 체감될 것이라고 말했습니다. 이 수치에 반대하는 것은 Forbes 칼럼니스트 John Koetsier가 수집한 사례들입니다. 한 프롬프트가 $100짜리 5시간 제한의 37%를 소모하거나, 5시간 분량의 할당량이 단 몇 시간 만에 바닥나는 경우 등이 있습니다. Koetsier 본인의 입장은 정직합니다. 자신의 계정에서는 여전히 남은 제한 용량이 있었기 때문에, 그 효과는 불균일하며 단순히 요금제(plan)뿐만 아니라 개별 사용자의 부하(load)에 따라 달라진다는 것입니다.
세 번째 목소리는 비대칭성을 더합니다. 법률가이자 IT 전문가인 J.D. Hodges는 제한 변경 사항의 연대기적 기록을 다루면서, Claude Code를 상위 요금제에서 사용한 자신의 경험이 '온라인에서 설명하는 것보다 눈에 띄게 좋다'고 직접 작성했습니다. 그는 이 격차의 원인을 설명할 수 없으며, 계정 우선순위(account prioritization) 가설을 추측으로만 언급합니다. 이는 논쟁을 해결하지는 못하지만, 가장 중요한 실질적인 결론을 뒷받침합니다. 즉, 결정하는 것은 요금제의 명목상 금액이 아니라 부하 프로필입니다. 얼마나 많은 장기 세션(long sessions), agent teams 및 MCP 서버를 사용했는지, 그 숫자가 가격표의 숫자보다 중요하다는 것입니다。
Anthropic의 문구 옹호론자들에게는 실질적인 논거가 있습니다. "세션당 5배/20배"라는 상대적 배수는 구성이 동일한 세션에 대해서는 수학적으로 정확하며, 이는 Max 플랜으로 전환하여 에이전트 팀(agentic teams), 팀원(teammates), 긴 컨텍스트(long contexts)를 돌리기 시작하며 부하 프로필(load profile)을 변경한 사용자들의 체감과는 차이가 있을 뿐입니다. 또한 2026년의 기본 용량은 실제로 증가했습니다. 5월 6일, Anthropic은 Pro, Max, Team 및 Enterprise 사용자를 위해 Claude Code의 5시간 제한을 두 배로 늘리고 피크 타임 축소를 제거했습니다. 이를 위해 SpaceX로부터 300MW 이상의 전력과 220,000개 이상의 GPU를 확보했습니다. Claude Code의 주간 제한은 최소 8월 19일까지 +50%로 유지되며, 이 상향 조치는 이미 두 차례 연장되었습니다.
이는 Ken Ish의 주장을 약화시키지만 완전히 반박하지는 못합니다. 기본 용량이 두 배로 늘어났음에도 불구하고, Max 플랜의 사용자 한 명이 20배를 사용했을 때 단 한 번의 세션으로 주간 할당량의 15%를 소진했기 때문입니다. 또한 5월과 7월의 관대함은 특정 날짜에 종속된 일시적인 것으로 설명된 반면, 마케팅에 사용된 배수(multipliers)는 영구적입니다. 투명성에 대한 불신의 전례도 존재합니다. 지난 1월, 한 고객은 연휴 기간의 두 배 적용 이후 토큰 제한이 60% 급감했다고 주장했으나, Anthropic은 할당량이 단순히 기본값으로 돌아간 것이라고 주장했습니다. 당시에도 외부에서 확인할 방법이 없었듯, 지금도 마찬가지입니다.
"업그레이드 전 측정" 프로토콜
자신의 계정에 대한 유일한 진실의 원천은 Claude Code의 /usage 명령입니다. 이 명령은 플랜의 대역폭, 스킬(skills), 서브 에이전트(sub-agents), 플러그인(plugins) 및 MCP 서버별 내역을 보여주며, 최근 소비의 10% 이상을 차지한 항목을 강조 표시합니다. 키보드 d(일 단위)와 w(주 단위) 키로 창을 전환할 수 있습니다. Max 플랜 비용을 지불하기 전에, 일주일 동안 매일 한 번씩 이 명령을 실행하여 기록을 남기십시오.
| 요일 | 기록할 내용 | 결정 기준 임계값 |
|---|---|---|
| 월–일 | 일일 종료 시점의 주간 한도(weekly ceiling) 도달 비율 | 처음으로 한도에 도달한 요일 |
| ... |
한도가 금요일 이전에 도달하거나, 에이전트 팀(agent teams)/MCP가 소비의 상당 부분을 차지하거나, 캐시 미스(cache misses)가 일회성이 아닌 시스템적인 문제라면 업그레이드가 정당화됩니다. 그렇지 않다면, 사용량 크레딧(usage credits)을 활성화하는 것이 더 저렴합니다 (Pro, Max 5x, Max 20x에서 사용 가능하며, 일일 한도는 $2000, API 요율에 따라 결제). 이 크레딧은 한도가 소진되기 전에 웹에서 미리 활성화해야 합니다. 모바일 앱에는 전환 스위치가 없습니다. 비용 기준: Anthropic의 기업용 배포(corporate deployments)의 경우, 활성일 기준 개발자당 평균 지출은 약 $13, 월 $150–250 수준이며, 사용자 90%는 하루 $30 미만을 사용합니다. 이는 API 비용이며 Max 구독 가격과 직접적으로 동일한 것은 아니지만, $100 및 $200 구독 모델과 비교할 수 있는 유용한 지표입니다.
API 요율에 따른 추가 지불이 부담스럽고, 초안 번역, 요약, 코드에 대한 세컨드 오피니언(second opinion) 등 일부 작업이 반드시 Claude를 통할 필요가 없다면, 이러한 작업들은 별도의 구독 없이 다른 모델로 돌릴 수 있습니다. OpenAI 프로토콜을 지원하는 클라이언트는 base URL과 키를 변경하여 provod.ai에 연결할 수 있으며, 이를 통해 각 벤더의 탭을 전환하는 대신 하나의 인터페이스에서 모델 간 비교를 수행할 수 있습니다.
Team 플랜이 제공하는 것과 8월 19일에 변화하는 점
Team 플랜의 메커니즘은 동일하지만, 예산이 사용자(seat)에 귀속된다는 점이 다릅니다. 5시간 및 주간 윈도우(window)가 사용자별로 슬라이딩되며, 채팅, Claude Code, Cowork에 대한 공통 카운터가 적용됩니다. 할당량의 크기는 Standard 또는 Premium과 같은 사용자 유형에 따라 달라지며, Anthropic은 이 수치를 공개하지 않습니다. 팀 전체를 위한 공통 풀(pool)은 없습니다. 즉, 한 개발자가 이틀 연속으로 한도를 다 써버리고 다른 개발자는 몇 주 동안 Claude를 사용하지 않더라도, 그 용량을 서로 옮길 수 없습니다. 다양한 모델에 대해 사용자별 엄격한 귀속이 아닌 공통 카운트를 원하는 일부 팀에게는 provod.ai와 같이 역할 및 비용 제어를 통해 조직적 균형을 맞추는 모델이 더 적합합니다. 이는 Team 플랜 내 Claude Code의 에이전트 기능을 대체하는 것이 아니라, 반드시 Claude일 필요가 없는 작업 때문에 두 번째 사용자(seat)를 구매하지 않기 위한 방법입니다.
기억해야 할 세 가지 날짜가 있습니다. 8월 19일은 Claude Code의 주간 한도를 50% 상향 조정한 연장 기간이 종료되는 날입니다. 만약 세 번째 연장이 이루어지지 않는다면, 현재의 모든 용량 계산을 처음부터 다시 해야 합니다. "Fable 5 — 주간 한도의 50%를 초과하지 않음" 규칙은 7월 20일부터 적용되며 오직 이 모델에만 해당됩니다. 그리고 가장 중요한 점은, Max 플랜에서 Opus 5가 기본값으로 설정됨에 따라 구독 예산 소진 속도에 미치는 영향이 어디에도 설명되어 있지 않다는 것입니다. 이는 이 모든 주제에서 가장 최신이며 검증되지 않은 변수이며, 공식 수치가 나오기 전까지 이를 추적할 수 있는 유일한 방법은 활발한 사용 전후의 /usage를 확인하는 것뿐입니다.
provod.ai — AI를 테스트 단계에서 지속적인 프로세스로 전환하세요
모델이 일상 업무의 일부가 될 때, 통합된 액세스, 명확한 결제, 호환 가능한 API가 중요합니다: 이 플랫폼은 팀과 비즈니스를 위해 이러한 요소들을 하나로 결합합니다.
하나의 카탈로그에서 텍스트 및 미디어용 최신 모델을 확인하세요: OpenAI의 GPT, Anthropic의 Claude, Google의 Gemini, xAI의 Grok, DeepSeek, Qwen, GLM, Kimi 및 MiniMax가 포함됩니다. 이미지의 경우 Nano Banana 2 Pro 및 GPT Image를, 비디오의 경우 Seedance, Kling, Veo 및 Google Omni의 최신 버전을 제공합니다. 또한 추론(reasoning), 검색, 문서, 임베딩(embeddings), 음악 및 오디오를 위한 모델도 사용할 수 있습니다.
지속적인 운영은 투명한 가격 책정을 기반으로 합니다: provod.ai는 자체적인 추가 마진 없이 공식 모델 요금을 1:1로 전달합니다.
업무용 AI 컨투어(AI-contour)를 구축하세요: 등록 양식 · 모델 가격 · 152-FZ에 따른 데이터 보호 · provod.ai 메인
출처
AI 자동 생성 콘텐츠
본 콘텐츠는 Dev.to AI tag의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기
