2026년 Claude Code 대 Codex CLI: 어떤 구독을 선택해야 할까요?
요약
본 기사는 2026년 Claude Code와 Codex CLI의 요금 체계(metering system)를 비교 분석하며, 어떤 구독 모델이 개발자에게 더 적합한지 의사 결정 프레임워크를 제공합니다. Anthropic은 시간 기반 제한을 두는 반면, OpenAI는 토큰 크레딧 시스템을 사용한다는 점이 핵심 차이점입니다.
핵심 포인트
- Anthropic Claude Code: 5시간 단위 순환 창 및 주간 한도 등 '시간'에 비용 청구.
- OpenAI Codex CLI: 2026년 4월부터 모든 작업이 토큰 크레딧 시스템으로 전환됨.
- 시간 기반 제한은 긴 근무 시간에, 토큰 기반 제한은 읽고 쓰는 코드 양에 벌점을 부과함.
- 두 서비스는 가격대($20, $100, $200)가 대칭적이어서 비교가 용이함.
두 터미널 에이전트 모두 설치하는 데는 비용이 들지 않습니다. 둘 다 사용자가 방치하면 하루 만에 월간 플랜 전체를 소진할 수 있습니다. 그리고 2026년에는 Claude Code와 Codex CLI 중 어느 것이 더 스마트한 모델인지의 문제가 아니라, 어떤 방식의 요금 체계(meter)로 생활하고 싶은지에 대한 문제입니다.
왜냐하면 두 요금 체계가 현재 정말로 다르기 때문입니다. Anthropic은 시간 경과에 따라 제한을 둡니다: 5시간마다 초기화되는 사용 창과 주간 한도가 있습니다. OpenAI는 2026년 4월에 Codex를 크레딧 시스템으로 옮겼으며, 이 크레딧은 코스튬을 입은 토큰일 뿐입니다. 한쪽은 작업하는 시간에 대해 비용을 청구합니다. 다른 쪽은 에이전트가 읽고 쓰는 코드의 양에 대해 비용을 청구합니다.
저는 두 가지 모두에 대해 통제된 30일 체험을 진행하지 않았습니다. 다음 내용은 가격 책정 문서, 공개 사용 한도 가이드, 개발자 보고서에서 가져온 것이며, 주장이 의존하는 출처는 링크되어 있습니다. 이를 벤치마크가 아닌 의사 결정 프레임워크로 간주해 주십시오.
한눈에 보는 플랜 현황
두 도구 모두 각자의 부모 채팅 구독을 기반으로 작동합니다. 별도의 'Claude Code 플랜'이나 'Codex 플랜'은 없습니다.
Claude Code (Anthropic 측):
- Pro: 월 $20. 제3자 한도 추적기에 따르면, 5시간 단위로 순환하는 창으로 나뉘어 주당 Sonnet급 작업량의 약 40~80시간에 해당합니다.
- Max 5x: 월 $100. Pro 할당량의 5배입니다.
- Max 20x: 월 $200. Pro의 20배입니다.
- 모든 티어에서 모든 모델에 주간 한도가 적용됩니다.
Codex CLI (OpenAI 측):
- Go: 월 $8. 가벼운 사용량이며 클라우드 작업 위임 기능이 없습니다.
- Plus: 월 $20. 대부분의 개발자에게 기본 옵션입니다.
- Pro 5x: 월 $100. Plus 사용량의 5배입니다.
- Pro 20x: 월 $200. Plus의 20배입니다.
- 테스트용 무료 티어가 존재합니다.
대칭성은 우연이 아니며, 가격대가 동일하다는 점($20, $100, $200)은 비교를 그 어느 때보다 깔끔하게 만듭니다. 같은 돈으로 매우 다른 메커니즘을 사용합니다.
핵심 차이점: 시간 기반 대 토큰 기반
AI API 사용량 측정 방식: 시간제(Anthropic) 대 토큰제(OpenAI)
Anthropic은 활성 사용 시간에 제한을 둡니다. 일반적으로 보고되는 수치에 따르면 Pro는 주당 Sonnet 사용량이 약 40시간에서 80시간 정도이며, 여기에 5시간의 이동 평균 창(rolling window)이 추가됩니다. 만약 하루에 2시간씩 코딩한다면 시간 제한에 거의 도달하지 않을 것입니다. 하지만 토요일에 12시간 동안 리팩토링 마라톤을 한다면, 작업 자체가 작았더라도 이 한계에 부딪힐 수 있습니다.
OpenAI는 사용한 토큰(tokens)에 제한을 둡니다. 2026년 4월부터 모든 Codex 작업은 크레딧(credits)을 소모합니다. OpenAI의 자체 API 요율과 비교해 보면, 1 크레딧은 대략 4센트 정도의 가치를 지닙니다. OpenAI의 도움말 문서에 따르면, GPT-5.5에서 일반적인 작업 하나는 5~45 크레딧이 소모되며, 이는 같은 계획 내에서도 간단한 수정과 무거운 리팩토링 사이의 9배 차이를 보여줍니다.
이러한 차이는 어떤 요금제가 "더 관대하게 느껴지는지"를 바꿉니다. 토큰 미터는 10개의 코드를 작성하기 전에 40개의 파일을 읽은 에이전트(agents)에게 벌점을 부과합니다. 반면, 시간 미터는 작업의 크기와 상관없이 긴 근무 시간에 대해 사용자에게 벌점을 부과합니다.
실제 비용이 발생하는 지점
Codex의 요금표는 실질적인 계산을 할 수 있을 만큼 공개되어 있습니다. 이 계량기에는 세 가지 토큰 유형(입력, 캐시된 입력, 출력)이 사용됩니다.
- GPT-5.3-Codex: 백만 개의 입력 토큰당 43.75 크레딧, 백만 개의 출력 토큰당 350 크레딧 (출력 배율 8배).
- GPT-5.5: 백만 개의 입력 토큰당 125 크레딧, 백만 개의 출력 토큰당 750 크레딧 (배율 6배).
- 캐시된 입력은 모든 모델에서 신규 입력의 약 10%로 작동합니다.
마지막 문장이 이 시스템 전체에서 가장 큰 변수입니다. 컨텍스트를 재사용하는 것은 다시 불러오는 것보다 비용이 약 1/10 수준에 불과합니다. OpenAI 자체의 비용 가이드라인은 다른 각도에서 같은 점을 지적합니다. 즉, 부풀려진 AGENTS.md 파일은 모든 작업마다 토큰을 로드하므로, 이 파일을 다듬는 것이 이용 가능한 가장 저렴한 청구서 절감 방법입니다. 비슷한 논리는 세션에서 사용하지 않는 MCP 서버를 비활성화하는 것에도 적용됩니다.
Anthropic은 플랜 사용자에 대해 토큰당 등가 요율표를 공개하지 않습니다. 왜냐하면 이 플랜은 토큰 단위로 청구되지 않기 때문입니다. Claude Code에서 비용을 통제하는 요소는 다릅니다: 바로 모델 선택입니다. Sonnet 대신 Opus를 실행하는 것은 주간 할당량을 몇 배 더 빠르게 소진시키므로, 한도 안내가 모두 같은 조언을 반복하는 이유입니다: 기본적으로 Sonnet을 사용하고, 정말로 필요할 때만 Opus를 아껴두세요.
5시간 간격의 창이 진짜 결정 요소
이 글에서 단 하나만 기억한다면 이것으로 삼으십시오: 두 플랫폼 모두 사용량 창(usage window)은 5시간마다 재설정됩니다.
5시간 간격의 창과 주간 제한을 합치면, Claude Code는 특정 형태의 작업에 맞춰져 있습니다: 집중적인 세션, 한 번에 몇 시간 동안 진행하는 것, 하루에 여러 개의 세션을 거치는 것입니다. Pro 한도에 도달했다고 보고하는 개발자들은 거의 항상 마라톤 코더들입니다. 40시간 주말 스퍼트는 정확히 고갈되는 프로필입니다.
Codex의 크레딧은 사용자의 일정에 신경 쓰지 않습니다. 작업의 무게(task weight)에 신경을 씁니다. 아주 작은 수정 작업을 하루 종일 해도 Plus 한도에는 거의 영향을 미치지 못합니다. 하지만 전체 리포지토리를 읽는 단 하나의 마이그레이션 작업만으로도 주간 할당량의 눈에 띄는 부분을 한 번의 작업으로 소진시킬 수 있습니다. Codex 한도에 대한 GitHub 논의들은 몇 번의 대규모 세션을 가진 후 주간 제한에 도달한 개발자들로 채워집니다.
따라서 솔직한 질문은
- 작은 여러 작업 (버그 수정, 간단한 기능 추가, 코드베이스 관련 질문): Codex Plus가 더 유용합니다. 작은 작업들은 45 크레딧 상한선이 아닌 5~15 크레딧을 소모하기 때문입니다.
- 몇 가지 거대한 작업 (마이그레이션, 대규모 리팩토링, 전체 시스템 검토): 두 플랜 모두 어려움을 겪지만, Claude의 시간 기반 제한(throttle)은 적어도 큰 작업을 둘러싼 무제한의 작은 사고를 할 수 있게 해줍니다. Codex에서는 에이전트가 읽는 모든 파일에 비용이 청구됩니다.
- 장시간 자율 실행: 순수한 구조 면에서 Codex가 우위를 점합니다. 클라우드 작업 위임(task delegation)을 사용하면 인터랙티브 세션에 앉아 창을 소모하는 대신 백그라운드 작업을 맡길 수 있기 때문입니다. 참고로, Go에는 위임 기능이 포함되어 있지 않으므로 Plus 이상의 플랜이 필요합니다.
두 구독 모델보다 API가 우수한 경우
두 회사 모두 손익분기점을 찾을 수 있는 수치를 발표하며, 서드파티 계산기는 이 지점을 놀라울 정도로 낮은 곳에 위치시킵니다.
자체 API 키를 통해 Codex를 실행하면 크레딧이 완전히 건너뜁니다. 표준 토큰 요율로 GPT-5.3-Codex는 입력 토큰 100만 개당 $1.75, 출력 토큰 100만 개당 $14입니다. 일반적인 CLI 세션은 이 요율로 약 $0.50~$2.00 정도에 머무릅니다. 계산해 보면 API가 월간 1040회 세션 이하에서는 $20 Plus 플랜보다 우세한 경향을 보이며, 50200회 세션 이하에서는 심지어 $100 티어보다 나을 수도 있습니다. 이는 세션 가중치가 크게 달라지기 때문에 정확한 수치는 아니며 방향성을 제시하는 숫자입니다.
Claude의 유사 계산은 플랜이 측정(metered)되는 것이 아니라 제한(throttled)되기 때문에 더 불분명합니다. 실질적인 버전으로 말하자면, 점심시간 전에 Pro 창을 정기적으로 소진한다면, $100 Max 티어가 그렇지 않으면 실행했을 API 세션보다 비용이 적게 드는지 계산해 보세요. 대부분의 1인 개발자에게는 그렇습니다.
대부분의 비교에서 빠지는 보안 측면
만약 코드를 자율적으로 편집할 도구를 선택한다면, 가격 책정만큼이나 샌드박스(sandbox)가 중요합니다. 두 도구는 정반대의 베팅을 했습니다.
Codex CLI는 커널 레벨에서 샌드박싱을 수행합니다. macOS에서는 Seatbelt를 사용하고, Linux에서는 Landlock과 seccomp를 사용하여 애플리케이션 레이어 아래의 시스템 호출(syscalls)을 차단합니다. 세 가지 명시적 모드가 있습니다: 읽기 전용(read-only), 작업 공간 쓰기(workspace-write), 위험 접근(danger-full-access). 악성 에이전트는 허용하지 않은 파일 시스템 영역에 물리적으로 접근할 수 없습니다. 이 철학은 더 거친 제어(coarser control)를 가진 더 강력한 경계(stronger boundaries)입니다.
Claude Code는 후크(hooks) 레이어에서 샌드박싱을 수행합니다. 도구별로 세밀하고 패턴 기반의 허용 및 차단 목록(allow and deny lists)을 제공하며, 네트워크 허용 목록이 있는 샌드박스 Bash 모드를 지원합니다. 더 많은 제어 표면(control surface), 더 높은 프로그래밍 가능성(후크는 임의 스크립트를 실행할 수 있음)을 가지므로, 오설정(misconfiguration)에 대한 표면적도 더 넓습니다. 기본 경계가 약하고, 제어는 세밀합니다.
개인 기기에서 단독으로 작업하는 경우, 둘 다 기본 설정을 합리적으로 유지한다면 괜찮습니다. 하지만 프로덕션 자격 증명(production credentials)이 환경 변수에 포함된 저장소(repo)에 에이전트를 방치해야 하는 경우에는, Codex의 커널 레벨 차단 방식이 더 관대한 실패 모드입니다.
제가 실제로 할 일
위 모든 것을 고려했을 때, 이번 달에 구독을 선택할 친구에게 해줄 결정 경로는 다음과 같습니다:
- 시험 사용: 무료 등급(free tiers) 둘 다를 사용해보고, 비용 지출 없이 유료 맛보기를 원한다면 Codex Go($8).
- 예산 내 일상 작업용: 작업이 많은 소규모 태스크라면 Codex Plus($20), 긴 상호작용 세션에서 더 강력한 저장소 내부 추론 능력을 원한다면 Claude Pro($20).
- 대규모 단독 작업용: 5시간 연속 사용을 자주 한다면 Claude Max 5x($100), 태스크가 거대하고 토큰 소모가 심하다면 Codex Pro 5x($100).
- 경량 또는 간헐적 사용: 구독은 아예 건너뜁니다. 양쪽 모두 API 키를 사용하는 것이 좋으며, 대부분의 달에는 $20 미만을 지출할 가능성이 높습니다.
- 팀 전체 도입: 좌석(seat)이 아닌 측정 단위(meter)에 예산을 책정하세요. 플랜 가격은 절대 변하지 않습니다. 그 뒤에 있는 크레딧(credits)이 변합니다. 이것이 팀을 방심하게 만드는 부분이며, 재무 조사 결과도 이를 뒷받침합니다: 2026년 260명의 금융 리더를 대상으로 한 설문조사에서 46%가 AI 지출 관리를 가장 스트레스 받는 책임으로 꼽았습니다.
한 가지 실용적인 참고 사항이 더 있습니다. 두 도구 모두 충돌 없이 동일한 저장소에 공존합니다. Claude Code는 CLAUDE.md 파일을 읽고, Codex는 AGENTS.md 파일을 읽으며, 이 두 파일은 독립적입니다. 많은 개발자들이 둘 다 설치해 두고 프로젝트에 따라 구독을 번갈아 사용하며 비용을 지불합니다.
결론적으로
이 비교는 팬들의 전쟁(fan wars)이 암시하는 것보다 훨씬 가깝습니다. 왜냐하면 20달러라는 가격대에서 두 플랜은 서로 다른 품질 수준보다는 서로 다른 형태의 작업에 초점을 맞추고 있기 때문입니다. Claude Code는 5시간 단위로 보호된 시간을 판매합니다. Codex는 토큰을 판매하며, 사용자가 원하는 대로 사용할 수 있게 합니다. 가장 좋아하는 모델에 맞는 플랜이 아니라 자신의 일정표에 맞는 플랜을 선택하고, 구독료가 저렴한 옵션이라고 가정하기 전에 API 계산을 확인하세요.
그리고 어떤 것을 선택하든: AGENTS.md를 정리하세요. 미래의 청구서가 그 안에 숨어 있습니다.
지금 당장 일상적으로 사용하는 도구는 무엇이며, 실제로 사용량 제한에 부딪힌 적이 있나요? 5시간 간격 방식과 크레딧 미터 중 어느 것이 실제 사용자들에게 더 큰 제약으로 작용하는지 궁금합니다.
추가 자료:
- OpenAI Codex 플랜 및 가격: https://openai.com/codex/
- Codex 요율표: https://help.openai.com/en/articles/20001106-codex-rate-card
- Claude 플랜 및 사용 제한: https://support.claude.com/en/articles/11049741-what-is-the-max-plan
- Claude Code 사용 모범 사례: https://support.claude.com/en/articles/9797557-usage-limit-best-practices
AI 자동 생성 콘텐츠
본 콘텐츠는 Dev.to AI tag의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기