
Codex가 Claude Code를 추월했을까? 700만 사용자 질문
요약
Codex의 활성 사용자가 6개월 만에 10배 급증하며 700만 명을 돌파했습니다. Claude Code의 매출 성장세와 비교하며, 코딩 에이전트 시장의 주도권 경쟁과 측정 지표에 따른 시장 해석의 차이를 다룹니다.
핵심 포인트
- Codex 사용자 수가 6개월 만에 60만 명에서 700만 명으로 급증
- GPT-5.6 출시 이후 단 하루 만에 100만 명의 신규 유입 발생
- Claude Code의 강력한 매출 성장 및 Anthropic의 시장 지배력 전망
- 코딩 에이전트 분야의 성장을 측정하는 지표의 중요성 대두
Codex가 Claude Code를 추월했을까? 700만 사용자 질문
Codex는 2026년 7월 13일에 활성 사용자 700만 명을 달성했습니다. 이는 올해 초 60만 명에서 증가한 수치입니다. 이는 6개월 만에 10배 급증한 것이며, 마지막 100만 명은 7월 9일 GPT-5.6 출시 이후 단 하루 만에 유입되었습니다. Latent Space는 모두가 생각하던 헤드라인을 던졌습니다: "Codex가 Claude Code를 추월했는가?"
한편, Polymarket 베터(bettors)들은 Anthropic이 최고의 AI 모델을 보유할 확률을 94.8%로 책정하고 있습니다. 이는 2,200만 달러의 거래량이 발생하는 시장으로, 실제 자금은 Claude의 모델 제품군이 전 세계 1위와 2위를 모두 차지하고 있다고 말하고 있습니다. Claude Code 자체는 2월까지 연간 매출 25억 달러를 달성했으며, Dario Amodei는 2026년 5월 Code with Claude 컨퍼런스에서 그들이 10배의 연간 성장을 계획했으며 1분기에 연간 80배 성장을 목격했다고 말했습니다.
그렇다면 무엇이 사실일까요? Codex가 Claude Code를 추월했을까요, 아니면 Claude Code가 모든 것을 추월했을까요? 답은 무엇을 측정하느냐에 따라 전적으로 달라지며, 이러한 측정값 사이의 차이가 현재 코딩 에이전트(coding agents) 분야에서 일어나고 있는 가장 흥미로운 현상입니다.

수치: 실제로 무슨 일이 일어났는가
Codex의 성장 궤적은 수직적이었습니다. 확인된 마일스톤과 재무 분석을 바탕으로 작성된 타임라인은 다음과 같습니다:
- 2026년 1월: 주간 활성 사용자 수 (Weekly Active Users) 약 600,000명
- 2026년 3월: 200만 명 (2월 데스크톱 앱 및 GPT-5.3 Codex 출시 이후)
- 4월 초: 300만 명
- 4월 21일: 400만 명
- 6월 2일: 500만 명 (AWS GA 발표에서 OpenAI가 확인)
- 7월 12일: 600만 명 (GPT-5.6 출시 촉매제)
- 7월 13일: 700만 명 (~24시간 만에 100만 명 증가)
- 7월 14일: 800만 명을 향해 추적 중
이는 5개월 만에 730% 급증한 수치입니다. 두 가지 핵심 변곡점이 이를 견인했습니다: Codex를 CLI 외부에서도 사용할 수 있게 만든 2월의 데스크톱 앱 출시, 그리고 컴퓨터 사용(computer use), 브라우저, Excel, 문서 등 범용 에이전트(general-purpose agent) 역량을 추가한 4월의 "Codex for (almost) Everything" 업데이트입니다. 이후 7월 9일 GPT-5.6 출시는 이 성장 곡선에 로켓 연료를 부었습니다.
Claude Code의 수치는 다른 이야기를 들려줍니다. 성장이 느린 것이 아니라, 성장의 성격이 다릅니다. 2026년 1분기에 Codex가 100만 명 미만이었던 반면, Claude Code는 420만 명의 주간 활성 사용자 수 (Weekly Active Users)를 기록했습니다. Anthropic의 지난 2월 공개 자료에 따르면, Claude Code는 $25억 달러의 연간 반복 매출 (Annualized Recurring Revenue)을 창출하고 있었으며, 이는 어떤 개발자 도구도 도달한 적 없는 가장 빠른 기록입니다. Anthropic은 그 이후 업데이트된 사용자 수에 대해 눈에 띄게 침묵을 지키고 있으며, 그 와중에도 Claude Code의 주간 제한을 5주 동안 세 차례나 상향했습니다. 한 분석가는 이를 두고 "예상치 못한 경쟁자에게 뒤처질 것이라고 생각지 못했던 실험실이 실시간으로 가격을 재조정당하고 있는 상황"이라고 평가했습니다.
주목해야 할 수치: Codex는 주간 활성 사용자 수 (WAU, Weekly Active Users)에서 앞서고 있습니다. Claude Code는 사용자당 매출 (Revenue per user)에서 앞서고 있습니다. 추정 사용자 수 400~500만 명에 연간 반복 매출 (ARR, Annual Recurring Revenue) 25억 달러를 기록 중인 Claude Code는 사용자당 연간 약 500달러를 창출합니다. 무료 또는 낮은 요금제를 사용하는 비개발자 사용자 20%로 인해 상승한 Codex의 사용자당 매출은 거의 확실히 그 수치의 일부에 불과할 것입니다. 사용자 수와 비즈니스 건전성은 동일한 지표가 아닙니다.
급증세가 보이는 것과 다른 이유
Codex의 성장 데이터에는 서사를 바꾸는 결정적인 세부 사항이 숨겨져 있습니다. GPT-5.6 출시가 단순히 코딩 사용자만을 추가한 것이 아니라는 점입니다. 7월 9일, OpenAI는 독립형 Codex 앱을 ChatGPT 데스크톱 앱으로 통합했고, 지식 노동자를 위한 새로운 에이전트 모드(agentic mode)인 ChatGPT Work를 출시했으며, Atlas 브라우저의 서비스를 종료(sunsetting)하기 시작했습니다 — 이 모든 일이 단 하루 만에 일어났습니다.
이는 700만이라는 숫자가 Claude Code 대신 Codex를 선택한 700만 명의 개발자를 의미하는 것이 아니라는 뜻입니다. 이는 기존 워크플로우에 Codex 기능이 내장된 700만 명의 ChatGPT 파워 유저를 의미합니다. OpenAI 자체 보고에 따르면 Codex 사용자의 20%는 프로젝트 매니저, 마케터, 자동화를 실행하는 분석가와 같은 비개발자 지식 노동자입니다. ChatGPT에 통합된 캐주얼 사용자들과 비개발자들을 제외하고 나면, "순수 개발자용 코딩 에이전트"로서의 비교 수치는 상당히 줄어듭니다.
반면, Claude Code는 터미널 우선(terminal-first) 방식입니다. 사용자는 이를 설치하고, CLAUDE.md를 설정하며, 훅(hooks)과 스킬 시스템을 학습해야 합니다. 모든 Claude Code 사용자는 스스로 그곳에 있기를 선택했습니다. 이러한 자기 선택(self-selection)은 다른 종류의 사용 패턴을 만들어냅니다 — 더 깊은 세션, 사용자당 더 높은 토큰 소비량, 그리고 그에 따른 25억 달러의 ARR로 이어집니다.

커뮤니티가 실제로 말하고 있는 것
이 주제에 대한 Hacker News 스레드는 시사하는 바가 큽니다. "Is Codex really on Par with Claude Code?" 스레드에서 사용자 d-lo는 다음과 같이 작성했습니다: "Claude Code (Opus 4.6) 대신 주로 Codex (GPT-5.4 high)로 전환했습니다" — 하지만 그 이유는 품질이 아닌 워크플로 (workflow) 때문이었습니다. Codex의 샌드박스 (sandbox) 모델은 작업을 던져두고 나중에 돌아와 검토할 수 있게 해주는 반면, Claude Code는 대화형의 상주 (interactive presence)를 요구합니다. 사용자 palguna26도 같은 점을 지적했습니다: 토큰 제약 (token constraints) 때문에 전환했지만, "Claude Code가 초기에는 더 우수한 코드 품질을 생성한다"는 점은 인정했습니다.
"Do you use Claude Code, Codex, or something else?" 스레드에서 magicalhippo는 새롭게 나타나고 있는 합의된 패턴을 다음과 같이 설명했습니다: "저는 Codex GPT 5.5 High로 브레인스토밍 (brainstorming)과 솔루션 설계 (solution design)를 하는 것을 좋아하고, 그다음 Claude Opus가 구현 (implementation)을 하도록 합니다." 이는 승자 독식 시장이 아닙니다. 이는 작업 라우팅 (task-routing) 시장입니다.

개발자 Mckay Wrigley는 X에서 이러한 변화를 더 직설적으로 포착했습니다: "코딩의 경우, 3개월도 안 되어 claude/gpt 비율을 80/20에서 gpt/claude 80/20으로 바꿨습니다. 솔직히 이 점이 놀랍네요." 하지만 그는 즉시 단서 조항을 덧붙였습니다: "코딩 이외의 에이전트 (agent) 작업에 대해서는 여전히 claude가 gpt를 압도합니다 (mogs)."

500개 이상의 Reddit 개발자 댓글 분석에 따르면, Claude Code는 36개의 블라인드 코드 품질 테스트 중 67%에서 승리했지만, Codex는 속도와 비용 효율성 면에서 압도했습니다. SWE-bench Verified에서는 Claude Code가 59%로 Codex의 56.8%를 앞섰습니다. 하지만 실제 CLI 워크플로우를 테스트하는 Terminal-Bench에서는 Codex가 77.3% 대 Claude Code의 65.4%로 압승했습니다. 벤치마크 자체도 누가 승리하고 있는지에 대해 의견이 일치하지 않습니다.
아무도 예상하지 못한 경쟁적 대응
Codex의 성장에 대한 Anthropic의 대응은 마케팅이 아닌 용량(capacity) 확장이었습니다. 5주 동안 세 차례에 걸친 제한 상향이 그 이야기를 증명합니다:
- 4월 16일: "Claude 2x" 프로모션 — 비피크 시간대(off-peak hours) 동안 일시적으로 용량을 두 배로 증설
- 5월 6일: 시간당 제한(hourly limits)을 영구적으로 두 배로 상향; Pro 및 Max 사용자에게 "피크 시간대(peak hours)" 개념 제거
- 5월 13일: 주간 한도(weekly caps) 50% 상향, 7월 19일까지 연장
이 세 번째 상향이 이루어진 것과 같은 날, OpenAI는 30일 이내에 Claude Code에서 전환할 의사가 있는 기업 고객에게 두 달간의 Codex 무료 액세스를 제공했습니다. 두 회사 모두 같은 날에 각자의 영역을 확보하기 위해 나섰으며, 어느 쪽도 물러서지 않았습니다.
하지만 OpenAI의 가장 놀라운 행보는 경쟁적인 것이 아니라 협력적인 것이었습니다. 7월 초, OpenAI의 Romain Huet는 Claude Code를 위한 오픈 소스 (open-source) Codex 플러그인을 발표했습니다: "Claude Code 사용자들이 코드 리뷰를 위해 Codex를 가져오고, 더 복잡한 작업을 위해 GPT-5.4를 사용하는 것을 보았습니다. 그래서 우리는 '그 과정을 더 쉽게 만들면 어떨까?'라고 생각했습니다. 우리는 개방형 생태계 (open ecosystem)를 사랑합니다!" codex-plugin-cc 저장소 (repo)를 사용하면 Claude Code 세션에서 직접 자동 코드 리뷰를 위한 /codex:review와 작업 위임을 위한 /codex:rescue를 실행할 수 있습니다.
이는 OpenAI가 Anthropic의 제품 내부에서 실행되는 플러그인을 출시한 것입니다. 메시지는 명확합니다. 우리는 승리하기 위해 Claude Code를 죽일 필요가 없습니다. 우리는 단지 개발자들이 작업하는 곳이라면 어디든 존재하기만 하면 됩니다.
역발상적 관점 (Contrarian take): "Codex가 Claude Code를 추월했는가"라는 프레임은 이미 시대에 뒤떨어졌습니다. OpenAI가 Claude Code를 위한 플러그인을 출시했다는 사실이 그 증거입니다. 기업들은 이미 기술 언론이 여전히 밀어붙이고 있는 '승자 독식 (winner-take-all)' 서사를 넘어섰습니다. 진정한 경쟁은 Codex 대 Claude Code가 아니라, 어떤 모델과 하네스 (harness)의 조합이 멀티 에이전트 워크플로우 (multi-agent workflow)에서 가장 가치 있는 작업을 획득하느냐의 문제입니다.
Polymarket의 역설 (The Polymarket Paradox)
여기 모두가 잠시 멈춰 서서 생각해야 할 차이점이 있습니다. Polymarket에서 실제 돈을 걸고 베팅하는 트레이더들 — $2,200만 달러 규모의 거래량 — 은 Anthropic이 최고의 AI 모델을 보유할 확률을 94.8%로 보고 있습니다. 단순히 최고의 코딩 모델이 아닙니다. 그냥 최고의 모델 말입니다. "두 번째로 좋은 AI 모델" 시장에서도 Anthropic의 확률은 90.5%입니다. 즉, 시장의 합의는 Claude가 세계 1위와 2위 자리를 모두 차지하고 있다는 것입니다.
"Codex의 사용자가 3배 더 많다"는 사실과 "Anthropic이 최고의 모델을 보유할 확률이 95%이다"라는 사실을 어떻게 조화시킬 수 있을까요? 두 가지 가능한 설명이 있습니다:
설명 1: 배포(Distribution)가 품질을 압도한다. Codex는 월간 사용자 수가 4억 명 이상인 ChatGPT에 번들로 포함되어 있습니다. 반면 Claude Code는 별도의 설치가 필요합니다. OpenAI는 모델의 품질과는 별개로 엄청난 배포 우위를 점하고 있습니다. 이는 Microsoft Office의 전략과 같습니다: 기본값(default)이 되는 것이 최고가 되는 것보다 더 가치 있습니다.
AI 자동 생성 콘텐츠
본 콘텐츠는 Dev.to AI tag의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기