
Codex vs Claude Code: 1,828개의 게시글과 리뷰가 사용자 수 데이터가 말해주지 못하는 것을 보여주는 방식
요약
Codex와 Claude Code의 사용자 수 지표를 Reddit 댓글과 브라우저 확장 프로그램 리뷰를 통해 분석한 결과입니다. 단순 사용자 수보다는 비용, 할당량, 신뢰성 등 실무적인 이슈가 사용자 경험의 핵심임을 보여줍니다.
핵심 포인트
- 사용자들은 코드 품질보다 비용, 할당량, 신뢰성에 더 집중함
- Anthropic의 Claude 확장 프로그램은 높은 설치 기반에도 불구하고 낮은 평점을 기록함
- OpenAI의 사용자 수 발표는 제품을 합산한 수치로 프레이밍되어 있음
- GitHub 지표(Stars, Forks)에서는 Claude Code가 Codex보다 앞서 있음
핵심 요약 (Key takeaways)
- 완전히 독립적인 두 개의 코퍼스(Corpora) — 427개의 Reddit 댓글과 806개의 제1자 브라우저 확장 프로그램(browser-extension) 리뷰 — 모두에서 코드 품질(code quality)은 가장 적게 논의된 주제였습니다. 각각 427개 중 5회, 806개 중 3회 언급되었습니다. 개발자들은 어떤 에이전트가 더 나은 코드를 작성하는지가 아니라 비용, 할당량(quotas), 로그인 및 신뢰성에 대해 논쟁하고 있습니다.
- Anthropic의 Claude 확장 프로그램은 우리가 발견한 제1자 AI 브라우저 확장 프로그램 중 가장 큰 설치 기반(1100만 명의 사용자)을 보유하고 있지만, 가장 낮은 평점(2.71, 53%가 별점 1개 리뷰)을 기록했습니다. OpenAI의 두 확장 프로그램은 합계 600만 명의 사용자를 보유하고 있으며 평점은 각각 3.33과 3.71입니다. 설치 기반이 클수록 리뷰의 분노도 커지는 경향을 양방향 모두에서 보였습니다.
- 2026년 7월 9일, OpenAI는 Atlas 사이드바를 대체하며 ChatGPT Chrome 확장 프로그램을 Codex for Chrome으로 전환했습니다. 리뷰어들은 이를 주목했습니다: 최근 166개의 리뷰 중 52개가 Codex를 언급했으며, 많은 이들이 자신이 선택하지 않은 제품에 대해 분노하고 있었습니다. 이것이 800만 명의 활성 사용자라는 번들(bundled) 수치가 내부에서 어떻게 보이는지에 대한 모습입니다.
- 두 도구가 직접 비교 가능한 형태로 노출하는 유일한 지표인 GitHub에서는 Codex가 아닌 Claude Code가 앞서고 있습니다: 별(stars)은 137,890 대 98,105, 포크(forks)는 22,235 대 14,628입니다. 이는 헤드라인과는 반대되는 결과이지만, 두 리포지토리(repositories)가 서로 다른 것을 담고 있으며, 왜 이것이 중요한지는 아래에서 설명하겠습니다.
- 이 중 어느 것도 승자를 가려내지 못하며, 그것이 바로 이번 조사 결과입니다. 벤더(Vendor)의 사용자 수는 검증이 불가능하며, 독립적인 코퍼스는 실무자들이 대체로 더 이상 묻지 않게 된 질문을 설명하고 있습니다.
2026년 7월 14일, OpenAI의 Thibault Sottiaux는 Codex가 800만 명의 활성 사용자(active users)에 도달했다고 게시했습니다. 이는 3일 동안 세 번째로 발표된 수치였습니다 — 7월 12일 600만 명, 7월 13일 700만 명, 7월 14일 800만 명 — 그리고 이전의 두 수치와 마찬가지로, 두 제품을 합산한 명시적인 수치였습니다:
"안녕하세요. Codex와 ChatGPT Work를 합쳐 800만 명의 활성 사용자에 도달했습니다."
— @thsottiaux, 2026년 7월 14일
우리는 어제 그 수치의 프레이밍을 팩트 체크했습니다: 해당 수치는 Codex를 ChatGPT Work와 묶어서 계산하고 있으며, 비교 대상이 되는 "Claude Code 200만 명"이라는 기준점은 날짜가 명시되지 않은 오래된 스냅샷(snapshot)입니다. 해당 포스트는 그 수치가 헤드라인에서 말하는 의미를 갖는지에 대해서는 답했습니다. 하지만 그 이면에 깔린 질문, 즉 **Codex가 실제로 Claude Code를 이기고 있는가?**에 대해서는 답하지 않았습니다.
그래서 우리는 그 질문에 답하기 위해 노력했습니다. 보도 자료가 아니라, 두 회사 모두가 통제할 수 없는 코퍼스(corpora, 말뭉치)를 통해서 말이죠. 벤더(vendor)의 사용자 수는 구조적으로 위조가 불가능합니다. 즉, 감사(audit)하거나 재현하거나 분모를 확인할 수 없습니다. 반면 게시글, 댓글, 스토어 리뷰는 독립적이고, 타임스탬프(timestamp)가 찍혀 있으며, 데이터 마이닝(minable)이 가능합니다. 데이터가 말해주는 내용은 다음과 같습니다.
어떤 채널이 실제로 답을 줄 수 있는가 — 추측이 아닌 측정
Codex와 Claude Code는 커맨드 라인 도구(command-line tools)이므로, 스토어 데이터가 존재하지 않을 것이라고 추측하는 것이 본능적인 반응입니다. 그 본능은 절반은 맞고, 틀린 나머지 절반이 흥미로운 부분입니다.
모바일 스토어에는 실제로 Codex 앱도, Claude Code 앱도 존재하지 않습니다. 하지만 두 벤더 모두 많은 다른 소프트웨어를 출시하고 있으며, 우리는 그들의 스토어 등록 정보가 무관하다고 가정하는 대신, 각 코퍼스에서 코딩 에이전트(coding-agent) 신호를 직접 측정했습니다.
| 채널 | 퍼스트 파티(First-party) 존재 여부 | 코딩 에이전트 신호 (측정됨) | 사용 가능 여부 |
|---|---|---|---|
| iOS App Store | ChatGPT (8,592,629개 평점), Claude (199,486개) | 최근 리뷰 100개 중 1개가 Codex 또는 Claude Code를 언급 | 아니오 — 신호 약 1% |
| ... |
모바일 앱은 모든 사람이 범하는 범주 오류(category error)입니다. ChatGPT iOS 앱은 8,592,629개의 평점이 있고 Claude 앱은 199,486개의 평점이 있으며, 이 43:1의 비율이 이 논쟁의 증거로 인용됩니다. 우리는 양쪽 모두에서 최근 리뷰 100개를 추출했으며, 정확히 단 하나만이 코딩 에이전트를 언급했습니다. 해당 평점들은 소비자용 채팅을 측정하는 것이며, 이제 우리는 추측이 아닌 수치를 통해 이를 말할 수 있습니다.
Chrome 웹 스토어(Chrome Web Store)가 반전의 요소였으며, 알고 보니 그곳이 진짜 이야기가 숨겨진 곳이었습니다.
OpenAI는 ChatGPT 확장 프로그램을 Codex로 전환했습니다 — 그리고 사용자들은 이를 알아차렸습니다
두 업체 모두 공식 Chrome 확장 프로그램(extension)을 운영하고 있으며, 그 규모도 작지 않습니다:
| 확장 프로그램 (first-party) | 사용자 수 | 리뷰 수 | 점수 | 별점 1점 | 별점 5점 |
|---|---|---|---|---|---|
| Claude (Anthropic) | 11,000,000 | 1,306 | 2.71 | 53% | 24% |
| ... | |||||
![]() |
가장 중요한 것은 마지막 행입니다. OpenAI의 ChatGPT 확장 프로그램은 2026년 7월 9일에 업데이트되었습니다 — GPT-5.6 Sol이 출시된 것과 같은 날입니다 — 그리고 이것은 더 이상 진정한 ChatGPT 확장 프로그램이 아닙니다. 이것은 Chrome용 Codex이며, 사용자들이 설치했던 Atlas 사이드바(sidebar)를 대체했습니다. 사용자들은 즉각적으로 알아차렸습니다:
"이것은 Chrome용 ChatGPT가 아니라, Chrome용 Codex입니다"
"Atlas를 은퇴시키고 이것으로 대체하고 있군요"
최근 리뷰 166개 중 52개(31%)가 Codex를 언급하고 있으며, 이는 Codex에 대한 의미 있는 피드백이 포함된 유일한 first-party 스토어 말뭉치(corpus)임을 보여줍니다. 평점 프로필은 뚜렷한 양봉형(bimodal) 분포를 보입니다: 별점 5점이 56%, 별점 1점이 28%이며, 그 사이의 점수는 매우 적습니다. 코딩 에이전트(coding agent)를 원했던 사람들은 기뻐하고 있습니다. 브라우저 어시스턴트(browser assistant)를 돌려받길 원했던 사람들은 그렇지 않습니다.
이것은 단순히 Chrome 평점 이상의 의미를 갖습니다. 왜냐하면 이것이 번들링된 활성 사용자 수(active-user number)가 무엇으로 구성되어 있는지를 보여주는 가장 명확한 사례이기 때문입니다. OpenAI는 "Codex와 ChatGPT Work를 통틀어 800만 명의 활성 사용자"를 보고합니다. 그 사용자 중 일부는 선택하지 않은 Codex 인터페이스로 이동되어, 이곳의 별점 1점 리뷰에 남겨져 있습니다. 그러한 지표에서 교체에 의한 성장은 채택(adoption)에 의한 성장과 동일하게 계산됩니다 — 그리고 이 둘 중 하나는 Claude Code에 대한 경쟁 우위가 아닙니다.
Anthropic의 확장 프로그램은 더 규모가 크고 더 분노하고 있습니다
이 거울 이미지와 같은 발견은 정직함을 유지합니다. Anthropic의 Claude 확장 프로그램은 세 가지 중 가장 큰 설치 기반(1,100만 명)을 보유하고 있지만, 최악의 점수(2.71점)와 53%의 별점 1점 리뷰를 기록하고 있습니다. 만약 스토어 평점이 어느 회사가 승리하고 있는지에 대한 국민투표라면, Anthropic은 자신의 확장 프로그램에서 처참하게 패배하고 있는 셈입니다.
하지만 별점 1점 리뷰의 원인이 코드 품질(code quality) 때문도 아닙니다. 그것은 무한 루프에 빠지는 로그인, 권한 침해(permissions creep), 그리고 토큰(tokens)에 관한 것입니다:
"이 확장 프로그램은 저에게 묻지도 않고 claude에 의해 설치되었습니다"
"그들은 더 많은 돈을 벌기 위해 우리가 더 많은 토큰을 사용하기를 원합니다"
"Claude CLI는 이 플러그인의 존재를 완전히 무시합니다"
두 회사 모두 동일한 문제들, 즉 인증 마찰(auth friction), 비용, 그리고 아무도 요청하지 않은 배포 변경 사항들로 인해 사용자들로부터 처벌을 받고 있습니다. 두 회사 모두 나쁜 코드를 작성해서 처벌받고 있는 것이 아닙니다.
서로 관련 없는 영역에서 두 번 반복된 동일한 발견
우리는 두 말뭉치(corpora)에 대해 독립적으로 주제 분류(theme classification)를 실행했습니다. 806개의 1차 확장 프로그램 리뷰와 6개의 서브레딧(subreddits)에서 수집한 427개의 Reddit 댓글을 대상으로 했습니다. 결과는 동일하게 재현되었습니다:
| 주제 | 확장 프로그램 리뷰 (806개 중) | Reddit 댓글 (427개 중) |
|---|---|---|
| 신뢰성 / 버그 (Reliability / bugs) | 120 | 21 |
| ... |
코드 품질(Code quality)은 두 말뭉치 모두에서 가장 적게 논의된 주제이며, 그 격차는 매우 큽니다. 806개의 스토어 리뷰 중 언급은 단 3회였습니다. 427개의 Reddit 댓글 중에는 5회였습니다. 브라우저 확장 프로그램에 대해 불평하는 집단과 CLI 워크플로우에 깊이 몰입해 있는 집단이라는, 공통점이 전혀 없는 두 집단이 이 논쟁의 명목상 주제가 정작 아무도 언급하지 않는 주제라는 점에 독립적으로 동의하고 있습니다.
대신 그들이 제기하는 문제는 비용과 내부 구조(plumbing)입니다. 이는 할당량이 초기화되는 종량제 구독(metered subscriptions) 방식으로 가격이 책정된 제품들에게 일관된 양상을 보여줍니다. 동일한 800만 명의 사용자를 보유한 게시물에서도 두 번째 문장에서 사용량 제한(usage-limit) 초기화에 대해 언급하고 있습니다. 두 도구 모두 품질이 병목 현상이 되지 않을 정도로 충분히 훌륭해지면, 논쟁은 비용이 얼마인지, 그리고 로그인을 요구하는지 여부로 옮겨갑니다.
GitHub는 헤드라인과 정반대의 이야기를 합니다
두 도구 모두 공식적인 공개 저장소(public repository)를 가지고 있으며, 둘 다 활발하게 업데이트되고 있고, 누구나 몇 초 안에 확인할 수 있는 스타(star) 수를 보유하고 있습니다.
| 지표 (2026년 7월 15일) | Claude Code | Codex | 리더 |
|---|---|---|---|
| Stars | 137,890 | 98,105 | Claude Code, 1.41x |
| ... |
두 제품이 비교 가능한 공개 수치를 노출하는 유일한 측면에서, Codex는 앞서 있지 않습니다. 바로 "Codex가 승리하고 있다"는 헤드라인이 정점에 달했던 바로 그날에 말입니다.
우리는 이것이 결론이라고 가정하지 않을 것입니다. 왜냐하면 두 저장소는 동일한 종류의 객체가 아니기 때문입니다. openai/codex는 Apache-2.0 라이선스 하에 있는 실제 Rust 소스 코드입니다. 이를 읽고, 포크(fork)하고, 패치(patch)를 배포할 수 있습니다. 여기서의 스타는 "이 코드를 원한다"는 의미일 수 있습니다. 반면 anthropics/claude-code는 npm을 통해 배포되는 폐쇄형 소스(closed-source) 도구를 위한 이슈 트래커(issue tracker) 및 문서 저장소입니다. 여기서의 스타는 북마크에 더 가깝습니다. 이 둘은 서로 다른 행위이며, 단순한 비교는 이 차이를 뭉개버립니다.
정직한 해석은 좁은 범위 내에서 이루어져야 합니다. Codex가 여기서 앞서 있지 않다는 점은 "차이가 거의 나지 않는다"는 주장과 양립할 수 없습니다. 그렇다고 해서 이것이 Claude Code가 승리하고 있다는 증거가 되는 것도 아닙니다.
우리는 또한 두 저장소의 릴리스 주기(release cadence)를 측정하려고 시도했으며, 이는 진정으로 유용했을 것입니다. 하지만 릴리스 엔드포인트(releases endpoint)가 두 곳 모두에서 업스트림 오류(upstream errors)를 반환했기에, 추측하기보다는 해당 부분을 제외했습니다.
Reddit에서 두 도구를 모두 언급하는 스레드는 비교 글이 아닙니다
우리는 6개의 서브레딧(subreddit) — r/ClaudeCode, r/ClaudeAI, r/OpenAI, r/ChatGPTCoding, r/CodingLLM, r/Claudex — 에서 가장 최근의 게시물 100개씩을 추출했습니다. 총 495개의 게시물과 427개의 댓글을 수집했습니다.
먼저 방법론적인 참고 사항을 말씀드리자면, 그 자체로 하나의 발견이기도 합니다. Reddit의 검색 엔드포인트(search endpoint)로는 이 주제를 분리해낼 수 없습니다. "codex vs claude code"라는 쿼리는 "code"라는 단어에 느슨하게 매칭되어 Destiny 2 프로모션 코드 목록, VS Code 밈, 그리고 Arduino 프로젝트를 반환합니다. 이 논쟁에서 Reddit 검색 결과 수를 인용하는 사람은 모두 노이즈를 세고 있는 것입니다. 저희는 서브레딧(subreddit)을 하나씩 확인하며 도구 이름이 일치하는지 대조했습니다.
| Subreddit | 샘플링된 게시글 수 | 기간 | Codex 언급 | Claude Code 언급 | 둘 다 언급 |
|---|---|---|---|---|---|
| r/ClaudeCode | 100 | 7월 14–15일 | 12 | 40 | 10 |
| ... |
495개의 게시글 중 21개가 두 도구를 모두 언급했습니다. 저희는 이를 읽어보았습니다. 거의 대부분은 판결이 아니라 통합에 관한 질문이었습니다: "Codex와 Claude Code를 모두 사용하는 가장 좋은 방법은 무엇인가요?" 그리고 _"Claude Code 기반 워크플로우(workflow)에서 Codex가 유용한가요?"_와 같은 질문들입니다.
답변들은 충성도가 아니라 배관(plumbing, 시스템 연결)에 관한 것이었습니다. 둘 다 사용하는 가장 좋은 방법 스레드에서 개발자들은 ~/.claude/skills를 ~/.codex/skills로 심볼릭 링크(symlinking)를 걸고, Claude Code 내부에 OpenAI의 Codex MCP 서버를 등록하며, 두 에이전트(agent)를 동일한 작업 디렉토리(working directory)로 지정하는 방식을 설명합니다. 한 답변은 단순히 다음과 같습니다:
"가장 좋은 사용법: 둘을 함께 비벼서 사용하세요."
지배적인 패턴은 분업입니다. 한 에이전트가 계획을 세우면 다른 에이전트가 구현하거나 검토하는 방식인데, 특히 두 번째 모델이 첫 번째 모델이 놓치는 것을 잡아내기 때문입니다. Claude Code 워크플로우에서의 Codex 스레드에서는 다음과 같이 말합니다:
"그것은 그들이 어떻게 함께 작동하느냐의 문제입니다. 저는 둘 다 사용합니다."
그리고 더 직설적으로, 이 기사의 논지가 될 수 있는 댓글이 있습니다:
"Codex를 Fable과 일대일로 점수 매기는 것을 멈추세요."
이것이 보여주는 것과 보여주지 않는 것
우리가 유효하다고 생각하는 점: 코드 품질 (code quality)은 서로 관련이 없는 두 개의 말뭉치 (corpora)에서 가장 논쟁이 적은 주제였으며, 그 차이가 매우 컸습니다. 두 업체 사용자들은 대신 비용 (cost), 인증 (auth), 그리고 신뢰성 (reliability)에 대해 불만을 토로했습니다. OpenAI는 7월 9일에 자사의 ChatGPT 확장 프로그램을 Codex 인터페이스 (surface)로 전환했으며, 사용자 중 눈에 띄는 일부는 이에 대해 분노하고 있습니다. 이는 묶음 형태의 활성 사용자 (active-user) 성장과 경쟁력 있는 채택 (competitive adoption)이 동일한 것이 아니라는 직접적인 증거입니다. 비교 가능한 유일한 공개 지표에서는 Claude Code가 앞서고 있습니다. 공동 언급 (Co-mention) 스레드는 상호 운용성 (interoperability) 쪽으로 크게 기울어져 있습니다.
한계점:
AI 자동 생성 콘텐츠
본 콘텐츠는 Dev.to AI tag의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기
