OpenAI의 새로운 Codex 데스크톱 앱을 테스트해봤습니다. 진짜 제품은 UI입니다
요약
OpenAI의 새로운 Codex 데스크톱 앱을 테스트한 후기를 공유하며, 진정한 제품은 UI에 있다고 강조합니다. 이 인터페이스는 AI 코딩 에이전트가 필요한 기능을 직관적으로 통합하여 개발 워크플로우의 마찰 지점을 제거하는 데 초점을 맞추고 있습니다.
핵심 포인트
- Codex 앱을 통해 AI 코딩 에이전트를 평가하고 테스트했습니다.
- 진정한 혁신은 IDE나 챗봇이 아닌, 사용자 경험(UI)에 있다는 점을 강조합니다.
- Git 작업, 터미널/IDE 토글 등 개발자가 자주 사용하는 기능을 통합했습니다.
- AI 기반 실행 제어 기능과 자동화가 주요 개선점입니다.
OpenAI의 새로운 Codex 데스크톱 앱을 테스트해봤습니다. 진짜 제품은 UI입니다
저는 항상 시작하는 방식으로 시작했습니다: 도구에 자체 설정을 디자인하도록 하는 것입니다.
AI 코딩 에이전트를 평가하려면, 먼저 스스로 작동하게 만들어야 합니다. Codex는 통과했습니다. 그것은 자신의 전체 에이전트 기능 범위를 끌어내어 제가 요청한 메모를 생성했습니다.
그리고 제가 기다려온 것을 주었습니다: Cursor에서 파일을 열 수 있는 직접적인 링크입니다.
이렇게 사소한 것. 저는 터미널이 몇 주 동안 이것을 해주기를 바랐습니다.
하지만 너무 흥분하지 마세요. 링크는 80%의 경우에 깨져 있습니다.
UI가 이야기입니다
오른쪽 상단 바를 보세요. 이것은 IDE가 아닙니다. 챗봇도 아닙니다.
이것은 제가 본 최초의 진정한 에이전트 네이티브 인터페이스이며, AI와 코딩할 때 제가 가장 많이 찾는 것을 정확히 구현했습니다.
편리한 위치에 배치된 Git 작업(커밋, 푸시, 워크트리). 터미널 토글. IDE 토글. 세션당 여러 번 마주치는 모든 마찰 지점들이 매끄럽게 사라졌습니다.
그리고 제가 특별히 좋아하는 기능이 있나요? 환경 설정을 가진 버튼에서 AI 기반 실행 제어입니다.
자동화
자동화
제가 지금까지 가장 마음에 드는 부분입니다. Codex에게 저의 컨텍스트(기존 프로젝트, AI 설정, Claude Code 대화 등)를 기반으로 일일 자동화를 생성해 달라고 요청했습니다. Codex는 적절하게도 'Context drift radar'를 결정하고 채팅창에 깔끔한 'Create' 버튼과 함께 초안을 작성해주었습니다.
그리고 간단한 모달 창만 띄워져서, 제가 'Save' 버튼을 누르기만 하면 됩니다.
빈 칸에 제가 직접 타이핑하도록 요구하는 대신, 전체 자동화를 구축해준 점이 좋습니다. Automations 패널에서 클릭 한 번으로 자동화를 테스트할 수 있으며, 새로운 대화와 이에 상응하는 작업 공간(worktree) 생성이 원활하게 트리거됩니다.
스킬 (Skills)
스킬을 사용하면 Codex의 기능을 코드 생성 이상으로 확장할 수 있습니다. 지침, 리소스, 스크립트를 재사용 가능한 패키지로 묶어두면, Codex가 자동으로 또는 명령에 따라 이를 가져와 사용합니다.
저는 Claude Code 명령어 중 하나를 Codex Skill로 변환했습니다. 제가 할 일은 단지 요청하는 것이었습니다.
openai.yaml 형식으로 깔끔하게 UI에 바로 사용할 수 있는 항목이 생성되었습니다.
이 스킬 시스템은 복잡성을 존중한다는 점이 마음에 듭니다. 단순히 '보일러플레이트 코드 생성' 수준이 아니라, 분기 로직을 가진 다단계 워크플로우인데도 Codex가 깔끔하게 처리합니다. 스킬이 앱, CLI(Command Line Interface), IDE 확장 프로그램 전반에 동기화되며, 팀 접근을 위해 레포지토리에 커밋할 수도 있습니다.
OpenAI는 내장된 스킬들(Figma, Linear, Vercel, 이미지 생성, 문서 작성)을 제공합니다. 하지만 진정한 가치는 사용자가 직접 가져와서 활용하는 데 있습니다.
모델 (Models)
현재로서는 Codex 모델만 사용할 수 있으며, 외부 모델에 대한 지원은 아직 없습니다(현재 UI 기준). ChatGPT 구독 계정 또는 API 계정 중 하나로 로그인할 수 있습니다.
GPT-5.2 Codex Medium을 사용해 봤는데, 모델이 ChatGPT 계정에서 지원되지 않는다는 오류가 발생했습니다. GPT-5.2 Codex Low로 변경했더니 훨씬 빠르게 응답했지만, 품질 저하가 매우 컸습니다. 첫인상은 Claude의 Haiku보다 떨어진다고 느꼈습니다.
개인화 (Personalization)
OpenAI는 두 가지 상호작용 스타일 중 선택할 수 있도록 제공합니다: 간결하고 실용적인(terse/pragmatic) 방식 또는 대화적이고 공감하는(conversational/empathetic) 방식입니다. 기능은 같지만 톤이 다릅니다.
저는 이를 실용적인 방식으로 설정했습니다:
"이것은 사려 깊은 자동화 프롬프트이며, 실제 리뷰 신호에 기반하기를 원한다는 점이 마음에 듭니다."
"함께 작업하기 좋은 프롬프트이고, 이미 흐름을 다듬을 수 있는 몇 가지 고효율 지점을 발견할 수 있습니다."
이는 실용적이라기보다는 '따뜻하고 협력적이며 도움이 되는' 느낌이 훨씬 강합니다.
저는 이를 저만의 시스템 프롬프트로 조정할 것이지만, 그들이 정확히 두 가지 옵션에 도달한 후 그 구분을 명확히 하지 않은 점이 재미있습니다.
문제점 (The Catch)
UI는 흥미롭습니다. 모델은 그렇지 않습니다.
GPT-5.2 Codex Medium은 일관되게 작동하지 않습니다. 이것은 완전히 새로운 것이므로 어느 정도의 여유는 필요합니다. 하지만 GPT-5.2 Codex Low는 실제 코드 생성에 부적합하다는 점을 빠르게 드러냈고, 저에게 남은 선택지는 매우 적었습니다.
이것이 의미하는 바 (What This Means)
OpenAI가 중요한 것을 출시했습니다: 마침내 AI 네이티브 개발을 위해 설계된 것처럼 보이는 인터페이스입니다. 챗봇 패러다임이 깨지고 있습니다.
UI 디테일에 대한 구현은 날카롭습니다. Git 통합, 환경 제어, diff 보기; 이것들은 기능이라기보다는 장애물의 제거입니다. 그리고 자동화는 깔끔합니다. 이것이 부족했던 부분이며, 저는 후크(hooks), 명령어, 온갖 종류의 패치로 이를 우회해 왔습니다. 모든 것이 내장되어 있다는 점에 감사드립니다.
하지만 저는 오랫동안 ChatGPT의 목소일에 지쳤었고, 그것이 여기서 전면적으로 돌아왔습니다. 심지어 '실용적 모드(pragmatic mode)'도 도움이 되지 않았습니다. 모델은 목소리와 실행 품질 모두에서 개선이 필요합니다.
현재 저의 평가는 이렇습니다: 워크플로우 자동화에는 Codex를 사용하세요. 모델을 테스트하고, 그것들이 무엇을 할 수 있고 무엇을 할 수 없는지 실험해 보세요.
진짜 신호는 오늘날 이 도구가 무엇을 할 수 있느냐가 아닙니다. OpenAI가 마침내 챗봇이 애초에 잘못된 틀이었음을 인정하는 UI를 구축했다는 사실입니다.
AI 자동 생성 콘텐츠
본 콘텐츠는 Dev.to AI tag의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기







