OpenAI Day 4 총정리: GPT-6.1 Sol의 최대 8배 Ultrafast 및 Codex 중간 지시 속도 향상
요약
OpenAI가 GPT-6.1 Sol에 'Ultrafast'라는 저지연 처리 모드를 도입하고, Codex의 실시간 방향 전환 기능(Near-instant steering)을 개선했습니다. 이는 모델 자체의 변화보다는 서비스 계층(service_tier) 변경으로, 출력 토큰 생성 속도를 최대 8배 향상시키는 것이 핵심입니다.
핵심 포인트
- GPT-6.1 Sol에 'Ultrafast' 저지연 처리 모드 도입
- 출력 토큰 생성 속도가 Standard 대비 최대 8배 빨라짐
- Codex에서 실행 중에도 지시를 보내 방향 전환 가능 (Near-instant steering)
- 속도 향상은 모델의 출력 부분에 국한되며, 전체 작업 시간 단축을 보장하지는 않음
OpenAI와 Codex의 '28일간 업데이트'를 앞으로도 매일 조사하여 전해드리겠습니다. 다음 내용이 궁금하신 분은 꼭 팔로우해주세요.
2026년 10월 8일(미국 시간), OpenAI의 '28일 동안 매일 개선 또는 리셋' 기획의 Day 4가 발표되었습니다.
이번에는 크게 두 가지 업데이트가 있습니다.
Day 4.1: GPT-6.1 Sol의 Ultrafast 모드 제공 시작 — API, Codex, ChatGPT Work에서 빠른 토큰 생성을 이용할 수 있음 -
Day 4.2: Near-instant steering — Codex가 실행되는 중에도 추가 지시를 통해 빠르게 방향 전환 가능
또한, 같은 10월 8일에 Codex CLI 0.162.0도 공개되었습니다. 이는 28일 기획의 번호가 매겨진 두 가지 사항과는 별개의 관련 릴리스로, 후반부에서 정리하겠습니다.
정보 기준일: 2026년 10월 9일(일본 시간). 본문에서는 OpenAI Developer Community, OpenAI API Changelog, 공식 요금표, ChatGPT Help Center, Codex Changelog를 확인했습니다. 모델이나 플랜의 제공 상황은 단계적으로 변경될 수 있습니다.
| 항목 | 변경 내용 | 주의점 |
|---|---|---|
| Ultrafast | GPT-6.1 Sol의 생성 속도가 Standard 대비 최대 8배 | |
| 작업 전체 완료 시간이 8배 빠르다는 보장은 아님 | ||
| API 요금 | 입력/출력 토큰 요금은 Standard 대비 6배 | |
| 속도 8배와 요금 6배를 혼동하지 말 것 | ||
| API 제공 | OpenAI API 사용자 전반에 제공 (레이트 제한 있음) | 구독 대상 플랜과는 다름 |
| Codex / Work | Pro $500, 대상 Enterprise・Edu에서 이용 가능 | Plus, Pro $100/$200, Business는 시작 시점에서 대상 아님 |
| Near-instant steering | 실행 중인 Codex에 보내는 지시에 대한 반응을 빠르게 함 | Queue와 달리 현재 실행에 지시를 넣음 |
| 관련 릴리스 | Codex CLI 0.162.0 공개 | Day 4의 번호가 매겨진 조치에는 포함하지 않음 |
Ultrafast는 새로운 GPT 모델의 이름이 아닙니다. 기존 모델에 대해 선택하는, **저지연 처리 모드(service tier)**입니다.
저지연이란 요청부터 처리 결과가 나오기 시작하거나, 중간 결과가 도착하기까지 걸리는 대기 시간이 짧다는 것을 의미합니다.
10월 8일 OpenAI API Changelog에는 gpt-6.1-sol의 Responses API에서
{
"model": "gpt-6.1-sol",
"service_tier": "ultrafast",
...
와 같은 지정으로 이용할 수 있다고 적혀 있습니다.
핵심은 model이 아니라 **service_tier**가 변경된다는 것입니다.
model: 어떤 AI로 생각하는가 -
service_tier: 어느 속도/처리 클래스로 그 모델을 실행할 것인가
기존 Standard와 비교하여, 출력 토큰을 생성하는 속도가 최대 8배라고 안내되었습니다.
이 부분을 오해하면 기대치가 크게 달라집니다.
OpenAI가 제시하는 것은 주로 생성 토큰 간의 시간, 즉 글이나 코드를 순서대로 출력하는 빠르기입니다.
예를 들어, Codex의 작업은 다음과 같은 여러 공정으로 구성됩니다.
요청을 읽음
↓
모델이 방침을 생각하고 생성함
...
Ultrafast가 빠른 것은 주로 모델의 출력 부분입니다.
따라서, 네트워크, 테스트 실행, CI 대기 시간, 외부 도구 실행 등이 지배적인 작업에서는 작업 전체가 반드시 8배가 되지는 않습니다.
마찬가지로, 추론 성능 자체가 8배가 된다는 의미도 아닙니다.
이들은 기본적으로 같은 모델을 다른 처리 속도와 요금으로 이용하기 위한 구분입니다.
Standard : 표준의 속도/요금
Fast : 속도를 우선하는 상위 모드
Ultrafast: 더욱 출력 속도를 우선하는 최상위 모드
'고속 모드니까 추론 설정을 High에서 Low로 변경해야 한다'는 이야기도 아닙니다. 모델이나 추론 설정과, service tier는 별개의 선택지입니다.
OpenAI Developer Community의 Day 4 발표 및 모델 요금표에 따르면, GPT-6.1 Sol의 Ultrafast는 Standard 대비 6배 높은 토큰 요금입니다.
| GPT-6.1 Sol API 요금 (100만 토큰) | Standard | Ultrafast |
|---|---|---|
| 입력 | $2 | $12 |
| ... | ||
| 토큰이란 AI가 글이나 코드를 처리할 때 사용하는 문자 단위입니다. 일본어 한 글자가 반드시 1 토큰이 되는 것은 아닙니다. |
만약 API로 입력 100만 토큰, 출력 100만 토큰을 처리한다고 가정하면, 위 입출력 요금만으로 계산했을 경우,
Standard : $2 + $10 = $12
Ultrafast: $12 + $60 = $72
이 됩니다.
실제 청구액에는 캐시 입력/캐시 쓰기/긴 컨텍스트/지역 처리 등의 조건이 영향을 미칠 수 있습니다. 비교는 반드시 최신 공식 요금표를 통해 진행해 주십시오.
API 토큰 요금의 6배를 ChatGPT 구독료 소비 배율에 그대로 적용해서는 안 됩니다.
API는 주로 토큰 요금으로, Codex/Work의 구독은 플랜 이용량이나 크레딧으로 관리됩니다.
OpenAI의 요금표는 각각 계산 방법을 나누어 설명하고 있습니다. 작업을 시작하기 전에 모델 선택 화면과 사용 현황을 확인하는 것이 안전합니다.
이 부분이 이번 발표에서 특히 혼동될 수 있는 지점입니다.
GPT-6.1 Sol Ultrafast는 OpenAI API 사용자 전체에게 제공됩니다. 다만, 별도의 Rate Limit(호출 제한)이 적용됩니다.
공식 문서에 명시된 GPT-6.1 Sol Ultrafast의 표준 TPM(Tokens Per Minute: 1분당 처리 가능한 토큰 수)은 다음과 같습니다.
| API Tier | Ultrafast의 TPM |
|---|---|
| Build | 1,000,000 |
| ... | |
| 이는 조직의 플랜/제한 설정 등에 따라 달라지므로, 실제 상한선은 API 대시보드에서 확인해 주십시오. |
2026년 10월 8일 공식 Changelog에는 다음 대상이 안내되어 있습니다.
| ChatGPT 측 플랜 | Ultrafast |
|---|---|
| Plus | 시작 시점에서는 미대상 |
| ... | |
| Pro $500 | 대상 |
| Business | 시작 시점에서는 미대상 |
| 대상 Enterprise | |
| 관리자의 활성화 필요 | |
| 대상 Edu | |
| 크레딧 방식으로 이용 가능 |
Pro $500의 경우, 플랜에 포함된 Work/Codex 사용량에서 먼저 소모하고, 그 이후에 사용 가능한 크레딧 잔액이 사용됩니다. 대상 Enterprise 및 Edu에서는 워크스페이스 크레딧이 사용됩니다.
Enterprise는 기본적으로 비활성화되어 있으며, 워크스페이스 소유자 또는 관리자의 설정이 필요합니다.
'API에서 누구나 이용 가능'이라는 것이 'ChatGPT Plus의 Codex로 바로 선택 가능하다'는 의미는 아닙니다.
Python SDK에서는 기존의 Responses API 호출에 `service_tier=
해당 Python 환경의 패키지 관리 기능을 호출하여 install을 추가하고, --upgrade는 기존 패키지를 새로운 버전으로 업데이트하는 지정입니다.
API 키는 소스 코드에 직접 작성하지 말고, 환경 변수 OPENAI_API_KEY 등에서 관리해 주세요.
OpenAI의 Ultrafast 문서는 도구 호출이 여러 번 발생하는 에이전트 용도에서는 WebSocket을 강력히 권장하고 있습니다.
WebSocket은 한 번 생성한 연결을 유지하면서 양방향으로 데이터를 주고받는 방식입니다.
예를 들어,
HTTP를 매번 이용
연결 → 모델 → 끊김
연결 → 도구 결과 전달 → 모델 → 끊김
...
와 같은 차이가 있습니다. 모델의 출력만 빨라져도, 매번 연결 처리 시간이 걸리면 효과가 반감됩니다. 지속적으로 도구를 사용하는 AI 에이전트에서는 연결을 재사용하는 것이 속도 향상의 이점을 얻기 쉽습니다.
다만 HTTP로도 Ultrafast를 이용 가능하며, 반드시 WebSocket으로 다시 만들 필요는 없습니다.
GPT-6.1 Sol Ultrafast는 글로벌 처리 외에 **미국 및 EU의 데이터 레지던시(data residency)**를 지원합니다.
데이터 레지던시는 모델의 추론 처리를 어느 지역에서 실행할지에 관한 요건입니다. 일반적인 모든 사용자가 자동으로 해당 지역으로 고정된다는 의미가 아니며, 계약 및 프로젝트 설정 조건도 확인이 필요합니다.
참고로, GPT-6 Astra Ultrafast는 먼저 공개되었으나, 동시점의 공식 문서에서는 EU 추론 레지던시에 대응하지 않으므로, 두 모델의 지역 지원은 동일하지 않습니다.
**Steering(스테어링)**이란 Codex 실행 중에 추가 메시지를 보내 현재 진행 중인 작업에 지시를 반영시키는 것입니다.
예를 들어 Codex에게,
리포지토리 전체의 버그를 조사해서 수정해 줘.
라고 요청한 후, 작업 도중에,
인증 부분은 변경하지 마. 먼저 테스트 케이스를 추가해 줘.
라고 보내고 싶은 경우가 있습니다.
이번 Day 4.2는 이러한 중간 지시에 Codex가 더 빠르게 반응하도록 개선된 것입니다.
이전부터 Steer 기능 자체는 존재했습니다. Day 4는 '처음으로 도중에 지시를 보낼 수 있게 되었다'가 아니라, 응답 속도를 개선했다는 발표입니다.
OpenAI Help Center에 따르면, 두 가지는 다음과 같이 구분됩니다.
| 작업 | 의미 | 구체적인 예시 |
|---|---|---|
| Steer | 현재 실행 중인 작업에 추가 지시 | |
| '인증 기능은 변경하지 마' | ||
| Queue | 현재 실행 종료 후에 다음 지시를 전달 | |
| '끝나면 README도 업데이트해 줘' |
Steer
작업 A를 실행 중
├── 도중에 지시 추가
...
ChatGPT 데스크톱 앱의 Codex에서는 다음부터 표준 동작을 설정할 수 있습니다.
Settings
→ General
→ Follow-up behavior
여기서, 중간에 추가 메시지를 Steer와 Queue 중 어디로 보낼지 선택합니다.
CLI에서는 Codex가 작업 중에 메시지를 입력하고,
Enter: 현재 실행에 Steer -
Tab: 다음 실행에 Queue
라는 조작이 안내되고 있습니다.
이번 고속 Steering은 먼저 ChatGPT 데스크톱 앱의 Codex에 단계적으로 전개될 것이라고 설명되었습니다. 따라서, CLI를 포함한 모든 클라이언트에서 동시에 '거의 순간적'인 응답이 보장된 것은 아닙니다.
예를 들어 다음과 같은 케이스가 있습니다.
리뷰 중:'이 PR은 머지하지 말고, 먼저 심각한 지적만 정리해 줘' -
버그 수정 중:'사양을 변경하는 것이 아니라 기존 동작을 유지해 줘' -
테스트 중:'운영 DB에는 연결하지 말고, 목(mock) 환경으로만 검증해 줘' -
장시간 조사 중:'그 원인은 다를 것 같으니까, 로그 조사를 우선해 줘'
장시간 작업일수록, 도중에 잘못된 전제에 깨달았을 때의 방향 수정이 중요합니다.
다만, 이미 실행한 파일 변경/배포/외부 서비스로의 쓰기가 자동으로 원래대로 돌아가는 것은 아닙니다. 중요한 작업에는 계속해서 적절한 권한 제한, 리뷰, Git 차분 확인 등이 필요합니다.
OpenAI 공식 Changelog에서는 Day 4와 같은 2026년 10월 8일에 Codex CLI 0.162.0도 공개되었습니다.
다만, 이것은 공식 28일 추적 스레드에 있는 'Day 4.1', 'Day 4.2'의 번호가 매겨진 릴리스와는 별개입니다.
주요 변경 사항은 다음과 같습니다:
- Git worktree 생성 및 목록을 다루는 도구 (기능 활성화 시)
- Command Center에서 작업 고정(pinning)
/copy를 통한 대화 로그 복사 작업 개선 - 승인 화면이나 MCP 확인 화면의 URL 클릭 가능하게 변경- Windows / Linux의 샌드박스 관련 버그 수정
apply_patch를 통한 변경 시 CRLF 줄 바꿈 유지 - Responses / WebSocket 재시도 시, 서버의Retry-After지침 준수
Git worktree는 동일한 Git 리포지토리에서 여러 작업 디렉터리를 준비하여 서로 다른 브랜치를 병렬로 다루는 메커니즘입니다. 여러 Codex 작업을 나누어 실행할 때 유용합니다.
CRLF는 주로 Windows에서 사용되는 줄 바꿈 코드입니다. 패치 적용 시 임의로 줄 바꿈이 LF로 바뀌면, 변경하지 않은 줄까지도 차이점으로 인식될 수 있습니다.
Retry-After는 API가 일시적인 제한 등을 반환할 때, 재시도까지 권장 대기 시간을 알려주는 HTTP 헤더입니다.
npm install -g @openai/[email protected]
명령어의 의미는 다음과 같습니다:
npm: Node.js 패키지 관리 도구 -install: 패키지를 설치 --g: 글로벌 영역에 설치 (일반 터미널에서 사용 가능하게 함) -@openai/codex: OpenAI 공식 Codex CLI 패키지 -@0.162.0: 버전 0.162.0을 명시적으로 지정
이것은 CLI를 업데이트하는 명령어입니다. 모델을 Ultrafast로 전환하는 명령어가 아닙니다.
10월 9일 오전(일본 시간) 공식 정보 확인 시점에서는 Day 4의 추가 풀 리셋은 확인할 수 없었습니다.
공식 추적 스레드에서 Day 4로 나열된 것은,
- Day 4.1: GPT-6.1 Sol Ultrafast
- Day 4.2: Near-instant steering
의 두 가지입니다.
전날의 Day 3에서는 **banked reset (저장 가능한 리셋)**이 배포되었지만, 이를 Day 4의 신규 리셋과 혼동하지 않도록 주의해야 합니다.
'Day 4에 리셋이 없었다'고 영구적으로 단정하는 것이 아니며, 이 기사 확인 시점에서 추가 공식 발표가 발견되지 않았다는 의미입니다.
| 일 | 주요 업데이트 |
|---|---|
| Day 1 | GPT-6 Astra / GPT-6.1 Sol의 구독을 통한 속도 개선 |
| Day 2 | Auto-review 무료화, API Tier 간소화, Meetings, Decisions API, 일괄 리셋 |
| Day 3 | GPT-6 + Intelligent UI, Codex / Work의 4,000만 명, 저장 가능한 리셋 |
| Day 4 | GPT-6.1 Sol Ultrafast, Near-instant steering |
Day 1은 기본 속도 개선이고, Day 4는 속도를 더욱 우선하고 싶을 때 스스로 선택하는 상위 모드입니다. 둘은 별개의 업데이트입니다.
마찬가지로 Day 3은 일반 채팅의 UI 경험에 초점이 맞춰져 있고, Day 4는 Codex의 실행 중 조작성에 초점이 맞춰져 있습니다.
Day 4는 '새로운 모델 공개'보다는, 기존 GPT-6.1 Sol을 빠르게 사용하는 방법과, Codex를 중간에 조작하기 쉽게 하는 개선이 중심이었습니다.
주목해야 할 포인트는 다음과 같습니다:
- Ultrafast는 신모델이 아니며`
GPT-6.1 Sol에서 선택하는 고속 모드 - GPT-6.1 Sol은 Standard 대비 최대 8배 빠른 출력 생성 속도를 제공합니다. API의 GPT-6.1 Sol Ultrafast 요금은 Standard의 6배입니다. 모든 사용자가 API에서 이용할 수 있지만, 전용 Rate Limit이 있습니다.
- Codex / ChatGPT Work에서는 Pro $500, 대상 Enterprise・Edu가 중심입니다. Near-instant steering 기능으로 실행 중인 Codex에 추가 지시를 내릴 때 반응 속도가 빨라집니다.
Steer는 현재 실행에 지시하고, Queue는 다음 실행에 지시합니다. - 같은 날의 Codex CLI 0.162.0은 별도의 관련 릴리스입니다.
Day 4의 추가 풀 리셋(full reset)은 확인 시점에서는 미확인입니다.
특히, API 요금과 ChatGPT 측의 이용 가능한 플랜을 분리해서 생각하는 것, 그리고 '최대 8배'를 모델 출력 속도에 대한 이야기로 이해하는 것이 중요합니다.
- OpenAI Developer Community: Ultrafast와 Near-instant steering Day 4 추적 정보
- OpenAI Developer Community: GPT-6.1 Sol Ultrafast 공식 발표
- OpenAI API: Ultrafast mode
- OpenAI API: Changelog
- OpenAI API: GPT-6.1 Sol 모델 요금
- OpenAI Help Center: ChatGPT Work and Codex
- OpenAI Help Center: ChatGPT release notes (10월 8일 Faster steering)
- OpenAI Help Center: Using Codex with your ChatGPT plan
- OpenAI Changelog: Codex CLI 0.162.0
OpenAI・Codex의 28일간 업데이트는 내일 이후로도 매일 추적하여 전달하겠습니다. Day 5 이후의 신기능이나 리셋 정보가 궁금한 분들은 꼭 팔로우해 주세요.
AI 자동 생성 콘텐츠
본 콘텐츠는 Qiita AI의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기