【2026년 9월】 GPT-6.1 Sol이 DevDay에 등장! Astra에 근접한 성능을 5분의 1 가격으로 / API 변경점 요약
요약
OpenAI가 DevDay에서 GPT-6.1 Sol을 공개하며, Astra급 성능에 근접하면서도 기존 모델 대비 비용 효율성을 크게 높였습니다. 특히 입력 및 캐시 입력 가격이 대폭 인하되어 에이전트 운영 비용 절감 효과가 큽니다. 또한, Ultrafast 티어와 Codex Security Cloud 등 다양한 API 업데이트 내용도 함께 발표되었습니다.
핵심 포인트
- GPT-6.1 Sol은 Astra급 성능을 기존 대비 5분의 1 가격으로 제공합니다.
- 캐시 입력 비용이 $0.10로 대폭 인하되어 에이전트 운영 효율성이 높아졌습니다.
- Ultrafast 티어는 최대 8배의 속도를 제공하며, Responses API를 통해 사용 가능합니다.
- Codex Security Cloud와 Agents API가 공개 베타로 출시되어 코드 리뷰 및 취약점 스캔 기능을 강화했습니다.
2026년 9월 29일, OpenAI의 DevDay에서 GPT-6.1 Sol이 공개되었습니다. 9월 22일에 출시된 GPT-6 Sol의 후속 모델로, API 문서에서는 'Astra에 근접한 성능을 더 낮은 비용으로'라고 설명하고 있습니다. OpenAI 발표에 따르면, 표준 API 가격은 GPT-6 Astra의 5분의 1입니다.
주목해야 할 점은 다음 네 가지입니다.
- 가격은 입력 $2 / 출력 $10 per 1M tokens입니다. Astra는 $10 / $50이므로 정확히 5분의 1입니다. GPT-6 Sol과 동일한 단가로 DeepSWE v1.1에서 GPT-6 Sol의 최고 점수(68.8%)를 넘어서는 75.2%를 달성했습니다.
- 캐시 입력은 $0.10으로, GPT-6 Sol의 $0.20에서 절반이 되었습니다.
- ChatGPT에서는 ChatGPT Work와 Codex로, API에서는
gpt-6.1-sol로 사용할 수 있습니다. 속도 중시의 Ultrafast는 GPT-6.1 Sol을 위한 '近日(출시 예정)' 공지이며, 가격표에도 아직 올라있지 않습니다. - API에서는 reasoning effort의none과minimal이 사용 불가하며, 도구 호출은 Responses API가 필수입니다.
OpenAI API나 Codex로 GPT-6 계열을 사용하는 개발자를 위해, 마이그레이션 판단에 필요한 정보를 요약했습니다. 수치와 사양은 2026년 10월 7일자 OpenAI 공식 문서를 기반으로 합니다.
| 항목 | GPT-6.1 Sol |
|---|---|
| 모델 ID | gpt-6.1-sol (스냅샷은 이것만) |
| 출시일 | 2026년 9월 29일 |
| 입력 가격 | $2 / 1M tokens |
| 캐시 입력 | $0.10 / 1M tokens |
| ... | low / medium (기본값) / high / xhigh / max. none과 minimal은 미지원 |
| 엔드포인트 | Responses (도구 호출은 여기) / Chat Completions (도구 |
시스템 카드 부록에는 검색이 필요한 작업에서 '검색 도구가 사용되지 않았음을 최종 답변으로 전달하지 않는' 비율이 GPT-6 Sol의 4.92%에 비해 GPT-6.1 Sol은 2.08%였다고 적혀 있습니다.
에이전트가 백그라운드에서 실패를 무마시키지 못하는지는 실제 운영 환경에서는 정답률보다 더 중요하게 작용할 때가 있습니다.
캐시 입력은 $0.10로, 일반 입력 대비 95% 저렴하며 GPT-6 Sol의 캐시 입력보다도 50% 저렴해졌습니다. 동일한 시스템 프롬프트나 리포지토리의 문맥을 반복적으로 읽게 하는 에이전트 용도로는 청구 금액에 큰 영향을 미칩니다.
OpenAI는 속도 중시 유료 티어인 Ultrafast를 발표했습니다. Codex에서는 최대 8배(300 토큰/초), API에서는 최대 6배의 속도를 가질 것으로 알려졌습니다.
현재 제공되는 것은 Astra용이며, API에서는 Responses API의 service_tier: "ultrafast"로 지정할 수 있습니다 (9월 29일 변경 이력). 가격 페이지의 Ultrafast 표에는 gpt-6-astra 행만 있고, 입력 $60 / 캐시 입력 $6 / 캐시 쓰기 $75 / 출력 $300입니다. GPT-6.1 Sol의 Ultrafast는 DevDay 발표에서 '조만간'이라고만 되어 있을 뿐, 가격표나 GPT-6.1 Sol의 모델 페이지에는 아직 올라와 있지 않습니다.
같은 DevDay에서는 다음 내용들이 발표되었습니다.
- Codex: Codex Cloud, Codex CLI의
/agents뷰 및 양방향 음성 조작, 클라우드 코드 리뷰, 취약점 스캔을 하는 Codex Security Cloud - Agents API: 공개 베타. 호스트 실행, 메모리, 도구, 멀티 에이전트에 대응하며 컴퓨터 사용(computer use)도 가능합니다. - Responses API의 멀티 에이전트: 베타 (9월 29일 변경 이력)
- Decisions API: DevDay에서는 한정 프리뷰로 발표되었으며, 10월 6일에 공개 베타(
gpt-6-luna전용)가 되었습니다. 자세한 내용은 GPT-6 Luna 기사에 적어 놓았습니다 - ChatGPT Pro 500: Plus의 25배 사용량과 Ultrafast가 붙음
OpenAI가 공식 개발자 게시물에서 제시한 수치입니다. 비교 대상과 비용 비율은 OpenAI 설명에 따릅니다.
| 벤치마크 | GPT-6.1 Sol | 비교 |
|---|---|---|
| DeepSWE v1.1 (실제 코드 기반의 복잡한 소프트웨어 공학) | 75.2% (high) | GPT-6 Sol의 최고 68.8% (max)를 상회하며, 작업당 비용은 약 76% 낮습니다. Astra와 동등하며, 비용은 약 5분의 1입니다. |
| ... |
괄호 안은 해당 점수를 얻었을 때의 추론 노력(reasoning effort)입니다. GPT-6.1 Sol이 Astra를 초과한 항목은 이 표에 없습니다. 차이가 작음에도 가격 차이가 크다는 것이 이번 판매 포인트입니다.
시스템 카드 부록에는 Preparedness Framework 분류로 다음과 같이 적혀 있습니다.
- "GPT-6.1 Sol을 사이버 보안 도메인의 중요 역량(Critical capability)으로 취급"<br>- "GPT-6.1 Sol을 생물학 및 화학 도메인의 높은 역량(High capability)으로 취급"
보안 영역에서 사용하거나 안전 대책 운영을 확인하고 싶다면 부록을 직접 읽어보세요.
GPT-6 Astra와 GPT-6.1 Sol은 none에 대응하지 않습니다. 공식 마이그레이션 가이드에서는 none을 사용했던 부분은 low로 변경하라고 안내합니다. minimal을 사용했던 부분도 먼저 low부터 시작하여 결과를 비교해 보세요. 레이턴시를 줄이기 위해 none으로 작동시키던 경로는 응답 시간과 품질을 재측정해야 합니다.
공식 가이드의 설명은 "Astra와 GPT-6.1 Sol 모두 Chat Completions에 대응하지만, 도구 호출은 Responses가 필수"입니다. GPT-6 Sol과 GPT-6 Luna는 Chat Completions의 함수 호출이 reasoning_effort: "none"
이전 청크에서 언급된 것처럼, GPT-6 Sol과 GPT-6 Luna는 Chat Completions의 함수 호출을 reasoning_effort: "none"일 때만 사용할 수 있었습니다. 따라서 GPT-6.1 Sol에서는 none이 사용 불가능하므로, 도구를 사용하는 처리는 Responses API로 옮겨야 합니다.
# Before: GPT-6 Sol. Chat Completions + effort none으로 도구를 호출했던 예시
client.chat.completions.create(
model="gpt-6-sol",
...
공식 마이그레이션 절차에는 "reasoning effort가 none이 아닐 때는, temperature, top_p, top_logprobs를 제외한다"고 나와 있습니다. GPT-6.1 Sol에서는 none이 사용 불가능하므로, 이들은 항상 제외해야 합니다.
prompt_cache_retention은 prompt_cache_options.ttl로 대체됩니다. 공식 가이드의 예시는 "30m"입니다.
컨텍스트는 1,050,000 토큰까지 사용할 수 있지만, 입력이 272K를 초과할 경우, 입력 및 캐시 단가가 2배, 출력이 1.5배가 됩니다. 긴 문맥을 매번 통째로 전달하는 설계라면 예상보다 비용이 높아질 수 있습니다.
GPT-6.1 Sol의 Ultrafast는 가격이나 제공일이 아직 발표되지 않았습니다. 속도 요구 사항이 까다로운 설계는 표준 속도로도 작동한다는 전제하에 구성하고, Ultrafast는 제공된 후에 전환하는 것이 현실적입니다. Fast 모드는 표준 가격의 2배이며, EU 데이터 레지던시에서는 사용할 수 없습니다.
공식 절차에서는 다음 5가지를 확인합니다:
model에gpt-6.1-sol을 지정할 것 - reasoning effort (none/minimal은 사용 불가) - 도구 호출 방식 (Responses) - 불필요한 파라미터 (temperature등) - 데이터 레지던시 요구 사항
from openai import OpenAI
client = OpenAI()
response = client.responses.create(
...
"Using GPT-6" 가이드에는, GPT-6의 신기능으로 도구 실행 중에도 추론을 계속할 수 있는 비동기 도구 호출, 작업 중 추가 지시를 보낼 수 있는 mid-turn steering, 대화 도중에 configuration_update 입력 아이템에 따라 reasoning effort를 높였다 낮추는 기능이 포함되어 있습니다.
GPT-6.1 Sol은 Astra와 유사한 성능을 5분의 1 가격으로 사용할 수 있게 만든 업데이트입니다. GPT-6 Sol과 단가가 같고 성능이 향상되었으며 캐시도 반값으로 내려갔기 때문에, GPT-6 Sol에서 마이그레이션하는 것은 기본적으로 이득입니다.
- GPT-6 Sol을 사용 중인 경우:
none/minimal을 사용하고 있지 않은지, Chat Completions에서 도구를 호출하고 있지는 않은지 확인합니다. 샘플링 파라미터도 제외해야 합니다. -
Astra를 사용하는 경우: 어려운 처리는 Astra에 남겨두고, 코딩이나 컴퓨터 조작의 대부분을 GPT-6.1 Sol로 분산시키면 비용이 크게 절감될 수 있습니다. 차이가 나는 처리 부분은 자신의 태스크에서 확인합니다. -
Claude Sonnet 5.5나 Opus 5.5와 비교하는 경우: Sonnet 5.5와는 같은 가격대이며, Opus 5.5와는 반값의 차이입니다. OpenAI는 AutomationBench나 GDP.pdf에서 Opus 5.5를 능가했다고 주장하지만, 이는 벤더 공표 값이므로 직접 자신의 태스크로 비교하는 것이 좋습니다. -
긴 문맥을 사용할 경우: 272K를 초과하면 할증되므로, 캐시와 입력을 제한하는 것을 설계에 포함해야 합니다. -
속도가 필요한 경우: GPT-6.1 Sol의 Ultrafast는 제공 대기 중입니다. 표준 속도로 작동할 수 있는 설계를 유지합니다.
OpenAI의 API 문서(모델 페이지/가격 페이지/변경 이력/
OpenAI의 API 문서(모델 페이지/가격 페이지/변경 이력/
- OpenAI:GPT-6.1 Sol 소개
- OpenAI API 문서:GPT-6.1 Sol 모델
- OpenAI API 문서:GPT-6 사용하기
- OpenAI API 문서:가격 책정
- OpenAI API 문서:변경 이력
- OpenAI 개발자 커뮤니티:API의 GPT-6.1 Sol: 비용 대비 성능 면에서 의미 있는 향상
- OpenAI 개발자 커뮤니티:DevDay 2026 발표 및 개발자 리소스
- OpenAI 배포 안전 허브:GPT-6 Astra 시스템 카드 부록: GPT-6.1 Sol
- OpenAI API 문서:GPT-6 Astra 모델
- OpenAI API 문서:GPT-6 Sol 모델
AI 자동 생성 콘텐츠
본 콘텐츠는 Qiita AI의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기