OpenAI의 Ultrafast 모드가 AI Gateway에서 사용 가능해짐
요약
OpenAI가 GPT-6 Astra를 위한 Ultrafast 서비스 티어를 AI Gateway에서 지원하며, 이를 통해 인터랙티브 애플리케이션과 빠른 코딩 반복 작업에 더 빠른 출력을 제공합니다. 개발자들은 AI SDK, Chat Completions API 또는 Responses API를 사용하여 이 기능을 활용할 수 있습니다.
핵심 포인트
- GPT-6 Astra 모델의 Ultrafast 티어 지원 시작
- 빠른 응답이 필요한 인터랙티브 앱 및 코딩 작업에 최적화
- Responses API 사용을 권장하여 턴 간 오버헤드를 줄임
- Ultrafast 요청은 표준 대비 6배 높은 요율로 청구됨
이제 GPT-6 Astra를 위한 OpenAI의 Ultrafast 서비스 티어를 지원하여, 인터랙티브 애플리케이션과 빠른 코딩 반복 작업에 더 빠른 출력을 제공합니다.AI Gateway
Ultrafast를 사용하려면 AI SDK, Chat Completions API 또는 Responses API를 통해 요청해야 합니다: openai/gpt-6-astra
잦은 도구 호출이 필요한 워크플로우의 경우, OpenAI는 턴(turn) 간 오버헤드를 줄이기 위해 지속적인 WebSocket 연결보다 Responses API 사용을 권장합니다. WebSocket을 통한 AI SDK를 포함한 지속적 연결에 대해서는 [여기]를 참조하십시오.Ultrafast 서비스 티어 예시
Ultrafast는 미국 및 글로벌 처리를 지원합니다. EU와 같이 지원되지 않는 지역에 고정된 요청은 표준 () 티어로 실행됩니다. 서비스 티어가 지정되지 않은 경우, 표준 처리가 기본값으로 유지됩니다.[default]
Ultrafast에서 제공되는 요청은 표준 대비 6배의 토큰당 요율로 청구되며, 다른 티어로 폴백(fallback)하는 요청은 실제로 제공된 티어의 요율로 청구됩니다. 현재 요율을 확인하십시오.GPT-6 Astra 모델 페이지
AI 자동 생성 콘텐츠
본 콘텐츠는 Vercel AI의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기