GPT-Live 1이 AI Gateway에서 사용 가능해졌습니다
요약
OpenAI의 GPT-Live 1이 AI Gateway에서 사용 가능해졌습니다. 이 모델은 듣기와 말하기를 동시에 처리하는 풀-듀플렉스 음성 기능을 제공하며, 대화 중에도 백그라운드 작업을 독립적으로 수행할 수 있는 클라이언트 위임(client delegation)을 지원합니다.
핵심 포인트
- GPT-Live 1: 듣기/말하기 동시 처리가 가능한 풀-듀플렉스 모델입니다.
- 클라이언트 위임 기능으로 대화 중에도 백그라운드 작업을 독립적으로 처리할 수 있습니다.
- AI SDK 7 이상 및 WebSocket 클라이언트를 사용하여 구현해야 합니다.
AI Gateway에서 사용할 수 있게 되었습니다. OpenAI의 GPT-Live 1
GPT-Live 1은 풀-듀플렉스(full-duplex) 음성 모델로, 듣기와 말하기를 동시에 할 수 있습니다. 많은 음성 모델들은 턴 디텍션(turn detection)을 사용하여 응답합니다. 풀-듀플렉스는 그 경계를 제거하여, GPT-Live가 말하는 동안 사용자가 일시 정지하거나, 끼어들거나, 세부 정보를 추가할 수 있게 합니다.
GPT-Live 1은 또한 클라이언트 위임(client delegation)을 지원합니다. 클라이언트 위임은 GPT-Live 1과 독립적으로 백그라운드 모델을 선택할 수 있게 해줍니다. 기본 세션은 음성 모델만 실행됩니다. 더 깊이 있는 작업이 필요할 때, 대화가 계속되는 동안 애플리케이션이 이를 처리할 수 있습니다.delegation-createdAI Gateway의 모든 텍스트 모델
AI SDK 7 이상 및 WebSocket 클라이언트:@ai-sdk/openai 4.0.67을 설치하세요.
이는 다른 모델 호출 없이 시작됩니다. 오디오를 보내기 전에 기다리세요.openai/gpt-live-1``session-started
GPT Live가 위임할 수 있는 텍스트 모델을 호출한 다음, 결과를 채널로 반환하여 해당 모델이 말하게 할 수 있습니다. 이 예제는 , 를 사용하지만, AI Gateway에서 사용 가능한 모든 텍스트 모델로 대체할 수 있습니다:commentary``openai/gpt-5.6-sol`
애플리케이션이 위임된 작업과 그 권한, 확인, 취소를 제어합니다. 위임된 모델 요청은 AI Gateway를 통해 별도로 청구되며; 백그라운드 작업을 실행하는 동안 음성 세션 사용은 계속됩니다. 이 코드 스니펫들은 WebSocket 연결, 이벤트 파싱, 전사본 조립, 오디오 스트리밍 및 종료는 생략했습니다. 연결 설정, 오디오 스트리밍 및 전체 예제는 AI Gateway 문서를 참조하세요. AI Gateway의 모든 오디오 모델에 대해서는 .GPT-Live 가이드모델 목록으로 이동하세요.
위임 없이 간단한 예제
작업 위임 및 대화 유지
AI 자동 생성 콘텐츠
본 콘텐츠는 Vercel AI의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기