Grok Voice Think Fast 2.0, 이제 AI Gateway에서 사용 가능합니다
요약
xAI의 Grok Voice Think Fast 2.0 모델이 AI Gateway에 출시되었습니다. 이 모델은 음성-대-음성(speech-to-speech) 방식을 지원하며, 추론과 음성을 병렬로 처리하여 지연 시간을 최소화한 것이 특징입니다.
핵심 포인트
- 음성과 추론의 병렬 처리를 통한 낮은 지연 시간 구현
- 이전 모델 대비 향상된 추론, 전사 및 대화 능력
- 배경 소음 및 전화 압축 환경에서도 안정적인 전사 기능
- AI SDK의 실시간 API를 통한 음성 에이전트 구축 지원
이제 AI Gateway에서 사용 가능합니다. 이는 오디오를 입력받고 오디오를 출력하는 음성-대-음성 (speech-to-speech) 음성 모델로, 이전 Grok Voice 모델에 비해 추론 (reasoning), 전사 (transcription) 정확도 및 대화 능력이 향상되었습니다. xAI의 Grok Voice Think Fast 2.0
이 모델은 음성과 병렬로 추론하므로, 지연 시간 (latency)을 추가하지 않고 대화하면서 질의를 생각할 수 있습니다. 또한 이전보다 더 적은 추론 토큰 (reasoning tokens)을 사용하도록 학습되어, 에이전트의 첫 문장이 끝나기 전인 경우가 많을 정도로 도구 호출 (tool calls)이 더 빠르게 실행됩니다. 전사 (transcription) 기능은 배경 소음 및 전화 압축 (telephony compression)을 포함한 실제 환경 조건에서도 안정적으로 작동합니다.
AI SDK의 실시간 (realtime) API를 통해 사용하세요. API 키가 클라이언트에 도달하지 않도록 서버에서 수명이 짧은 토큰을 생성하세요: xai/grok-voice-think-fast-2.0
Grok Voice Think Fast 2.0으로 음성 에이전트를 구축하는 방법을 확인해 보세요. 실시간 문서 (realtime documentation)에서 모델을 테스트해 보거나 AI Gateway 플레이그라운드 (AI Gateway playground)를 이용해 보세요.
AI 자동 생성 콘텐츠
본 콘텐츠는 Vercel AI의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기