Qwen 오디오 스택이 음성 인식부터 오디오 생성까지 전체 워크플로우를 지원합니다
요약
Qwen 오디오 스택은 음성 인식(ASR)부터 음성 합성(TTS), 실시간 대화까지 전체 오디오 워크플로우를 지원하도록 업그레이드되었습니다. ASR-Next와 TTS-Next가 추가되어 개발자가 활용할 수 있는 모델이 다양해졌습니다.
핵심 포인트
- Qwen 스택은 ASR, TTS, 실시간 대화 전 과정을 포괄합니다.
- ASR-Next 및 TTS-Next 등 다양한 최신 모델을 제공합니다.
Qwen 오디오 스택은 이제 음성 인식(speech recognition)과 실시간 대화에서부터 음성 합성(speech synthesis) 및 오디오 생성에 이르는 전체 워크플로우를 포괄합니다.
ASR, TTS, 그리고 Realtime 기능이 모두 업그레이드되었으며, ASR-Next와 TTS-Next가 가족을 이루었습니다. 개발할 모델이 다섯 가지나 충분합니다.
AI 자동 생성 콘텐츠
본 콘텐츠는 X 토픽: 오픈소스 LLM의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기