600여 개 이상의 언어로 목소리를 완벽하게 복제하는 음성 AI 등장
요약
OmniVoice라는 음성 AI가 등장했으며, 600개 이상의 언어에서 제로샷(zero-shot) 방식으로 완벽한 목소리 복제가 가능합니다. 이 모델은 오디오 샘플을 이용해 목소리를 클로닝하며, 나이, 음높이, 방언 등 다양한 요소를 조절할 수 있습니다.
핵심 포인트
- 600개 이상의 언어에서 제로샷 음성 합성이 가능합니다.
- 오디오 샘플 기반의 목소리 클로닝 기능을 제공합니다.
- 나이, 음높이, 방언 등 다양한 파라미터 조절이 가능합니다.
- 실시간 생성 속도가 매우 빠르다는 장점이 있습니다.
OmniVoice(Python으로 작성됨)가 등장했으며, GitHub 별표는 거의 만 개에 달합니다.
핵심 기능:
• 600개 이상 언어의 제로샷 (zero-shot) 음성 합성
• 오디오 샘플을 이용해 목소리 클로닝
• 나이, 음높이, 방언, 숨소리 조절 가능
• 실시간 생성 속도가 40배 빠름
다국어 콘텐츠 및 영상 더빙 작업을 하시는 분들이 매우 흥미로워할 것입니다.
Gemini, Grok 또는 GPT Image 2.0을 사용해 보세요.
사진을 업로드하고 아래 프롬프트를 붙여넣으면 정말 멋진 AI 그림을 생성할 수 있습니다.
프롬프트는 여기 ⤵️
AI 자동 생성 콘텐츠
본 콘텐츠는 X @xiaoying_eth (자동 발견)의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기