
“루코모리에 푸른 참나무가 있고” 타인의 목소리로: Google이 그은 레드라인
요약
Google이 Gemini Omni 출시와 함께 타인의 목소리를 변조하는 비디오 편집 기능을 제한하며 자발적인 윤리적 가이드라인을 설정했습니다. AI 생성 콘텐츠 식별을 위해 SynthID 워터마크를 강제 적용하며 저작권 및 책임 있는 AI 사용에 대한 대응을 보여줍니다.
핵심 포인트
- Google Gemini Omni 출시와 함께 음성 변조 기능의 제한적 제공 발표
- AI 생성 콘텐츠 식별을 위한 SynthID 워터마크 의무 적용
- 규제 기관의 요구 전 벤더가 자발적으로 설정한 윤리적 레드라인
- AI 음악 및 목소리 저작권 이슈에 대한 플랫폼의 대응 방식
당신은 좋아하는 아티스트의 목소리로 푸시킨(Pushkin)의 시를 듣기 위해 검색창에 “루코모리에 푸른 참나무가 있고 AI 노래(у лукоморья дуб зелёный песня ии)”를 입력하지만, 삭제된 영상들과 “AI에 의해 생성됨”이라는 표시를 마주하게 됩니다. 2026년 5월 19일부터 이 노래에는 경계병이 생겼습니다. Google I/O 2026의 개막일에 맞춰 회사는 Gemini Omni 모델을 선보였으며, 동일한 발표에서 타인의 목소리는 더 이상 허용되지 않는 선을 그었습니다 (Google 공식 블로그, 2026.05.19 기준).
텍스트 자체는 시사하는 바가 큽니다. “루코모리에 푸른 참나무가 있고(У лукоморья дуб зелёный)”는 1820년 작 “루슬란과 류드밀라(Ruslan and Lyudmila)”의 도입부로, 시 자체는 오래전부터 퍼블릭 도메인(Public Domain) 상태였습니다. 단어들은 자유롭습니다. 갈등이 발생하는 지점은 바로 목소리입니다. 아래에서는 Google이 무엇을 금지했는지, 플랫폼들은 어떻게 대응했는지, 그리고 저작권 침해 신고(Strike) 없이 AI 음악을 만드는 방법은 무엇인지 다룹니다.
2022년부터 러시아 카드로 해외 AI 서비스를 직접 결제하는 것은 불가능해졌으며, 남은 방법은 두 가지입니다. 추가 비용을 지불하는 중개인을 이용하거나, provod.ai (러시아의 OpenRouter)와 같은 애그리게이터(Aggregator)를 사용하는 것입니다. 이곳에서는 Gemini와 Claude가 하나의 채팅창에 존재하며 결제는 루블(Ruble)로 이루어집니다. 이 실무적인 부분은 마지막 부분에서 다시 다루겠습니다.
Google이 그은 레드라인이란 무엇인가?
요약하자면: 2026년 5월 19일 Google I/O에서 Gemini Omni가 공개되었습니다. 이 모델은 텍스트, 이미지, 오디오, 비디오를 입력받아 대화형 명령에 따르는 비디오를 출력합니다. 같은 날 Gemini Omni Flash가 Gemini 앱, Google Flow, YouTube Shorts에 배포되기 시작했습니다 (Google 블로그, 2026.05.19 기준). Google은 한 가지 기능을 의도적으로 제한했습니다.
직접 인용: “아바타 기능을 넘어, 오디오와 음성을 변경하기 위한 비디오 편집 측면에서, 우리는 이 기능을 사용자에게 책임감 있게 제공할 수 있는 방법을 더 잘 이해하고 테스트하기 위해 여전히 노력 중입니다” - “мы всё ещё тестируем редактирование видео с изменением аудио и речи и пытаемся понять, как дать такую возможность ответственно” (동일 출처). “온라인 음성 변조기 (voice converter online)”라는 검색어들은 Google이 출시하지 않기로 결정한 바로 그 기능을 설명합니다. 여기서 제 눈길을 끄는 다른 점은, 법원이나 규제 기관이 레드라인을 요구한 것이 아니라 벤더(vendor) 스스로가 자발적이고 공개적으로 그 선을 그었다는 사실입니다.
Omni가 수행하는 모든 작업에는 눈에 보이지 않는 워터마크인 SynthID가 포함됩니다. Gemini 앱, Chrome의 Gemini, 그리고 Google 검색을 통해 비디오를 확인할 수 있으며, 어떤 요금제를 사용하더라도 이 라벨을 끌 수는 없습니다 (Google 블로그 및 Digital Applied, 2026.05.19 기준). Flash 클립은 출시 초기 10초로 제한되는데, 이는 배포(deployment) 결정일 뿐 모델의 기능과는 무관합니다 (TNW, 2026.05.20 기준).
2026년 6월 30일부터 모델이 개발자에게 공개되었습니다: Google AI Studio 및 Gemini API에서 gemini-omni-flash-preview를 사용할 수 있으며, 비디오 초당 약 $0.10의 비용이 발생합니다. 이와 동시에 Nano Banana 2 Lite도 출시되었습니다 - 4초당 이미지 한 장에 1,000장당 $0.034입니다 (Google DeepMind 및 Coursiv, 2026.06.30 기준). 검색 엔진에서는 Nano Banana를 “나노바나(nanobana)”라고 부르기도 하는데, 동일한 모델입니다. 가격은 2026년 7월 기준입니다.
왜 “루코모리에 푸른 참나무가 있고”가 AI 노래의 상징이 되었나?
요약하자면: 푸시킨의 시구는 자유롭지만, 수요는 타인의 목소리에 있습니다. 텍스트는 합법적으로 가져올 수 있지만, 가창자를 “빌려오는” 문제가 남는 것입니다.
1820년 시의 서문은 퍼블릭 도메인 (Public Domain)에 속합니다 (텍스트는 MSU IRLC 컬렉션에 소장됨). 고전은 일반적으로 편리합니다. 사람들은 "마야콥스키 시를 바탕으로 한 클립", "AI가 부르는 츠베타예바 시 노래", "에세닌 시를 바탕으로 한 아코디언 연주 AI 노래" 등을 검색하며, 신경망 (Neural Network)은 러시아 시인들의 시에 맞춰 정직하게 음악을 만들어냅니다. 문제는 특정 가창자와 관련될 때 시작됩니다. "AI가 부르는 샤투노프의 노래" (사망한 아티스트의 '신곡'에 관한 가장 대중적인 러시아 인터넷 사례), "빅토르 초이 시렌(сирень) 신경망", 그리고 "Kanye West 스타일"의 커버곡들—이들은 "Kanye West AI 노래" 또는 "Kanye West의 세다야 노치(Седая ночь) AI"와 같이 검색되기도 합니다.
이러한 행위가 용인되던 시대는 한 트랙으로 종결되었습니다. 2023년 4월 4일, 익명의 Ghostwriter977은 Drake와 The Weeknd의 AI 목소리를 사용한 "Heart on My Sleeve"를 게시했습니다. AINEXT의 데이터에 따르면, 이 곡은 Spotify에서 약 60만 회의 스트리밍, YouTube에서 275,000회의 조회수, TikTok에서 약 1,500만 회의 조회수를 기록했으나, UMG의 항의 이후 (2026년 5월 28일) 삭제되었습니다. UMG는 "AI"를 직접적으로 언급할 수는 없었지만, 샘플링 권리(Rights to a sample)와 목소리 권리를 통해 압박했습니다. 당시에는 이것이 이례적인 일처럼 보였습니다. 3년이 지난 지금, 이는 규정 (Regulation)이 되었습니다.
Gemini Omni에서 가능한 것과 불가능한 것
요약하자면: Omni는 비디오를 생성하고 편집할 수 있지만, 비디오 내의 음성을 변경하는 기능은 아직 출시되지 않았습니다. 목소리, 얼굴, 음악에 대한 권리 및 플랫폼 규정은 별도로 확인해야 합니다.
"얼굴"에 대해서는 단 하나의 허점이 있습니다. Avatars 기능은 엄격한 제한 사항을 가진 당신 자신의 디지털 트윈 (Digital Twin)을 생성합니다. 나머지는 표를 통해 확인할 수 있으며, 이는 Omni를 어떤 작업에 사용할지 결정할 때 유용할 것입니다.
| Gemini Omni 기능 | 2026년 7월 기준 상태 |
|---|---|
| 본인의 디지털 아바타 | 작동 중: 18세 이상, 유료 요금제, 영어만 지원; EEA, 스위스 및 영국에서는 사용 불가 |
| ... |
이 표는 Google 블로그 (2026년 5월 19일), TNW (2026년 5월 20일) 및 Avatars 도움말 (2026년 5월 24일)을 바탕으로 작성되었습니다. 상황은 단순합니다. Google은 당신 자신을 당신에게 판매하고 있으며, 다른 누군가를 판매할 수 있게 만드는 모든 것을 매대에서 치우고 있습니다.

Google은 왜 카메라를 보고 숫자를 읽게 만들까요?
요약하자면: 이는 생존 확인(liveness check) 절차입니다. 아바타 온보딩 (onboarding) 과정에서 시스템은 사용자에게 비디오를 녹화하고 일련의 숫자를 소리 내어 말하도록 요청합니다. 이를 통해 카메라 앞에 있는 대상이 타인의 사진이 아닌 실제 살아있는 사람인지 확인합니다 (Google의 Avatars 관련 안내, 2026년 5월 24일). 사진을 통한 타인의 얼굴은 검증 (verification) 단계에서 즉시 거부됩니다.
시작 단계의 제한 사항: 18세 이상, 영어만 가능, 유료 요금제 전용, EEA(유럽경제지역), 스위스 및 영국에서는 사용 불가 (TNW, 2026년 5월 20일). YouTube에서도 유사한 의식이 있습니다. 자신의 얼굴을 탐지 (detection) 하기 위해 제작자는 신분증 사진과 셀카 비디오를 업로드해야 합니다 (The Verge, 2025년 10월 21일). 메커니즘은 동일합니다: 디지털 복제본을 원한다면, 당신이 자기 자신을 복제하고 있음을 증명하십시오.
누가 또 레드라인을 그었는가: 플랫폼 지도
요약하자면: 모든 대형 플랫폼이 각자의 방식으로 대응하고 있습니다.
YouTube는 가장 오래 동안 방어 체계를 구축해 왔습니다: 유사성 탐지 (likeness detection) 기능은 2024년 12월에 베타 테스트를 거쳤고, 2025년 10월 21일에 파트너 프로그램 제작자들에게 출시되었으며, 2026년 5월에는 모든 18세 이상 제작자들에게 배포되었습니다 (The Verge, 2025년 10월 21일; ID Tech Wire, 2026년 5월 18일). 플랫폼 스스로가 제시한 선례는 다음과 같습니다: Elecrow라는 회사가 유튜버 Jeff Geerling의 AI 음성 클론을 가져가 그의 동의 없이 하드웨어 광고에 사용했습니다 (WeRSM, 2025년 10월 21일). 현재 시스템은 얼굴은 잡아내지만, 음성 클론은 커버하지 못하고 있습니다.
| 플랫폼 | 조치 | 날짜 |
|---|---|---|
| YouTube | 18세 이상 제작자를 위한 likeness detection: 신분증, 셀카 비디오, 삭제 요청 | 2025년 10월 - 2026년 5월 |
| ... |
Spotify는 2025년 9월 25일에 승인되지 않은 보컬 사칭 (vocal impersonation) 금지를 발표했습니다. 지정된 아티스트의 음성 클론은 해당 아티스트의 서면 동의 없이 삭제되며, 대량 업로드를 막기 위한 스팸 필터도 도입되었습니다. 지난 12개월 동안 주로 AI 스팸인 7,500만 개의 트랙이 삭제되었습니다 (We Rave You, 2025년 9월 27일).
Deezer는 그 규모를 보여줍니다: 2026년 4월까지 일일 다운로드의 약 44%가 AI 음악이며, 이는 하루에 약 75,000개의 트랙에 해당하지만, 이에 대한 스트리밍 비중은 1~3%에 불과합니다. 탐지기는 1,340만 개의 트랙을 식별했으며, 플랫폼 데이터에 따르면 AI 음악 스트리밍의 85%가 사기성(fraudulent)입니다 (Deezer 데이터를 인용한 PopHits 및 Undetectr 리뷰, 2026년 4월). 이러한 수치들은 다운로더들의 동기를 설명해주지는 않습니다.
레이블과 Suno, Udio 간의 전쟁은 어떻게 끝났는가?
요약하자면: 개별적인 분쟁들은 라이선스(licensing)를 통해 해결되었으나, 법적 및 노동 관련 분쟁은 계속되고 있습니다.
2024년 6월 24일, RIAA는 UMG, Sony, Warner를 대신하여 Suno(매사추세츠 중부 지구)와 Udio(뉴욕 남부 지구)를 상대로 저작물당 최대 15만 달러의 손해배상을 청구하는 소송을 제기했습니다. 2025년 10월 29일, UMG와 Udio는 2026년 라이선스된 음악을 기반으로 한 공동 "walled-garden" 플랫폼 구축 계획을 담은 합의안에 서명했습니다. 2025년 11월 25일, Warner와 Suno는 소송을 합의했습니다: Suno는 Warner로부터 Songkick을 인수했으며, 아티스트의 목소리와 이미지에 대한 opt-in 방식을 적용하여 2026년에 라이선스된 모델을 출시하기로 약속했습니다. Sony와 UMG는 여전히 Suno를 상대로 소송 중입니다 (Chartlex, 2026.07.11).
최근 업계 내부에서 새로운 전선이 열렸습니다: 2026년 6월 5일, 미국 뮤지션 연맹(American Federation of Musicians)은 UMG와 Warner를 상대로 소송을 제기했습니다. 연맹의 주장에 따르면, 레이블들이 세션 뮤지션들의 녹음물을 동의나 보상 없이 Suno와 Udio의 학습용으로 라이선스했다는 것입니다. 이후 6월에는 31개 아티스트 단체 연합이 공개 서한을 발표했습니다 (Chartlex, 2026.07.11; 1 More Shot, 2026.06.25). 레이블들은 서비스 업체들과 합의했습니다. 하지만 뮤지션들은 자신들의 몫이 어디에 있는지 묻고 있습니다.
법은 무엇이라 말하는가 - 그리고 법이 아직 미치지 못한 곳은 어디인가?
요약하자면: 미국에는 연방법이 없습니다. 대신 주법(state laws)이 적용됩니다.
2026년 NO FAKES 법안(NO FAKES Act of 2026)은 2026년 5월 20일 크리스 쿤스(Chris Coons) 상원의원에 의해 상원에 제출되었으며(15명의 공동 저자, 네 번째 반복), 6월 18일 법사위원회에서 만장일치로 승인되어 6월 24일 상원 일정에 포함되었습니다. 아직 어느 의회에서도 통과되지 않았습니다 (IPWatchdog, 18.06.2026; AI Music Events, 2026.07.15 확인). 이 법안은 모든 개인의 목소리와 시각적 이미지에 대한 연방 재산권(federal property right)을 창설하고, 플랫폼을 대상으로 통지 및 삭제(notice-and-takedown) 절차를 규정합니다. 하원의 유사 법안은 H.R.8915입니다. RIAA는 여론을 활용하고 있습니다. RIAA의 데이터에 따르면 소비자 92%가 AI 딥페이크(AI deepfakes)에 대해 우려하고 있습니다 (IPWatchdog, 18.06.2026).
현행법은 주(state) 단위로 존재합니다. 테네시주의 ELVIS 법(ELVIS Act)은 2024년 7월 1일부터 목소리 그 자체를 보호합니다. 캘리포니아의 AB 1836은 2025년 1월 1일부터 유족의 동의가 있는 경우에만 사망자의 디지털 복제물(digital replicas)을 허용하며, 위반 시 최대 1만 달러의 벌금을 부과합니다. 이러한 동의 없는 '고인을 기리는' 클립은 창작이 아닌 직접적인 위반으로 간주됩니다. AB 2602는 생존 아티스트의 복제물에 관한 모호한 계약 조항들을 무효화합니다. 뉴욕주는 2026년 6월 9일부터 합성 아티스트(synthetic performer)에 대한 서면 동의를 요구하며, 주 검찰총장이 이를 감독합니다 (Howard East Law, 12.07.2026; TechJack, 20.06.2026). 러시아의 경우, 적용 가능한 법률과 리스크는 구체적인 상황에 따라 변호사에게 확인해야 합니다.
이것이 해결하지 못하는 것은 무엇인가?
요약하자면: 레드라인(red lines)이 모든 것을 해결해주지는 않습니다. 현재 네 가지 허점이 보입니다.
- YouTube는 얼굴은 잡아내지만 목소리 클론은 잡지 못합니다. 즉, 영상이 없는 오디오 딥페이크는 감지되지 않고 지나갑니다.
- SynthID는 Google의 도구로만 읽을 수 있습니다. 타사의 모델들은 이 워터마크를 포함하지 않습니다.
- Google의 가이드라인은 Google에만 의무적입니다. 제3자 음성 도구들은 각자의 규칙에 따라 운영됩니다.
- NO FAKES 법안이 통과되지 않았습니다: 규칙들이 플랫폼의 계약과 주법으로 파편화되어 있어, 마치 조각보(patchwork)와 같은 상태입니다.
이제 AI 음악과 영상을 합법적으로 만드는 방법은?
요약하자면: 본인의 텍스트를 사용하거나 퍼블릭 도메인(public domain)에 있는 클래식을 사용하고, 본인의 목소리나 라이선스가 확보된 목소리를 사용하며, 정직하게 표시(labeling)하는 것입니다.
- 필요한 관할 구역 내 특정 텍스트 및 판본의 퍼블릭 도메인 (Public Domain) 여부를 확인하세요. AI 음악에 대한 권리는 인간의 기여도와 현지 법률에 따라 달라집니다.
- 목소리는 본인의 것이거나, 아티스트가 직접 동의를 제공한 2025-2026년 거래 기반의 계약된 세션 가수 또는 옵트인 (opt-in) 모델을 사용해야 합니다 (Chartlex, 11.07.2026).
- 보컬이 필수인가요? 그렇다면 인스트루멘탈 (Instrumental)을 생성하세요. 복제본(clone)이 없는 편곡은 그 어떤 권리선도 침해하지 않습니다.
- 보호되는 것은 특정 개인이며, 장르와 언어는 자유롭습니다. 블루스를 원하면 블루스를 만드세요. 신경망(neural network)이 연주하는 집시 노래는 특정 가수의 목소리를 복제하지 않는 한 합법입니다.
- 일상적인 용도는 자유롭습니다. 본인의 목소리로 만든 벨소리, 친척을 위한 축하 메시지, 밴드를 위한 데모 등은 해당 트랙을 타인의 작업물로 속이지 않는 한 안전한 영역 (clean zone)에 있습니다.
- 라벨(label)을 제거하지 마세요. SynthID는 어차피 비활성화되지 않으며, Spotify는 아티스트의 서면 동의 없는 무단 목소리 복제본을 삭제합니다.
- 비디오는 본인의 아바타를 중심으로 구성하거나 개성이 없는 모델을 사용하세요. Luma는 Dream Machine을 발전시키고 있으며 (검색어 "luma dreaming machine"이 바로 그곳으로 연결됩니다), Google에는 규칙이 있는 Omni가 있습니다.
이러한 파이프라인 (pipeline)을 구축할 때는 하나의 대시보드에서 관리하는 것이 더 편리합니다. 한 모델이 텍스트를 쓰고, 다른 모델이 이미지를 그리며, 세 번째 모델이 비디오를 렌더링합니다. provod.ai에서는 루블화로 통합된 하나의 잔액과 OpenAI 및 Anthropic SDK와 호환되는 단일 API를 제공합니다. 코드 두 줄만 바꾸면 키 (key)와 base_url을 변경할 수 있으며, 사용 가능한 카탈로그와 결제 조건은 서비스 웹사이트에서 확인해야 합니다.
provod.ai가 적합하지 않은 경우
요약하자면: 당신의 과제가 모델에 대한 접근이 아니라, 배포 (distribution), 특정 서비스의 구독 플로우 (subscription flow), 또는 자체 인프라 (infrastructure) 구축일 때입니다.
AI 자동 생성 콘텐츠
본 콘텐츠는 Dev.to AI tag의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기