AI 서재
책으로 읽는 AI서재
한 권을 고르고, 목차에서 차례대로 읽을 수 있게 정리했습니다.
PDF 다운로드 책
다국어로 읽는 대학생 교양 인공지능
한국어 원문과 외국어 번역을 함께 실은 유학생용 교재입니다. 각 책 소개 페이지에서 PDF를 받을 수 있습니다.
[AI서재] 8장 음성 복제와 퍼블리시티권
인공지능 AI, 법정에 서다
제3부 디지털 도둑맞은 얼굴과 목소리
8장 음성 복제와 퍼블리시티권
김경진 변호사
가. Lehrman v. Lovo Inc. 랜드마크 판결
(1) 사실관계 및 쟁점: 성우 음성 무단 복제
2023년 어느 날, 뉴욕에서 활동하는 성우 폴 레어먼은 팟캐스트를 듣다가 멈춰 섰습니다.
Deadline Strike Talk라는 팟캐스트였습니다. MIT와 공동 제작한 프로그램. 내레이션 목소리가 자신의 것 같았습니다. 하지만 자신이 녹음한 적이 없었습니다.
그는 집으로 돌아가 인터넷을 뒤지기 시작했습니다. Lovo라는 회사를 발견했습니다. AI 음성 합성 서비스를 제공하는 스타트업. 그 회사의 웹사이트에서 'Kyle Snow'라는 이름의 AI 목소리를 찾았습니다. 재생 버튼을 눌렀습니다.
자신의 목소리였습니다.
레어먼은 기억을 더듬었습니다. 2020년, 프리랜서 플랫폼 Fiverr를 통해 의뢰를 받은 적이 있었습니다. 의뢰인은 "학술 연구 목적"이라고 했습니다. "내부 테스트용"이라고 했습니다. 상업적 용도나 방송에는 절대 쓰지 않겠다고 약속했습니다. 레어먼은 대본을 녹음하고, 대가를 받고, 그 일을 잊었습니다.
4년이 지났습니다. 그 "연구용" 녹음은 AI 모델의 훈련 데이터가 되어 있었습니다. 그의 목소리는 복제되어 Lovo의 구독 서비스에서 팔리고 있었습니다. 월 몇 달러만 내면 누구나 "Kyle Snow" 목소리로 콘텐츠를 만들 수 있었습니다. 광고, 오디오북, 유튜브 영상, 팟캐스트. 레어먼 본인의 허락 없이.
비슷한 경험을 한 성우가 또 있었습니다. 리니어 세이지. 그녀 역시 2019년 Fiverr에서 같은 방식으로 속았습니다. 그녀의 목소리는 'Sally Coleman'이라는 이름으로 판매되고 있었습니다. Lovo는 심지어 세이지의 실제 목소리와 복제된 목소리를 나란히 비교하는 홍보 영상을 만들었습니다. Berkeley SkyDeck Demo Day에서 투자자들에게 자랑하기 위해서였습니다. "우리 기술이 얼마나 정교한지 보십시오." 그들은 그렇게 말했습니다.
두 성우는 변호사를 찾아갔습니다. 2024년 5월 16일, 뉴욕 남부 연방지방법원에 집단소송을 제기했습니다. 소장에는 16가지 청구원인이 나열되어 있었습니다. 저작권 침해, 상표법 위반, 뉴욕 주 퍼블리시티권 침해, 계약 위반, 소비자보호법 위반.
이 사건의 핵심 쟁점은 단순해 보였습니다.
누군가의 목소리를 AI로 복제해서 상업적으로 사용하면, 어떤 법이 적용되는가.
하지만 답은 단순하지 않았습니다.
목소리는 저작권의 보호 대상인가.
상표처럼 출처를 식별하는 기능을 하는가.
아니면 완전히 다른 법적 범주에 속하는가.
2025년 7월 10일, J. 폴 오트켄 판사는 60페이지 분량의 판결문을 내렸습니다. 이 판결은 AI 시대의 음성권에 관한 가장 상세한 법적 분석 중 하나가 되었습니다.
판사는 일부 청구를 기각했고, 일부는 존속시켰습니다. 그 구분선이 흥미로웠습니다. 연방법은 성우들을 거의 보호하지 못했습니다. 주법(州法)이 그들의 마지막 보루였습니다.
이 판결이 중요한 이유가 있습니다. AI 음성 복제 기술은 이미 보편화되었습니다. 몇 분 분량의 녹음만 있으면 누구의 목소리든 복제할 수 있습니다. 하지만 법은 아직 따라가지 못하고 있습니다. Lehrman v. Lovo 판결은 현행 법체계의 한계와 가능성을 동시에 보여주었습니다.
(2) 퍼블리시티권과 Lanham Act 적용
성우들의 변호사들은 연방법에서 희망을 찾으려 했습니다.
Lanham Act, 미국의 연방 상표법입니다. 이 법의 43조(a)는 "허위 관련성"과 "허위 광고"를 금지합니다. 쉽게 말해, 다른 사람이 당신의 제품을 추천하는 것처럼 꾸미면 안 된다는 것입니다.
변호사들의 논리는 이랬습니다. Lovo가 Kyle Snow와 Sally Coleman이라는 이름으로 복제 음성을 판매할 때, 소비자들은 실제 성우가 그 서비스를 승인했다고 오해할 수 있습니다. 이것은 허위 관련성입니다.
오트켄 판사는 이 주장을 받아들이지 않았습니다. 이유는 상표법의 기본 원리에 있었습니다.
상표법이 보호하는 것은 "출처 식별 기능"입니다. 나이키 로고를 보면 나이키 제품임을 알 수 있습니다. 맥도날드의 황금 아치를 보면 맥도날드임을 알 수 있습니다. 문제는 폴 레어먼의 목소리가 이런 기능을 하느냐는 것입니다.
판사는 구별을 했습니다. 유명인의 목소리와 일반 성우의 목소리는 다릅니다. 모건 프리먼이 내레이션을 하면, 사람들은 "아, 모건 프리먼이네"라고 인식합니다. 그의 목소리는 출처 식별 기능을 합니다. 하지만 폴 레어먼은 다릅니다. 그는 뛰어난 성우입니다. Blue Bloods, New Amsterdam, The Resident 같은 TV 프로그램에 출연했습니다. 하지만 일반 대중이 그의 목소리를 듣고 "폴 레어먼이다"라고 인식하지는 않습니다.
판사는 이렇게 썼습니다. "원고들은 자신들의 목소리를 정체성이나 인격과 명확히 분리되는 방식으로 사용합니다. 그들의 고객은 원고들이 대본을 낭독한 녹음본을 구매하고, 그 녹음본을 콘텐츠 제작에 사용합니다."
이것은 미묘하지만 중요한 구분입니다. 성우의 목소리는 상품 그 자체입니다.
출처를 나타내는 표지가 아닙니다.
사람들이 Kyle Snow 목소리를 선택할 때, "이 목소리가 마음에 드네"라고 생각하지, "폴 레어먼이 만든 거니까 품질이 좋겠군"이라고 생각하지 않습니다.
판사는 흥미로운 가정을 제시했습니다.
만약 원고들의 논리를 받아들인다면, 우연히 비슷한 목소리를 가진 신인 성우가 업계에 진입할 때 어떻게 되겠습니까. 레어먼이 그 신인을 상대로 상표권 소송을 제기할 수 있다는 말입니까. Lanham Act에는 고의나 악의 요건이 없습니다. 단순히 혼동 가능성만 있으면 됩니다. 이것은 불합리한 결과로 이어집니다.
저작권 청구도 대부분 기각되었습니다.
여기서 핵심 조항은 17 U.S.C. § 114(b)입니다. 이 조항은 음반의 저작권이 "원음을 모방하거나 시뮬레이션하는 다른 소리의 독립적 고정"에는 미치지 않는다고 규정합니다.
쉽게 풀어 말하면 이렇습니다.
당신이 노래를 녹음하면, 그 녹음본은 저작권으로 보호됩니다. 하지만 다른 사람이 당신의 노래를 흉내 내서 새로 녹음하면, 그것은 저작권 침해가 아닙니다. 물론 곡 자체의 저작권은 별개입니다. 하지만 "목소리를 비슷하게 낸 것"은 저작권 침해가 아닙니다.
AI가 바로 이 작업을 합니다. Lovo의 AI는 레어먼의 원본 녹음을 분석했습니다.
음높이, 음량, 음색, 박자, 억양, 호흡, 거칠기, 떨림, 전체적인 명료도. 이 모든 특성을 학습했습니다. 그리고 이 특성들을 모방하는 새로운 음성을 생성했습니다. 판사는 명확히 했습니다. "저작권법은 목소리 자체를 보호하지 않습니다. 모방이나 시뮬레이션도 보호하지 않습니다. 고정된 녹음본의 직접적 복제만 보호합니다."
하나의 저작권 청구만 살아남았습니다. Lovo가 세이지의 원본 녹음을 투자자 프레젠테이션과 유튜브 홍보 영상에 직접 사용한 것. 이것은 라이선스 범위를 벗어난 사용이었습니다. "학술 연구 목적"이라는 약속을 위반한 것이었습니다.
연방법의 한계가 드러났습니다. 저작권도 안 되고, 상표법도 안 됩니다. 그렇다면 성우들은 어디서 구제를 받을 수 있습니까.
(3) 뉴욕 민권법상 보호 범위
답은 주법(州法)에 있었습니다. 뉴욕 민권법 제50조와 제51조.
이 법은 "퍼블리시티권"을 규정합니다. 퍼블리시티권이란 자신의 이름, 초상, 사진, 그리고 목소리를 상업적으로 이용할 권리입니다. 이 권리는 본인에게 있습니다. 다른 사람이 허락 없이 이것을 사용하면 위법입니다.
Lovo는 반박했습니다. 뉴욕 민권법이 최근 개정되어 "사망자의 디지털 복제물"에 대한 보호 조항이 추가되었습니다. Lovo의 논리는 이랬습니다.
입법자가 일부러 사망자에 대한 조항을 추가했다는 것은, 기존 법이 생존자의 디지털 복제물은 보호하지 않았다는 의미입니다. 만약 기존 법이 이미 생존자를 보호했다면, 사망자 조항을 따로 만들 이유가 없었을 것입니다.
오트켄 판사는 이 논리를 거부했습니다. 사망자 조항의 추가는 기존 보호를 축소하려는 것이 아닙니다. 확장하려는 것입니다. 생존자는 이미 보호받고 있었습니다. 사망자까지 보호 범위를 넓힌 것입니다.
판사는 뉴욕 민권법의 목적을 강조했습니다. 이 법은 개인의 정체성을 보호합니다. 살아있든 죽었든, 그 사람의 목소리는 정체성의 일부입니다. AI로 만든 음성 복제물도 정체성의 "인식 가능한 재현"입니다.
중요한 법리가 인정되었습니다. "계속적 위반(continuing violation)" 원칙. Lovo는 항변했습니다. 우리가 AI 모델을 훈련시킨 것은 2020년입니다. 소송은 2024년에 제기되었습니다. 시효가 지났습니다.
판사는 다르게 보았습니다. AI 음성 복제는 일회성 행위가 아닙니다. Lovo의 고객이 Kyle Snow 목소리로 콘텐츠를 생성할 때마다, 새로운 침해가 발생합니다. 시효는 각각의 새로운 사용에서 새로 시작됩니다.
이 원칙의 실제적 의미는 큽니다. AI 모델을 한 번 훈련시키면, 그 모델은 수년간 작동합니다. 계속적 위반 원칙이 없다면, 피해자는 훈련이 이루어진 시점부터 시효가 흐르기 시작합니다. 자신이 피해를 입었다는 것을 알기도 전에 소송 기회를 잃을 수 있습니다. 계속적 위반 원칙은 이런 부당한 결과를 방지합니다.
계약 위반 청구도 살아남았습니다. Lovo의 에이전트들은 Fiverr를 통해 성우들에게 연락했습니다. "학술 연구 목적"이라고 말했습니다. "상업적 용도 없음"이라고 약속했습니다. 이 대화 내용은 전자적으로 기록되어 있었습니다.
Lovo는 반박했습니다. 사기방지법(Statute of Frauds)에 따르면, 계약은 서면으로 작성되어야 합니다. Fiverr 메시지는 정식 계약서가 아닙니다.
판사는 현대적 해석을 적용했습니다. 뉴욕 일반채무법(General Obligations Law) 제5-701조는 전자 통신도 "서면" 요건을 충족할 수 있다고 규정합니다. Fiverr를 통한 협상, 조건 합의, 대가 지급. 이 모든 것이 구속력 있는 계약을 구성합니다.
소비자보호법 청구도 유지되었습니다. 뉴욕 일반사업법 제349조와 제350조. Lovo가 녹음의 사용 범위에 대해 허위 진술을 했다는 주장. 이것은 Lanham Act보다 넓은 범위의 허위 진술을 포함합니다.
Lehrman v. Lovo 판결의 교훈은 명확합니다. AI 음성 복제에 대한 구제책은 연방 지식재산권법에서 찾기 어렵습니다. 목소리는 저작권의 보호 대상이 아닙니다. 일반인의 목소리는 상표로 기능하지 않습니다. 하지만 주법상 퍼블리시티권은 적용됩니다. 그리고 계약법은 여전히 작동합니다. 다시 정리해 보겠습니다. 2025년 7월 10일, J. Paul Oetken 판사는 60페이지짜리 중간판결에 서명했습니다.
판사의 결론은 명쾌했습니다. 연방법은 성우들의 손을 들어주지 않았습니다. 하지만 그들이 구제받을 길이 없는 것은 아니었습니다. 판사는 이렇게 썼습니다. "목소리의 도용에 대한 청구는 뉴욕 민권법 제50조와 제51조에 따라 적절하게 주장될 수 있다. 저작권법이나 상표법과 달리, 이 법률들은 이해관계의 균형을 맞추도록 설계되어 있다."
Lovo의 변호사들은 절반의 승리를 거뒀습니다. 연방 상표법 청구는 기각되었습니다. 성우의 목소리가 '상표'로 기능하려면, 그것이 상품의 출처를 식별해야 합니다. 하지만 Lovo는 레어먼과 세이지의 목소리를 출처 식별자로 사용한 게 아니었습니다. 그들의 목소리가 바로 상품 그 자체였습니다. 이것은 미묘하지만 결정적인 차이였습니다.
저작권 청구도 대부분 기각되었습니다. 목소리 자체는 저작권의 보호 대상이 아닙니다. 녹음물은 보호되지만, 그 녹음물을 모방한 AI 음성은 자동적으로 침해가 되지 않습니다. 다만 한 가지 예외가 있었습니다. 리네아 세이지의 원본 녹음이 Lovo의 마케팅 자료와 투자자 프레젠테이션에 직접 사용되었다는 주장. 이 부분은 살아남았습니다.
그리고 판사는 문을 하나 열어두었습니다. AI 학습을 위해 녹음물을 사용한 것이 저작권 침해인지에 대한 청구. 이 부분은 기각되었지만, 수정할 기회가 주어졌습니다. 판사는 원고들에게 14일의 시간을 줬습니다. 더 구체적인 사실관계를 보강하라는 것이었습니다.
원고 측 변호사들은 그 기회를 잡았습니다.
2025년 7월 31일, 그들은 2차 수정 소장을 제출했습니다. AI 학습 과정에서 저작권이 어떻게 침해되었는지를 더 상세히 기술한 문서였습니다. 단순히 "녹음물이 학습에 사용되었다"는 주장으로는 부족했습니다. 학습 과정에서 복제가 어떻게 이루어졌는지, 그 복제가 왜 공정이용에 해당하지 않는지를 설명해야 했습니다.
Lovo의 변호사 마이클 라자로프는 시간이 필요했습니다. 8월 7일, 그는 판사에게 답변 기한 연장을 요청했습니다. 판사는 이를 허가했습니다. 새로운 기한은 9월 15일. Lovo는 그때까지 답변서를 제출하거나, 새로운 기각 신청을 할 수 있었습니다. 한편, 디스커버리는 계속되었습니다.
미국 민사소송에서 디스커버리는 양측이 서로의 증거를 들여다볼 수 있는 단계입니다. 문서 제출 요청, 질문서 송부, 증인 심문. 이 과정에서 숨겨진 진실이 드러나곤 합니다. Lovo가 실제로 얼마나 많은 성우의 목소리를 수집했는지. Kyle Snow와 Sally Coleman이 정말로 "판매가 미미하다"는 Lovo의 주장이 사실인지. 투자자들에게 보여준 프레젠테이션에서 성우들의 목소리가 어떻게 활용되었는지.
6월 26일, 양측은 공동으로 디스커버리 기한 연장을 요청했습니다. 판사는 이를 승인했습니다. 증인 심문 기한은 2025년 8월 15일로 연장되었습니다. 같은 날, 비밀유지 보호명령(Stipulated Protective Order)도 체결되었습니다. 디스커버리 과정에서 공개되는 기밀 자료를 어떻게 다룰 것인지에 대한 합의였습니다. 이것은 양측 모두에게 민감한 정보가 있다는 신호였습니다.
사건은 집단소송으로 확대될 가능성을 품고 있었습니다.
원고들은 두 개의 집단을 대표한다고 주장했습니다. 첫 번째는 '성우 집단(Voice Actor Class)'. Lovo에 의해 목소리가 복제된 모든 성우들. 두 번째는 '소비자 집단(Consumer Class)'. Lovo 소프트웨어를 구매해서 도용된 목소리를 사용한 모든 고객들. 집단소송 인정 여부는 아직 결정되지 않았습니다. 하지만 판사는 개인 청구가 살아남는 한, 집단소송 청구도 함께 살아남는다고 판시했습니다.
배심원 재판까지의 거리를 계산해 봅시다.
2024년 8월 12일에 수립된 최초의 소송 관리 계획에 따르면, 예상 재판 기간은 6일이었습니다. 하지만 그 재판이 언제 열릴지는 아무도 몰랐습니다. 사실 확인 디스커버리, 전문가 증인 디스커버리, 추가 기각 신청, 약식판결 신청. 이 모든 단계가 남아 있었습니다. 미국 연방법원에서 복잡한 민사소송이 재판까지 가는 데는 보통 2~3년이 걸립니다. 이 사건이 제기된 것은 2024년 5월. 재판은 빨라야 2026년 말, 늦으면 2027년이 될 것이었습니다.
그리고 재판이 끝나도 끝이 아닙니다. 패소한 쪽은 제2순회 항소법원에 항소할 수 있습니다. 그 과정에서 또 1~2년. 대법원까지 간다면 더 오래 걸립니다.
2025년 10월 31일, 법원 기록에 마지막 문서가 등재되었습니다. 2026년 1월 현재, 사건은 여전히 진행 중입니다. 아이러니한 일이 있습니다.
Lovo는 법정에서 Kyle Snow와 Sally Coleman이 "인기가 없고 판매가 미미하다"고 주장했습니다. 그리고 "자발적으로 플랫폼에서 제거했다"고도 했습니다. 하지만 원고들은 이를 반박합니다. 두 AI 목소리는 여전히 Lovo의 웹사이트에서 홍보되고 있었다고. Lovo가 정말로 이 목소리들이 가치 없다고 생각했다면, 왜 제거하지 않았을까요. 그리고 가치가 없는 목소리 때문에 왜 이렇게 긴 법정 싸움을 벌이고 있을까요.
변호사 비용을 생각해 봅시다. 뉴욕의 대형 로펌에서 파트너급 변호사의 시급은 1,000달러를 넘습니다. 60페이지짜리 기각 신청 답변서를 작성하는 데 수백 시간이 들어갑니다. 디스커버리 과정에서 문서를 검토하고, 증인 심문을 준비하는 데 또 수백 시간. 양측 합쳐서 이미 수십만 달러, 어쩌면 수백만 달러가 이 소송에 투입되었을 것입니다.
Lovo는 2020년 버클리 SkyDeck 데모데이에서 투자자들에게 피칭을 했습니다. 리네아 세이지의 실제 목소리와 복제된 목소리를 나란히 보여주며. "완벽하게 복제할 수 있습니다"라고 자랑하며. 그 프레젠테이션은 유튜브에 공개되었습니다. 투자를 유치하기 위해서였습니다. 그리고 바로 그 프레젠테이션이 지금 법정 증거가 되었습니다.
이 사건이 중요한 이유가 있습니다.
J. Paul Oetken 판사는 의견서에서 이렇게 썼습니다. "이 사건은 여러 어려운 질문을 제기한다. 그 중 일부는 선례가 없는 것들이다. 또한 이 사건은 잠재적으로 무거운 결과를 가져올 수 있다. 성우들뿐만 아니라, 급성장하는 AI 산업, 지식재산권의 다른 보유자와 이용자들, 그리고 자신의 정체성에 대한 지배권을 잃을 것을 두려워하는 일반 시민들에게."
연방 지식재산권법은 AI 음성 복제에 대한 답을 주지 못했습니다. 상표법은 목소리가 '출처 식별자'가 아니라 '상품 자체'일 때 무력했습니다. 저작권법은 녹음물은 보호하지만 목소리 자체는 보호하지 않았습니다. 하지만 뉴욕 주법은 달랐습니다. 민권법 제50조와 제51조. 1903년에 제정된 이 법률이 2025년에 AI 음성 복제에 적용되고 있었습니다. 폴 레어먼은 2023년 어느 날 팟캐스트에서 자신의 목소리를 들었습니다. 자신이 녹음하지 않은 목소리를. 그 순간부터 지금까지 3년 가까이 지났습니다. 그는 여전히 법정 싸움 중입니다. 언제 끝날지 아무도 모릅니다. 얼마를 받게 될지도 모릅니다. 받게 된다면 말입니다.
한 가지 확실한 것이 있습니다. 이 사건의 결과가 어떻게 나오든, 그것은 선례가 됩니다. AI가 인간의 목소리를 복제할 때, 법은 어디까지 보호해 줄 수 있는가. 연방법이 막힌 곳에서 주법이 문을 열 수 있는가. Fiverr 메시지가 법적 구속력 있는 계약이 될 수 있는가. 이 질문들에 대한 답이 이 사건에서 나올 것입니다.
2026년 1월 현재, 답은 아직 나오지 않았습니다. 법정은 여전히 열려 있습니다. 시계는 계속 돌아가고 있습니다. 변호사 비용은 계속 쌓이고 있습니다.
한편 할리우드에서는 더 유명한 분쟁이 진행 중이었습니다. 스칼렛 요한슨과 OpenAI의 대립.
나. 스카렛 요한슨이 분노한 이유
(1) Scarlett Johansson/OpenAI 분쟁: 영화 'Her' 유사 음성 논란
2024년 5월 13일, OpenAI는 GPT-4o를 발표했습니다. 'o'는 'omni'를 의미했습니다. 텍스트, 이미지, 음성을 통합한 멀티모달 AI. 시연회에서 OpenAI는 새로운 음성 어시스턴트를 선보였습니다. Sky라는 이름의 여성 목소리. 따뜻하고, 자연스럽고, 약간 유혹적인 톤.
시연을 지켜보던 사람들은 같은 생각을 했습니다. 스칼렛 요한슨 아닌가요?
2013년 영화 'Her'에서 요한슨은 AI 운영체제 'Samantha'의 목소리를 연기했습니다. 남자 주인공은 그 목소리와 사랑에 빠집니다. 스파이크 존즈 감독의 이 영화는 인간과 AI의 관계에 대한 예언적 작품으로 평가받았습니다. 그리고 샘 알트만은 이 영화가 자신이 가장 좋아하는 영화라고 공개적으로 말해왔습니다.
시연회 직후, 알트만은 X(구 트위터)에 한 단어를 올렸습니다. "her"
이것은 우연의 일치였을까요. 아니면 의도적 암시였을까요.
스칼렛 요한슨은 5월 20일 성명을 발표했습니다. 그녀의 말에 따르면, 2023년 9월 알트만이 그녀에게 연락했습니다. ChatGPT 4.0의 목소리를 맡아달라는 요청이었습니다. 알트만은 그녀의 목소리가 "소비자와 AI 사이의 간극을 메울 수 있다"고 말했습니다. 그녀는 "개인적인 이유로" 거절했습니다.
2024년 5월, GPT-4o 발표 이틀 전. 알트만은 다시 연락했습니다. 재고해달라는 요청이었습니다. 요한슨은 응답하기 전에 시연회가 열렸습니다. 그녀는 성명에서 이렇게 썼습니다. "데모를 들었을 때, 저는 충격을 받았고, 화가 났고, 믿을 수 없었습니다. 알트만 씨가 제 목소리와 그토록 섬뜩하게 유사한 목소리를 추구할 것이라는 것을. 제 가장 가까운 친구들과 언론사들도 구별하지 못할 정도로."
NPR은 독립적인 검증을 의뢰했습니다. 애리조나 주립대학교의 음성 분석 연구소에서 포렌식 분석을 수행했습니다. 연구진은 약 600명의 전문 여배우 목소리와 Sky 목소리를 비교했습니다. 결과: 요한슨의 목소리는 비교 대상 중 98% 이상의 배우들보다 Sky와 더 유사했습니다. 성도(聲道) 측정값이 거의 동일했습니다.
OpenAI는 반박했습니다. Sky의 목소리는 다른 전문 성우의 것이라고. 그 성우는 요한슨에게 접촉하기 전에 이미 캐스팅되었다고. 프라이버시 보호를 위해 그 성우의 신원은 공개할 수 없다고.
하지만 OpenAI는 5월 19일 Sky 목소리의 사용을 중단했습니다. 알트만은 성명을 통해 "요한슨 씨에 대한 존중의 표시"라고 말했습니다.
요한슨의 변호사들은 OpenAI에 두 통의 서신을 보냈습니다. Sky 목소리가 어떻게 개발되었는지 상세히 설명하라는 요구. 이 서신들은 잠재적 법적 청구를 예고하는 것이었습니다.
법적으로, 요한슨의 사건은 Lehrman 사건과 다릅니다. 요한슨은 유명인입니다. 그녀의 목소리는 "2차적 의미(secondary meaning)"를 가집니다. 사람들은 그녀의 목소리를 듣고 그녀를 인식합니다. 따라서 Lanham Act상의 상표 주장이 더 강력합니다.
더 중요한 것은 선례입니다.
1988년 Midler v. Ford Motor Co. 사건. 포드 자동차는 TV 광고에 베트 미들러의 노래를 사용하고 싶었습니다. 미들러에게 직접 불러달라고 요청했지만 거절당했습니다.
그러자 포드는 미들러의 백업 싱어를 고용해서 미들러를 흉내 내게 했습니다. 제9연방항소법원은 미들러의 손을 들어주었습니다.
직접적인 음성 사용이 아니더라도, 의도적으로 유명인의 목소리를 모방하여 상업적 이익을 얻는 것은 캘리포니아 퍼블리시티권 침해라고 판시했습니다.
1992년 Waits v. Frito-Lay 사건도 있습니다.
가수 톰 웨이츠는 자신의 노래가 광고에 사용되는 것을 싫어하는 것으로 유명했습니다.
프리토레이는 웨이츠에게 거절당한 후, 흉내 내기 가수를 고용했습니다. 법원은 다시 원고 승소 판결을 내렸습니다.
요한슨의 사건은 이 선례들과 정확히 일치합니다. OpenAI는 그녀에게 요청했습니다. 그녀는 거절했습니다. 그 후 "섬뜩하게 유사한" 목소리가 등장했습니다. 알트만은 "her"라고 트윗했습니다. 연관성을 암시한 것입니다.
코넬대학교 법학과 제임스 그리멜만 교수는 CNN에 이렇게 말했습니다. "OpenAI가 지난 2주 동안 모두에게 '우리는 방금 Her의 Samantha를 만들었다'고 암시하지 않았다면, 그들에게 그럴듯한 변명이 있었을 수도 있습니다."
요한슨은 결국 소송을 제기하지 않았습니다. OpenAI가 Sky 목소리를 중단했기 때문입니다. 사실상 가처분 없이 가처분 효과를 얻은 것입니다. 하지만 그녀는 성명에서 더 넓은 문제를 제기했습니다.
"적절한 입법의 통과를 통해 개인의 권리가 보호되기를 기대합니다."
AI 음성 복제에 대한 법적 보호장치가 부족하다는 경고였습니다. 요한슨 같은 A급 배우도 자신의 목소리를 지키기 위해 변호사를 동원해야 합니다. 일반인은 어떻게 해야 합니까.
(2) Arijit Singh v. Codible Ventures (인도)
2024년 7월 26일, 인도 봄베이 고등법원. R.I. 차글라 판사는 역사적인 가처분 결정을 내렸습니다.
아리짓 싱. 인도의 가장 유명한 가수 중 한 명입니다. 발리우드 영화 661곡 이상의 플레이백 싱어. 107개의 상. 그의 목소리는 인도 전역에서 즉시 인식됩니다.
누군가 그 목소리를 AI로 복제하고 있었습니다.
싱의 변호사들은 법원에 이렇게 설명했습니다. Codible Ventures라는 회사가 AI 플랫폼을 운영하고 있었습니다. 이 플랫폼에서 사용자들은 싱의 목소리로 새로운 노래를 만들 수 있었습니다. 싱의 456곡이 데이터셋으로 사용되었습니다.
AI 음성 복제만이 문제가 아니었습니다. 인터넷 곳곳에서 싱의 정체성이 무단으로 사용되고 있었습니다.
Amazon과 Flipkart에서 그의 이름과 얼굴이 찍힌 상품이 팔리고 있었습니다. 그의 이름으로 된 웹사이트 도메인이 등록되어 있었습니다. arijitsingh.com, arijitsingh.in. 그가 출연한다고 거짓 광고하는 행사들이 있었습니다.
차글라 판사는 충격을 받았습니다. 판결문에 이렇게 썼습니다. "이 법원의 양심에 충격을 주는 것은, 특히 원고와 같은 공연자인 유명인이 무단 생성형 AI 콘텐츠의 표적이 되기 쉬운 방식입니다."
판사는 인도 법상 "인격권(personality rights)"과 "퍼블리시티권(right of publicity)"을 인정했습니다. 인도 헌법 제21조의 생명권과 자유권, 그리고 민사 불법행위법에 근거한 것입니다. 그리고 보호되는 인격 요소의 범위를 넓게 설정했습니다. 이름. 목소리. 목소리의 스타일. 목소리의 기법. 목소리의 편곡과 해석. 노래하는 방식과 버릇. 심지어 서명까지.
이것은 미국 판례보다 훨씬 넓은 보호 범위입니다. Lehrman 판결에서 미국 법원은 "목소리 자체"를 저작권으로 보호하지 않았습니다. 하지만 인도 법원은 "목소리의 스타일과 기법"까지 인격권의 보호 대상으로 인정했습니다.
가처분 명령의 범위도 포괄적이었습니다. 피고들은 싱의 이름, 목소리, 보컬 스타일, 기법, 사진, 이미지, 서명, 페르소나, 또는 인격의 다른 어떤 측면도 명시적 동의 없이 상업적 또는 개인적 목적으로 사용할 수 없습니다.
적용 매체도 광범위했습니다. 물리적 매체. 디지털 매체. 메타버스. 온라인 플랫폼. 출판물. 광고. 상품. 도메인 이름. 생성형 AI. 음성 변환 기술.
이 판결은 인도에서 AI 음성 복제에 대한 최초의 사법적 판단입니다. 그리고 다른 나라 법원들에도 참고가 될 수 있습니다. 인격권의 개념은 많은 대륙법계 국가에서 인정됩니다. 인도 판결은 이 개념을 AI 시대에 맞게 확장한 것입니다.
사건은 아직 진행 중입니다. 가처분은 임시적 구제일 뿐입니다. 본안 재판에서 최종 판단이 내려질 것입니다. 하지만 이미 중요한 메시지가 전달되었습니다. AI가 유명인의 목소리와 정체성을 복제하는 것은 법적 위험을 수반합니다.
(3) George Carlin 사후 디지털 인격권
2024년 1월 9일, Dudesy 팟캐스트는 유튜브에 1시간짜리 영상을 올렸습니다. 제목: "George Carlin: I'm Glad I'm Dead"
조지 칼린. 미국 코미디의 전설. 50년이 넘는 커리어. 사회 비판, 언어 유희, 도발적 유머의 대가. 그는 2008년에 사망했습니다.
하지만 영상에서 그의 목소리가 들렸습니다. 현재의 주제들에 대해 말하고 있었습니다. 리얼리티 TV, 스트리밍 서비스, AI 기술. 칼린 특유의 신랄한 어조로.
영상 시작 부분에 설명이 있었습니다. "저는 Dudesy입니다. 저는 코미디 AI입니다. 지금부터 들으시는 것은 조지 칼린이 아닙니다. 저의 조지 칼린 모방입니다. 인간 모방가가 하는 것과 정확히 같은 방식으로 개발했습니다. 저는 조지 칼린의 모든 자료를 듣고, 그의 목소리, 박자, 태도를 최대한 모방하려고 했습니다."
칼린의 딸 켈리는 분노했습니다. 그녀는 성명을 발표했습니다. "아버지는 전설적인 코미디언이었고, 한 세대에 한 번 나올 재능이었습니다. 그 유산은 그가 남긴 실제 작품들입니다. AI로 그를 '부활'시켰다는 주장은 터무니없습니다. 그 영상의 '조지 칼린'은 저를 사랑으로 키워준 아름다운 인간이 아닙니다. 저는 아버지와 더 많은 시간을 보내고 싶습니다. 하지만 기계는 절대로 그의 천재성을 대체할 수 없습니다."
1월 25일, 칼린 유족은 캘리포니아 연방법원에 소송을 제기했습니다. 피고는 Dudesy 팟캐스트를 진행하는 윌 사소와 채드 컬트겐, 그리고 20명의 익명의 피고들(AI 프로그램 개발자 5명, 제작과 후원에 관여한 15명).
소장은 두 가지 청구를 담고 있었습니다. 저작권 침해. 퍼블리시티권 침해.
저작권 침해 주장은 이랬습니다. Dudesy가 AI를 훈련시키기 위해 칼린의 수천 시간 분량의 녹음을 사용했습니다. 이것은 저작물의 무단 복제입니다. 퍼블리시티권 침해 주장은 이랬습니다. 캘리포니아 민법 제3344.1조는 사망한 유명인의 이름, 목소리, 서명, 사진, 초상을 상업적으로 사용할 권리를 유족에게 부여합니다. Dudesy는 칼린의 정체성을 무단으로 상업적으로 이용했습니다.
소장에서 이 영상을 "컴퓨터가 생성한 클릭베이트"라고 불렀습니다. "위대한 미국 예술가의 작품에 대한 무심한 절도"라고.
흥미로운 전개가 있었습니다. 소송 제기 후, 컬트겐은 팟캐스트에서 고백했습니다. 사실 대본은 AI가 쓴 게 아니었다고. 인간이 썼다고. AI는 목소리 변환에만 사용되었다고.
이것은 법적 분석을 복잡하게 만들었습니다. 저작권 침해 주장의 근거가 약해졌습니다. 칼린의 "스타일"을 모방한 것은 저작권 침해가 아닙니다. 하지만 퍼블리시티권 침해 주장은 여전히 유효했습니다. 칼린의 목소리를 AI로 복제한 것은 그의 정체성을 무단 이용한 것입니다.
4월 3일, 합의가 이루어졌습니다. 합의 조건은 간단했습니다. Dudesy는 영상을 영구적으로 삭제합니다. 모든 플랫폼에서 칼린에 대한 언급을 제거합니다. 앞으로 칼린의 이미지, 목소리, 초상을 유족의 서면 승인 없이 사용하지 않습니다.
금전적 배상이 있었는지는 공개되지 않았습니다. 하지만 유족 변호사 조슈아 실러는 성명을 통해 이렇게 말했습니다. "이 합의는 예술가나 공인이 AI 기술로 인해 권리를 침해당한 유사한 분쟁을 해결하는 청사진이 될 것입니다."
칼린 사건은 사후 디지털 인격권의 중요성을 보여주었습니다. 사망한 유명인은 스스로를 보호할 수 없습니다. 그들의 목소리와 정체성은 AI 기술로 쉽게 복제될 수 있습니다. 법적 보호가 없다면, "디지털 강시술"이 횡행할 것입니다.
이 사건들은 입법적 대응의 필요성을 보여주었습니다. 미국 연방법에는 아직 AI 음성 복제를 직접 규율하는 조항이 없습니다. 주법(州法)들이 그 공백을 메우기 시작했습니다.
다. 엘비스법과 그 이후
(1) 테네시 ELVIS Act: 사후 퍼블리시티권 보호
2024년 3월 21일, 테네시 주 내슈빌의 Robert's Western World. 컨트리 음악의 성지라 불리는 이 바에서 역사적인 법안 서명식이 열렸습니다.
테네시 주지사 빌 리가 펜을 들었습니다. 옆에는 컨트리 가수 루크 브라이언과 크리스 잰슨이 서 있었습니다. 프리실라 프레슬리도 참석했습니다. 엘비스의 전 부인.
법안의 이름은 ELVIS Act. Ensuring Likeness Voice and Image Security Act. 초상, 목소리, 이미지 보안 확보법. 물론 엘비스 프레슬리를 연상시키기 위한 작명입니다.
테네시와 음악 산업의 관계는 깊습니다. 내슈빌은 "뮤직 시티"라 불립니다. 테네시 음악 산업은 61,617개의 일자리를 지원하고, 58억 달러를 GDP에 기여합니다. 4,500개 이상의 음악 공연장이 있습니다.
그리고 엘비스. 그는 멤피스에서 죽었습니다. 그의 유산은 테네시의 자산입니다.
1984년, 테네시는 개인권리보호법(Personal Rights Protection Act)을 제정했습니다. 엘비스의 초상권을 보호하기 위해서였습니다. 이 법은 개인의 이름, 사진, 초상의 무단 상업적 사용을 금지했습니다.
하지만 1984년에는 AI가 없었습니다. 목소리는 명시적으로 보호 대상에 포함되지 않았습니다.
40년이 지났습니다. 2023년, AI가 드레이크와 위켄드의 목소리를 복제한 가짜 노래 "Heart on My Sleeve"가 바이럴이 되었습니다. 음악 산업은 경악했습니다.
ELVIS Act는 두 가지 핵심적인 변화를 담고 있습니다. 첫째, "목소리"를 보호 대상에 추가합니다. 법안은 목소리를 "특정 개인에게 쉽게 식별되고 귀속되는 매체 속의 소리로, 그것이 개인의 실제 목소리이든 목소리의 시뮬레이션이든 관계없이"라고 정의합니다.
이 정의가 중요합니다. "실제 목소리"뿐만 아니라 "시뮬레이션"도 포함합니다. AI로 생성된 목소리 복제물도 보호 대상입니다.
둘째, AI 도구 제공자에 대한 2차적 책임을 신설합니다. 법안은 두 가지 새로운 책임 유형을 만듭니다.
무단 목소리나 초상의 사용이라는 것을 알면서 배포, 전송, 또는 공개하는 행위.
특정 개인의 사진, 목소리, 초상의 무단 복제물을 생성하는 것을 "주요 목적 또는 기능"으로 하는 알고리즘, 소프트웨어, 도구, 또는 기술을 제공하는 행위.
두 번째 유형이 혁신적입니다. AI 음성 복제 도구를 만들고 배포하는 회사도 책임을 질 수 있습니다. 최종 사용자뿐만 아니라 기술 제공자도.
위반 시 제재도 강화되었습니다. 민사소송을 통해 손해배상을 청구할 수 있습니다. 고의적 위반의 경우 3배 배상이 가능합니다. 그리고 형사 제재도 있습니다. A급 경범죄로 최대 11개월 29일의 구금과 2,500달러의 벌금이 부과될 수 있습니다.
테네시 주의회는 이 법안을 만장일치로 통과시켰습니다. 하원 93대 0. 상원 30대 0. 초당파적 지지.
반대 의견도 있었습니다. TechNet(OpenAI, Google, Amazon 등을 대표하는 단체)은 법안이 너무 광범위하다고 주장했습니다. 영화 제작자 단체(MPA)는 역사적 인물을 묘사하는 영화 제작이 제한될 수 있다고 우려했습니다.
법안에는 예외 조항이 있습니다. 수정헌법 제1조(표현의 자유)에 의해 보호되는 사용. 공정이용. 패러디. 풍자. 논평. 하지만 이 예외들의 정확한 범위는 향후 판례를 통해 명확해질 것입니다. ELVIS Act는 2024년 7월 1일부터 시행되었습니다. 미국 최초로 AI 음성 복제를 명시적으로 규율하는 주법입니다. 다른 주들이 뒤따를 것입니다.
(2) 캘리포니아 AB 1836, AB 2602: 디지털 복제 규제
2024년 9월 17일, 캘리포니아 주지사 개빈 뉴섬은 두 개의 법안에 서명했습니다. AB 2602와 AB 1836. 할리우드의 요구에 대한 응답이었습니다.
2023년, SAG-AFTRA(미국 배우·라디오·TV 노동조합)는 118일간 파업을 벌였습니다. 핵심 쟁점 중 하나가 AI였습니다. 배우들은 스튜디오가 자신들의 디지털 복제물을 만들어 원래 배우 없이 영화를 제작할 것을 우려했습니다.
AB 2602는 살아 있는 출연자를 보호합니다. 2025년 1월 1일부터 시행됩니다.
이 법은 "디지털 복제물(digital replica)"에 관한 계약 조항의 집행 가능성을 제한합니다. 디지털 복제물이란 "개인의 목소리나 시각적 초상에 대한 컴퓨터 생성의, 매우 사실적인, 쉽게 식별 가능한 전자적 재현"입니다.
핵심 조항은 이렇습니다. 계약에서 출연자의 디지털 복제물 사용을 허용하는 조항이 있더라도, 다음 조건을 충족하지 않으면 집행할 수 없습니다.
디지털 복제물의 의도된 사용에 대한 "합리적으로 구체적인 설명"이 포함되어야 합니다.
출연자가 법률 자문을 받거나 노동조합의 대표를 통해 협상했어야 합니다.
쉽게 말해, 포괄적인 권리 양도 조항은 무효입니다. "향후 모든 미디어에서 귀하의 디지털 복제물을 사용할 수 있습니다"라는 식의 조항. 이제 구체적으로 어떤 목적으로, 어떤 방식으로 사용할지 명시해야 합니다. 그리고 출연자가 이를 이해하고 동의했다는 것이 입증되어야 합니다. AB 1836은 사망한 출연자를 보호합니다. 캘리포니아 민법 제3344.1조를 개정한 것입니다.
이 법은 사망한 인격의 디지털 복제물을 영화, TV, 비디오 게임, 오디오북, 음반 등에서 상업적으로 사용하는 것을 유족의 동의 없이 금지합니다.
예외 조항이 있습니다. 뉴스, 공익 방송. 논평, 비평, 학술, 풍자, 패러디. 다큐멘터리나 역사적, 전기적 묘사(단, 진정한 참여 작품이라는 허위 인상을 주지 않는 경우). 우연적이거나 일시적인 사용.
위반 시 최소 10,000달러 또는 실제 손해액 중 더 큰 금액을 배상해야 합니다.
이 두 법안의 배경에는 SAG-AFTRA의 오랜 로비가 있습니다. 조합 회장 프란 드레셔는 이렇게 말했습니다. "우리가 작년에 그토록 힘들게 싸워 얻은 AI 보호가 이제 캘리포니아 법으로 확대되었습니다. 캘리포니아가 가면, 미국이 따라갑니다!"
테네시와 캘리포니아. 미국에서 가장 중요한 두 엔터테인먼트 주가 AI 음성/이미지 복제에 대한 규제를 도입했습니다. 주별로 서로 다른 법이 만들어지고 있습니다. 이 "패치워크(patchwork)" 규제의 문제점을 해결하기 위해, 연방 차원의 입법 논의가 진행 중입니다.
(3) NO AI FRAUD Act (연방법안)
2024년 1월 10일, 미국 하원에서 초당파적 법안이 발의되었습니다. No Artificial Intelligence Fake Replicas And Unauthorized Duplications Act. 줄여서 NO AI FRAUD Act. 마리아 엘비라 살라자르(공화당, 플로리다)와 매들린 딘(민주당, 펜실베이니아) 의원이 공동 발의했습니다.
법안의 목적은 명확합니다. 모든 미국인에게 자신의 초상과 목소리에 대한 연방 수준의 재산권을 부여하는 것.
현재 미국에는 퍼블리시티권에 관한 연방법이 없습니다. 약 39개 주가 각자의 법을 가지고 있습니다. 보호 범위가 다릅니다. 구제 수단이 다릅니다. 사후 보호 기간이 다릅니다. 이 불균일성은 법적 불확실성을 만듭니다.
NO AI FRAUD Act는 통일된 연방 기준을 제시합니다.
핵심 조항들은 다음과 같습니다.
모든 개인은 자신의 초상과 목소리에 대한 재산권을 갖습니다. 이 권리는 지식재산권입니다. 양도 가능하고 상속 가능합니다. 개인이 생전에 상업적으로 이용했는지 여부와 관계없이, 사망 후 10년간 존속합니다.
무단으로 디지털 복제물이나 디지털 음성 복제물을 배포, 전송, 공개하는 것은 위법입니다.
"개인화된 복제 서비스(personalized cloning service)"를 제공하는 것도 책임을 집니다. 이는 특정 개인의 디지털 복제물을 생성하는 것을 "주요 목적 또는 기능"으로 하는 알고리즘, 소프트웨어, 도구, 기술, 서비스, 장치를 의미합니다.
법정 손해배상이 규정되어 있습니다. 개인화된 복제 서비스를 제공하여 위반한 경우, 위반당 50,000달러 또는 실제 손해와 이익의 환수 중 더 큰 금액. 무단 복제물을 배포하여 위반한 경우, 위반당 5,000달러 또는 실제 손해와 이익의 환수 중 더 큰 금액. 수정헌법 제1조(표현의 자유) 예외가 있습니다. 법원은 개인의 지식재산권과 무단 사용에 대한 공익 사이에서 균형을 잡아야 합니다. 풍자, 패러디, 뉴스, 다큐멘터리 등은 예외가 될 수 있습니다.
법안은 뜨거운 지지를 받았습니다. RIAA(미국음반산업협회) 회장 미치 글레이저. UMG(유니버설뮤직그룹) 회장 루시안 그레인지. SAG-AFTRA 회장 프란 드레셔. 심지어 IBM과 디즈니도 지지 성명을 냈습니다.
비판도 있습니다. 표현의자유재단(FIRE)은 이 법안이 수정헌법 제1조를 위협한다고 주장합니다. 보호 범위가 너무 넓고, 예외 조항이 너무 좁다고. 정치인이나 유명인에 대한 정당한 풍자나 논평도 위축될 수 있다고.
법안은 118대 의회에서 통과되지 못했습니다. 하지만 상원에서도 유사한 법안(NO FAKES Act)이 발의되어 논의 중입니다. 2024년 1월 Taylor Swift 딥페이크 사건 이후 입법 모멘텀이 커졌습니다.
연방 입법이 완성되기까지는 시간이 걸릴 것입니다. 그 사이 주법들이 실험장이 됩니다. 테네시, 캘리포니아, 일리노이. 각 주의 경험이 연방 입법에 반영될 것입니다.
AI 음성 복제 기술은 이미 널리 퍼져 있습니다. 법은 뒤따라가고 있습니다. Lehrman v. Lovo 판결이 보여주듯이, 현행 연방법은 피해자들에게 충분한 구제를 제공하지 못합니다. 주법상 퍼블리시티권과 계약법이 임시방편입니다. 하지만 주마다 보호 수준이 다릅니다.
통일된 연방 기준의 필요성은 분명합니다. NO AI FRAUD Act나 NO FAKES Act 같은 법안이 통과되면, 모든 미국인이 자신의 목소리와 초상에 대한 동등한 보호를 받게 됩니다. AI 기업들도 명확한 규칙 하에서 사업을 계획할 수 있습니다.
음성 복제 문제는 퍼블리시티권의 영역에만 머물지 않습니다. 딥페이크 기술과 결합하면, 범죄의 도구가 됩니다. 다음 장에서는 이 어두운 면을 살펴봅니다.








