AI 서재
책으로 읽는 AI서재
한 권을 고르고, 목차에서 차례대로 읽을 수 있게 정리했습니다.

대학생을 위한 교양 인공지능
프랑스어·한국어 쌍어판
372쪽 PDF. 인공지능의 기본 개념과 대학 생활에서 AI를 쓰는 방법을 두 언어로 읽는 교재입니다.
한국에 유학 온 외국인 학생들은 이 교재를 무료로 마음껏 내려받아 사용해도 좋습니다. 개인 학습과 수업 자료로 쓰고, 필요한 부분을 인쇄해 공부해도 좋습니다.
책 소개PDF 다운로드
대학생을 위한 교양 인공지능
러시아어·한국어 쌍어판
372쪽 PDF. 인공지능의 기본 개념과 대학 생활에서 AI를 쓰는 방법을 두 언어로 읽는 교재입니다.
한국에 유학 온 외국인 학생들은 이 교재를 무료로 마음껏 내려받아 사용해도 좋습니다. 개인 학습과 수업 자료로 쓰고, 필요한 부분을 인쇄해 공부해도 좋습니다.
책 소개PDF 다운로드
대학생을 위한 교양 인공지능
베트남어·한국어 쌍어판
372쪽 PDF. 인공지능의 기본 개념과 대학 생활에서 AI를 쓰는 방법을 두 언어로 읽는 교재입니다.
한국에 유학 온 외국인 학생들은 이 교재를 무료로 마음껏 내려받아 사용해도 좋습니다. 개인 학습과 수업 자료로 쓰고, 필요한 부분을 인쇄해 공부해도 좋습니다.
책 소개PDF 다운로드
대학생을 위한 교양 인공지능
라오스어·한국어 쌍어판
372쪽 PDF. 인공지능의 기본 개념과 대학 생활에서 AI를 쓰는 방법을 두 언어로 읽는 교재입니다.
한국에 유학 온 외국인 학생들은 이 교재를 무료로 마음껏 내려받아 사용해도 좋습니다. 개인 학습과 수업 자료로 쓰고, 필요한 부분을 인쇄해 공부해도 좋습니다.
책 소개PDF 다운로드
대학생을 위한 교양 인공지능
몽골어·한국어 쌍어판
372쪽 PDF. 인공지능의 기본 개념과 대학 생활에서 AI를 쓰는 방법을 두 언어로 읽는 교재입니다.
한국에 유학 온 외국인 학생들은 이 교재를 무료로 마음껏 내려받아 사용해도 좋습니다. 개인 학습과 수업 자료로 쓰고, 필요한 부분을 인쇄해 공부해도 좋습니다.
책 소개PDF 다운로드PDF 다운로드 책
다국어로 읽는 대학생 교양 인공지능
한국어 원문과 외국어 번역을 함께 실은 유학생용 교재입니다. 각 책 소개 페이지에서 PDF를 받을 수 있습니다.
[AI서재] 4.1 저작권 침해 소송과 무단 데이터 스크래핑
알고리즘의 실책: AIAAIC 사례로 본 AI 부작용과 윤리적 과제
4.1 저작권 침해 소송과 무단 데이터 스크래핑
김경진 변호사
먼저 책을 삽니다. 진짜 책입니다. 값을 치르고 삽니다.
다음에 제본을 자릅니다. 등을 칼로 잘라 내면 책이 낱장 뭉치가 됩니다. 그 낱장을 자동 급지 스캐너에 넣습니다. 종이가 한 장씩 넘어가면서 디지털 파일이 됩니다.
스캔이 끝난 종이는 버립니다.
인공지능 기업 앤스로픽 내부에서 이렇게 처리한 책이 수십만 권입니다. 프로젝트 파나마라는 이름이 붙어 있었습니다.
법적으로는 영리한 방법입니다. 산 책은 소유물이니 잘라도 됩니다. 그런데 이 장면을 머릿속에 그려 보면 마음이 이상해집니다. 누군가 평생 걸려 쓴 책이 컨베이어 위에서 스무 초 만에 처리되고 쓰레기통으로 갑니다.
앤스로픽은 이 방법만 쓴 것이 아니었습니다. 립젠과 피리미 같은 해적 도서관에서 오십만 권 넘는 책을 그냥 내려받기도 했습니다.
작가 안드레아 바르츠, 커크 월리스 존슨, 찰스 그레이버가 낸 집단소송에서 2025년 앤스로픽은 십오억 달러를 내기로 합의했습니다. 미국 저작권 소송 역사상 제일 큰 금액입니다.
이 사건에서 법원이 어디에 선을 그었는지가 중요합니다. 법원은 저작물로 언어 모델을 학습시키는 행위 자체는 불법으로 보지 않았습니다. 문제 삼은 것은 해적판을 내려받아 보관한 부분이었습니다.
배우는 것은 되고, 훔쳐서 배우는 것은 안 된다는 뜻입니다. 이 구별은 앞으로 나올 모든 소송의 뼈대가 됩니다.
작가들이 처음 나선 것은 2023년입니다.
그해 6월 소설가 모나 아와드와 폴 트렘블레이가 오픈AI를 상대로 첫 소송을 냈습니다. 9월에는 미국 작가조합 소속 열일곱 명이 뉴욕 연방법원에 집단소송을 냈습니다. 왕좌의 게임을 쓴 조지 마틴, 존 그리셤, 조디 피콜트, 스콧 터로, 데이비드 발다치, 조너선 프랜즌 같은 이름들이었습니다.
이들의 주장은 이랬습니다. 오픈AI가 허락 없이 소설 수만 권을 학습에 썼다. 그 재료는 라이브러리 제네시스나 제트라이브러리 같은 해적 도서관, 그리고 북스3이라는 데이터셋에서 왔다.
챗GPT가 유려한 문장을 쓰는 이유는 유려한 문장을 많이 읽었기 때문입니다. 그 문장들은 누군가 썼습니다.
퓰리처상을 받은 마이클 셰이본, 극작가 데이비드 헨리 황, 논픽션 작가 레이철 루이즈 스나이더도 오픈AI와 메타를 상대로 나섰습니다.
2023년 11월에는 작가 줄리언 생턴이 오픈AI와 마이크로소프트를 상대로 논픽션 수만 권의 무단 사용을 주장하는 집단소송을 냈습니다. 마이크 허커비를 비롯한 종교 서적 저자들은 북스3 데이터셋에 담긴 십팔만 권이 학습에 쓰였다며 메타와 마이크로소프트 등을 걸었습니다.
2024년 8월에는 저널리스트 니컬러스 배스베인스와 니컬러스 게이지가 북스2라는 다른 데이터셋을 문제 삼아 소송에 합류했습니다.
2025년 10월에는 뉴욕주립대 다운스테이트 보건과학센터의 수사나 마르티네스콘데와 스티븐 맥닉 교수가 애플을 상대로 소송을 냈습니다. 애플 인텔리전스 학습에 해적 도서관 데이터가 쓰였다는 주장입니다. 엔비디아도 작가 세 명에게 같은 이유로 소송을 당했습니다.
언론사들은 다른 각도에서 싸웁니다.
2023년 12월 뉴욕타임스가 오픈AI와 마이크로소프트를 상대로 수십억 달러 규모의 소송을 냈습니다. 수백만 건의 기사가 허락도 대가도 없이 학습에 쓰였다는 겁니다.
이 소송의 핵심은 학습이 아니라 경쟁입니다. 신문사가 돈과 시간을 들여 취재한 결과로 만든 서비스가, 그 신문사와 독자를 두고 경쟁합니다. 독자가 요약만 읽고 기사에 오지 않으면 신문사는 광고 수익을 잃습니다.
취재에는 돈이 듭니다. 기자를 현장에 보내야 하고, 자료를 청구해야 하고, 취재원을 여러 번 만나야 합니다. 요약에는 그런 비용이 들지 않습니다.
2026년에도 이 싸움은 진행 중입니다. 뉴욕타임스와 여러 언론사는 오픈AI가 자사 시스템 안에서 저작권 자료를 찾아낼 수 있는 능력에 대해 법원을 오도했다며 맨해튼 연방판사에게 제재를 요청했습니다.
2024년 4월에는 시카고 트리뷴과 덴버 포스트를 비롯한 미국 일간지 여덟 곳이 소장을 냈습니다. 기사를 무단 수집했을 뿐 아니라 저작권 표기를 일부러 지웠다는 주장이 들어 있었습니다.
출처를 지우는 행위는 실수로 보기 어렵습니다. 코드에 그렇게 적어야 지워집니다.
2024년 2월 디 인터셉트와 로 스토리와 알터넷이, 6월에는 탐사보도센터가 소송을 냈습니다. 11월에는 캘거리 헤럴드와 몬트리올 가제트를 가진 캐나다 출판사들이 나섰습니다.
인공지능 검색 서비스 퍼플렉시티도 표적이 됐습니다. 2024년 10월 다우존스와 뉴욕 포스트가, 2025년 12월 시카고 트리뷴이 소송을 냈습니다. 콘데 나스트와 뉴욕타임스는 경고장을 보냈습니다.
프랑스 당국은 2024년 3월 구글에 이억 오천만 유로의 과징금을 물렸습니다. 언론사들과 상의 없이 제미나이 학습에 뉴스 기사를 썼다는 이유였습니다.
한국에서도 2024년과 2025년에 방송사들이 네이버를 상대로 소송을 냈습니다. 방송 뉴스 콘텐츠가 하이퍼클로바 X 학습에 무단으로 쓰였다는 주장입니다.
그림 쪽에서는 증거가 화면에 그대로 찍혀 나왔습니다.
2023년 1월 게티 이미지가 스태빌리티 AI를 상대로 영국과 미국에서 소송을 냈습니다. 워터마크가 박힌 자사 사진 천이백만 장 이상이 라이선스 없이 학습에 쓰였다는 겁니다.
증거는 이랬습니다. 스테이블 디퓨전이 만들어 낸 그림 구석에 게티 이미지의 워터마크가 일그러진 모양으로 남아 있었습니다.
기계는 워터마크가 무엇인지 모릅니다. 사진에 자주 나오는 무늬라서 같이 배운 겁니다. 도둑이 훔친 물건에 가게 이름표를 그대로 달고 나온 셈입니다.
독일의 스톡 사진가 로베르트 크네슈케는 자기 사진이 라이온 데이터셋을 통해 학습에 쓰인 것을 확인하고 소송을 진행했습니다. 일러스트레이터 홀리 멩거트는 자신의 화풍이 통째로 복제돼 모델이 되는 일을 겪었습니다.
화풍은 저작권으로 지키기 어렵습니다. 법이 보호하는 것은 개별 작품이지 스타일이 아니기 때문입니다. 그런데 인공지능이 훔치는 것은 정확히 스타일입니다.
법이 그은 선과 기술이 가져가는 것이 어긋나 있습니다.
거대 미디어 기업들도 나섰습니다.
2025년 디즈니와 유니버설과 워너 브라더스 디스커버리가 이미지 생성 기업 미드저니를 상대로 집단소송을 냈습니다. 자사 애니메이션과 영화 속 캐릭터가 무단으로 수집돼 합성 이미지로 나온다는 겁니다. 같은 기업들이 중국의 미니맥스도 걸었습니다.
영화사 알콘 엔터테인먼트는 2024년 10월 테슬라와 일론 머스크를 상대로 소송을 냈습니다. 로보택시 공개 행사에서 블레이드 러너 2049의 시각 이미지를 인공지능으로 재현해 썼다는 이유였습니다.
중국 법원은 2024년 울트라맨 캐릭터를 무단 학습해 생성한 기업에 저작권 침해 판결을 내렸습니다.
음악은 소리로 남습니다.
2024년 6월 소니 뮤직과 유니버설 뮤직 그룹과 워너 뮤직이 음악 생성 기업 수노와 우디오를 상대로 소송을 냈습니다. 수십 년간 쌓인 상업 음원을 무단으로 긁어 학습시켰고, 그 결과 특정 가수의 음색과 스타일을 정교하게 복제하는 기계가 나왔다는 주장입니다.
2023년 10월 유니버설 뮤직 그룹은 앤스로픽을 상대로 가사 데이터베이스 무단 수집 소송을 냈습니다. 클로드가 유명 노래 가사를 그대로 출력했기 때문입니다. 이 소송에서 앤스로픽 쪽이 낸 서류에 존재하지 않는 학술 논문이 인용됐던 사건은 앞에서 나왔습니다.
코미디언 조지 칼린은 2008년에 세상을 떠났습니다. 2024년 1월 그의 유족은 칼린의 생전 음성을 학습시켜 인공지능 코미디 특집을 만든 채널을 상대로 소송을 내 삭제와 합의를 이끌어 냈습니다.
죽은 사람은 새로운 농담을 하지 않습니다. 그런데 그 목소리는 계속 새로운 농담을 했습니다.
목소리로 먹고사는 사람들의 이야기는 더 직접적입니다.
베테랑 성우 폴 스카이 리먼과 리네아 세이지는 2024년 5월 음성 생성 스타트업을 상대로 뉴욕 연방법원에 소송을 냈습니다. 회사가 대화 연구 목적이라며 목소리를 녹음해 놓고, 그 녹음을 상업용 인공지능 성우 서비스의 학습 데이터로 쓰고 팔았다는 겁니다.
성우 베브 스탠딩은 자기 목소리가 틱톡의 자동 읽기 음성으로 쓰이는 것을 알고 소송을 내 합의를 받아 냈습니다. 자기가 하지 않은 말을 자기 목소리로 수억 명이 듣고 있었던 겁니다.
배우 스칼렛 요한슨은 2024년 5월 오픈AI가 만든 인공지능 목소리가 자기 목소리를 그대로 흉내 냈다고 항의했습니다. 오픈AI는 그 음성 서비스를 급히 중단했습니다.
요한슨은 자신이 나오는 인공지능 광고를 무단으로 만든 앱 개발사에도 법적 대응에 나섰습니다. 배우 브라이언 크랜스턴도 자기 음성과 얼굴이 동의 없이 영상 모델 학습에 쓰였다고 밝혔습니다.
전문 데이터베이스도 털렸습니다.
캐나다의 법률 데이터베이스 캔리는 2024년 11월 한 법률 인공지능 스타트업을 상대로 소송을 냈습니다. 이용약관과 접근 제한을 무시하고 판결문과 해석 문서 수십만 건을 긁어 갔다는 겁니다.
법률 정보 회사 톰슨 로이터는 2025년 1월 자사 데이터베이스를 무단으로 긁어 학습한 로스 인텔리전스를 상대로 승소했습니다.
이 사건들에서 기업들이 내놓는 방어 논리는 대체로 같습니다. 공정 이용입니다. 학습은 복제가 아니라 분석이고, 사람이 책을 읽고 배우는 것과 다르지 않다는 겁니다.
이 비유에는 빠진 것이 있습니다. 사람은 책을 한 권씩 읽고, 읽는 데 시간이 걸리고, 읽은 책을 사거나 빌립니다. 그리고 사람 한 명이 읽어서 얻는 능력은 그 사람 한 명의 것입니다.
모델은 오십만 권을 며칠 만에 읽고, 그 능력을 수억 명에게 동시에 팝니다.
규모가 달라지면 성질이 달라집니다. 물 한 컵을 뜨는 것과 강을 통째로 끌어가는 것은 같은 행위가 아닙니다.
한 가지는 분명해졌습니다. 이 재판들이 어떻게 끝나든, 이미 학습된 모델에서 특정 작가의 흔적만 골라 지우는 방법은 아직 없습니다.
책은 잘려 나갔고, 스캔은 끝났고, 종이는 버려졌습니다.

















