404미디어의 조사에 따르면 아마존이 희귀 도서를 대량 매입해 AI 학습 데이터로 스캔한 뒤 파기하는 것으로 나타났다. 조사팀이 도서 배송 상자에 에어태그를 넣어 추적한 결과, 화물은 라스베이거스의 아마존 창고로 향했고 이곳 직원들은 스캔 속도를 높이기 위해 책 제본을 잘라내는 방식으로 원본을 파기하고 있었다. 스캔된 데이터는 아마존의 노바(Nova) 모델 학습에 쓰이며, 앤트로픽도 유사한 '프로젝트 파나마'를 운영해 법원에서 공정 이용으로 인정받은 바 있다. 서점업계는 AI 기업들이 ISBN 단위로 사실상 모든 도서를 체계적으로 스캔하려 한다고 의심하고 있으며, 2022년 이전 인쇄물은 AI 생성물이 섞이지 않은 희소 가치 때문에 특히 표적이 되고 있다.
- •아마존, 희귀 도서를 매입 후 스캔해 AI 모델 '노바' 학습에 사용, 원본은 파기
- •404미디어가 에어태그로 추적, 라스베이거스 창고 'VGT3' 팀이 책 제본을 잘라 스캔
- •앤트로픽도 유사한 '프로젝트 파나마' 운영, 법원은 원본 파기를 근거로 공정 이용 인정
- •서점업계, AI 기업들이 ISBN 기준으로 모든 도서를 체계적으로 스캔하려 한다는 의혹 제기
- •2022년 이전 인쇄물은 AI 생성 콘텐츠가 섮이지 않아 학습 데이터로서 특히 가치 높음
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
AirTag reveals how Amazon destroys rare books for AI training

- 1.404 Media가 AirTag로 추적, 아마존이 희귀 도서를 구매해 AI 훈련용으로 스캔 후 파쇄하는 사실을 확인
- 2.라스베이거스 창고 VGT3팀이 책등을 잘라 스캔, 데이터는 아마존 노바(Nova) 모델 훈련에 사용
- 3.앤트로픽도 '프로젝트 파나마'로 책을 구매·파쇄해 디지털화, 법원은 원본 파기를 근거로 공정이용 인정
- 4.2022년 이전 인쇄본은 AI 생성 콘텐츠가 섞이지 않아 가치 높아, 서적상들은 ISBN 단위 전수 스캔 의혹 제기
왜 중요한가?
절판·희귀 도서 원본이 되돌릴 수 없이 파기되면서 공공 지식 자산이 단일 기업의 폐쇄형 AI 모델 안에 갇히는 문제를 보여주며, 파쇄를 근거로 공정이용을 인정한 판례는 향후 AI 학습데이터 확보 관행에 영향을 줄 수 있다.
본문 미리보기
Amazon buys large quantities of printed books, scans them as AI training data, and destroys them in the process. The article AirTag reveals how Amazon destroys rare books for AI training appeared first on The Decoder.
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 11:17AI 초안

