일본 AI 도서 구매, 중고 서점 매출 5배 끌어올렸지만 책은 돌아오지 않을 수도
일본의 AI 도서 구매가 일부 중고 서점의 일일 매출을 평소의 다섯 배까지 끌어올린 것으로 전해졌다. 하지만 이 예상 밖의 호황에는 불편한 가능성이 따른다. 구매된 책 상당수가 스캔된 뒤 제본이 해체되고, 영구히 유통망에서 사라질 수 있다는 것이다.
Tom’s Hardware가 인용한 일본 보도에 따르면, 서점들은 한 번에 수백 권에 이르는 주문을 받았다. 서로 별개로 보이는 여러 구매자가 오카야마현의 동일한 물류센터로 배송을 지시한 것으로 알려졌다. 확인된 한 배송 건에서는 일본 도서 50톤이 미국으로 보내졌다.
구매자들의 신원은 공개되지 않았으며, 물류 운영업체도 질문에 답변을 거부했다. 현재 공개된 증거만으로는 모든 주문이 AI 기업과 연결돼 있다고 입증할 수 없다. 다만 이러한 구매 패턴은 Anthropic이 미국에서 사용한 것으로 확인된 절차와 닮아 있다.
그 절차에서는 실물 책을 구매해 제본을 제거하고, 모든 페이지를 스캔한 뒤 검색 가능한 디지털 사본을 보관했다. 이후 인쇄된 페이지는 폐기됐다. 연방 판사는 훗날 이 실물 스캔 방식과 Anthropic의 수백만 권 불법 디지털 도서 확보를 다르게 판단했다.
따라서 핵심 갈등은 이례적인 매출 급증보다 더 크다. 일본 서점들은 오늘 반가운 수익을 얻지만, 연구자와 독자들은 내일 책 부족에 직면할 수 있다. 이 거래는 정보를 사설 데이터베이스 안에 보존하는 한편, 그 정보를 제공한 공공의 실물 사본은 파괴할 수 있다.
일본 중고책 붐의 정체불명 구매자
매장 단위에서 보고된 매출 급증은 사실이지만, 대량 구매자들의 목적과 신원은 여전히 확인되지 않았다.
일본에는 깊이 있고 다양한 중고 도서 시장이 존재한다. 전국 체인, 전문 판매점, 동네 서점, 창고에 재고를 분산해 둔 온라인 판매자가 포함된다. 이러한 분포는 폭넓은 코퍼스를 빠르게 구축하는 데 시장을 유용하게 만든다.
코퍼스는 검색, 분석 또는 AI 학습에 사용되는 대규모 텍스트 모음이다. 인쇄 도서는 일반적인 웹 크롤링으로는 확보하기 어려운, 편집된 인간 작성 자료를 제공한다. 오래된 책은 온라인상 기계 생성 텍스트의 확산 이전에 출간됐다는 점에서도 의미가 있다.
최근 구매 활동은 정확히 이런 종류의 자료에 집중된 것으로 보인다. 최초의 대량 주문 보도에 따르면, 일부 서점은 온라인 매출이 다섯 배로 뛴 날을 보고했다. 일부는 일반 소비자 장바구니 규모가 아니라 수백 권이 포함된 주문을 받았다.
주제 구성도 의문을 키운다. 소설과 만화는 전통적으로 많은 소비자 주문에서 비중이 높지만, 보고된 구매는 철학, 정치사, 의학, 법학, 사회사에 걸쳐 이뤄졌다. 한 사례에는 에도 시대의 삶과 문화를 다룬 도서들이 포함됐다.
이 같은 폭넓은 범위는 개인 수집보다 데이터세트 구축에 더 가까워 보인다. 독자는 보통 작가, 장르, 시대 또는 특정 연구 질문을 따른다. 반면 데이터 구매자는 다양성, 정돈된 메타데이터, 통계적 포괄성을 높일 충분한 물량에서 이익을 얻는다.
주문은 여러 계정을 통해 들어온 것으로 알려졌다. 그러나 그중 많은 계정이 오카야마현의 한 물류센터로 배송을 요청했다. 이 공통 목적지는 중요한 단서이지만, 최종 고객을 특정하지는 못한다.
물류센터는 수출, 재판매, 보관, 도서관 처리 또는 디지털화를 위해 책을 집결시킬 수 있다. 운영업체는 자신의 역할을 설명하기를 거부한 것으로 전해졌다. 송장, 계약서 또는 실명 고객이 없다면 특정 AI 개발사에 주문을 귀속하는 것은 추측에 불과하다.
50톤 배송은 더 강한 역사적 맥락을 제공한다. 일본 보도는 Anthropic과 연관된 스캔을 위해 해당 물량이 미국으로 보내진 기록을 설명했다. 그렇다고 Anthropic이 현재의 오카야마 주문을 넣었다는 사실이 입증되는 것은 아니다.
마찬가지로, 익명의 외국 기업이 일본 서부의 한 서점에 수만 권의 도서 매입을 문의한 것으로 알려졌다. 이 문의는 산업 규모의 해외 수요를 보여준다. 그러나 구매자의 목적과 신원은 여전히 밝혀지지 않았다.
이 구분은 중요하다. 증거는 의심스러운 대량 구매가 일어나고 있다는 보도를 뒷받침한다. 일부 책이 파괴적 스캔을 위해 수집되고 있을 수 있다는 우려 역시 뒷받침한다. 하지만 모든 판매를 확인된 Anthropic 구매로 묘사할 근거는 없다.
더 정확한 결론은 범위가 좁다. 일본의 AI 도서 구매는 일반적인 소매 행동만으로는 쉽게 설명하기 어려운 규모에 이른 것으로 보인다. 책들이 불투명한 공급망으로 사라지기 전에, 배송 경로와 주제 선정은 면밀한 검토가 필요하다.
AI 기업이 여전히 실물 책을 원하는 이유
실물 책은 웹 규모 AI 개발사들이 조성한 데이터 품질 문제를 해결하는 동시에, 해적 도서관보다 구매자에게 더 명확한 취득 경로를 제공한다.
대규모 언어 모델은 막대한 텍스트 모음에서 통계적 패턴을 학습한다. 그 텍스트의 품질은 모델이 추론, 문체, 전문 용어, 사실 관계를 얼마나 잘 다루는지에 영향을 준다. 책은 짧은 웹페이지가 좀처럼 제공하지 못하는 길고 구조화된 논증을 담고 있다.
책은 온라인에서 자유롭게 접근할 수 없었던 지식도 포괄한다. 지역사, 전문 매뉴얼, 학술 저작, 오래된 번역본, 절판 도서는 종이 형태로만 존재할 수 있다. 일본어 컬렉션은 영어를 넘어 모델 성능을 개선하는 데 특히 가치가 있다.
이 시점은 합성 데이터 오염에 대한 우려가 커진 상황과도 맞물린다. 생성형 AI가 널리 이용 가능해진 뒤, 기계가 작성한 페이지는 웹 전반에 급증했다. 크롤러는 이제 오류와 반복적인 문체 패턴을 포함한 기존 모델 생성 텍스트를 수집할 수 있다.
인간이 쓴 책은 더 깨끗한 대안을 제공한다. 생성형 AI 붐 이전에 출간된 저작물에는 현대 챗봇의 출력이 포함돼 있을 가능성이 낮다. 출판 과정에는 흔히 편집, 사실 확인, 일관된 구성도 포함된다.
그렇다고 모든 인쇄 도서가 정확하거나 유용하다는 뜻은 아니다. 책은 의도적으로 구성된 인간 언어의 비교적 밀도 높은 원천이라는 의미다. 다국어 성능을 두고 경쟁하는 AI 개발사에는 이런 자료를 대체하기가 어려울 수 있다.
법원 기록은 Anthropic이 책을 얼마나 중시했는지 보여준다. 2025년 공정 이용 판결에서 William Alsup 판사는 회사가 책을 최고 수준 언어 모델로 가는 비용 효율적인 경로로 여겼다고 적었다.
Anthropic은 처음에 여러 출처에서 디지털 사본을 확보했다. 법원은 회사가 Books3에서 196,640권, Library Genesis에서 최소 500만 권, PiLiMi에서 최소 200만 권을 내려받았다고 판단했다.
판결에 따르면 이 컬렉션에는 무단 복제본이 포함돼 있었다. Anthropic은 특정 책이 학습용 혼합물에 선택되지 않은 경우에도 영구적인 중앙 도서관을 유지했다. 이 결정은 모델 학습 자체와 별개로 법적 위험을 만들었다.
회사는 이후 실물 확보 경로를 추진했다. 2024년에는 이전에 Google의 도서 스캔 프로젝트 파트너십을 이끌었던 Tom Turvey를 고용했다. 그의 업무는 이전의 법적 문제를 되풀이하지 않으면서 극도로 광범위한 도서 컬렉션을 확보하는 일이었다.
Anthropic은 중고 상태의 책을 다수 포함해 수백만 권의 실물 도서를 구매했다. 계약업체들은 제본을 제거하고 페이지를 분리해 스캔한 뒤, 이미지를 기계 판독 가능한 텍스트로 변환했다. 회사는 그 결과물인 디지털 파일을 보관했다.
이 작업 흐름은 중고 시장이 매력적인 이유를 설명한다. 중고 사본은 많은 판매자로부터 조달할 수 있고, 구매는 통상적인 거래 기록을 남긴다. 구매자는 International Standard Book Numbers, 즉 ISBN을 이용해 판본을 겨냥할 수도 있다.
ISBN은 특정 도서의 판본과 형식을 식별한다. 구매자가 중복 구매를 피하고, 스캔을 메타데이터와 연결하며, 언어 또는 출판 세부 정보를 추적하는 데 도움이 된다. 수천 권의 서로 관련 없는 제목이 주문에 포함될 때 이러한 기능은 중요하다.
파괴적 스캔은 제본된 페이지를 한 장씩 촬영하는 것보다 빠르다. 책등을 제거하면 낱장이 고속 스캐너를 통과할 수 있다. 이후 광학 문자 인식이 페이지 이미지를 검색 가능한 텍스트로 변환한다.
이 과정은 보존을 처리량과 맞바꾼다. 희귀본과 흔한 문고본은 누군가 미리 분류하지 않는 한 동일한 기계적 작업 흐름에 들어갈 수 있다. 최종 데이터세트는 남지만, 구매된 실물은 남지 않는다.
이 메커니즘은 일본 주문이 AI 관련 취득일 가능성을 뒷받침한다. 하지만 연결성을 증명하지는 않는다. 그럼에도 깨끗한 일본어 텍스트에 대한 수요와 문서화된 산업 작업 흐름이 결합되면서, 서점 주인들이 우려할 합리적인 근거가 생긴다.
일본 AI 도서 구매, 수익을 보존 위험으로 바꾸다
핵심 역설은 단순하다. 서점에 도움이 되는 구매가 그 판매를 가능하게 한 도서 시장을 약화시킬 수도 있다.
판매자에게 매출이 다섯 배가 된 하루는 대개 좋은 소식이다. 중고 서점은 제한된 공간, 불균등한 수요, 수년간 팔리지 않을 수 있는 재고 속에서 운영된다. 대량 주문은 보관 공간을 확보하고 느리게 움직이던 재고를 수익으로 전환한다.
매입된 책 중 상당수는 일반적인 과잉 사본일 수도 있다. 흔한 문고본 한 권을 파기한다고 해서 그 내용이 세상에서 사라지는 것은 아니다. 서점들은 보존 비용이 예상 수요를 넘을 때 훼손되거나 원하지 않는 재고를 일상적으로 폐기한다.
문제는 구매자가 희소성이 아니라 메타데이터를 기준으로 책을 살 때 커진다. 대규모 취득 시스템은 절판된 지역 연구서도 다른 ISBN과 똑같이 취급할 수 있다. 등록된 사본이 아직 구할 수 있는 극소수 중 하나라는 점을 인식하지 못할 수 있다.
스캔이 끝나면 실물 책은 펄프 처리될 수 있다. 그 텍스트는 사설 기업 저장소 안에서만 접근 가능한 상태로 남을 수 있다. 도서관, 연구자, 수집가, 미래의 독자가 그 디지털 버전에 자동으로 접근할 수 있는 것은 아니다.
이 결과는 보존 프로젝트와 다르다. 도서관은 가능한 한 원본을 보관하면서 접근성을 넓히기 위해 취약한 자료를 디지털화한다. 사설 AI 코퍼스는 공공 아카이브 역할을 하기보다 주로 상업용 모델을 개선하도록 설계된다.
이 구분은 검증에도 영향을 준다. 연구자들은 안정적인 판본, 페이지 이미지, 주석, 삽화, 그리고 실물 맥락을 필요로 한다. 단순 추출 텍스트는 여백 메모, 레이아웃, 타이포그래피, 도표, 판본의 역사를 보여주는 흔적을 누락할 수 있다.
일본 출판 환경에서는 이 문제가 특히 민감하다. 많은 저작물은 소량 인쇄되며 디지털 판본으로 전환되지 않는다. 지역사와 오래된 기술 문헌은 전국적 관심을 끌지 못한 채 시장에서 사라질 수 있다.
중고 서점은 비공식적인 보존 네트워크 역할을 한다. 서가에는 원치 않는 개인 소장품이 다른 독자를 만날 때까지 남아 있다. 모든 개별 구매가 합법이더라도, 산업적 물량으로 책을 제거하면 이 네트워크는 달라진다.
압력은 고르게 분산되지 않는다. 대형 체인은 여러 지점에서 인기 도서를 보충할 수 있다. 소규모 전문 판매자는 수십 년에 걸쳐 모은 독특한 재고를 보유할 수 있다. 폭넓은 단일 주문 하나가 그 서점들이 제공하는 것을 영구히 바꿀 수 있다.
이것이 대량 구매 자체를 본질적으로 부적절하게 만드는 것은 아니다. 소유자는 자신의 재고를 판매할 권리가 있으며, 많은 이들에게 그 수익은 필요하다. 구매자에게도 접근성, 검색, 학술 연구, 언어 기술 등을 위해 책을 디지털화할 정당한 이유가 있다.
문제는 충분한 정보를 바탕으로 한 선택이 불가능하다는 데 있다. 서점은 자신이 독자, 도서관 또는 수집가에게 책을 공급한다고 믿을 수 있다. 그러나 구매자가 모든 책을 해체할 의도라면, 판매자는 자신의 보존 기준을 적용할 수 없다.
일부 소유자는 희소 자료에 대한 이런 주문을 거절할 수 있다. 다른 이들은 가격을 다르게 책정하거나, 한 부를 보관하거나, 희귀 도서에는 비파괴 스캔을 요구할 수 있다. 그러나 중개업체가 최종 용도를 숨기면 이런 결정을 내릴 수 없다.
따라서 일본에서의 AI용 도서 구매는 시장 정보의 실패를 낳는다. 판매자는 제목과 수량을 알지만, 목적지나 용도는 모를 수 있다. 구매자는 의도한 처리 과정을 알고 있지만, 주문을 여러 계정에 분산할 수 있다.
그 결과는 단기적인 가치 이전이다. 서점은 현금을 받는 반면, 구매자는 실물과 함께 디지털화된 내용물에 대한 배타적 통제권도 얻는다. 대중은 손실이 발생했다는 사실조차 인식하지 못한 채 접근권을 잃을 수 있다.
이 때문에 이 이야기는 단순히 AI 기업이 학습 데이터에 비용을 지불하는 문제에 그치지 않는다. 대가는 취득에 관한 한 가지 질문을 해결한다. 그러나 보존, 투명성, 라이선스 또는 지속적인 유통이 지닌 사회적 가치를 해결하지는 못한다.
책을 구매했다고 해서 저작권 문제가 해결되는 것은 아니다
실물 사본의 소유권과 텍스트 복제 허가는 별개의 권리이며, AI 학습은 관할권 전반에서 여전히 법적으로 다투어지고 있다.
구매자는 일반적으로 적법하게 구매한 책을 재판매, 대여, 변경 또는 폐기할 수 있다. 그러나 저작권법은 보호되는 표현물을 복제하고 이용하는 행위를 여전히 제한한다. AI 스캔은 이 두 원칙을 정면으로 충돌시킨다.
Anthropic 사건에서 연방법원은 취득과 학습을 구분했다. Alsup 판사는 해당 사건의 사실관계 아래에서 적법하게 취득한 도서를 학습에 사용한 Anthropic의 행위가 변형적이라고 판단했다. 이 판결이 모든 AI 시스템에 적용되는 보편적 면제를 만든 것은 아니다.
판사는 Anthropic의 실물 도서 스캔과 해적 도서관에서 내려받은 자료도 구별했다. 인쇄본을 구매해 내부 사용을 위해 변환한 행위는 더 유리하게 판단받았다. 반면 고의로 불법 복제된 파일 수백만 건을 보관한 행위는 그렇지 않았다.
이 차이는 실물 도서가 현재 전략적 가치를 지니는 한 이유다. 구매 기록은 법적 위험의 한 범주를 줄일 수 있다. 그러나 복제, 시장 피해, 데이터 투명성 또는 국가별 상이한 법률과 관련된 청구를 없애지는 못한다.
Anthropic은 이후 해적 복제본과 관련된 청구를 해결하기로 합의했다. 제안된 합의는 약 50만 건의 저작물을 포괄했으며, 문제 제기된 디지털 도서관에서 취득한 원본 파일의 파기를 요구했다.
copyright settlement은 파괴적 스캔 자체가 불법이라고 확정하지는 않았다. 다만 법원이 모델 학습을 변형적이라고 보더라도 취득 방식이 중요할 수 있음을 부각했다.
작가와 출판사는 광범위한 학습 주장에 여전히 회의적이다. Authors Guild는 도서 및 기타 보호 대상 자료와 관련된 미국 저작권 사건 약 12건을 추적해 왔다. 피고에는 Anthropic, OpenAI, Microsoft, Meta, Nvidia, Google, Bloomberg, Databricks가 포함된다.
이들 pending AI cases는 서로 다른 데이터셋, 모델, 원고, 원고 측 당사자 및 법리를 다룬다. 하나의 판결을 이들 모두에 자동으로 적용할 수는 없다. 항소로 인해 현재의 해석이 바뀔 수도 있다.
일본은 분석에 또 하나의 법체계를 더한다. 일본 저작권법에는 정해진 조건 아래 정보 분석을 허용할 수 있는 조항이 있다. 그 적용은 목적, 저작물 향유 여부, 권리자에게 미칠 수 있는 피해에 따라 달라진다.
해외 배송에는 여러 단계와 관할권이 얽힐 수 있다. 책은 일본에서 구매되고, 오카야마에서 집하된 뒤, 미국에서 스캔되어 전 세계에서 사업하는 기업에 의해 사용될 수 있다. 각 단계는 서로 다른 사실관계상의 질문을 낳는다.
현재 보도는 그러한 계약 내용을 밝히지 않는다. 어떤 주체가 제목을 선정하는지, 누가 스캔본을 소유하는지, 출판사가 라이선스 대가를 받는지도 확인하지 못한다. 이러한 공백은 적법성에 관한 단정적인 결론을 막는다.
파기에도 같은 신중함이 필요하다. Anthropic의 과거 작업 흐름에 관한 보도는 대규모 파괴적 스캔이 존재함을 보여 준다. 그러나 오카야마 센터를 거치는 모든 도서가 펄프 처리될 것임을 증명하지는 않는다.
일부는 비파괴 이미지화 후 재판매될 수 있다. 다른 일부는 일반 수출을 위해 보관되거나 처리될 수 있다. 구매자, 물류업체, 스캔 업체 또는 배송 기록이 더 많은 세부 사항을 제시하기 전까지 최종 처리 방식은 주장에 머문다.
그 불확실성이 조사를 끝내서는 안 된다. 오히려 그것이 조사의 범위를 규정한다. 가장 강력한 기사는 근거 없이 범인을 지목하는 기사가 아니라, 주장을 검증하는 데 필요한 기록을 식별하는 기사다.
서점은 계정 정보, 주문 목록, 배송 라벨, 이례적인 서신을 보관할 수 있다. 수출 기록은 목적지와 중량을 입증할 수 있다. 스캔 계약업체는 보호 대상 고객 데이터를 공개하지 않고도 보존 정책을 밝힐 수 있다.
출판사와 작가는 새로 취득한 일본어 데이터셋이 라이선스를 받았는지도 물을 수 있다. 모델 개발사는 갈수록 안전성 방식과 컴퓨팅 자원을 설명하고 있다. 학습 데이터 취득 과정은 여전히 훨씬 덜 투명하다.
법적 분쟁은 계속되겠지만, 법원이 최종 답변을 내리기 전에도 투명성은 개선될 수 있다. 구매자는 목적을 공개하고, 희소 사본을 보호하며, 권리자에게 의미 있는 정보를 제공할 수 있다. 이 어떤 조치도 모델 아키텍처를 공개할 필요는 없다.
다음 증거는 공급망에서 나와야 한다
이 현상이 일시적인 소매 이상 현상인지, 아니면 일본 출판물이 비공개 AI 아카이브로 산업적으로 이전되는 일인지 판가름할 세 가지 신호가 있다.
첫 번째 신호는 최종 구매자의 식별이다. 모든 배송물이 한 시설로 모인다면, 여러 구매 계정이 여러 고객을 뜻하지는 않는다. 계약서나 수출 문서는 그 시설을 스캔 회사 또는 AI 개발사와 연결할 수 있다.
확인된 고객은 AI 데이터 취득설을 강화할 것이다. 일반 수출, 도서관 재판매 또는 상업적 아카이빙의 증거는 이를 약화할 것이다. 어느 쪽 결과든 의심을 책임 있는 관리 연쇄로 대체하게 된다.
두 번째 신호는 희소 도서의 처리 방식이다. 판매자는 구매자가 흔한 중복본만 고르는지, 아니면 일치하는 모든 ISBN을 쓸어 담는지 추적해야 한다. 절판된 학술서와 지역사 자료가 포함된 주문은 특히 주의 깊게 살펴볼 필요가 있다.
희소 사본을 제외하는 구매자는 보존 우려를 줄일 수 있다. 비파괴 스캔은 이를 한층 더 줄인다. 희소성 검토 없이 책을 파기하는 절차는 영구적인 문화적 손실에 대한 우려를 뒷받침할 것이다.
세 번째 신호는 AI 개발사의 공개다. 기업은 일본 인쇄 도서 컬렉션을 구매하고 있는지, 계약업체가 원본을 파기하는지, 저작권을 어떻게 처리하는지를 밝힐 수 있다. 침묵은 중개업체와 서점에 평판상 부담을 떠넘기게 된다.
개발사는 스캔본이 비공개로 유지되는지, 아니면 공공 보존 사본을 지원하는지도 설명할 수 있다. 비공개 코퍼스는 한 기업에 상업적 가치를 제공한다. 접근 가능한 아카이브는 적어도 독자와 연구자에게 일부 혜택을 보존할 수 있다.
이 신호들은 일본을 넘어 중요하다. 유럽과 미국의 서점들도 AI 학습 데이터 수요와 연관된 이례적인 대량 주문을 보고했다. 반복 가능한 국제적 패턴은 고립된 수집 행위가 아니라 조직화된 데이터 조달 산업을 시사할 것이다.
이는 경쟁 구도도 바꿀 것이다. 모델 개발사는 한때 주로 컴퓨팅 역량, 엔지니어링 인재, 인터넷 규모의 데이터셋을 두고 경쟁했다. 이제는 아직 온라인에서 자유롭게 유통되지 않은 선별된 인간 지식을 두고 경쟁한다.
이 경쟁은 서점들을 낯선 위치에 놓는다. 이들은 더 이상 독자만을 상대하는 소매업체가 아니다. 그들의 목록은 훨씬 큰 예산과 거의 없는 공적 가시성을 가진 기업을 위한 상류 데이터 인프라가 될 수 있다.
소유자가 모든 대량 판매를 거절할 필요는 없다. 새로운 수익을 포기하지 않으면서도 보호 장치를 도입할 수 있다. 여기에는 수량 검토, 희소성 확인, 구매자 선언, 파괴적 사용에 대한 별도 승인 등이 포함될 수 있다.
마켓플레이스도 목적지를 공유하는 조직적 계정을 표시할 수 있다. 서로 무관한 학술 분야에 걸친 대량 주문이 반드시 부적절한 것은 아니다. 그럼에도 희소 재고를 내놓을지 결정하는 판매자에게는 유용한 정보다.
도서관, 출판사, 대학도 같은 패턴을 지켜봐야 한다. 전문 도서의 갑작스러운 소멸은 공식 유통 통계가 부족을 드러내기 훨씬 전부터 연구에 영향을 미칠 수 있다. 공동 감시 목록은 취약한 저작물을 더 일찍 식별할 수 있다.
독자에게도 역할이 있다. 상속받은 컬렉션을 판매하는 사람은 가장 빠른 대량 구매자를 택하기 전에, 고유한 자료가 도서관이나 아카이브에 속하는지 물어야 한다. 희귀 사본이 파괴적 처리에 들어가면 그 결정은 되돌릴 수 없다.
당장의 일본 판매 급증은 현재의 취득 목표가 완료되면 사라질 수 있다. 그렇게 되면 서점은 소유자들이 우려하는 반전을 겪을 수 있다. 수집 기간에는 수익이 늘지만, 이후에는 매력적인 재고를 보충하기 어려워 매출이 감소한다.
더 오래 지속되는 질문은 결과적으로 만들어진 지식을 누가 통제하는가에 관한 것이다. 스캔된 책은 언어 도구, 검색 시스템, 장애인의 접근성을 개선할 수 있다. 그런 혜택에는 비밀주의나 불필요한 파기가 필요하지 않다.
그러므로 일본의 AI용 도서 구매는 구매 이후에 무엇이 일어나는지에 따라 평가되어야 한다. 희소 저작물은 보호되는가? 창작자는 정보를 제공받는가? 연구자는 보존된 사본에 접근할 수 있는가? 구매자는 공적 책임을 수용하는가?
그 답이 나오기 전까지 책임 있는 결론은 신중해야 한다. 대량 주문은 서점 계정을 통해 기록되어 있지만, AI와의 연관성은 강하게 시사될 뿐 불완전하게 검증되어 있다. 위험이 되돌릴 수 없게 되는 시점은 책이 스캐너에 들어갈 때뿐이다.
오카야마 공급망, 절판 도서의 운명, 주요 모델 개발사의 공개를 지켜봐야 한다. 이 세 신호가 소매 호황이 문화 기억의 은밀한 이전으로 바뀌었는지를 보여 줄 것이다.



