Japoński skup książek dla AI zwiększa sprzedaż w antykwariatach pięciokrotnie, ale książki mogą nie wrócić
Japoński skup książek dla AI miał podobno zwiększyć dzienną sprzedaż w niektórych antykwariatach do pięciokrotności normalnego poziomu. Ten zaskakujący boom niesie ze sobą niepokojącą możliwość. Wiele zakupionych książek może zostać zeskanowanych, rozebranych i na zawsze wycofanych z obiegu.
Według japońskich doniesień, cytowanych przez Tom’s Hardware, sklepy otrzymały jednorazowe zamówienia obejmujące setki książek. Kilku pozornie niezależnych nabywców miało kierować zamówienia do tego samego centrum logistycznego w prefekturze Okayama. Jedna udokumentowana wysyłka obejmowała 50 ton japońskich książek wysłanych do Stanów Zjednoczonych.
Nabywcy nie zostali publicznie zidentyfikowani, a operator logistyczny odmówił odpowiedzi na pytania. Żadne dostępne dowody nie potwierdzają, że każde zamówienie jest powiązane z firmą AI. Schemat zakupów przypomina jednak udokumentowany proces stosowany przez Anthropic w Stanach Zjednoczonych.
Proces ten obejmował kupowanie fizycznych książek, usuwanie ich opraw, skanowanie każdej strony i zachowywanie przeszukiwalnych kopii cyfrowych. Drukowane strony były następnie niszczone. Sędzia federalny później inaczej ocenił tę ścieżkę skanowania fizycznych książek niż pozyskanie przez Anthropic milionów pirackich książek cyfrowych.
Główny konflikt jest więc większy niż nietypowy skok sprzedaży. Japońskie księgarnie otrzymują dziś mile widziane przychody, podczas gdy badacze i czytelnicy mogą jutro stanąć wobec niedoboru. Transakcja zachowuje informacje w prywatnej bazie danych, ale może zniszczyć publiczny egzemplarz, który je dostarczył.
Boom na rynku używanych książek w Japonii ma niezidentyfikowanego nabywcę
Zgłaszany wzrost sprzedaży jest realny na poziomie sklepów, lecz cel i tożsamość hurtowych nabywców pozostają niepotwierdzone.
Japonia ma głęboki i zróżnicowany rynek książek z drugiej ręki. Obejmuje on ogólnokrajowe sieci, wyspecjalizowanych sprzedawców, lokalne sklepy oraz internetowych handlarzy z zapasami rozproszonymi po magazynach. Taka struktura sprawia, że rynek jest przydatny do szybkiego gromadzenia szerokiego korpusu.
Korpus to duży zbiór tekstów wykorzystywany do wyszukiwania, analizy lub trenowania AI. Drukowane książki oferują zredagowane, napisane przez ludzi materiały, które często są niedostępne dla zwykłego indeksowania internetu. Starsze książki powstały też przed upowszechnieniem się tekstów generowanych przez maszyny w sieci.
Najnowsza aktywność zakupowa wydaje się koncentrować właśnie na takim materiale. Według pierwotnej relacji o zamówieniach hurtowych, sklepy odnotowały dni, w których sprzedaż internetowa wzrosła pięciokrotnie. Niektóre otrzymały zamówienia na setki książek, a nie typowe koszyki konsumenckie.
Pytania budzi również dobór tematów. Powieści i komiksy zwykle dominują w wielu zamówieniach konsumenckich, lecz zgłaszane zakupy obejmowały filozofię, historię polityczną, medycynę, prawo i historię społeczną. Jeden z przykładów dotyczył książek o życiu i kulturze w okresie Edo.
Taka rozpiętość przypomina raczej budowę zbioru danych niż prywatne kolekcjonerstwo. Czytelnik zwykle kieruje się autorami, gatunkami, epokami lub konkretnymi pytaniami badawczymi. Nabywca danych korzysta na różnorodności, czystych metadanych i skali wystarczającej do poprawy pokrycia statystycznego.
Zamówienia miały podobno napływać z wielu kont. Mimo to wiele z nich wskazywało dostawę do jednego centrum logistycznego w prefekturze Okayama. Ten wspólny adres jest ważną wskazówką, choć nie identyfikuje ostatecznego klienta.
Centrum logistyczne może konsolidować książki na potrzeby eksportu, odsprzedaży, magazynowania, obsługi bibliotek lub digitalizacji. Operator miał odmówić wyjaśnienia swojej roli. Bez faktur, umów lub nazwanych klientów przypisanie zamówień konkretnemu twórcy AI byłoby spekulacją.
Wysyłka 50 ton daje mocniejszy kontekst historyczny. Japońskie media opisały dokumenty dotyczące wysłania takiej ilości do Stanów Zjednoczonych na potrzeby skanowania powiązanego z Anthropic. Nie dowodzi to, że Anthropic złożył obecne zamówienia w Okayamie.
Podobnie, nienazwana zagraniczna firma miała skontaktować się ze sklepem w zachodniej Japonii w sprawie zakupu dziesiątek tysięcy książek. To zapytanie pokazuje zagraniczny popyt na skalę przemysłową. Nadal nie wyjaśnia jednak celu ani tożsamości nabywcy.
To rozróżnienie ma znaczenie. Dowody pozwalają informować, że dochodzi do podejrzanych zakupów hurtowych. Uzasadniają też obawy, że część książek jest gromadzona w celu destrukcyjnego skanowania. Nie uzasadniają jednak opisywania każdej sprzedaży jako potwierdzonego zakupu Anthropic.
Dokładniejszy wniosek jest węższy. Japoński skup książek dla AI wydaje się osiągać skalę, której nie da się łatwo wyjaśnić zwykłym zachowaniem detalicznym. Kierowanie przesyłek i dobór tematów uzasadniają dokładniejszą analizę, zanim książki znikną w nieprzejrzystym łańcuchu dostaw.
Dlaczego firmy AI nadal chcą fizycznych książek
Fizyczne książki rozwiązują problem jakości danych, do którego przyczynili się twórcy AI działający na skalę internetu, a jednocześnie dają nabywcom bardziej przejrzystą ścieżkę pozyskania niż pirackie biblioteki.
Duże modele językowe uczą się wzorców statystycznych z ogromnych zbiorów tekstów. Jakość tego tekstu wpływa na to, jak dobrze model radzi sobie z rozumowaniem, stylem, specjalistycznym słownictwem i relacjami faktycznymi. Książki oferują długie, ustrukturyzowane argumentacje, którym krótkie strony internetowe rzadko dorównują.
Książki obejmują również wiedzę, która nigdy nie stała się swobodnie dostępna w internecie. Lokalne historie, specjalistyczne podręczniki, prace akademickie, starsze tłumaczenia i tytuły wycofane z druku mogą istnieć wyłącznie na papierze. Zbiory w języku japońskim są szczególnie cenne dla ulepszania modeli poza językiem angielskim.
Moment ten odzwierciedla także rosnące obawy dotyczące zanieczyszczenia danymi syntetycznymi. Od czasu szerokiego upowszechnienia generatywnej AI liczba stron tworzonych przez maszyny wzrosła w całej sieci. Roboty indeksujące mogą teraz pobierać tekst wygenerowany przez wcześniejsze modele, w tym błędy i powtarzalne wzorce stylistyczne.
Książki napisane przez ludzi stanowią czystszą alternatywę. Dzieła opublikowane przed boomem generatywnej AI prawdopodobnie nie zawierają współczesnych treści generowanych przez chatboty. Ich proces wydawniczy często obejmował redakcję, weryfikację faktów i spójną organizację.
Nie oznacza to, że każda drukowana książka jest dokładna lub użyteczna. Oznacza to, że książki stanowią stosunkowo gęste źródło celowo tworzonego ludzkiego języka. Dla twórców AI konkurujących jakością wielojęzyczną taki materiał może być trudny do zastąpienia.
Akta sądowe pokazują, jak wysoko Anthropic cenił książki. W orzeczeniu z 2025 roku dotyczącym dozwolonego użytku sędzia William Alsup napisał, że firma postrzegała książki jako opłacalną drogę do stworzenia modelu językowego najwyższej klasy.
Anthropic początkowo pozyskiwał kopie cyfrowe z kilku źródeł. Sąd ustalił, że firma pobrała 196 640 książek z Books3, co najmniej pięć milionów z Library Genesis oraz co najmniej dwa miliony z PiLiMi.
Zgodnie z orzeczeniem zbiory te zawierały nieautoryzowane kopie. Anthropic utrzymywał stałą, centralną bibliotekę nawet wtedy, gdy poszczególne książki nie były wybierane do zestawu treningowego. Ta decyzja stworzyła ryzyko prawne odrębne od samego trenowania modeli.
Firma później obrała drogę pozyskiwania fizycznych książek. W 2024 roku zatrudniła Toma Turveya, który wcześniej kierował partnerstwami w projekcie skanowania książek Google. Jego zadanie obejmowało zdobycie niezwykle szerokiego zbioru książek bez powtarzania wcześniejszych problemów prawnych.
Anthropic kupił miliony fizycznych książek, z których wiele było używanych. Wykonawcy usuwali oprawy, rozdzielali strony, skanowali je i przekształcali obrazy w tekst odczytywalny dla maszyn. Firma zachowywała powstałe pliki cyfrowe.
Ten proces wyjaśnia, dlaczego rynki wtórne są atrakcyjne. Używane egzemplarze można pozyskiwać od wielu sprzedawców, a ich zakup tworzy konwencjonalny zapis transakcji. Nabywcy mogą również wybierać wydania na podstawie Międzynarodowych Znormalizowanych Numerów Książki, czyli ISBN.
ISBN identyfikuje konkretne wydanie i format książki. Pomaga nabywcom unikać duplikatów, łączyć skany z metadanymi oraz śledzić informacje o języku i publikacji. Takie możliwości mają znaczenie, gdy zamówienie obejmuje tysiące niepowiązanych tytułów.
Destrukcyjne skanowanie jest szybsze niż indywidualne fotografowanie oprawionych stron. Po usunięciu grzbietu luźne arkusze mogą przechodzić przez skanery o dużej prędkości. Optyczne rozpoznawanie znaków następnie przekształca obrazy stron w przeszukiwalny tekst.
Proces ten wymienia ochronę zasobów na wydajność. Rzadki wolumin i popularna książka w miękkiej oprawie mogą trafić do tego samego mechanicznego procesu, jeśli nikt wcześniej ich nie rozdzieli. Końcowy zbiór danych przetrwa, ale zakupiony obiekt już nie.
Mechanizm ten sprawia, że japońskie zamówienia wydają się wiarygodne jako zakupy związane z AI. Nie dowodzi jednak tego związku. Mimo to popyt na czysty tekst japoński, połączony z udokumentowanym procesem przemysłowym, daje właścicielom księgarń uzasadnione powody do obaw.
Japoński skup książek dla AI zamienia przychody w ryzyko dla ochrony zbiorów
Podstawowe odwrócenie sytuacji jest proste: zakup, który pomaga księgarni, może jednocześnie osłabić rynek książek umożliwiający tę sprzedaż.
Dla sprzedawcy dzień z pięciokrotnie wyższą sprzedażą jest zwykle dobrą wiadomością. Antykwariaty działają przy ograniczonej przestrzeni, nierównym popycie i zapasach, które mogą pozostawać niesprzedane przez lata. Zamówienia hurtowe zwalniają miejsce magazynowe i zamieniają wolno rotujące zasoby w przychód.
Wiele kupowanych książek może być również zwykłymi nadwyżkami egzemplarzy. Zniszczenie jednego popularnego wydania w miękkiej oprawie nie usuwa jego treści ze świata. Sklepy rutynowo pozbywają się uszkodzonych lub niechcianych zasobów, gdy koszty ich przechowywania przewyższają prawdopodobny popyt.
Obawy rosną, gdy nabywcy kupują według metadanych, a nie rzadkości. Duży system zakupowy może traktować niedostępne w druku lokalne opracowanie jak każdy inny ISBN. Może nie rozpoznać, że wystawiony egzemplarz jest jednym z nielicznych nadal dostępnych.
Po zeskanowaniu fizyczna książka może zostać przerobiona na makulaturę. Jej tekst może pozostać dostępny wyłącznie w prywatnym korporacyjnym repozytorium. Biblioteki, badacze, kolekcjonerzy i przyszli czytelnicy nie uzyskają automatycznie dostępu do tej cyfrowej wersji.
Taki rezultat różni się od projektu ochrony zbiorów. Biblioteki digitalizują delikatne materiały, aby rozszerzać dostęp, jednocześnie zachowując oryginały, gdy jest to możliwe. Prywatny korpus AI służy przede wszystkim ulepszaniu komercyjnych modeli, a nie funkcjonowaniu jako publiczne archiwum.
Rozróżnienie to wpływa również na weryfikację. Badacze potrzebują stabilnych wydań, obrazów stron, przypisów, ilustracji i fizycznego kontekstu. Zwykły wyodrębniony tekst może pomijać marginalia, układ, typografię, wykresy i ślady historii wydania.
Japoński rynek wydawniczy czyni tę kwestię szczególnie wrażliwą. Wiele prac ma ograniczone nakłady i nigdy nie otrzymuje wydań cyfrowych. Historie regionalne i starsze teksty techniczne mogą zniknąć z rynku, nie przyciągając uwagi całego kraju.
Antykwariaty działają jako nieformalna sieć ochrony zbiorów. Ich półki utrzymują niechciane prywatne kolekcje w dostępności, aż znajdzie je kolejny czytelnik. Usuwanie książek w ilościach przemysłowych zmienia tę sieć, nawet gdy każdy pojedynczy zakup jest legalny.
Presja rozkłada się nierównomiernie. Duże sieci mogą uzupełniać popularne tytuły z wielu oddziałów. Mali wyspecjalizowani sprzedawcy mogą posiadać wyjątkowe zasoby, których zgromadzenie zajęło dekady. Jedno szerokie zamówienie może na stałe zmienić ofertę takich sklepów.
Nie oznacza to, że zakupy hurtowe są z natury niewłaściwe. Właściciele mają prawo sprzedawać swoje książki, a wielu z nich potrzebuje tych przychodów. Nabywcy mają również uzasadnione powody, by digitalizować książki, w tym dostępność, wyszukiwanie, badania naukowe i technologie językowe.
Problemem jest brak świadomego wyboru. Księgarnia może sądzić, że zaopatruje czytelników, biblioteki lub kolekcjonerów. Jeśli jednak nabywca zamierza zniszczyć każdy egzemplarz, sprzedawca nie może zastosować własnych standardów ochrony zbiorów.
Niektórzy właściciele mogliby odrzucić takie zamówienia dotyczące rzadkich materiałów. Inni mogliby ustalić inną cenę, zachować jeden egzemplarz lub zażądać bezinwazyjnego skanowania rzadkich książek. Nie mogą podjąć takich decyzji, gdy pośrednicy ukrywają ostateczne przeznaczenie.
Japońskie zakupy książek na potrzeby AI tworzą zatem problem asymetrii informacji na rynku. Sprzedawcy znają tytuły i ilości, lecz mogą nie znać miejsca docelowego ani celu. Kupujący znają planowany proces, ale mogą rozdzielać zamówienia między wiele kont.
Rezultatem jest krótkoterminowy transfer wartości. Księgarnie otrzymują gotówkę, a kupujący zyskuje zarówno fizyczny obiekt, jak i wyłączną kontrolę nad jego zdigitalizowaną treścią. Społeczeństwo może stracić dostęp, nie zdając sobie sprawy, że doszło do straty.
Dlatego ta historia nie dotyczy wyłącznie firm AI płacących za dane treningowe. Płatność rozstrzyga jedną kwestię dotyczącą pozyskania. Nie rozstrzyga jednak kwestii ochrony zbiorów, przejrzystości, licencjonowania ani społecznej wartości dalszego obiegu książek.
Zakup książki nie rozstrzyga kwestii praw autorskich
Własność fizycznego egzemplarza i zgoda na powielanie jego tekstu to odrębne prawa, a trenowanie AI pozostaje przedmiotem sporów prawnych w różnych jurysdykcjach.
Kupujący może zazwyczaj odsprzedać, wypożyczyć, zmodyfikować lub zniszczyć legalnie nabytą książkę. Prawo autorskie nadal ogranicza jednak tworzenie i wykorzystywanie kopii chronionego utworu. Skanowanie na potrzeby AI stawia te dwie zasady w bezpośrednim konflikcie.
W sprawie Anthropic sąd federalny oddzielił pozyskanie książek od treningu. Sędzia Alsup uznał, że wykorzystanie przez firmę legalnie pozyskanych książek do treningu miało charakter transformacyjny w świetle rozpatrywanych faktów. Orzeczenie nie stworzyło powszechnego wyjątku dla każdego systemu AI.
Sędzia odróżnił również fizyczne skany Anthropic od pobrań z pirackich bibliotek. Zakup drukowanych egzemplarzy i konwersja ich do użytku wewnętrznego zostały potraktowane korzystniej. Przechowywanie milionów plików, o których firma wiedziała, że są pirackie, już nie.
Ta różnica jest jednym z powodów, dla których fizyczne książki mają obecnie strategiczną wartość. Udokumentowany zakup może ograniczyć jedną kategorię ryzyka prawnego. Nie eliminuje jednak roszczeń dotyczących powielania, szkody rynkowej, przejrzystości danych ani odmiennych przepisów krajowych.
Anthropic później zgodził się rozwiązać roszczenia dotyczące pirackich kopii. Proponowana ugoda obejmowała szacunkowo 500 000 utworów i wymagała zniszczenia oryginalnych plików pozyskanych z kwestionowanych bibliotek cyfrowych.
Ugoda dotycząca praw autorskich nie przesądzała, że samo destrukcyjne skanowanie było nielegalne. Pokazała, jak metody pozyskania mogą mieć znaczenie nawet wtedy, gdy sądy uznają trening modeli za transformacyjny.
Autorzy i wydawcy pozostają sceptyczni wobec szerokich twierdzeń dotyczących treningu. Authors Guild śledzi około tuzina amerykańskich spraw dotyczących praw autorskich związanych z książkami i innymi chronionymi materiałami. Wśród pozwanych znajdują się Anthropic, OpenAI, Microsoft, Meta, Nvidia, Google, Bloomberg i Databricks.
Te toczące się sprawy dotyczące AI dotyczą różnych zbiorów danych, modeli, powodów i teorii prawnych. Jednego wyroku nie można automatycznie zastosować do wszystkich. Odwołania mogą również zmienić obecne interpretacje.
Japonia wnosi do analizy kolejny system prawny. Japońskie prawo autorskie zawiera przepisy, które mogą zezwalać na analizę informacji pod określonymi warunkami. Ich zastosowanie zależy od celu, korzystania z utworu i potencjalnej szkody dla posiadaczy praw.
Przesyłka zagraniczna może obejmować kilka etapów i jurysdykcji. Książka może zostać kupiona w Japonii, skonsolidowana w Okayamie, zeskanowana w Stanach Zjednoczonych i wykorzystana przez firmę działającą globalnie. Każdy etap rodzi inne pytania faktyczne.
Obecne relacje nie ujawniają tych umów. Nie wskazują też, kto wybiera tytuły, kto jest właścicielem skanów ani czy wydawcy otrzymują opłaty licencyjne. Te luki uniemożliwiają stanowcze wnioski co do legalności.
Ta sama ostrożność dotyczy niszczenia książek. Doniesienia o wcześniejszym procesie pracy Anthropic pokazują, że destrukcyjne skanowanie na dużą skalę istnieje. Nie dowodzą jednak, że wszystkie książki kierowane przez centrum w Okayamie zostaną przerobione na makulaturę.
Niektóre mogłyby zostać odsprzedane po bezinwazyjnym obrazowaniu. Inne mogłyby zostać przechowane lub przetworzone na potrzeby zwykłego eksportu. Dopóki nabywca, dostawca usług logistycznych, podmiot skanujący lub dokument przewozowy nie dostarczy więcej szczegółów, ostateczny los książek pozostaje zarzutem.
Ta niepewność nie powinna kończyć dochodzenia. Ona je definiuje. Najmocniejszy artykuł nie wskazuje niepotwierdzonego winowajcy, lecz identyfikuje dokumenty potrzebne do sprawdzenia tezy.
Księgarnie mogą zachowywać informacje o kontach, listy zamówień, etykiety wysyłkowe i nietypową korespondencję. Dokumentacja eksportowa może ustalić miejsca docelowe i wagę przesyłek. Wykonawcy skanowania mogą ujawniać zasady ochrony zbiorów bez ujawniania chronionych danych klientów.
Wydawcy i autorzy mogą również pytać, czy nowo pozyskane zbiory danych w języku japońskim są licencjonowane. Twórcy modeli coraz częściej opisują metody bezpieczeństwa i zasoby obliczeniowe. Pozyskiwanie danych treningowych pozostaje znacznie mniej przejrzyste.
Spór prawny będzie trwał, ale przejrzystość może się poprawić, zanim sądy wydadzą ostateczne odpowiedzi. Nabywcy mogą ujawniać swój cel, chronić rzadkie egzemplarze i przekazywać posiadaczom praw istotne informacje. Żaden z tych kroków nie wymaga ujawnienia architektury modelu.
Kolejne dowody muszą pochodzić z łańcucha dostaw
Trzy sygnały zdecydują, czy jest to tymczasowa anomalia w handlu detalicznym, czy przemysłowy transfer japońskiego dorobku wydawniczego do prywatnych archiwów AI.
Pierwszym sygnałem jest identyfikacja ostatecznego nabywcy. Wiele kont zakupowych nie dowodzi istnienia wielu klientów, jeśli wszystkie przesyłki trafiają do jednego obiektu. Umowy lub dokumentacja eksportowa mogłyby powiązać ten obiekt z firmą skanującą lub twórcą AI.
Potwierdzony klient wzmocniłby teorię pozyskiwania danych przez AI. Dowody na zwykły eksport, odsprzedaż biblioteczną lub komercyjne archiwizowanie osłabiłyby ją. Każdy z tych wyników zastąpiłby podejrzenia rozliczalnym łańcuchem pieczy.
Drugim sygnałem jest traktowanie rzadkich książek. Sprzedawcy powinni śledzić, czy kupujący wybierają popularne duplikaty, czy wykupują każdy pasujący ISBN. Zamówienia obejmujące niedostępną już literaturę naukową i historię regionalną zasługują na szczególną uwagę.
Nabywca wykluczający rzadkie egzemplarze ograniczyłby obawy dotyczące ochrony zbiorów. Bezinwazyjne skanowanie zmniejszyłoby je jeszcze bardziej. Proces, który niszczy książki bez oceny ich rzadkości, potwierdzałby obawy o trwałą utratę dziedzictwa kulturowego.
Trzecim sygnałem są ujawnienia ze strony twórców AI. Firmy mogą oświadczyć, czy kupują japońskie kolekcje drukowane, czy wykonawcy niszczą oryginały oraz jak traktują prawa autorskie. Milczenie pozostawi pośredników i księgarnie z ciężarem reputacyjnym.
Twórcy mogliby również wyjaśnić, czy skany pozostają prywatne, czy służą utworzeniu publicznej kopii archiwalnej. Prywatny korpus oferuje wartość komercyjną jednej firmie. Dostępne archiwum może zachować przynajmniej część korzyści dla czytelników i badaczy.
Te sygnały mają znaczenie także poza Japonią. Europejscy i amerykańscy księgarze również zgłaszali nietypowe zamówienia hurtowe związane z popytem na dane treningowe AI. Powtarzalny wzorzec międzynarodowy sugerowałby skoordynowaną branżę pozyskiwania danych, a nie odosobnione kolekcjonowanie.
Zmieniłoby to również obraz konkurencji. Twórcy modeli konkurowali wcześniej głównie o moc obliczeniową, talenty inżynieryjne i zbiory danych w skali internetu. Teraz konkurują o starannie dobraną ludzką wiedzę, która nie krążyła wcześniej swobodnie w internecie.
Ta konkurencja stawia księgarzy w nieznanej roli. Nie są już wyłącznie detalistami obsługującymi czytelników. Ich katalogi mogą stać się elementem infrastruktury danych dla firm o znacznie większych budżetach i niewielkiej widoczności publicznej.
Właściciele nie muszą odrzucać każdej sprzedaży hurtowej. Mogą wprowadzić zabezpieczenia, nie rezygnując z nowych przychodów. Mogłyby one obejmować przeglądy ilościowe, kontrole rzadkości, oświadczenia nabywców i odrębną zgodę na użycie destrukcyjne.
Platformy handlowe mogą również oznaczać skoordynowane konta mające wspólne miejsca docelowe. Zamówienie na dużą skalę obejmujące niepowiązane dziedziny akademickie nie musi być nadużyciem. Nadal jest to użyteczna informacja dla sprzedawców decydujących, czy udostępnić rzadkie zasoby.
Biblioteki, wydawcy i uniwersytety powinny obserwować te same wzorce. Nagłe zniknięcie specjalistycznych tytułów może wpłynąć na badania na długo przed tym, zanim oficjalne statystyki obiegu ujawnią niedobór. Wspólne listy obserwacyjne mogłyby wcześniej identyfikować zagrożone dzieła.
Czytelnicy również mają do odegrania rolę. Każdy, kto sprzedaje odziedziczoną kolekcję, powinien przed wyborem najszybszego nabywcy hurtowego zapytać, czy unikatowy materiał nie powinien trafić do biblioteki lub archiwum. Gdy rzadki egzemplarz trafi do destrukcyjnego przetwarzania, tej decyzji nie da się odwrócić.
Obecny wzrost sprzedaży w Japonii może osłabnąć po ukończeniu bieżącego celu pozyskiwania. Jeśli tak się stanie, sklepy mogą doświadczyć odwrócenia, którego obawiają się właściciele. Przychody rosną w trakcie gromadzenia zbiorów, a następnie spadają, ponieważ pożądany asortyment trudniej zastąpić.
Trwalsze pytanie dotyczy tego, kto kontroluje powstającą wiedzę. Zeskanowana książka może ulepszać narzędzia językowe, systemy wyszukiwania i dostęp dla osób z niepełnosprawnościami. Te korzyści nie wymagają tajemnicy ani niepotrzebnego niszczenia.
Japońskie zakupy książek na potrzeby AI należy więc oceniać na podstawie tego, co dzieje się po zakupie. Czy rzadkie dzieła są chronione? Czy twórcy są informowani? Czy badacze mogą uzyskać dostęp do zachowanych egzemplarzy? Czy nabywca akceptuje publiczną rozliczalność?
Dopóki odpowiedzi nie będą znane, odpowiedzialny wniosek powinien pozostać ostrożny. Zamówienia hurtowe są udokumentowane w relacjach księgarni, podczas gdy związek z AI jest silnie sugerowany, lecz nie w pełni zweryfikowany. Ryzyko staje się nieodwracalne dopiero wtedy, gdy książki trafiają do skanera.
Należy obserwować łańcuch dostaw w Okayamie, los niedostępnych już tytułów oraz ujawnienia głównych twórców modeli. Te trzy sygnały pokażą, czy boom detaliczny przekształcił się w ukryty transfer pamięci kulturowej.



