前稿[日販とAnthropicを巡る論点整理]で取り上げた問題は、単なる一企業の著作権コンプライアンスや、AI学習データの収集手法を巡る個別トラブルにとどまらない。
この問題の本質は、「インターネット上に存在しない日本語の未デジタル化知識(専門書、地域史料、自費出版物など)が、公共的な知の共有(オープンアーカイブ)を経ることなく、一企業のプロプライエタリなモデルに物理的破壊(裁断・スキャン・廃棄)を伴って私物化され、人類のアクセス可能な記録から不可逆的に消滅させられている」という文化資源の収奪と解体の構造にある。黙っていてよい問題ではない。

日テレNEWS NNNが2026年9月22日に報じた「古書店での謎の大量注文」と「米国向け50トン超の書籍輸出記録」は、この水面下の収奪が産業規模で本格稼働している動かぬ証跡である。
水面下で進む「書籍の回収と輸出」の現実
2026年8月以降、日本各地のオンライン古書店に対して異様な注文が相次いでいる。同一の物流センター(岡山県)を配送先に指定し、複数アカウントから機械的かつ等間隔に発注が繰り返される。1日に100冊が捌け、売上が通常の5倍に跳ね上がった店舗もある。言うまでもなく、売上があがったのだから喜ばしい、ということではないのだ。
注目すべきは、買付の対象となっている書籍群の性質だ。小説やコミックといった一般の流通主力品は除外され、哲学、歴史、医学、法律、江戸時代の生活文化、数十年前の政界インサイドレポートといった「専門書」が無差別に買い集められている。
さらに、貿易データ分析ツール「Sayari」の記録によって、日本の大手出版取次グループ会社から米国へ向けて、品名「JAPANESE BOOKS」として計50トン以上が輸出されていた事実が判明した。上製本(ハードカバー)500グラム換算で約10万冊規模の紙の書物が、海を渡っている。
この動きは、米国カリフォルニア州北部地区連邦地方裁判所で係争中のAnthropic社に対する著作権侵害訴訟資料と完全に符号する。同社は「Project Panama」と称する社内計画のもと、数百万冊規模の古書を調達し、油圧式裁断機で背表紙を切り落として高速スキャンにかけ、残余の紙を廃棄・リサイクルしていた。その対象リストには、日本の書籍および大手出版取次の名が明記されている。米メディア「404 Media」が報じたAmazonによる書籍の裁断・廃棄スキャンを含め、紙の書籍を「物理的に消費・破壊してトークン化する」サプライチェーンが既に成立している。
失われる「周縁的記録」と地域知の不可逆的喪失
英語圏やフランス語圏であれば、200年前の地方都市で発行された非合法パンフレットすらGoogle Books等の公共的スキャン事業によってデジタル化され、テキストとして捕捉されているケースが多い。しかし、日本語の文化資源において同様のインフラは存在しない。
日本の古書市場に眠る「いらない本」の中には、国立国会図書館に法定納本されておらず、公立図書館のOPAC(目録)にも登録されていない資料が膨大に含まれている。
- 地方自治体や郷土史家が極小部数で発行した地域史料
- 個人が私費を投じて編纂した自費出版の記録や調査書
- 特定の時代・集落の風俗や方言、食文化を記録したミニコミ誌やZINE
これらは、古書という「物理的な紙の束」の形態を保っていたからこそ、いつか公的機関に寄贈されたり、研究者の目に留まってアーカイブ化される余地を残していた。
しかし、AI企業による機械的なクローリング買い付けによって古書市場から回収され、裁断機で背表紙を落とされて可燃ゴミやリサイクル原料に変わった瞬間、その原本はこの世界から物理的に消滅する。そして、スキャンされたテキストデータはAI開発企業の内部サーバーに閉じ込められ、外部からは二度と参照できない。存在すら知られないまま、地域の記憶が「トークン」として消費され、歴史から永久に抹消されている。
「公開なき学習」と日米欧の制度的空隙
かつてGoogle Booksが書籍の大量スキャンを進めた際、米国の司法(Authors Guild v. Google, 2015)がフェアユースを認めた根拠の中心には、「全文検索インデックスの提供」と「スニペット表示」という公衆アクセスの拡大と知の還元があった。著作権者の利益に配慮しつつも、人類全体の知へのアクセス性を向上させるという大義が存在した。
対照的に、現在の生成AI企業が行っている破壊的スキャンには、いかなる公共還元も存在しない。スキャンされた全文テキストはプロプライエタリな学習コーパスとして秘匿され、原著者も、研究者も、一般市民もその原本テキストを読むことはできない。
この一方的な収奪を可能にしているのが、各国における法制度の非対称性(レギュラトリー・アービトラージ)である。
- 日本(著作権法第30条の4): 思想・感情の享受を目的としない「情報解析」であれば、営利・非営利を問わず著作物を無許諾で利用可能。権利者が明示的に拒絶しても法的に排除するオプトアウト制度は存在しない。世界で最もAI学習規制が緩やかな法域となっている。
- EU(DSM著作権指令 第3条・第4条 / AI法): 学術研究(第3条)を除き、営利目的(第4条)では権利者が機械可読な方法で権利留保(オプトアウト)したデータの利用を禁止。さらにEU AI法により、汎用AIモデル提供者には学習データ要約書の開示が義務付けられている。
- 米国(著作権法第107条): 明文の例外規定はなく、フェアユースの4要素(目的、変形性、利用量、市場への影響)に基づき司法が事後判断する。現在、海賊版データや書籍の裁断スキャンを巡る複数の集団訴訟で適法性が激しく争われている。
EUではオプトアウトやデータ開示義務があり、米国では司法リスクが燻るなかで、法的な抜け穴となって機能しているのが日本の著作権法第30条の4である。私的所有権に基づく売買の体裁を取り、緩格な日本法規の隙間を突いて「未デジタル化知」を根こそぎ調達する構造が成立してしまっている。
人文学軽視とビッグテックのマッチポンプ
なぜ、これほど貴重な専門書が「10万冊単位」で安価に調達できてしまうのか。その根本的な要因は、古書市場そのものの崩壊にある。
「人文・社会科学の研究はお金にならない」「即効性のある実学を重視すべきだ」という新自由主義的な社会風潮が長年続いた結果、大学の人文系研究費やポストは削減され、専門研究者の母集団は激減した。研究者層の縮小は専門書の需要激減を直撃し、かつて学術的価値を持っていた書籍の市場価格は暴落した。某古書店主が漏らした「宝の山が、ゴミの山」という言葉は、この市場の壊滅を端的に表している。
ビッグテックはこの「人文学の衰退」によって生じた底値の専門書を買い叩き、大規模言語モデルの知能基盤として貪欲に吸収している。
そして、古書から抽出された知識によってAIが哲学や歴史、文学についてもっともらしい解説を出力できるようになると、今度は社会の側から「もう人文系の学者や研究者はいらない。AIと対話していれば十分だ」という言説が声高に叫ばれるようになる。
これは極めてグロテスクなマッチポンプである。自ら社会的に人文学の基盤を痩せ細らせて文化資源を底値で収奪し、その収奪物を用いて作り上げたツールを掲げて、元あった人文学研究の存在意義そのものを解体しようとしている。知を生み出す土壌を自ら枯死させながら、過去の蓄積の最後の絞りかすを吸い上げる行為に他ならない。
知のコモンズを奪還するための制度設計
書物は私有財産であると同時に、時代と地域を記録した「人類共通の文化遺産(コモンズ)」である。適法に購入した所有物だからといって、未デジタル化の希少な記録を非公開のまま裁断・廃棄し、自社の独占的アルゴリズムの燃料として消費し尽くす行為を野放しにしてはならない。
この不可逆な文化破壊を食い止めるためには、技術的・法的な境界線の再構築が不可欠である。
- 破壊的スキャンの適法要件化としての「公的寄託」: 紙書籍を不可逆的に裁断・デジタル化してAI学習に用いる場合、著作権法第30条の4の適用要件として、取得した高解像度スキャンデータおよび書誌メタデータを国立国会図書館等の公的アーカイブに寄託することを義務付ける。原本を消滅させる代償として、デジタルデータとしての公的保全を担保させる。
- 学習データセットのトレーサビリティ確保: EU AI法に倣い、商用AIモデルがどの書籍や資料を学習コーパスとして取り込んだのか、目録レベルでの透明性開示を義務付ける。どの地域記録がモデル内部に組み込まれたのかを事後検証可能にする。
- 文化還元ファンドの創設: 古書・未デジタル化資料の大量買付および学習利用によって得られるAI企業の経済的利益から、地方史料の保存活動や人文系研究基盤を支える公的基金への還元枠組みを法制化する。
「AIか、人文学か」という二項対立に終始してはならない。過去の記録を公に遺す回路を遮断したまま、一握りのテック企業が過去の知を焼き尽くす行為は、技術革新ではなく単なる文化の侵食である。書物がゴミとして消え去る前に、知のコモンズを守るための法制是正が急務である。
「支配される側」から、仕組みを「所有する側」へ。
月額課金の鎖に縛られ、データを吸い上げられる「待ち」の経営を終わりにしませんか?
阿部寛のHPに匹敵する「軽量・高信頼」な自前の自動化パイプライン。その設計図(n8nインポート用JSON)を、今すぐお持ち帰りいただけます。
「あなたの時間は、他人のサーバーを動かすためにあるのではない。」





