今、日本の古書業界に前例のない現象が起きており、インターネット上で大きな話題となっています。日本各地のオンライン古書店で、今年の8月頃から書籍の「謎の大量注文」が相次いでいるのです。
この不可解な動きの背景には、急速に進化するAI技術、特に「生成AI(人工知能)の学習データ収集」があるのではないかという見方が業界内で急速に広まっています。
この現象は単なる国内の話題に留まらず、追跡調査によって「米国向けに日本の本が50トン以上輸出された」という記録も明らかになり、その規模の大きさに多くの人々が驚きを隠せずにいます。
なぜ今、日本の古書がこれほどまでに大量に求められているのでしょうか。そして、この新たな需要は、本の未来、ひいては文化にどのような影響をもたらすのでしょうか。
本記事では、この古書業界を揺るがすトレンドについて、最新の情報をもとに深掘りし、その背景、経緯、そして今後の見通しを詳しく解説します。
日本の古書店に押し寄せる「謎の大量注文」の正体
日本各地のオンライン古書店では、2026年8月頃から、それまでには見られなかった大量の書籍注文が頻繁に入るようになりました。
ある古書店では「1日100冊売れる」と話し、また別の店では「売上が5倍になった日もある」と、驚きの実情を明かしています。この突然の需要増加は、古書業界に大きな活気をもたらしている一方で、その異例な内容から多くの疑問と憶測を呼んでいます。
売り上げ急増と奇妙な注文内容
古書店への注文は、その内容に大きな特徴が見られます。通常であれば小説やコミックといった人気のジャンルが売れることが多い中、今回の大量注文では、日テレNEWS NNNの取材によると、哲学、歴史、医学、法律といった専門書が目立つとのことです。
さらに、「江戸時代の生活・文化」や「30年前の政界の話」に関する書籍など、一見脈絡のない、多岐にわたるジャンルの本が選ばれている点が指摘されています。
関東地方のある古書店の店主(50代男性)は、1000冊以上を売却した経験から、注文が等間隔で入るため「機械的にシステムを組んで買っているのではないか」と推測しています。
また、購入者が価格交渉をせず、「最高価格」で買い進めるケースも報告されており、通常の古書取引とは異なる様相を呈しています。
このような注文の傾向は、特定の読者層によるものではなく、何らかの目的を持った組織的な収集活動であることを示唆しています。
岡山県の物流センターへ集まる書籍
今回の謎の大量注文には、ある共通点が存在します。複数のオンライン古書店に注文を入れるアカウントは複数あるものの、古本の送り先がいずれも「岡山県にある物流センター」であるという事実です。
この物流センターが、日本各地から集められた大量の書籍の一時的な集積地となっている可能性が指摘されています。
また、西日本にある別の古書店には、海外企業から「数万冊を注文できるか」といった問い合わせメールが届いた事例もあり、この動きが国際的なものであることを裏付けています。
東京都古書籍商業協同組合も、最近のこうした動きを把握しており、業界内では「AIの学習目的ではないか」という話題が持ち上がっていることを認めています。
この岡山県の物流センターが、日本から米国へ50トン以上の書籍が輸出された記録と関連していると見られており、その背後にある巨大な需要の存在が浮き彫りになっています。
AI学習データとしての「紙の本」の価値
なぜ今、AIの学習データとして、わざわざ手間のかかる「紙の本」が大量に求められているのでしょうか。その理由は、近年の生成AI技術の発展と、それに伴う学習データの質の確保という喫緊の課題にあります。
インターネット上の情報だけでは、もはや高品質なAIを育成することが難しくなっているのが現状です。
▶ あわせて読みたい:「行儀が良すぎた」左派が問われる現代:議論の背景と未来
「データ汚染」回避とクリーンな情報源
AIモデルの学習においては、膨大な量のデータが必要とされます。しかし、ウェブ上にはすでにAIが生成したテキストが大量に存在しており、これをAIの学習データとして使用すると「データ汚染」や「モデル崩壊」のリスクが生じると指摘されています。
AIがAIの生成したテキストを学習し続けると、言葉の機微が失われたり、同じような間違いが増幅されたりして、AIの質が低下してしまうのです。
この問題を回避するため、AI開発企業は、AIが関与していない「クリーンな」一次情報源を求めています。その最たるものが、紙媒体の書籍です。
特に、AI生成コンテンツがほとんど存在しなかったとされる2022年以前に出版された書籍は、大規模言語モデルを訓練するための「純粋なコーパス」として非常に価値が高いとされています。
紙の本は、インターネット上の情報とは異なり、人間の手によって書かれ、編集された信頼性の高い情報源として、その価値が再認識されているのです。
書籍のデジタル化と「破壊的スキャン」の実態
購入された大量の書籍は、AIの学習データとして利用するためにデジタル化されることになります。このデジタル化の過程で、一部のAI企業は「破壊的スキャン」と呼ばれる手法を採用していることが明らかになっています。
これは、本の背表紙を切り落とし、ページを一枚ずつ機械に流し込んで高速でスキャンするという方法です。
この手法により、効率的に高品質なデジタルデータを作成できる一方で、物理的な書籍は損傷し、多くの場合、スキャン後に破棄されるかリサイクルされることになります。
この破壊的スキャンは、AI学習のためのデータ収集において、純粋なデータを確保し、そのデータが再び市場に流出するのを防ぐ目的もあるとされています。
古書店主の中には、売れ残っていた古い在庫がはけることは喜ばしいとしながらも、「珍しい本がパルプにされるのは好きじゃない」と複雑な心境を語る声も上がっています。
書籍がAI学習のために「消費・廃棄」されることの是非については、倫理的な議論も巻き起こっています。
なぜ今、日本の古書が狙われるのか
世界中でAI学習データの需要が高まる中、なぜ特に日本の古書が大量に買い集められ、米国に輸出されているのでしょうか。そこには、日本語という言語の特殊性や、著作権に関する各国の法制度、そして海外AI企業の戦略が深く関係しています。
日本語特有のデータ需要と著作権の側面
大規模言語モデル(LLM)の性能向上には、その言語圏に特化した高品質な学習データが不可欠です。
日本語は、漢字、ひらがな、カタカナが混在する複雑な表記体系を持ち、独特の文法構造を持つため、英語などの欧米言語のデータだけでは十分な性能を発揮できません。
デジタル庁の調査研究でも、「日本固有の背景や情報に答えられるデータ」を継続的に公開することの重要性が確認されています。
このため、日本語のAIモデルを高度化させるためには、日本語の書籍から得られる豊富で質の高いデータが強く求められているのです。
また、著作権の扱いも重要な要素です。米国では、AIモデルの学習に合法的に購入した書籍を利用することは、著作権法上の「フェアユース(公正利用)」に該当するという連邦判事の判断が出ています。
これにより、AI企業は法的リスクを低減しつつ、大量の書籍をデータとして活用できる環境が整っています。
ただし、英国など他の国では著作権法の解釈が異なり、複製行為に著作権者の許可が必要となる場合があるため、国際的な法整備の動向も注目されています。
▶ あわせて読みたい:チョコザップ「サブスクトイレ化」騒動の深層:なぜ今、衛生とマナーが問われるのか
海外AI企業の動向と「プロジェクト・パナマ」
海外のAI企業が、日本語の紙媒体のデータに目を向けている背景には、彼らのデータ収集戦略と潤沢な資金力があります。
過去には、AI企業Anthropicが「プロジェクト・パナマ」と呼ばれる取り組みで、数百万冊の紙の本を買い集め、スキャン後に破棄する計画を進めていたことが報じられています。
このプロジェクトには数千万ドル規模の資金が投じられたとされており、紙の書籍を大量に調達し、デジタル化するための費用を惜しまない姿勢がうかがえます。
「ISBNdb」のような企業は、書籍のデータベースを活用し、AIラボ向けに紙の本を大量に買い集める調達代行サービスを提供しています。
彼らは、どのISBNの本をすでに購入したかを機械的に管理し、ジャンルや出版年、言語などで絞り込んだ発注も可能にしています。
日本の古書店業界においても、「日本の古本屋」という約1000軒の参加店と700万冊以上の在庫を誇る大規模なオンラインプラットフォームが存在するため、海外のAI企業が日本語の書籍データを効率的に収集する上での重要な窓口となっていると考えられます。
古書業界が直面する新たな光と影
AI学習データとしての古書需要の急増は、日本の古書業界に大きな変化をもたらしています。一時的な経済的恩恵がある一方で、長期的な視点での本の価値や文化財としての位置づけに対する懸念も浮上しており、業界全体が新たな課題に直面しています。
経済的恩恵と文化財としての本の行方
古書店にとっては、これまで長年売れ残っていた在庫が大量に売れるという、予期せぬ経済的恩恵があります。ある古書店主は「売上が上がるのはうれしい」と率直な気持ちを語っています。
特に、保管場所や送料の負担が大きく、価格を下げてもなかなか売れなかった専門書や重い本が新たな買い手を見つけることは、業界にとってプラスの側面もあります。
古書店の現場では、高齢化に伴う蔵書の整理などで日々大量の本が市場に流れ込む一方で、買い手がつかずに処分せざるを得ない本も少なくないのが現実です。
しかし、この需要の裏側には、書籍がスキャン後に破棄される可能性が潜んでいます。古書店の店主からは「本の価値は今後どうなるのか。複雑な気持ちもある」という声も聞かれます。
特に、現存数が極めて少ない絶版の古書や稀覯本が、AI学習のために破壊され、失われてしまうことへの懸念は深刻です。本は単なる情報源であるだけでなく、歴史や文化を伝える貴重な媒体でもあります。
その物理的な存在が失われることは、将来の世代にとって取り返しのつかない損失となる可能性も指摘されています。
新たな需要への期待と懸念の声
このAI学習による新たな需要を、古書業界の活性化の機会と捉える向きもあります。
株式会社サーフボードの社長である北野氏は、スタッフブログで「すでに廃棄へ向かっていた本に新しい使い道が生まれる可能性も、同じように見てほしい」と語り、AIによる新たな需要が、これまで顧みられなかった本の価値を再発見するきっかけになることを期待しています。
本が持つ情報としての価値が最大化され、新たな知識創造の源となる可能性は否定できません。
一方で、この一方的な需要増加が、古書市場の価格形成や流通構造にどのような影響を与えるか、不透明な部分も多く残されています。また、著作権者への適切な対価や、書籍の文化財としての保護といった課題も浮上しています。
AI技術の発展と古書の保存という二つの重要なテーマの間で、いかにバランスを取り、ウィンウィンの関係を築いていくかが、今後の古書業界、ひいては社会全体に問われることとなるでしょう。
▶ あわせて読みたい:傷害罪の潮流:メタノール事件無罪確定が問う司法の原則
よくある質問
Q: 古書店での「謎の大量注文」はいつ頃から始まったのですか?
A: 日本各地のオンライン古書店に対して、今年の8月ごろから書籍の大量注文が相次いでいることがわかっています。
Q: どのような種類の本が大量に注文されているのですか?
A: 哲学、歴史、医学、法律といった専門書や、「江戸時代の生活・文化」「30年前の政界の話」など、多岐にわたるジャンルの本が注文されています。通常売れることの多い小説やコミックとは異なる傾向が見られます。
Q: なぜAIの学習に紙の本が使われるのですか?
A: インターネット上にはAIが生成したテキストが増えており、それを学習データにすると「データ汚染」や「モデル崩壊」のリスクがあるためです。
AIが関与していない「クリーンな」一次情報源として、紙の本、特に2022年以前に出版された書籍が求められています。
Q: 買い集められた日本の本はどこへ運ばれているのですか?
A: 複数の古書店からの注文品の送り先が、いずれも岡山県にある物流センターであるという共通点があります。その後、米国向けに50トン以上の日本の本が輸出された記録も確認されています。
Q: 大量に買い集められた本は、最終的にどうなるのですか?
A: AI学習のためにスキャンされ、デジタルデータとして利用されることが主な目的です。この過程で、本の背表紙を裁断する「破壊的スキャン」が行われ、物理的な書籍は破棄されるかリサイクルされることが多いと報じられています。
まとめ
2026年9月22日、日本の古書店に突如として押し寄せた「謎の大量注文」と、それに続く米国への「日本の本50トン輸出」のニュースは、AI技術の進化が現実世界にもたらす影響を鮮明に示しています。
この現象の背景には、生成AIの学習データにおける「データ汚染」を回避し、質の高い「クリーンな」情報源を確保したいというAI開発企業の切実なニーズがあります。
特に、日本語特有の複雑さを持つ言語モデルの精度向上には、日本固有の書籍データが不可欠とされています。
古書店にとっては、長年売れ残っていた専門書などが売れるという経済的な恩恵がある一方で、貴重な書籍がスキャン後に破棄される可能性や、文化財としての本の価値が失われることへの懸念も広がっています。
この一連の動きは、本の未来、ひいては知識や文化の継承のあり方について、私たちに新たな問いを投げかけています。
AIとの共存が深まる社会において、書籍という媒体が持つ多面的な価値をいかに守り、活用していくか、継続的な議論と対応が求められるでしょう。

コメント
コメント一覧 (2件)
[…] ▶ あわせて読みたい:古書店を席巻するAIの影:謎の大量注文と日本の書籍50トン輸出の衝撃 […]
[…] ▶ あわせて読みたい:古書店を席巻するAIの影:謎の大量注文と日本の書籍50トン輸出の衝撃 […]