AIによる知識の集積

1.AIと図書館
謎の大量注文
「古書店で『謎の大量注文』相次ぐ……AI学習か 米国向け『日本の本50トン』の輸出記録も」(日テレNEWS、2026年9月22日)という記事を読みました。
今年8月ごろから、日本各地のオンライン古書店に書籍の大量注文が相次いでいるというのです。売れているのは、哲学、歴史、医学、法律、江戸時代の生活や文化、過去の政治などに関する専門書です。
送り先はいずれも岡山県内の物流センター。さらに、日本の出版取次会社のグループ企業から、米国向けに50トンを超える「日本の本」が輸出された記録も確認されたといいます。
これらの本がAIの学習に使われたことは、まだ確認されていません。
しかし米国では、AI企業が大量の紙の本を収集し、裁断、スキャン、データ化してAIの学習に使った事例が明らかになっています。
AIがたくさんの書籍を情報として取り込んでいくことは、AIが図書館に近づいていくことにつながります。
そこでまず、図書館とは何かについて確認しておきたいと思います。
図書館とは
図書館は、無料で本を貸してくれる施設だと思われていますが、それにとどまりません。
日本図書館協会の「図書館の自由に関する宣言」は、「図書館は、基本的人権のひとつとして知る自由をもつ国民に、資料と施設を提供することを、もっとも重要な任務とする」としています。
知る自由を保障するため、図書館資料は、原則として誰もが自由に利用できなければなりません。
しかし、利用する人にお金がなければ資料に近づけないのであれば、知る自由は実質的に保障されません。そのため図書館法第17条は、公立図書館が入館料や資料の利用料を徴収することを禁じています。
もちろん、本の購入、施設の建設・維持、司書の配置には費用がかかります。公立図書館は、その費用を税金によって社会全体で負担し、利用する人には料金を求めないしくみです。
これによって、所得の少ない人でも、高価な専門書を読み、社会の問題を調べ、政治について考えることができます。
図書館は、知識へのアクセスを個人の購買力から切り離す制度なのです。
ただし、料金を取らなければ、それだけで知る自由が保障されるわけではありません。
利用者がさまざまな考え方に接するためには、特定の立場に偏らず、多様な資料が集められていなければなりません。
どの資料に基づいているのかを確かめ、異なる立場の資料を読み比べられることも必要です。
また、現在の利用だけでなく、将来の研究や検証に備えて、資料を保存しなければなりません。誰が何を読んだのかという利用者の秘密も守られなければなりません。
誰もが、資力にかかわらず多様な情報に接し、自分で考え、判断する。そのための条件を保障するのが図書館です。
図書館は、知る権利を支え、民主主義の土台をつくる制度だといえます。
2.AIによる知の蓄積と私有
AIが書籍の内容を取り込む意味
では、記事にあるように、AIが大量の書籍の内容を取り込んでいくことには、どのような意味があるのでしょうか。
AIは、図書館や検索システムと同じように、資料の所在を案内することもします。しかし、AIの機能はそこにとどまりません。
多数の資料を比較検討し、論点を整理し、質問に応じて説明します。
これまでにない新たな結論を導き出すこともあります。
資料を調べ、内容についての相談に乗り、文章を組み立て、校正もする。いわば、図書館司書、研究助手、編集者、家庭教師などの役割も果たすわけです。
これは利用者にとって、大きな利便性があります。
AIが図書館的な機能をもつこと自体は、悪いことではありません。
知識がカネしだいになる
図書館は本を保存し、目録を公開し、市民の利用に供します。
しかし、民間企業が本を大量に集め、裁断・スキャンし、データに変えていくとどうなるでしょうか。
集積されたデータのうち、誰にでも無料で利用できるのは簡単な回答だけ。それを超えるものは、有料の商品となるでしょう。
より詳細な回答、専門資料の横断的な調査、出典の表示、原資料への接続などは、別料金となる可能性があります。
みんなが「使い続けないわけにはいかない」「買わざるをえない」という状況を見計らって有料プランを設定することは、これまでネットのさまざまな無料サービスが有料化していった経過からも十分にありうることです。
資力のある人は原資料を読み、複数の見解を比較し、AIの誤りも検証できる。資力のない人は、出典の分からない回答を受け入れるしかない。
知識へのアクセスの格差が、考え、判断する力の格差となり、やがて政治参加の格差にもつながりかねません。
人類が蓄積してきた知識を私企業が囲い込み、誰がどこまで利用できるかを、企業と市場の判断だけで決めてよいのでしょうか。
3.知的遺産を守る
AIが本を読み、知識を結びつけ、人びとの調査を助けることには、大きな可能性があります。
その可能性を生かしながら、著作者の権利と利用者の権利を守り、人類が蓄積してきた知的遺産を将来へ引き継ぐには、どのようなしくみが必要でしょうか。
著作者の権利を守る
AIによる書籍の利用では、著作者の権利が大きな問題になります。
紙の本を一冊買ってスキャンし、その内容をAIの能力に組み込めば、その本は一回読まれて終わるのではありません。
AIは、その知識を使って何百万回でも回答し、有料サービスとして利益を生み続けます。一冊の本が、AI企業の手によって、利益を繰り返し生む手段へ変えられるわけです。
しかも、古書の購入代金は古書店に支払われるだけで、通常、著者や出版社には届きません。AIの能力として溶け込んでしまえば、どの本の、誰の仕事が回答に寄与したのかも見えにくくなります。
著作者への対価をどのように算定し、分配するのかは簡単ではありません。
しかし、著作物をスキャンし、データとして取り込んだ企業だけが利益を得るしくみは、まともとはいえないでしょう。
まず、AIの学習に使われた資料について、透明性を確保する必要があります。
学習に使ったすべての資料を一冊ずつ明らかにすることが技術的に困難であっても、どのような資料群を、どのような方法で収集したのかは公開させる。
違法に複製された資料や、入手経路の不明な資料が使われていないかを検証できなければなりません。
個々の著作者が巨大なAI企業と交渉することは困難です。
権利を集団的に管理し、AI企業から利用料を徴収して、著者や出版社へ配分するしくみも必要になるでしょう。
AI企業に学習資料や利用記録の保存・開示を求め、独立した機関が検証できるようにすることも、検討しなければならないのではないでしょうか。
利用者の権利を守る
利用者がAIの回答をうのみにせず、自分で確かめるためには、出典と原資料への道が開かれていなければなりません。
AIが根拠となる資料を特定できる場合には、書名、著者名、該当箇所などを示す。利用者が原文に戻り、異なる立場の資料と読み比べられるようにする必要があります。
出典の表示や原資料への接続を、高額な有料プランだけの機能にしてはなりません。根拠を確かめる機能は、知る権利を保障するための基本的な機能だからです。
高度な機能のすべてを無料にすることはできないとしても、基本的な調査、出典の確認、複数の見解へのアクセスなどは、所得に左右されず利用できなければなりません。
利用者の秘密を守ることも重要です。
企業は利用料金を取らなければ、広告、個人情報や行動履歴の利用、有料サービスへの誘導などによって費用を回収します。
図書館が、誰が何を読んだかという秘密を守るように、AIについても、誰が何を尋ね、何を調べたのかを保護しなければなりません。
調査履歴を広告、信用評価、政治的な選別、監視などに利用することは、厳しく制限する必要があります。
図書館の論理をAIに
図書館は、著作者や出版社には本の購入を通じて対価を支払い、利用者には資力を問わず資料を提供してきました。
費用を利用者一人ひとりに負わせるのではなく、社会全体で負担するしくみです。
著作者には正当な対価を支払う。その一方で、社会について調べ、根拠となる資料を確かめ、自分で判断するために必要な基本的な調査機能は、利用者の資力にかかわらず保障する。
AIは、この原則を引き継ぐことができるでしょうか。
国や自治体、図書館などがAI企業と契約し、図書館では必要な調査機能を無料で利用できるようにする。
高価な新聞記事データベースや判例データベースを図書館が契約し、利用者に提供しているのと同じ考え方です。
図書館や学校などの公共施設を通じて利用できるしくみを整え、その費用の一部をAI企業の利益に対する負担金などによって賄うことも検討すべきでしょう。
希少な資料を保存することも必要です。
絶版となり、古書市場にわずかしか残っていない本を大量に購入して裁断すれば、研究者や市民が原資料を利用できなくなります。
希少本については、裁断前の確認、保存機関への提供、非破壊でのデジタル化などを求める必要があります。
さらに、少数の企業が、学習データ、計算設備、AIモデル、利用者情報を独占すれば、回答の内容や利用料金を一方的に決めることができます。
公正な競争を確保するとともに、将来的には、国立国会図書館、公共図書館、大学図書館などが協力し、公共的・非営利的なAI基盤を整備することも考えられます。
しかし、現段階でまず必要なのは、私企業によるAIの開発と利用を市場任せにせず、知る権利の観点から社会的な規制をかけることです。
問題は、AIの能力を一部の企業が私有し、誰がどこまで利用できるかを、市場と企業の判断だけで決めてしまうことです。
人類が蓄積してきた知識からAIがつくられるのであれば、そこから生まれる利益は著作者に還元され、その能力は社会全体のものとしても利用できなければなりません。
誰もが知り、考え、根拠を確かめ、社会の意思決定に参加できるのか。
AIによる知識へのアクセスを市場の論理だけに委ねないこと。
それは、著作権政策にとどまらない、知る権利と民主主義の問題なのです。












コメントを残す