HyperAIHyperAI

Command Palette

Search for a command to run...

AI企業、絶版書を大量購入し学習データ化

大規模言語モデルの学習データ危機を背景に、AI企業による絶版・希少書籍の大量購入と破壊的スキャンが加速している。Anthropicが2024年初に始動させた内部プロジェクト「パナマ計画」が中心となり、米国や欧州、カナダ、シンガポールの古書店を通じて世界中の書籍が購入されている。購入された書籍は高速産業用スキャナでデジタル化され、その後、資源リサイクルのために破砕・廃棄される。この行為を仲介するISBNdbなどのプラットフォームも台頭し、秘密保持条約を盾に企業秘密として取引を扱っている。 法的には、米連邦裁判所が2025年6月、合法購入した書籍のスキャンと内部利用を「転用的使用」の枠組みで認定した。初販売の原則とデータ保存の効率性を理由に、AnthropicやOpenAI、Metaを巡る著作権訴訟は企業側に有利に展開されている。これにより、Anthropicは2026年7月に約15億ドルの和解金を支払いつつも、プロジェクトは継続可能な体制を整えている。 業界ではこの動きに強い懸念が広がっている。エロン・マスクは非破壊型スキャンの保留を指示し、専門家らは文化財の消滅とクリエイター報酬の欠如を指摘している。また、歴史上出版された約1億3000万冊の書籍で得られるデータ量は次世代モデルに必要な規模に到底満たず、この対策は根本的なデータ不足の解決にはつながらないという現実も浮かび上がっている。AI企業と創造的労働者の権力非対称性を象徴するこの動向は、大規模言語モデルの進化軌道と知的財産のあり方に新たな問いを投げかけている。

関連リンク

AI企業、絶版書を大量購入し学習データ化 | トレンドストーリー | HyperAI超神経