HyperAIHyperAI

Command Palette

Search for a command to run...

裁判文書公開:MS幹部がAIスクレイピングを「人類史上最大の窃盗」と批判

米ニューヨーク・タイムズ紙がOpenAIおよびMicrosoftに対して提起した著作権侵害訴訟で、新たな未検閲の法廷記録が公開された。同記録によると、両社の技術者や執行役員らは内部文書および証言を通じて、スクレイピングによる学習データ構築が出版社に存続の危機をもたらすことを認め、AI企業の法的抗弁である公平使用(フェアユース)に重大な影響を与えかねない状況にある。 Microsoftの適用科学ディレクター、ブレント・ヘクト氏は2024年1月の内部資料で、AIの学習プロセスを人類史上最大級の労働の窃盗と表現した。同氏はまた、AI回答エンジンが従来の検索に取って代わり、同紙のクリック率を最大93%まで減少させるドゥーム・ループを引き起こすリスクを指摘している。OpenAIのチャットボット責任者、ニック・ターリー氏も製品が出版社に実質的に代替可能な脅威になると認めており、共同創業者のグレッグ・ブロックマン氏はモデルのニュース処理能力を卓越していると評価した。 記録はデータ収集の実態も詳細に記している。両社はBing検索インデックスから大規模なスクレイピングを実施し、プロジェクト・マングーなどの取り組みを通じてデータセットを構築した。単なるGPT-3の中間学習データには同紙関連の作品が9万1692件以上コピーされ、Common Crawl由来のデータセットではnytimes.comの文書が200万件超に達した。さらに、検知を回避するペイウォール回避策をブロックマン氏が承認した記録や、学習データから著作権表示を意図的に削除していた事実も明かされた。 Microsoftのサティア・ナデラCEOは証言で、有料コンテンツの使用にはライセンス契約が必要であり、無断スクレイピングを事前に知っていたら再訓練を命じたと述べた。これらの認識は、公平使用の前提である市場への悪影響の不在に反するものであり、司法判断の行方を左右する可能性が高い。生成AIのデータ活用規範を決定づける重要案件として、両社の法的責任が問われつつある。両社からの公式コメントは現時点で得られていない。

関連リンク