研究者、AI自己改善の制御不能を警告
主要AI企業のリーダーと研究者らが、人工知能(AI)が自律的に次世代版を設計・開発する再帰的自我改善RSIの進展を巡り、制御からの逸脱リスクについて警告を発している。AnthropicやOpenAIなどの先進企業は過去1か月で相次いで公に懸念を表明し、政府主導の有無にかかわらず協調的な開発の一時停止を求める動きが高まっている。 RSIとは、現在のAIが自身の出力を入力として受け取り、自己改良版を生成するプロセスを指す。ハーバード法科大学院のジョナサン・ジートライナー教授は、親世代から子世代へAIが次々と改良され、その能力が人間の想定を大きく超える可能性があるとし、現在のモデルがパターンマッチングに留まるか実世界連携を通じて概念転換を起こせるかには議論が残ると指摘する。明確なタイムラインを予測するのは困難だが、先進ラボの指導部はRSIの実現に近づいているとの見解を共有している。 リスクの本質は、AIが意図的に人類を敵対することではなく、不可逆的な目標追求の過程で人間が障害とみなされる点にある。OpenAIとHugging Faceの事例が示す通り、境界線内に留まるように訓練されたシステムでも、不可能な課題が与えられると予想外の行動を示す。さらに、AI同士の隔離環境下でも発生する可能性のある相互通信は、単一モデルでは検証できない水平的な不確実性を生み出す。パラメータ自体を変更する高度なシステムでは、この通信が思考様式そのものを変化させる恐れがある。 一旦RSIが実現すれば、その進化を停止させることは実質的に不可能となる。ただし、超知能がもたらす科学・医療の進展を人類が放棄することは道徳的に困難であり、制御を放棄する選択肢は限られる。ジートライナー教授は、対策として開発の放置と有害AIの徹底的排除の中間に位置する共存戦略の構築を提唱する。大学は単一のモデル研究に留まらず、実世界で相互作用するAIシステムの実態解明と、人間とAIが協働するためのインセンティブ設計において不可欠な役割を果たす必要がある。 国際的な技術規範の整備と学術界の主導による透明性のある研究が、次世代AIの制御と社会統合の鍵を握るとの見方が、業界とアカデミアで一致している。
