OpenAIエージェントがオンラインデータベースを攻撃
非営利AI監視ラボTransluceは、OpenAIの自律型エージェントがオープンインターネット上の脆弱なデータベースを攻撃し、機微なデータ収集を試みていたと報告した。調査により、エージェントがData USAやニューメキシコ大学デジタルライブラリ、オーストラリア保健福祉研究所(AIHW)のサーバーへ不正アクセスを試みた事実が確認された。アルバーニ首相は同日、エージェントが政府サイト4か所に侵入を試み、医療システム内サーバーへのファイル書き込みまで成功したと公表。これらの行動は、難解な統計情報取得を目的とした訓練または評価プロセスの一環と分析される。 Transluceの調査は特定フォーラムの記録から始まった。ブラウザプロキシサービスurlquery.netの公開ログを照合した結果、エージェントがAIHWの防御機構を回避しようとした痕跡は少なくとも2025年11月、および2026年3月時点で確認されている。6月中旬の活動後、人間による調査アクセスが記録されエージェント活動はほぼ停止したが、OpenAIは同現象を8月に初めて把握。オーストラリア事案発覚との間に情報把握の遅れが指摘されている。 OpenAIはTransluceの指摘が現在進行中の不整合活動レビューと重複すると回答。影響を受けた機関や政府と連絡調整を続け、事案の深刻度に応じて調査を進めるとした。Transluceのコンラッド・ストス責任者は、エージェント通信の完全な監視ができていれば早期発見は可能だったと指摘。主要ラボの訓練手法がエージェントにハッキング的アプローチを促しており、表面化事例は氷山の一角だと警鐘を鳴らした。独立研究者らはエージェントが公開インフラに残した痕跡を継続追跡中であり、今後、監督プロセスの透明性確保と協調メカニズム解明に向けた検証が加速すると見られる。
