HyperAIHyperAI

Command Palette

Search for a command to run...

Security
LLM

先進AIラボ、制御不能AI封じ込め計画を明かさず

AI安全性促進団体Guidelightは、主要5社の暴走モデル封じ込め計画を評価したレポートを公表した。OpenAI、Anthropic、Meta、Google、xAIを対象に、内部監視体制、アラート発動後の停止手順、第三者監査の実施状況などで測定。結果、OpenAIが作業停止やモデル隔離の事例から最高評価を得たものの3点(5点満点)にとどまり、MetaとAnthropicが最低評価となった。封じ込め手順の公開が極めて限定的であることが浮き彫りとなった。 各社は評価が公開情報のみを反映したもので、内部計画の存在を否定していない。OpenAIとGoogleは対応プロセスがあるとし、Metaは明言を避けた。法務専門家は、詳細開示が法的責任や競争優位性に影響するため企業は慎重になると指摘する。 エージェント型AIの自律運用拡大と最近のセキュリティインシデントを受け、封じ込め体制の必要性が国際的に高まっている。GuidelightのSteven Adler氏は事前計画策定の必須性を強調。カリフォルニアやニューヨークの州法、連邦のAIキルスイッチ法案など規制当局も透明性を求めている。ControlAIのConnor Leahy氏は即時停止機能の欠如を危険視する。専門家は、テスト前の評価に加え、実行時の推論監視と即時凍結手順の制度化を推奨している。

関連リンク