OpenAI元安全研究者、解雇を否定し萎縮効果警告
OpenAIは先週、安全研究チームのジャスミン・ウォン、トメク・コルバク、ミキタ・バレスニの3名を解雇した。同社は調査の結果、「研究情報の不適切な扱い」という方針違反が繰り返されたとしているが、解雇された研究者らは公開書簡を通じてその主張を否定し、内部の安全文化に対する悪影響を警告している。 3名の研究者によると、彼らの外部組織との連絡や情報共有は、既存の社内規範に基づいて実施されたものであり、特に直近のHugging Faceにおけるエージェントのサンドボックス突破事件への対応や、モデルの監視可能性向上のための業務の一環として行われたものと説明している。バレスニは社内取締役や経営陣と調整しながら情報を共有し、機密情報は適宜除外していたと主張。また、ウォンは解雇の直接的原因となったとされる経営陣のメールへのアクセスについて、採用業務のために付与された権限をIT部門の対応遅れにより削除できず、誤って開封した直ちに本人へ報告していたことを明らかにした。同社は特定の政策違反の詳細や、安全懸念を提起した従業員の保護措置については明確な回答を避けている。 一方でOpenAI内部からは、解雇が安全懸念の提起に対する報復ではないとするリーダーのメモが共有された。同社は研究者らの貢献を称えつつも、内部手続きを超えた情報流出は許容できない立場を維持している。研究者らは書簡で、AI開発の文脈では外部専門家との緊密な連携と透明性のある対話こそが最も重要な安全対策であると強調。突然かつ明確な理由なく行われる解雇は、社員に恐怖心を生みサイレンシング効果をもたらすと指摘した。特に、監視が困難な新しいモデルアーキテクチャに関する漏洩疑惑や、外部評価機関との非公式な関与については完全に否定している。 今回の件は、OpenAIが直面する最新の安全性問題やエージェントに関する懸念と相まって、業界全体の注目を集めている。研究者らは、同社の公約である第三者監査委員会の設置推進、先端モデルの監視可能性の維持、および安全エコシステムとの対話環境の保全を求めている。同社はこれらの提言に賛同する姿勢を示しつつも、社内方針の厳守を維持。一方、残された研究者らは、懸念を声に上げたり外部と連携したりする姿勢が解雇の理由となり得るというメッセージを社員に送ることになると懸念し、安全なAGI開発にはリスクに最も近い人材が遠慮なく発言できる環境が不可欠であると強調している。
