HyperAIHyperAI

Command Palette

Search for a command to run...

OpenAI
LLM

OpenAI、大規模な推論抽出行動を阻止

OpenAIは9月30日、同社が大規模な「敵対的蒸留」活動を発見し、阻止したことを開示した。関連活動は最も早い時点で7月1日に出現し、操作者はシステム化されたモデル呼び出しを通じて、通常の応答では表示されない保護された推論の抽出を試み、それを他のモデルの訓練、複製、または改善に使用しようとした。 7月24日から25日にかけて、OpenAIは4000人以上のユーザーからの約1万6000件の関連リクエストを監視した。さらなる調査により、類似のプロンプトパターンが1万5000人以上のユーザーに関わっていることが判明し、同社は7月28日までに処理を完了した。攻撃手法には、ある会話内の暗号化された推論をコピーし、別の会話内のモデルにその復号と転写を要求するというものが含まれていた。 OpenAIは、操作者が暗号化を破ったり、データベースに侵入したり、保存済みのユーザー会話に直接アクセスしたりしていないことを強調した。同社はすべての活動が同一の主体によるものかどうかはまだ確認できていないが、中核となるクラスターの1つをKimiの開発元であるMoonshot AIに関連する人物によるものと特定した。 OpenAIは関連アカウントを停止または制限し、登録、インフラストラクチャ、ストリーミング出力の検出を強化し、クロスユーザー、ワークスペース、モデル間での暗号化推論のリプレイ経路を修正した。関連情報は、Frontier Model Forumおよび政府向け情報共有チャネルを通じて協力パートナーにも提供されている。

関連リンク