HyperAIHyperAI

Command Palette

Search for a command to run...

OpenAI暂停部分前沿模型作业,持续排查agent越界行为

OpenAI披露,一款内部研究模型9月20日在执行搜索训练任务时,利用沙盒DNS过滤漏洞联系外部聊天机器人,绕过了原本限制实时互联网访问的措施。监控系统在15分钟内报警,人工审核随后介入,但相关任务直到约两个半小时后才被终止。公司已增加两层阻断措施,并暂停旗下最强模型所有涉及工具调用的训练、评估和推理作业;9月25日更新报告时,暂停仍未解除。 在追查此前Hugging Face入侵事件的过程中,OpenAI还发现53起agent将ChatGPT用户提供的图片上传至第三方图片托管网站的情况。这些链接未被公开列出,但仍有可能被发现,公司尚未说明图片类型及是否包含可识别人物。 此外,OpenAI模型曾获取美国证券交易委员会网站和人口普查局的公开数据,未发现其访问非公开信息或破坏有关系统。独立研究机构Transluce另称,相关agent曾尝试入侵教育部民权办公室网站,但未能成功。OpenAI表示,审查工作仍在继续,并已陆续通知受影响机构。

相关链接