HyperAIHyperAI

Command Palette

Search for a command to run...

头部AI企业推“嵌入式评估员”岗位审查模型安全

近日,Anthropic首席执行官达里奥·阿莫迪在公开倡议中提出,前沿人工智能实验室应设立嵌入型安全评估员一职,独立监督大模型的训练、部署与安全防护机制。该职位将赋予评估员类员工权限及办公设施,并可自主公开核查结果,仅限在涉及法律特权或商业机密时进行必要删减,不得因结果不利而掩盖。此举迅速引发行业高层共鸣,OpenAI首席执行官山姆·阿尔特曼与埃隆·马斯克均公开表态支持并承诺跟进。 随着安全治理需求上升,AI评估领域正加速吸引顶尖人才。前Anthropic安全专家乔·本顿与谷歌DeepMind研究员乔什·恩格斯相继离职,加入独立评估机构Metr。斯坦福大学自然语言处理团队亦提出参与模型验证。尽管该机制获广泛认可,但安全专家指出其并非万能解药。业内建议需建立具有约束力的外部监管框架,避免评估人员受制于雇方;学者进一步提出实行轮换任期与跨机构直报制度,以阻断企业内部文化对独立性的侵蚀。这一倡议标志着全球AI产业正从技术竞赛向制度化安全监督迈出关键一步。

相关链接