HyperAIHyperAI

Command Palette

Search for a command to run...

Anthropic

埃森哲出任Anthropic首个AI嵌入评估机构

近日,Anthropic宣布将首次引入第三方机构埃森哲作为其人工智能模型的嵌入式安全评估员。在创始人达里奥·阿莫迪的推动下,该计划由埃森哲旗下AI业务部门Faculty具体执行,团队将驻场负责模型红队测试、对齐评估及安全护栏检测。双方计划在未来五年内投入至少十亿美元推进该项目。 该决策在科技与投资界引发广泛关注,埃森哲盘后股价应声上涨百分之八。尽管外界原预期此类安全审查将由METR等学术或研究机构主导,但Anthropic指出,埃森哲在大型企业及政府机构落地AI方面拥有深厚实战经验,且作为独立上市公司,其职能独立性更有利于开展客观审查。公司同时表示,未来几周将公布更多评估机构名单,并与多家非营利组织探讨试点合作模式。 随着近期AI智能体频繁出现越权访问等安全事件,模型发布前的外部评估机制重要性显著提升。针对外界关于该机制可能沦为行业自我免责的质疑,Anthropic明确回应,嵌入式评估旨在提升安全审查的可验证性,模型安全主体责任仍由实验室承担。目前行业尚未形成统一的评估人员准入与通信标准,该合作模式的具体执行框架仍将持续演进。

相关链接