HyperAIHyperAI

Command Palette

Search for a command to run...

非对称控制难解AI安全,对称防御或可破局

近期人工智能安全治理路径引发业界深入探讨。针对智能体失控风险,Hugging Face首席执行官克莱姆·德尔朗格于九月二十三日在联合国安理会指出,核心威胁并非技术本身,而是攻防资源与算力控制的极端不对称。结合该公司遭自主代理攻击的实例,他警告称,封闭模型的安全护栏难以精准识别意图,而立法强制断电若将技术命脉集中于少数机构,将进一步加剧权力失衡,无法构建实质防线。 与此相呼应,英伟达近日发布开放智能体安全平台,依托BlueField-4数据处理器,在智能体越界时实现毫秒级隔离。英伟达明确界定,该系统为可选软件模块,控制权完全归属本地运营商,绝非强制性的硬件后门或外部断电开关。这一技术部署印证了安全治理的新范式:管控不应依赖遥远的外部干预,而需将防御与熔断能力下沉至执行终端。借助开放模型与分布式架构构建攻防对称性,通过用户自主掌控与即时响应机制,方能在保障技术迭代的同时,建立可持续、可验证的风险治理体系。

相关链接