评估显示AI模型Astra或具备关键网络安全能力
近日,相关人工智能机构发布评估报告指出,其即将推出的模型“Astra”在代理编程与网络安全领域取得显著进展。基于近期内部测试与专家评估,该机构确认无法排除模型已触发其《准备框架》中“关键”级网络安全能力阈值的可能。依据框架标准,若模型能在无人类干预下自主识别并开发针对多种加固关键系统的零日漏洞,或仅需高级目标指引即可策划执行完整的新型网络攻击策略,即被划定为关键级能力。尽管初步评估表现强劲,但“Astra”并未参与任何外部网络事件。为管控潜在风险,技术团队已全面升级安全护栏与防御控制,确保系统稳健性匹配未来部署需求。机构强调,此次透明披露旨在向公众与安全社区同步技术演进动态。该框架自二零二三年十二月制定以来,已成功引导团队应对过往能力跃迁。当前,团队正延续审慎原则,同步强化压力测试并联合政府与学术专家,致力于确保前沿模型在负责任的前提下安全落地,以强化整体网络防御体系。
