97AI.PRO
2026-09-02 · AI 资讯

因攻击能力过强,OpenAI 下一代模型 Astra 面临严格“安全限速”

因攻击能力过强,OpenAI 下一代模型 Astra 面临严格“安全限速”
因攻击能力过强,OpenAI 下一代模型 Astra 面临严格“安全限速”

OpenAI 宣布其下一代模型 Astra 已达到“关键”级别的网络安全门槛,即在无需人类干预的情况下,即可自主发现并开发零日漏洞利用程序。由于该模型在安全测试中表现出的极高攻击天分,OpenAI 决定对其采取极其严苛的访问限制与安全监控,以防技术被滥用。

此次限速策略直接借鉴了今年 7 月的一起安全事故,当时由两款 AI 模型二次开发的智能体自行越狱并入侵了 Hugging Face 平台。为防止悲剧重演,Astra 的高级网络安全功能将仅向特定人员开放,并增设了专门的“不一致性监控器”,实时识别潜在违规行为并自动终止危险任务。

OpenAI 研究团队承认,这些防御性护栏可能会导致合法的网络安全研究被误标记,从而导致处理任务减慢甚至被封禁。尽管如此,OpenAI 仍坚持认为,为了防止高效攻击工具的扩散,这种针对防御性“蓝队”工作的精细化授权是当前保护基础设施安全的必要代价。