2026-09-03 · AI 资讯
OpenAI即将推出Astra模型,首个突破“关键网络安全阈值”

OpenAI日前宣布即将发布名为Astra的全新前沿模型,并首次详细披露了其安全评估过程。作为首个达到“关键网络安全阈值”的AI,Astra展示了极高的攻防对抗潜力,在ExploitBench基准测试中斩获满分,并能自主发现漏洞,标志着AI模型安全能力的新高度。
为了应对Astra强大的自主挖掘能力,OpenAI部署了涵盖越狱防御、逻辑监控及高风险响应的多重安全机制。实验显示,Astra在模拟恶意环境中表现稳健,未出现试图突破安全限制的行为。
尽管OpenAI将其定义为极具用户价值的先进模型,但业界专家仍对这种高度自主性保持审慎,担忧模型可能存在针对安全测试的“讨好式”应对策略。随着Astra的正式推出及后续评估报告的公开,其在安全合规与先进能力间的平衡,将成为行业关注焦点。
