Astra模型突破性通过OpenAI最高安全评估

据OpenAI披露,Astra模型于9月1日正式进入其Preparedness框架中的“Critical”等级,成为该公司历史上首个获得该评级的AI系统。该模型展现出在复杂环境中识别隐蔽缺陷并生成有效攻击链的卓越能力。

自主攻防能力实现质的飞跃,漏洞挖掘效率达满分

在ExploitBench基准测试中,Astra取得100%的得分,表明其可在受控环境下完整复现真实世界中的漏洞利用流程。更关键的是,在针对今年夏季公开的V8浏览器漏洞进行的内部模拟攻击中,它成功独立定位并串联两个此前未被记录的零日漏洞,形成可执行的攻击路径。

防御韧性显著超越当前主流模型,越狱抵御率达九成以上

在对抗性测试中,Astra模型成功拦截了91.5%的越狱尝试,大幅领先于当前旗舰版本GPT-5.6 Sol的59%拦截率,凸显其在安全边界控制与行为约束方面的先进性。