OpenAI 正式确认,即将发布的 Astra 已跨过其「Critical」网络安全能力门槛,成为首款获此评级的模型。在获得合适工具与权限后,Astra 可自主寻找未知漏洞并开发攻击方法,无需逐步人工指导。

在 ExploitBench 测试中,Astra 取得 100% 成绩。OpenAI 另用 20 个近期高危漏洞进行内部测试,Astra 在过程中自行发现并利用了 2 个此前未知的零日漏洞。专家测试显示,它能攻破浏览器沙箱并在宿主机执行命令,还能对加固系统发起攻击,将普通权限提升至 root。

上述结果基于开放高级网络安全能力的 Daybreak Blue 版本,并非普通用户的默认配置。正式上线初期,高级能力仅面向少量测试者,后续再通过 Daybreak Blue 向防御方开放。

此前因 Hugging Face 安全事故暂停的 Astra 相关训练已恢复。OpenAI 于 8 月 28 日重启大规模前沿 RL 训练,但部分实验性训练仍继续暂停。