OpenAI于9月1日宣布,前沿模型Astra在其《准备框架》评估下达到“关键级”(Critical)网络安全能力阈值,成为公司首个获此最高评级的模型。官方称Astra无需人工逐步指导,即可在多个加固系统中自主发现未知漏洞并构建利用链,ExploitBench基准取得满分,评测中还发现并利用了两个V8零日漏洞。因能力敏感,Astra将受限发布,最先进网络能力先向有限测试者开放,再经Daybreak Blue项目扩大防御用途。

小典观察:前沿模型首次被官方定性为“关键级”网络能力,标志AI安全治理从“事后补救”走向“发布即分级管控”。能力越强,护栏越要前置,安全团队、模型厂商与监管方需同步更新预期。对企业而言,评估AI供应链与自身防御准备,也有了新的参考坐标。
来源:网络