OpenAI 将 Astra AI 模型标记为具有关键的网络能力
核心要点
- OpenAI 将其即将推出的 Astra 模型标记为具有自动发现零日漏洞的潜力,这是该公司准备框架的首例 OpenAI 有一个新的人工智能模型,显然可以自行破解。
- 该公司于 8 月 7 日宣布,对其即将推出的型号 Astra 的内部评估表明,其在 OpenAI 自己的准备框架下已达到“关键”网络安全能

OpenAI 将其即将推出的 Astra 模型标记为具有自动发现零日漏洞的潜力,这是该公司准备框架的首例
OpenAI 有一个新的人工智能模型,显然可以自行破解。在公司历史上,这是第一次在发货前踩刹车。
该公司于 8 月 7 日宣布,对其即将推出的型号 Astra 的内部评估表明,其在 OpenAI 自己的准备框架下已达到“关键”网络安全能力。该框架于 2023 年 12 月推出,旨在对此类风险进行准确分类。 Astra 是第一个触发网络技能最高警报级别的模型。
“关键”的实际含义是什么
OpenAI 的准备框架本质上是一个针对危险 AI 功能的红绿灯系统。模型在多个风险领域进行评级,从“低”到“严重”。该公司之前的前沿模型 GPT-5.6 在网络能力方面仅获得“高”评级。阿斯特拉显然已经突破了这个门槛。
根据该框架的定义,“关键”意味着该模型可以在强化系统中自主识别和开发功能性零日漏洞。 “关键”称号还意味着 Astra 可以从高层战略目标出发执行全面的网络攻击。
OpenAI 的回应是暂停了 Astra 的某些内部开发工作。该公司实施了强化的安全控制,包括隔离测试环境和跨 Astra 相关系统的通用监控。据报道,选定的合作伙伴将获得对该模型的早期访问权,以便他们有时间在更广泛的发布之前加强防御。
以不同方式构建的模型
Astra 是与 OpenAI 的 GPT 系列不同的模型,其功能远远超出了网络安全范围。该模型已经展现出卓越的数学能力,据报道可以以大约 2,000 美元的计算成本解决 10 个长期存在的数学问题。
OpenAI 一直小心翼翼地将 Astra 与 2026 年 7 月涉及 Hugging Face 的另一起安全事件划清界限,并澄清 Astra 在此事件中没有发挥任何作用。
截至 2026 年 9 月上旬,Astra 仍未发布。没有公共 API 访问权限,没有定价信息,也没有确认的发布日期。该公司表示,其最终目标是部署 Astra 的复杂功能用于防御目的。
