OpenAI 的 GPT-6 Astra 在选择早期访问后开始向 ChatGPT 订阅者推出
核心要点
- OpenAI 最先进的模型在网络安全基准测试中得分为 100%,完成任务的速度比其前身快 47%,同时提出了有关 AI 安全护栏的新问题。
- OpenAI 的 GPT-6 Astra 已上线。
- 网络安全悖论 Astra 完美的 ExploitBench 分数使 OpenAI 处于很少有人工智能公司能够达到

OpenAI 最先进的模型在网络安全基准测试中得分为 100%,完成任务的速度比其前身快 47%,同时提出了有关 AI 安全护栏的新问题。
OpenAI 的 GPT-6 Astra 已上线。该公司最强大的人工智能模型于 9 月 3 日开始向用户提供服务,首先是一小群测试人员,然后扩展到 Plus、Pro、Business 和 Enterprise 级别的付费 ChatGPT 订阅者。
多个用户实时确认了此次部署,并报告说 Astra 在初始部署后几分钟内就出现在他们的帐户中。此次发布标志着 OpenAI 总裁格雷格·布罗克曼 (Greg Brockman) 所说的“代际飞跃”,以及该公司认为的 AGI 时代的开始。
是什么让阿斯特拉与众不同
性能数据很清楚地说明了这个问题。 Astra 完成任务的速度比其前身 GPT-5.6 Sol 快约 47%。在 OSWorld 2.0 基准测试中,Astra 在 40 分钟内得分为 72.6%,而 Sol 在 75 分钟内得分为 65.7%。
Astra 在 FrontierMath Tier 4 上得分为 98%,在 ExploitBench 上得分为 100%。最后一个数字意味着该模型可以自主检测和利用安全系统中的未知漏洞。
这一能力为 Astra OpenAI 赢得了最高的内部评级:其网络安全准备框架为“关键”。这是第一个达到该门槛的模型。 OpenAI 的回应是在初始阶段限制对最先进网络安全功能的访问,并计划最终扩大防御应用程序的可用性。
艰难的前 24 小时
OpenAI 最初优先考虑加入其 Daybreak 网络安全计划的组织以及企业客户的访问权限。到 9 月 4 日,足够多的 ChatGPT Plus 和 Pro 用户报告了访问问题,首席执行官 Sam Altman 发表了公开道歉。他承认存在这种困惑,尤其是那些希望立即访问现有订阅计划中包含的模型的订阅者。 OpenAI 提供存储重置作为服务中断的补偿。
Astra 包含在现有的订阅级别中,无需额外费用,因此瓶颈在于推出物流,而不是定价或许可。
网络安全悖论
Astra 完美的 ExploitBench 分数使 OpenAI 处于很少有人工智能公司能够达到如此规模的位置。准备框架的“关键”指定会在功能到达广泛受众之前触发额外的安全协议和访问控制。
这对人工智能领域意味着什么
已经使用 ChatGPT 进行业务运营的公司现在无需额外费用即可使用功能更加强大的系统。布罗克曼将 Astra 视为 AGI 时代的开始,这是一个雄心勃勃的品牌宣传,但基准测试为这一主张提供了比大多数此类声明更多的实质内容。
