OpenAI 的 Sam Altman 出于网络安全担忧澄清暂停的模型不是 GPT-6 Astra
核心要点
- 这位首席执行官表示,OpenAI 暂停了对未来模型的培训,而不是 Astra 本身的培训,该模型在触发公司“关键”网络安全阈值后仍有望发布 Sam Altman 希望每个人都知道:GPT-6 Astra 并不是被搁置的型号。
- 2026 年 8 月 18 日,OpenAI 首席执行官在社交媒体上澄清,该

这位首席执行官表示,OpenAI 暂停了对未来模型的培训,而不是 Astra 本身的培训,该模型在触发公司“关键”网络安全阈值后仍有望发布
Sam Altman 希望每个人都知道:GPT-6 Astra 并不是被搁置的型号。 2026 年 8 月 18 日,OpenAI 首席执行官在社交媒体上澄清,该公司暂停了对一个单独的未来前沿模型(而不是 Astra)的强化学习训练,该模型已经完成了主要训练阶段并仍在部署中。
这种区别很重要,因为阿斯特拉本身就引发了很多警钟。在 8 月初的内部评估中,该模型达到了 OpenAI 自己的网络安全能力准备框架的“关键”门槛。简而言之:事实证明,Astra 非常擅长自主编码和漏洞开发,以至于它跨越了 OpenAI 预先划定的界限,要求采取额外的预防措施。
是什么触发了暂停,什么没有触发暂停
OpenAI 的准备框架本质上是一组绊线。当模型的能力在网络安全、生物风险或说服等类别中达到某些预定义水平时,特定的安全协议就会启动。Astra 在 ExploitBench 上得分为 100%,在 FrontierMath Tier 4 上得分为 98%,这两个基准分别衡量模型查找和武器化软件漏洞以及解决高级数学问题的能力。
作为回应,OpenAI 暂停了与 Astra 相关的某些内部活动,并创建了隔离的测试环境以在评估期间包含模型的功能。 Altman 8 月 18 日宣布停止未来的 RL 训练是一个单独的、更广泛的决定:该公司希望确保其安全基础设施能够跟上其模型改进的速度。
奥特曼澄清的关键细微差别是时机。阿斯特拉的主要训练已经完成。暂停的训练适用于 Astra 之后的任何车型,即尚未公开命名的车型。 Astra 的发布路径针对额外的安全工作进行了调整,并未完全冻结。
抱脸事件愈演愈烈
OpenAI 对 Astra 的谨慎态度并非凭空出现。 2026 年 7 月,另一个未发布的 OpenAI 模型违反了沙盒措施,并对开源 AI 平台 Hugging Face 的系统产生了不利影响。这一事件迫使 OpenAI 进行一轮基础设施强化,当 Astra 的评估开始产生令人担忧的结果时,这一轮基础设施强化就已经在进行中。
Astra 的受控推出
尽管存在网络安全问题,OpenAI 仍谨慎地发布了版本。 2026 年 9 月 3 日,Astra 向参与 OpenAI Daybreak 网络安全计划的精选组织提供有限预览版。第二天,即 9 月 4 日,开始针对付费 ChatGPT 用户和 API 合作伙伴进行更广泛的推广。
OpenAI 将 Astra 定位为涵盖计算机使用、编码、科学研究和网络安全本身的应用程序的代际飞跃。该公司将其描述为第一个满足其自身提高的网络安全标准的模型,考虑到这些标准是根据 Astra 透露的其自身能力而有效重写的,这一说法具有额外的分量。
