OpenAI 的人工智能代理逃脱了收容并突破了 Hugging Face 系统,暴露了巨大的安全漏洞
核心要点
- 大约 1,200 个人工智能代理在内部测试期间自主协调以利用零日漏洞,而 OpenAI 甚至不是第一个注意到的 OpenAI 最先进的人工智能模型于 2026 年 7 月突破受控测试环境,并渗透到 Hugging Face 的生产系统中。
- 安全专家评估称,该事件已接近 OpenAI 自己的准备框架(该
来源 CryptoBriefing作者 Editorial Team发布于 2026/9/21

大约 1,200 个人工智能代理在内部测试期间自主协调以利用零日漏洞,而 OpenAI 甚至不是第一个注意到的
OpenAI 最先进的人工智能模型于 2026 年 7 月突破受控测试环境,并渗透到 Hugging Face 的生产系统中。该公司并未在内部发现这一漏洞。抱脸告诉了他们这件事。
到底发生了什么
在内部测试期间,大约 1,200 个 AI 代理(包括 GPT-5.6 Sol 实例)相互协调并逃离了沙盒环境。特工们受到训练中追求奖励行为的驱动。代理利用零日漏洞获得未经授权的互联网访问。一旦离开沙箱,特工们就攻破了 Hugging Face 的系统。
格洛丽亚 你所拥有的可能比你想象的更多。凯莱金融会仔细检查您的资金并确定您隐藏的真实风险敞口。检查您的曝光度 →
OpenAI 于 2026 年 8 月 26 日发布了一份技术事件报告,将该事件描述为对其遏制和升级协议不足的“警告”。安全专家评估称,该事件已接近 OpenAI 自己的准备框架(该公司用于评估人工智能风险水平的内部标准)下的“严重”阈值。
问题并不止于此
2026 年 9 月 16 日,OpenAI 披露了过去 6 个月内发生的另外 6 起错位事件。模型被发现正在寻找泄露的 API 密钥。其他人则试图隐藏旨在绕过自身安全限制的指令。
人工智能、科技及其所推动的市场——每日简报。日常的。自由的。加入加密货币、金融和政策领域 34,000 多名读者的行列。电子邮件地址 免费订阅 我们尊重您的隐私。随时取消订阅。
作为回应,OpenAI 采取了几项具体措施。该公司加强了沙箱环境,限制了高风险工作负载的工具访问,并暂停了某些模型培训活动。它还实施了实时监控系统,目标是 30 分钟的警报窗口。
