黑客攻破 OpenAI,暴露安全系统漏洞
核心要点
- 一个三人安全团队利用 Anthropic 的 Claude 闯入了 OpenAI 的内部系统,获得了 6,500 美元的赏金,并提出了有关人工智能黑客攻击的令人不安的问题。
- 一组安全研究人员于 2026 年 7 月成功侵入 OpenAI 的内部系统,获得了对员工 ChatGPT 和 Codex 帐户以

一个三人安全团队利用 Anthropic 的 Claude 闯入了 OpenAI 的内部系统,获得了 6,500 美元的赏金,并提出了有关人工智能黑客攻击的令人不安的问题。
一组安全研究人员于 2026 年 7 月成功侵入 OpenAI 的内部系统,获得了对员工 ChatGPT 和 Codex 帐户以及该公司私人 GitHub 存储库的访问权限。更关键的是:他们使用了竞争对手人工智能公司的模型来做到这一点。
由 Harsh Jaiswal、Mohan Pedhapati 和 Rahul Maini 组成的 Hacktron AI 研究团队于 9 月 18 日公开披露了这一漏洞,距利用这些漏洞大约两个月后。 OpenAI 证实了这一事件,但表示没有敏感的用户数据或生产系统受到损害。
Gloria One 应用程序,一个屏幕 - 每天早上,Gloria Finance 都会向您简要介绍发生的事情以及它如何影响您的投资组合。阅读您的简介 →
竞争对手的人工智能如何帮助破解 OpenAI 的防御
这次攻击利用了两个明显的弱点。第一个是 libheif 库中的堆缓冲区溢出,libheif 库是集成到 OpenAI 堆栈中的第三方图像处理工具。第二个是过于宽松的单点登录 (SSO) 令牌,它为研究人员提供了比任何外部方应有的更多访问权限。
Hacktron 团队使用 Anthropic 的 Claude Opus 模型的专门版本来开发他们的漏洞。研究人员在开始工作后 72 小时内执行了完整的攻击链。
OpenAI 在收到通知后迅速响应,在大约 14 小时内修复了报告的漏洞。该公司向 Hacktron 奖励 6,500 美元,奖励其负责任的披露行为。
人工智能、科技及其所推动的市场——每日简报。日常的。自由的。加入加密货币、金融和政策领域 34,000 多名读者的行列。电子邮件地址 免费订阅 我们尊重您的隐私。随时取消订阅。
军民两用问题变得现实
事实上,研究人员使用的是 Claude,而不是经过微调的暗网工具或越狱模型,这一点很重要。研究人员不需要以任何不寻常的方式绕过安全护栏。他们只是将克劳德的编码能力应用到安全研究工作流程中。
此次事件与之前的事件不同,据报道,OpenAI 自己的人工智能代理破坏了外部系统,包括属于 Hugging Face 的基础设施。
libheif 漏洞值得在上下文中进行研究。像 libheif 这样的开源库嵌入在科技行业的数千种软件产品中。这些依赖项之一中的缓冲区溢出并不是 OpenAI 独有的故障。
这对人工智能安全及其他领域意味着什么
按照行业标准,14 小时响应时间确实令人印象深刻。许多组织需要数天或数周的时间来修复已披露的漏洞。
72 小时的时间范围是任何考虑这个领域的人都应该坚持的数字。从开始到访问世界上最著名的人工智能公司之一的内部 GitHub 仅用了三天。
