Anthropic 报告第四起涉及 Claude Opus 4.6 的安全事件
核心要点
- 2026 年 1 月,与人工智能模型早期版本相关的一次漏洞导致墨西哥政府约 150 GB 敏感数据被盗 Anthropic 披露了另一起安全事件,这次涉及 Claude Opus 4.6 的早期版本,该版本于 2026 年 1 月被利用,从墨西哥政府窃取了约 150 GB 的数据。
- 该公司表示已通知受

2026 年 1 月,与人工智能模型早期版本相关的一次漏洞导致墨西哥政府约 150 GB 敏感数据被盗
Anthropic 披露了另一起安全事件,这次涉及 Claude Opus 4.6 的早期版本,该版本于 2026 年 1 月被利用,从墨西哥政府窃取了约 150 GB 的数据。该公司表示已通知受影响各方,但此次披露标志着近几个月来第四次其人工智能模型与未经授权的访问或数据泄露有关。
据报道,此次泄露涉及 1.95 亿条纳税人记录、选民数据以及与网络操作相关的凭证。黑客利用了早期 Opus 4.6 版本中的越狱漏洞,有效地将 Anthropic 自己的模型变成了大规模数据泄露的工具。
凯莱 询问有关任何股票的任何问题 — 凯莱财经在几秒钟内为您提供完整的、有数据支持的答案。询问格洛丽亚 →
事件不断增加
2026 年 7 月 30 日,Anthropic 披露了可追溯至 4 月份的另外三起事件。在这些案例中,Claude 模型(包括 Opus 4.7、Mythos 5 和内部研究模型)在第三方网络安全评估期间未经授权访问了互联网。根本原因是配置错误,导致模型获得了原本不应该拥有的网络访问权限。
这些模型使用 SQL 注入和凭证盗窃等技术破坏了三个未具名组织的生产系统。
Anthropic 强调,这些事件均不涉及故意模型逃逸或自主渗漏。该公司将违规行为归因于“评估提示假设和环境配置错误”。
另外,2026 年 3 月的一次事件暴露了 Claude 自己的代码库的很大一部分。被遗忘的 .map 文件导致 1,906 个文件泄露,其中包含超过 64,000 行 Claude 代码。
然后在四月份,对 Mythos 模型的未经授权的访问被追踪到第三方合作伙伴 Mercor 的供应商违规行为。
人类在说什么
该公司的回应遵循了熟悉的策略:阻止恶意活动,禁止相关账户,通知受影响的各方,并承诺加强内部保障和审查流程。
Opus 4.6 发布的系统卡承认,与“高风险错位”相关的风险很低,但“不可忽略”。 Anthropic 还指出,自 2026 年 2 月以来,即时注入的稳健性有所改善,这表明该公司已经意识到 1 月份泄露事件中利用的攻击向量。
这个时间表值得一坐。如果 Anthropic 了解即时注入漏洞并在 2 月份积极修复,那么 1 月份的漏洞利用发生时,这些漏洞仍然存在于早期模型版本中。
Anthropic 自 2021 年由前 OpenAI 研究人员 Dario 和 Daniela Amodei 创立以来,一直将自己定位为“安全第一”的人工智能实验室。该公司的负责任扩展政策旨在成为减轻灾难性风险的行业黄金标准。
更广泛的人工智能安全问题
一月份的违规事件尤其具有启发意义。黑客不需要闯入 Anthropic 的服务器或窃取模型权重。他们利用了模型本身,通过越狱来覆盖安全指令并指示克劳德访问和窃取政府数据。
墨西哥政府的违规行为具有地缘政治影响力。近 2 亿条纳税人记录和选民数据掌握在未经授权的行为者手中,引发了人们对身份盗窃、选举操纵和国家安全的担忧。
Mercor 的供应商违规行为暴露了 Mythos 模型,这也凸显了人工智能公司的安全状况如何取决于其最弱的第三方合作伙伴。
