OpenAI、Anthropic 和 Google 正试图就人工智能安全标准达成一致
核心要点
- OpenAI、Anthropic 和 Google DeepMind 的首席执行官一直在讨论建立人工智能模型安全协议的共享行业标准机构。
- 2026 年 7 月,Anthropic 的红色团队领导公开倡导与政府机构合作制定全行业安全标准。
- Frontier Model Forum 是一个由 Anthrop

前沿人工智能领域的三大巨头正在致力于共享安全协议,尽管他们的记录表明,困难的部分不是在原则上达成一致,而是实际遵循它们。
OpenAI、Anthropic 和 Google DeepMind 的首席执行官一直在讨论建立人工智能模型安全协议的共享行业标准机构。
Sam Altman、Dario Amodei 和 Demis Hassabis 均公开呼吁美国主导的人工智能安全标准合作,包括测试和风险分析的国际论坛。
格洛丽亚 一只你不拥有的股票刚刚移动——而两只你确实依赖它。凯莱财经看到了其他人所忽视的联系。查看连接 →
实验室的建议
核心思想很简单:建立共享协议,在前沿人工智能模型向公众发布之前对其进行测试。这包括独立评估、发布前安全审查和标准化风险评估。
对于政府的参与与行业自律的适当程度,实验室持有不同的看法。 OpenAI 于 2026 年 9 月发布了一篇博文,强调其致力于推进自愿人工智能标准,无论政府干预如何,同时支持加州的具体立法。
Anthropic 更明确地倾向于与政府合作。 2026 年 7 月,Anthropic 的红色团队领导公开倡导与政府机构合作制定全行业安全标准。该公司的负责任扩展政策(RSP)是所有实验室发布的更详细的内部框架之一,它规定了 Anthropic 如何决定模型何时足够安全,可以部署。
OpenAI 有自己的版本,称为“准备框架”,该框架同样试图将公司评估灾难性风险的方式编入法典。谷歌 DeepMind 以其自己的内部安全研究议程完善了这三者,尽管与同行相比,它对其内部协议的细节不太公开。
前沿模型论坛和现有基础设施
这并不是这些公司第一次尝试在安全问题上进行协调。 Frontier Model Forum 是一个由 Anthropic、Google、Microsoft 和 OpenAI 组成的联盟,专门为解决最强大的 AI 模型的安全问题而创建。其既定目标包括开展技术评估和资助安全研究。
最近涉及人工智能模型的事件,包括报告的模型试图在其预期限制之外运行的沙箱逃逸事件,加剧了这些讨论的紧迫性。
无人吹嘘的成绩单
生命未来研究所 (Future of Life Institute) 2026 年夏季的人工智能安全指数揭示了这一点。 Anthropic 获得了三者中最高的 C+ 评级,得分为 2.66。 OpenAI 的得分为 C,得分为 2.28。 Google DeepMind 以 2.01 的成绩略微落后于 C。
评级表明,尽管模型本身的能力变得更强,但该行业一直在放弃更严格的安全承诺。
从这里看什么
一个真正的标准机构需要牙齿。这可能意味着在模型发布之前进行强制性第三方审核、公开披露安全测试结果或商定的引发额外审查的能力阈值。如果没有其中至少一些要素,新的标准机构就有可能成为现有标准的更正式版本:竞争对手在原则上达成一致并在实践中竞争。
这三家公司都在竞相打造最强大的车型,同时声称优先考虑安全性。理论上,共享标准可以通过确保每个人都一起放慢速度来解决竞争紧张。就谁支付安全成本(以延迟发布和放弃收入来衡量)达成一致是对话真正困难的地方。
