Anthropic 在其人工智能研究能力评估中使用未公开的来源
核心要点
- Claude Opus 5.5 系统卡揭示了一个不透明的评估过程,引发了有关人工智能安全测试透明度的新问题 Anthropic 的 Claude Opus 5.5 最新系统卡包含一个比实际情况更值得关注的细节:独立非营利组织 METR 的任务是评估该模型是否将人工智能研究加速到危险水平,它依赖未公开

Claude Opus 5.5 系统卡揭示了一个不透明的评估过程,引发了有关人工智能安全测试透明度的新问题
Anthropic 的 Claude Opus 5.5 最新系统卡包含一个比实际情况更值得关注的细节:独立非营利组织 METR 的任务是评估该模型是否将人工智能研究加速到危险水平,它依赖未公开的信息来源得出结论。这些结论背后的证据无法公开分享。
系统卡实际上说了什么
2026 年 9 月 22 日发布的 Claude Opus 5.5 系统卡记录了 Anthropic 在发布其最新 Opus 级模型之前进行的部署前评估。主要发现包括:与 Anthropic 自己的内部评估相比,METR 的外部测试并未发现人工智能开发速度持续翻倍。
Gloria One 应用程序,一个屏幕 - 每天早上,Gloria Finance 都会向您简要介绍发生的事情以及它如何影响您的投资组合。阅读您的简介 →
但这一结论背后的方法论却让事情变得扑朔迷离。 METR 团队的操作受到限制,他们的报告被描述为“高度实验性和初步性”。系统卡还指出,Anthropic 本身在评估中使用了另一个未公开的信息来源,这一细节隐藏在大多数人永远不会完整阅读的文档中。
Opus 5.5 实际带来了什么
Opus 5.5 型号本身代表着 Anthropic 产品线向前迈出了有意义的一步。该系统卡记录了多个领域的改进,包括代理编码功能、更有效的计算机使用以及长期专业任务的更强性能。
人工智能、科技及其所推动的市场——每日简报。日常的。自由的。加入加密货币、金融和政策领域 34,000 多名读者的行列。电子邮件地址 免费订阅 我们尊重您的隐私。随时取消订阅。
这对人工智能开发责任意味着什么
当 METR 或类似的评估者确实发现危险能力加速的证据时,真正的考验才会到来。在这种情况下,当风险不再是理论上的时候,未公开的来源和受限的访问是否可以接受,这是当前框架尚未回答的问题。
