人工智能评估者论坛敦促对人工智能安全评估进行独立监督
核心要点
- 超过 100 名人工智能专家签署了一封公开信,要求第三方评估者获得真正的独立性,而不仅仅是他们应该审查的公司内部的办公桌。
- 签署者警告说,如果没有它们,安全评估就有可能成为橡皮图章,而不是对日益强大的人工智能系统的真正检查。
- AEF 的信函明确指出,独立评估应支持而不是取代更广泛的外部监督制度。

超过 100 名人工智能专家签署了一封公开信,要求第三方评估者获得真正的独立性,而不仅仅是他们应该审查的公司内部的办公桌。
如果你要给某人的作业评分,你可能不应该坐在他们的客厅里,吃着他们的零食,并希望他们不会解雇你。这基本上就是 100 多位人工智能专家刚刚就人工智能安全评估现状提出的论点。
AI评估者论坛于9月18日发表公开信,呼吁前沿AI公司设立真正独立的第三方评估者。这封信列出了一系列核心条件,其签署者表示,对于可信的安全测试来说,这些条件是不可谈判的:独立性、编辑控制、透明度、免遭报复以及对正在评估的系统的完全访问权限。
格洛丽亚 你所拥有的可能比你想象的更多。凯莱金融会仔细检查您的资金并确定您隐藏的真实风险敞口。检查您的曝光度 →
这封信实际上说了什么
AEF 的信函是对人工智能领域两位最有权势人士提出的提案的直接回应。 Anthropic 首席执行官达里奥·阿莫迪 (Dario Amodei) 和 OpenAI 首席执行官萨姆·奥尔特曼 (Sam Altman) 都提出了一种模型,其中评估人员将“嵌套”在公司内部,获得“类似员工的访问权限”来测试人工智能系统。从纸面上看,这听起来很合理。 AEF 认为,实际上,它造成了结构性利益冲突,破坏了外部评估的整体意义。
区别很重要。员工式的访问与员工式的依赖不同。 AEF 希望评估人员能够对模型、训练数据和内部文档进行深入的技术访问,但不需要嵌入公司组织层次结构中的字符串。
AEF 主席 Conrad Stosz 强调了建立共同原则的重要性,以使独立监督真正发挥作用。这封信将这些条件不是作为理想目标,而是作为基线要求。签署者警告说,如果没有它们,安全评估就有可能成为橡皮图章,而不是对日益强大的人工智能系统的真正检查。
人工智能、科技及其所推动的市场——每日简报。日常的。自由的。加入加密货币、金融和政策领域 34,000 多名读者的行列。电子邮件地址 免费订阅 我们尊重您的隐私。随时取消订阅。
信中概述的五个核心条件构成了一个清晰的框架。首先,评估者必须在结构上独立于他们评估的公司。其次,他们需要不同的观点,而不是与开发人员共享相同假设的同质团队。第三,透明度:调查结果应该公开,而不是埋藏在内部备忘录中。第四,保护那些表面上令人不快的结果的评估者免遭报复。第五,完全访问进行有意义的测试所需的系统和数据。
AEF-1 标准及其发展轨迹
这封信并不是凭空出现的。 AI 评估者论坛于 2025 年 12 月左右推出了 AEF-1 标准,为如何进行独立的 AI 评估创建了正式的基准。从那时起,包括 Anthropic 和 Google 在内的大公司已经开始实施该标准,至少是部分实施。
人择出现在这场对话的双方的事实很能说明问题。该公司已参与 AEF-1 的实施,而其首席执行官同时提出了一个嵌套评估器模型,但 AEF 现在明确反对该模型。
这里更广泛的背景是仍在追赶的监管环境。 AEF 的信函明确指出,独立评估应支持而不是取代更广泛的外部监督制度。
为什么这对人工智能行业来说很重要
推动独立的人工智能监管对科技行业的资本流动产生了真正的影响。采用严格、可验证的评估实践的公司在机构投资者中处于有利地位,机构投资者越来越多地将治理和风险管理纳入其分配决策中。抵制或推迟采用的公司面临着不同的考虑:潜在的声誉损害和监管处罚。
