由于工作人员在评估员和公司之间轮换,人工智能安全监管机构面临利益冲突问题
核心要点
- 这就是对人工智能安全评估组织和他们应该监管的公司之间的旋转门越来越多的审查所带来的令人不安的影响。
- 一起看看→ 连接网络 争议的中心是 METR(模型评估和威胁研究),它是最著名的组织之一,负责评估前沿人工智能模型是否足够安全,可以部署。
- 该行业在某种程度上进行了反击 METR 正面回应了这些指控,表示

一项获得近 500 万次浏览的病毒式分析引发了国会对人工智能实验室与旨在保持诚实的组织之间的亲密关系进行调查的呼声。
给人工智能安全作业评分的人也可能是写作业的人。这就是对人工智能安全评估组织和他们应该监管的公司之间的旋转门越来越多的审查所带来的令人不安的影响。
Anthropic 首席执行官达里奥·阿莫迪 (Dario Amodei) 和 OpenAI 首席执行官萨姆·奥尔特曼 (Sam Altman) 提议将第三方评估者直接嵌入他们的实验室,这一提议将一触即发的担忧变成了全面沸腾。
Gloria Stocks 在一个应用程序中,加密货币在另一个应用程序中,钱包无处不在?凯莱金融将您的整个投资组合一目了然。一起看看→
连接网络
争议的中心是 METR(模型评估和威胁研究),它是最著名的组织之一,负责评估前沿人工智能模型是否足够安全,可以部署。 METR 的员工包括之前在 OpenAI 和 Anthropic 工作过的人,而且重叠之处并不仅限于简历。
资金问题是事情变得尤其复杂的地方。 Facebook 联合创始人达斯汀·莫斯科维茨 (Dustin Moskovitz) 持有 Anthropic 的股权。他的慈善基金会通过有效利他主义网络筹集资金,这些网络为 METR 和 Redwood Research 等评估组织提供了大量资金。其结果是形成一个生态系统,流向安全监管机构的资金可以追溯到被评估的公司,有时只需一两跳。
一些评估员与他们评估的实验室的员工有个人或家庭关系。
人工智能、科技及其所推动的市场——每日简报。日常的。自由的。加入加密货币、金融和政策领域 34,000 多名读者的行列。电子邮件地址 免费订阅 我们尊重您的隐私。随时取消订阅。
研究人员 Kevin Bass 于 2026 年 9 月 14 日至 15 日发表了一份分析报告,详细描绘了这些联系。该帖子吸引了近 500 万次浏览,并明确呼吁国会对巴斯所描述的结构性利益冲突进行调查。
该行业在某种程度上进行了反击
METR 正面回应了这些指控,表示不接受人工智能实验室或其员工的补偿或捐赠。该组织表示,它已积极拒绝某些资金来源以保持其独立性,并强调其致力于披露潜在冲突。
当前安排的捍卫者指出,评估前沿人工智能模型需要极其专业的技术知识。人才库本质上是狭窄的,拥有合适技能的人几乎肯定在某个时候曾在人工智能实验室工作过或接受过人工智能实验室的资助。
专家信函以及接下来的内容
2026年9月18日,100多名人工智能专家签署公开信,要求进行结构性改革。签名者包括图灵奖获得者杰弗里·辛顿(Geoffrey Hinton),他已成为对人工智能行业自我监管最直言不讳的批评者之一。这封信呼吁评估人员对其调查结果拥有完全的编辑自主权,对方法和结果完全透明,并明确保护其免受所评估公司的报复。
目前尚未颁布重大监管变化,但政治压力正在增加。
