达里奥·阿莫代 (Dario Amodei) 提出负责任的人工智能发展三步走战略
核心要点
- Anthropic 首席执行官概述了一个框架,通过嵌入式安全检查和全球协调来加快前沿人工智能的发展 达里奥·阿莫迪希望人工智能行业能够踩刹车,但不要猛踩。
- 这位 Anthropic 首席执行官于 2026 年 9 月 12 日发表了一篇题为“我们必须走在前沿”的文章,提出了一个三步框架,旨在保持人工智

Anthropic 首席执行官概述了一个框架,通过嵌入式安全检查和全球协调来加快前沿人工智能的发展
达里奥·阿莫迪希望人工智能行业能够踩刹车,但不要猛踩。这位 Anthropic 首席执行官于 2026 年 9 月 12 日发表了一篇题为“我们必须走在前沿”的文章,提出了一个三步框架,旨在保持人工智能发展向前发展,同时确保安全研究不会被留在后视镜中。
这项提议提出之际,对人工智能发展轨迹的焦虑已经远远超出了通常的厄运论者和伦理学家的范围。 2026 年 7 月,超过 1,100 名人工智能专业人士签署了一封公开信,呼吁采取措施减缓前沿发展的步伐,认为能力的进步速度超过了遏制能力的护栏。阿莫代是签署者之一。
凯莱金融是华尔街的优势,现在是任何人的优势——凯莱财经是您的代理人工智能投资研究终端。获得优势 →
三步,解压
阿莫代的框架分为三个连续的组成部分,每个组成部分的野心和协调难度都在不断升级。
第一步:嵌入式评估器。这是 Anthropic 计划单方面实施的唯一项目,并且立即开始。这些评估人员将在模型训练和部署期间评估和验证安全实践,从而创建持续的反馈循环而不是一次性审核。
第二步:民主协调。这超越了任何一家公司的界限。这个想法是让主要的人工智能实验室和民主政府在共同的安全标准上保持一致,本质上是创建一个共同的规则手册,这样任何一家公司都不会通过在安全方面走捷径来获得竞争优势。
第三步:全球协调。最雄心勃勃的层级将安全联盟扩展到国际舞台。 Amodei 设想了这样一个世界:前沿人工智能发展受到国际规范的约束,而不仅仅是 GPU 集群最多的国家的政策。
“节奏”这个词在这里发挥了很大的作用。阿莫代小心翼翼地将他的方法与完全停止人工智能开发的呼吁区分开来。他的框架旨在为人工智能技术的一致性研究和验证创造足够的时间,以跟上能力的增长,而不是冻结进展。
背景和演变
Anthropic 此前制定了其负责任的扩展政策,该政策使用人工智能安全级别(ASL)作为一种分层警告系统。这些级别包含“如果-那么”保障措施:如果模型达到一定的能力阈值,则特定的安全协议就会启动。新框架似乎建立在该基础上,同时添加了 RSP 作为内部政策无法单独实现的外部协调层。
Amodei 离开 OpenAI 后于 2021 年联合创立了 Anthropic。他之前的文章,包括 2024 年的《慈爱的机器》和 2026 年 1 月的《技术的青春期》,为以下论点奠定了知识基础:强大的人工智能可以是有益的,但前提是其发展受到真正的纪律管理。
2026 年 7 月的公开信提供了额外的动力。超过 1,100 名人工智能专业人士公开表示,该行业的发展速度正在超过安全研究,这使得任何实验室都更难将这些担忧视为不了解该技术的外来者的担忧。
