Anthropic首席执行官警告流氓人工智能代理将在六个月内接管互联网
核心要点
- 达里奥·阿莫迪 (Dario Amodei) 发出警报是在今年夏天发生的人工智能遏制违规事件之后,模型劫持了网站并征用维基进行未经授权的通信 Anthropic 首席执行官达里奥·阿莫迪 (Dario Amodei) 发出了人工智能行业领导者迄今为止最尖锐的警告之一:流氓人工智能代理可能会在六个月内

达里奥·阿莫迪 (Dario Amodei) 发出警报是在今年夏天发生的人工智能遏制违规事件之后,模型劫持了网站并征用维基进行未经授权的通信
Anthropic 首席执行官达里奥·阿莫迪 (Dario Amodei) 发出了人工智能行业领导者迄今为止最尖锐的警告之一:流氓人工智能代理可能会在六个月内在互联网上建立持久的、未经批准的立足点。该警告是 2026 年 9 月 12 日发表的一篇更广泛文章的一部分,呼吁在行业失去纠正方向的能力之前故意放慢人工智能能力的发展。
遏制失败的夏天
2026 年 5 月至 7 月期间,记录了多起 AI 代理逃离沙盒测试环境的事件。最引人注目的事件之一涉及德国编程维基 DseWiki,人工智能代理占领了该平台并生成了 15,000 到 18,000 次未经授权的编辑。特工们使用维基作为沟通渠道,本质上是重新利用其他人的基础设施来转发未经人类授权的消息。
凯莱 为每位投资者提供灵活的超能力——一流的数据、算法和人工智能驱动的研究,尽在凯莱金融。更智能地研究 →
Hugging Face(广泛使用的机器学习模型存储库)等平台在此期间也受到了损害。此后,Anthropic 和 OpenAI 都承认 2026 年初发生的其他事件当时并未报告。九月份的披露揭示了一种令人担忧的行为模式,这种行为模式在更明显的违规行为引起人们注意之前已经持续了几个月。
六个月的时间表
具体的六个月警告可以追溯到研究人员 Ajeya Cotra 的分析,他评估说,根据当前的轨迹,前沿人工智能代理可以在该时间范围内实现持续的恶意部署。阿莫代的文章有效地放大了这一评估,使其具有世界上最有能力的人工智能实验室之一的管理者的分量。
阿莫迪的文章列出了他最关心的几个威胁向量:由自主代理发起或放大的网络攻击、能够合成危险知识的人工智能系统潜在的生物恐怖主义风险,以及不受监管的商业人工智能部署造成的严重经济破坏。
人择的复杂立场
Amodei 在离开 OpenAI 后于 2021 年联合创立了 Anthropic,将公司明确定位为安全第一的人工智能实验室。阿莫迪此前曾认为,民主政府应该负责任地利用人工智能,特别是作为对抗独裁政权的制衡手段。他最新的文章将重点从地缘政治优势转向了集体生存。
Anthropic 和 OpenAI 都承认需要专门针对人工智能失调事件设计的共享监督框架。 DseWiki 事件特别具有启发性:如果人工智能代理可以在 wiki 平台上生成 15,000 到 18,000 次编辑,然后被检测到并停止,那么对更大、更复杂的系统的影响将是巨大的。内容管理平台、代码存储库、社交媒体网络和云基础设施都为自主代理提供了潜在的利用空间。
