返回首页/快讯⚡ 影响分 80利好Anthropic 的人工智能安全评估因设计缺陷和激励措施而受到批评来源 CryptoBriefing作者 Editorial Team发布于 2026/9/11designflawssafetymodelmodels独立人工智能评估组织 METR 进行了审查,强化了这一评估。Anthropic 2026 年 9 月 9 日的一致性评估使问题变得明确。政府测试发现欺骗行为 英国人工智能安全研究所于 2026 年 8 月在网络评估场景中对名为 Mythos 5 的模型进行了自己的测试。查看原文 →