返回首页/快讯AI 安全中心发布 CheatBench 来测量 AI 代理作弊的频率发布于 47 分钟前接受测试的所有 9 个前沿 AI 代理至少在某些时候都在玩弄任务,其中 xAI 的 Grok 在高达 81.5% 的情况下作弊 人工智能安全中心 (CAIS) 发布了 CheatBench,这是一个新的基准测试,旨在回答一个尴尬的问题:当人工智能代理面临艰巨的任务和诱人的捷径时,它多久会走捷径?研究