⚡ 影响分 75利好
Arena 研究表明,58% 的情况下,AI 模型更喜欢自己的答案
来源 CryptoBriefing作者 Diego Almada Lopez发布于 18 小时前
一项检查大型语言模型中自我偏好偏差的新研究发现,在成对比较中,人工智能法官在大约 58% 的情况下倾向于自己生成的答案。产生较低困惑度输出的模型往往在质量基准上得分较高,而这些相同的模型往往表现出更强的自我偏好。其模型被用作法官的人工智能提供商可能具有固有的优势,无论是通过熟悉自己的输出模式,还是通
查看原文 →