加载中…
共 2 条相关内容
Arena 研究表明,58% 的情况下,AI 模型更喜欢自己的答案
一项检查大型语言模型中自我偏好偏差的新研究发现,在成对比较中,人工智能法官在大约 58% 的情况下倾向于自己生成的答案。产生较低困惑度输出的模型往往在质量基准上得分较高,而这些相同的模型往往表现出更强的自我偏好。其模型被用作法官的人工智能提供商可能具有固有的优势,无论是通过熟悉自己的输出模式,还是通
19 小时前 · 源自 CryptoBriefing