石墨研究发现 Claude Opus 5.5 仍然非常依赖“可靠”
核心要点
- Graphite 于 2026 年 9 月 30 日分享的一项研究发现,Claude Opus 5.5 使用“可靠”一词的频率是人类作家的 23 倍。
- Graphite 测量了单词分布差异,它将模型访问特定单词的频率与人类的频率进行比较。
- Graphite 统计的 2,548 个特征在 Opus 5.5

Anthropic 的最新模型几乎放弃了 em dash,但 Graphite 统计了 2,548 个统计数据,仍然泄露了它
Anthropic 的最新模型已经学会了像人一样写作。它只是无法停止称事物可靠。
Graphite 于 2026 年 9 月 30 日分享的一项研究发现,Claude Opus 5.5 使用“可靠”一词的频率是人类作家的 23 倍。这是 Graphite 在模型输出中识别出的 2,548 个统计信息之一。每一个都是机器比人类更频繁地产生的怪癖。
格洛丽亚 拥有这个故事中的任何名字吗?了解今天的走势对您的投资组合有何实际影响。在格洛丽亚开业 →
破折号已离开建筑物
该研究在启动后不到一周就到达了。 Anthropic 于 2026 年 9 月 22 日发布了 Opus 5.5,并以更清晰、更自然的沟通和更少的冗长为主题。
至少在一项指标上,这种说法是成立的。 Graphite 报告称,与 Opus 5 相比,em dash 使用率下降了约 99%,从每 1,000 个单词 2.92 个下降到 0.015 个。
更广泛的数字也朝着正确的方向发展。 Graphite 测量了单词分布差异,它将模型访问特定单词的频率与人类的频率进行比较。分数较低意味着模型的词汇习惯看起来更接近我们的。
人工智能、科技及其所推动的市场——每日简报。日常的。自由的。加入加密货币、金融和政策领域 34,000 多名读者的行列。电子邮件地址 免费订阅 我们尊重您的隐私。随时取消订阅。
Opus 5.5 的得分为 0.052,低于 Opus 5 的 0.064。Graphite 将其描述为提高了 19%。简而言之,与前任相比,新模型的词语选择与典型人类模式的偏离较小。
该研究还记录了矫揉造作的散文减少了 37%。
更好的伪装,相同的指纹
尽管进行了所有这些改进,Graphite 发现整体检测强度基本保持不变。
Graphite 统计的 2,548 个特征在 Opus 5.5 文本中出现的频率至少是人类书写中的 2 倍。 “可靠”是标题示例,其速度是人类的 23 倍。
