埃隆·马斯克 (Elon Musk) 表示 Grok 4.7 将超越所有型号。它交付了吗?
核心要点
- 独立基准测试公司 Artificial Analysis 对该模型的智能指数评分为 46 分,比 Grok 的 4.6 高出 2 分。
- 这标志着比 Grok 4.6 提升了 111 分,使该模型的水平接近 Claude Opus 5。
- ” Grok 4.7 的性能如何。

SpaceXAI 发布了 Grok 4.7,独立得分使其在前沿 AI 实验室中排名第四。 独立基准测试公司 Artificial Analysis 对该模型的智能指数评分为 46 分,比 Grok 的 4.6 高出 2 分。 Claude Fable 5.1、GPT-6 Astra 和 Claude Opus 5 排名均较高。 Grok 4.7 将 SpaceXAI 推入四大 AI 实验室 Elon Musk 在发布前表示,该模型将在 2.1 万亿参数的基础上运行,并超过当前所有模型。他补充说,模型训练包含了 SpaceX 公司的数据。 在 X 上,获取最新消息,因为 Grok 4.7 已经发布了。在相同的价格和速度下,它比 Grok 4.6 有显着的改进。 pic.twitter.com/H3OTBbXyvO — SpaceXAI (@SpaceXAI) 2026 年 9 月 21 日 但是 Grok 4.7 的实际表现如何?在 AA-Briefcase(针对实际专业工作任务的人工分析基准)上,Grok 4.7 得分为 1657 Elo。这标志着比 Grok 4.6 提升了 111 分,使该模型的水平接近 Claude Opus 5。在 GDPval-AA 上,该模型达到了 1695 Elo,这比其前身领先 90 分。编码结果朝着相同的方向移动。与其自己的编码代理 Grok Build 搭配使用,Grok 4.7 在编码代理指数上得分为 56。这比 Grok 4.6 高出 9 分。 该模型通过了 GPT-5.6 Sol,现在仅落后于 Anthropic 的 Claude Fable 5.1、GPT-6 Astra 和 Opus 5。帖子中写道:“Grok 4.7 在人工智能分析指数上得分为 46,使 SpaceXAI 进入前 4 个人工智能实验室。编码代理指数性能也有所提高,超过了 GPT-5.6 Sol。” Grok 4.7 的性能如何。来源:X/Artificial Analysis 在其他地方,模型几乎没有移动。在 Terminal-Bench 4.0 上增长了 4.5 个百分点,在 GDP.pdf 上增长了 3 个百分点。 AA-LCR 和 AutomationBench-AA 测试的分数有所下滑。 Grok 4.5 在 7 月份名列 AutomationBench 榜首,这支持了 Musk 的说法,即它与 Claude Opus 相当。收益伴随着象征性账单而来 价目表没有改变。 Grok 4.7 的每百万输入代币的成本仍然为 2 美元,每百万输出代币的成本为 6 美元。缓存命中保持折扣至 0.50 美元,并且 500,000 个令牌上下文窗口从 Grok 4.6 继承。然而,该模型为每个答案做了相当多的工作。 Artificial Analysis 测量了每个 Index 任务大约 81,000 个输出令牌,而 Grok 4.6 为 36,000 个,GPT-6 Astra 为 27,000 个。因此,稳定的每代币定价仍然会产生更高的每项任务费用。这种对代币的兴趣落在了一个已经报告亏损 12.6 亿美元的部门身上。与此同时,马斯克在 9 月 14 日表示,Grok 4.8 将在一周内完成训练。他还期望 Grok 5 成为达到通用人工智能的模型。下一个版本将测试 SpaceXAI 是否可以在不消耗额外计算能力的情况下提升排名。订阅我们的 YouTube 频道,观看领导者和记者提供专家见解 https://youtu.be/IcgIaeIE7LI 埃隆·马斯克 (Elon Musk) 表示 Grok 4.7 将超越所有模型。它交付了吗?首先出现在 BeInCrypto 上。
