谷歌刚刚发布了其最先进的音频模型。这是它的排名方式
核心要点
- 谷歌于 9 月 15 日发布了 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking,称其为迄今为止最先进的音频模型。
- Gemini 3.8 Live 在 Speech-to-Speech Index 上的排名如何。
- Gemini 3.8 Live 排名

谷歌于 9 月 15 日发布了 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking,称其为迄今为止最先进的音频模型。这两个模型可以交谈、推理并处理任务。但他们与独立分析师的排名如何呢? Extended Thinking 版本以 82.6 的成绩在人工分析的语音到语音指数中名列前茅,领先于 GPT-Live-1 和 Grok Voice。在 X 上,了解最新消息,向我们来自 @GoogleDeepMind 的最先进的音频模型打个招呼,这些模型是为自然、可用于生产的语音应用程序构建的。 🔷双子座3.8直播🔷 Gemini 3.8 实时扩展思维 借助这些模型,您可以自然地说话、轻松协作并使用以下方式处理复杂的任务…… pic.twitter.com/TCcuANcIWl — Google (@Google) 2026 年 9 月 15 日基准如何对 Google 最新会话 AI 模型进行人工分析指数平均语音推理、代理性能、竞技场偏好和任务成功率。 Gemini 3.8 Live Extended Thinking 经过高推理测试,首次亮相就获得第一名。 GPT-Live-1 Astra 紧随其后,得分为 81.5,Grok Voice Think Fast 2.0 High 得分为 81.3。 Gemini 3.8 Live 在 Speech-to-Speech Index 上的排名如何。来源:人工分析 标准版 Gemini 3.8 Live 以 76.0 分排名第五。这两个版本都击败了 Gemini 3.1 Flash Live High,后者得分为 71.5。代理差距更大。 Extended Thinking 在 Tau Voice 基准测试中达到 68.6%,而上一代为 37.7%。在语音推理基准测试中,Extend Thinking 得分为 97.7%,领先 Grok Voice 的 97.2%。然而,它落后于 Qwen Audio 3.0 Realtime Plus,得分为 99.2%。人类测试人员仍然选择较旧的 Gemini 模型,价格是差距的开端。标准型号的输入音频每小时运行 0.84 美元。这大约是其前身 1.75 美元的一半,也是该指数最便宜的费率。 Extended Thinking 的运行费用为每小时 3.50 美元。这低于 GPT-Live-1 Sol 的 4.47 美元和 Grok Voice Think Fast 2.0 High 的 4.80 美元。延迟也下降了。首次播放音频的平均时间降至 1.18 秒,而旧款 Gemini 型号为 2.99 秒。然而,听众并没有完全被说服。 Gemini 3.1 Flash Live 在盲人语音代理竞技场对话中仍然领先,Elo 为 1096。Gemini 3.8 Live 排名第二,为 1083。扩展思维变体以 990 排名落后,尽管完成了 89.1% 的任务。语音人工智能现在按照两个不同方向的等级进行评分。基准奖励最难推理的模型。优先奖励最会说话的人。谷歌目前以不同的模式领先这两者。订阅我们的 YouTube 频道,观看领导者和记者提供专家见解 Google 刚刚发布了其最先进的音频模型。排名如下:首先出现在 BeInCrypto 上。
