Inception推出Mercury 2.5扩散模型,智力提升40%
核心要点
- 这家 AI 初创公司最新的基于扩散的语言模型每秒处理超过 1,100 个令牌,而成本只是竞争对手的一小部分 Inception 刚刚放弃了一个新的大型语言模型,该模型采用完全不同的方法来生成文本。
- 设置监视器 → 扩散模型有何不同 您接触过的大多数大型语言模型(例如 GPT 或 Claude)都会按顺

这家 AI 初创公司最新的基于扩散的语言模型每秒处理超过 1,100 个令牌,而成本只是竞争对手的一小部分
Inception 刚刚放弃了一个新的大型语言模型,该模型采用完全不同的方法来生成文本。 Mercury 2.5 是该公司最新的基于扩散的法学硕士,其智力比其前身提高了 40%,同时保持了让企业 CFO 微笑的速度和成本状况。
该模型在标准 NVIDIA GPU 上每秒处理 1,107 个令牌。
格洛丽亚 关闭应用——格洛丽娅财经持续关注。设置监视器并仅在发生重大变化时才收到反馈。设置监视器 →
扩散模型有何不同
您接触过的大多数大型语言模型(例如 GPT 或 Claude)都会按顺序一次生成一个标记文本。它们是自回归的,这意味着每个单词都依赖于它之前的单词。扩散模型的工作方式不同。它们同时生成多个标记,更像图像扩散模型如何通过逐渐将噪声细化为连贯的东西来创建图片。
Mercury 2.5 配备了 260K 令牌上下文窗口,这意味着它可以在单个提示中处理大约相当于一本 500 页的书。它还支持可调节的推理级别,让开发人员根据是否需要深入分析或快速响应来向上或向下调整模型的思维深度。并行工具调用和结构化 JSON 输出完善了功能集。
Inception 声称该型号可与 GPT-5.6 Luna(低)和 Gemini 3.5 Flash-Lite 竞争。
定价游戏
Mercury 2.5 的标准定价为每百万个输入代币 0.20 美元,每百万个输出代币 0.75 美元。 Inception 在启动阶段提供 80% 的折扣,使成本降至每百万个输入代币 0.04 美元,每百万个输出代币 0.15 美元。
该模型通过兼容 OpenAI 的 API 提供,这意味着任何已连接到 OpenAI 端点的应用程序都可以切换到 Mercury 2.5,只需进行最少的代码更改。
早期采用者已经开始测试该模型。语音 AI 公司 OpenCall 报告称,使用 Mercury 2.5 进行语音交互的平均延迟低于 200 毫秒。
模型背后的公司
Inception 筹集了 5000 万美元资金,由 Menlo Ventures 领投,斯坦福大学教授、谷歌大脑前负责人吴恩达 (Andrew Ng) 以及特斯拉人工智能负责人安德烈·卡帕西 (Andrej Karpathy) 也提供支持。
Mercury 2.5 是该公司的第二个主要模型版本,建立在 Mercury 2 的基础上,据称智能性能提升了 40%。此次发布专门针对延迟敏感的生产工作负载,包括语音代理、编码助理和企业搜索。
