随着 Surplus 的快速增长,Chute 主导了链上推理请求
核心要点
- 去中心化人工智能推理平台正在以中心化定价的一小部分处理数万亿代币,重塑人工智能工作负载的服务方式。
- Chutes 和 Surplus Intelligence 这两个去中心化平台通过做一些看似简单的事情来拉动越来越多的链上推理请求:降低运行人工智能模型的成本。
- 拥有备用显卡的独立矿工按需提供开源人工智能

去中心化人工智能推理平台正在以中心化定价的一小部分处理数万亿代币,重塑人工智能工作负载的服务方式。
人工智能推理市场正在悄然从底层进行重组。 Chutes 和 Surplus Intelligence 这两个去中心化平台通过做一些看似简单的事情来拉动越来越多的链上推理请求:降低运行人工智能模型的成本。
Chutes 建立在 Bittensor 的子网 64 上,已累计处理超过 34 万亿个代币,日峰值超过 1200 亿个代币。 Surplus Intelligence 于两个月前推出,目前已收到 250 万个请求和 1070 亿个输入代币。它们共同代表了一个不断发展的论点,即集中式人工智能提供商对核心商品计算收取过高的费用。
Gloria One 应用程序,一个屏幕 - 每天早上,Gloria Finance 都会向您简要介绍发生的事情以及它如何影响您的投资组合。阅读您的简介 →
滑槽如何成为默认设置
Chutes 于 2025 年 1 月下旬公开推出,作为去中心化无服务器推理平台。拥有备用显卡的独立矿工按需提供开源人工智能模型,用户按处理的代币付费。
定价说明了一切。 Chutes 对某些模型的每百万代币收取个位数美分的费用,这只是中心化替代方案在同等工作负载下通常收取的费用的一小部分。
发布后开始货币化后,每日代币吞吐量攀升至 1200 亿枚。该平台使用无需许可的 GPU 矿工,这些矿工根据容量、速度和可用性进行评分,从而创建了一个竞争激烈的市场,性能最好的硬件可以赢得更多工作。
安全性通过可信执行环境(TEE)来处理。这些是硬件级隔离区,即使对于处理数据的矿工来说,也能保证数据的私密性。硬件验证通过 GraVal 技术进行,该技术确认矿工实际上正在运行他们声称正在运行的 GPU。
所有结算均在 USDC 链上进行,没有发票周期或付款条件。
剩余情报爆发两个月
Surplus Intelligence 于 2026 年 5 月下旬首次亮相,作为未使用的人工智能推理能力的市场,这是计算买家和卖家直接会面的订单簿。
2026 年 5 月下旬,Surplus 处理了 47,000 个请求和 17 亿个输入代币。到 2026 年 7 月下旬,这些数字已激增至 250 万个请求和 1070 亿个代币——两个月内大约增加了 50 倍。
Surplus 报告称,与传统推理提供商相比,用户节省了 40-60%。市场模型支持动态价格发现,这意味着价格根据实际供需进行调整。与 Chutes 一样,Surplus 在链上以 USDC 结算。
这两个平台的不同之处在于它们的供应方式。 Chutes 将 GPU 矿工招募到一个按性能指标评分的无需许可的网络中。剩余的运作更像是一个二级市场,将拥有过剩推理能力的实体与需要它的实体连接起来。
这对人工智能计算市场意味着什么
特别是对于 Bittensor 生态系统,Chutes 在 Subnet 64 上的地位强化了 TAO 的实用性叙述。当子网每天处理 1200 亿个代币时,代币经济学就以实际吞吐量为基础,而不是对未来采用情况的猜测。
去中心化基础设施的风险在于可靠性。集中式提供商提供 SLA、专门支持和有保证的正常运行时间。无需许可的矿工网络提供较低的价格和审查阻力,但矿工在推理过程中离线是与 AWS 区域宕机不同的故障模式。
这些平台也主要服务于开源模型。如果您的工作负载需要 OpenAI 或 Anthropic 的专有前沿模型,那么去中心化推理还不是一个选择。
