Nvidia 推出免费个人 AI 路由器来连接家庭电脑
核心要点
- Nvidia 的开源 PAIR 软件可让多台家用 PC 集中 GPU 能力进行本地 AI 推理,无需云 Nvidia 希望您的家用计算机能够团队协作。
- 该公司的新型个人人工智能路由器(PAIR)是免费的开源软件,它可以发现本地网络上的兼容机器,将它们链接在一起,并准备好它们在多个 GPU 上分配人工智

Nvidia 的开源 PAIR 软件可让多台家用 PC 集中 GPU 能力进行本地 AI 推理,无需云
Nvidia 希望您的家用计算机能够团队协作。该公司的新型个人人工智能路由器(PAIR)是免费的开源软件,它可以发现本地网络上的兼容机器,将它们链接在一起,并准备好它们在多个 GPU 上分配人工智能推理任务,而无需向云端发送任何提示。
将其视为客厅的负载平衡器。 PAIR 不再需要一台 PC 独自努力运行大型语言模型,而是在网络上每台有能力的设备上协调工作负载,将请求路由到任何有可用空间的计算机。
PAIR 实际上做了什么
PAIR 不是物理路由器。无需新硬件,无需插入墙上的盒子。
它是处理本地人工智能推理的网络发现、设备协调和任务分配的软件。兼容的工具包括 Ollama 和 LM Studio,这是两种在消费类硬件上运行大型语言模型的更流行的应用程序。
设备支持严重偏向 Nvidia 自己的生态系统,涵盖 GeForce RTX 20 系列卡和任何更新的产品、RTX Pro GPU 和 DGX Spark 系统。 Apple 的 M4 芯片或更新版本也兼容。
Nvidia 的 DGX Spark 是本地推理系列皇冠上的明珠。当运行 DGX Spark 的机器进行集群化并对模型进行量化时,系统可以处理 2000 亿个参数范围内的模型。
RTX 5090 等高端消费卡配备 24 至 32 GB 的 VRAM。 PAIR 的工作是让该硬件在整个家庭网络中发挥作用,而不仅仅是在单个桌面上。
大局观:英伟达推动人工智能本地化
PAIR 完全符合 Nvidia 正在并行执行的更广泛的战略转变。该公司一直在开发所谓的人工智能网格,该计划旨在通过使计算尽可能靠近用户来减少与基于云的人工智能相关的延迟和成本。
Nvidia 还于 2026 年 8 月 25 日宣布与 Perplexity 合作,生产两家公司所谓的便携式计算机,这是一种设计用于在 Nvidia 硬件上本地运行中端 Qwen 模型的设备。最低 VRAM 起价为 24 GB,与 RTX 5090 级别一致。
现代人工智能代理不会发出一个请求就停止;而是发出一个请求就停下来。它们按顺序将数十个模型调用、工具使用和推理步骤链接在一起。云延迟在长链上迅速复合。由 PAIR 协调的本地 GPU 网络可最大限度地缩短往返时间,并避免每个令牌的成本,而这种成本会使代理应用程序在托管 API 上大规模运行时成本高昂。
这对竞争格局意味着什么
Nvidia 正在采取一项精心策划的举措,将 PAIR 作为免费的开源软件发布。该工具本身不会产生直接收入,但它加深了用户对 Nvidia 硬件的依赖。如果您的家庭 AI 网络是围绕 PAIR 和 RTX GPU 构建的,那么您下次升级的阻力最小的路径就是 Nvidia 的生态系统。
AMD 和英特尔都提供能够进行本地推理的竞争 GPU 系列,而 Ollama 等工具的开源性质意味着两者都不会被排除在工作流程之外。但 Nvidia 的 CUDA 生态系统及其与主流推理框架的紧密集成为 PAIR 提供了竞争对手难以快速复制的兼容性深度。
对于云提供商来说,PAIR所代表的趋势值得仔细关注。 Amazon Web Services、Google Cloud 和 Microsoft Azure 都从 AI 推理 API 流量中产生了可观的收入。将工作负载迁移到消费类硬件上的工具会削弱这些企业在其前瞻性预测中建立的增长假设。
