Nvidia|开源PAIR将闲置PC组成家庭本地推理集群

PromptTree|阅读 0
2026/09/05 08:14
NvidiaPAIR本地推理Ollama
IFA 2026期间Nvidia发布免费开源Personal AI Router(PAIR)beta:在局域网发现兼容设备,把独立推理请求路由到空闲节点,适配Ollama与LM Studio。支持Windows/Linux/macOS,覆盖RTX 20系及以上、DGX Spark与Apple M4+。

本地Agent若只能打满一张卡,多子任务一并发就会排队——家里其他显卡却可能在休眠。IFA 2026期间,Nvidia发布免费开源工具Personal AI Router(PAIR)beta:在家庭局域网内发现兼容设备,把独立推理请求路由到空闲节点,并适配Ollama与LM Studio等熟悉后端。

Nvidia是加速计算与AI芯片公司,近年同步加码消费级与专业级本地AI体验。PAIR不是硬件路由器,也不会把多卡VRAM合并成一张虚拟GPU;它调度的是「一个个独立请求」,让Agent拆出来的子任务分散到不同机器,从而抬高并行吞吐。产品页与公开演示强调:提示词、文件与Agent上下文留在用户本地网络,不默认送进云端推理。

能力与适配要点:

  1. 系统:Windows、Linux、macOS;图形与命令行界面
  2. 硬件:GeForce RTX 20系及更新、RTX PRO、DGX Spark;Apple M4及以上
  3. 后端:上线即支持Ollama、LM Studio,对外提供统一本地端点
  4. 安全:六位配对码建立信任,通道使用mTLS双向加密
  5. 动态:设备忙碌(例如开始打游戏)可退出调度;节点加入离开可自适应

所谓个人AI集群,白话是把家里睡着的显卡叫醒,给Agent当临时工;所谓PAIR,白话是家里的「推理调度员」,决定下一单活派给哪台机器。Nvidia产品经理举例称,极端多机家庭闲置算力可达约165 teraflops量级,但更现实的用户画像是「一台笔记本+一台游戏PC」。同期还称Perplexity Portable Computer、Hermes Agent、OpenClaw等将提供面向Nvidia GPU的简化本地安装路径。

放在本地Agent上下文里,云API账单与隐私顾虑推动一部分工作流回流家庭;瓶颈常从「有没有模型」变成「多Agent抢同一张卡」。PAIR降低的是调度与发现成本,而不是声称单请求线性加速。对企业边缘与工作室场景,则可审计的局域网推理比「再买一张云账单」更易讲清数据边界。

需要把边界读清楚:加速来自并行任务吞吐;单模型单请求不会因多机而自动变快。下一观察点是开源社区对发现/路由的贡献,以及更多Agent应用是否提供一键接入。