家里闲置电脑也能组AI集群,英伟达开源PAIR免费“捡”算力

9月3日,英伟达在柏林IFA 2026展会上正式宣布推出Personal AI Router(PAIR)测试版。这是一款免费的开源软件,旨在将家庭或小型办公网络中多台兼容设备的闲置算力整合起来,协同处理本地AI推理任务。

不是硬件路由器,是AI任务的“调度员”

尽管名字里带有“Router”字样,PAIR并不是传统意义上的网络硬件路由器。更准确地说,它是一个运行在本地网络中的虚拟推理路由器。PAIR的核心功能,是把AI代理和本地大模型产生的推理请求,自动调度到网络中有空闲算力的设备上执行。

这一设计的背景,是AI代理工作流的快速普及。一个主代理可以将复杂任务拆分成多个子任务,分配给专门的子代理并行处理。但如果所有请求都挤在同一块GPU上,排队等待就成了不可避免的瓶颈。PAIR要解决的,正是这个“多代理争抢单GPU”的问题。

工作原理:不拼显存,只分任务

PAIR并不会把多台电脑的显存“拼接”起来运行一个更大的模型。它的工作方式更接近任务调度:每个独立的推理请求被分配到某个符合条件的设备上,由该设备上的Ollama或LM Studio等推理后端完整执行,再将结果返回给发起请求的应用。

这种设计意味着,用户无需修改现有AI代理的架构,也不用为每台机器单独配置推理环境。PAIR在后台自动发现设备、追踪状态、分配任务,对上层应用保持透明。

PAIR的动态适应能力也值得一提。当新设备加入或已有设备离开(比如关机、休眠或被用户用来打游戏)时,系统会自动调整路由策略。路由决策会综合考虑节点的就绪状态、推理引擎是否运行、模型是否已存在以及GPU利用率等因素。

安全与隐私:数据留在本地

英伟达强调,PAIR的设计目标之一是让AI工作流的数据始终留在用户自己的网络中。提示词、文件和代理上下文不会被发送到云端推理服务。设备之间通过六位数字配对码完成配对,之后所有通信都通过双向TLS(mTLS)加密通道进行。

兼容设备与系统要求

目前PAIR测试版支持Windows、macOS和Linux三大平台。硬件方面,兼容范围包括:

-NVIDIA GeForce RTX 20系列及更新型号

-基于Turing架构及更新架构的NVIDIA RTX PRO工作站GPU

-NVIDIA DGX Spark系统

-搭载Apple M4或更新芯片的Mac设备

系统要求至少8GB内存,建议准备20GB或以上磁盘空间。软件运行本身不依赖互联网连接,但下载模型时仍需联网。

性能演示:从18分钟到8分48秒

英伟达在演示中展示了一个典型场景:在Hermes Agent中使用Ollama与Qwen 3.6 35B A3B模型,将一个任务拆分给5个AI子代理。仅用RTX Spark笔记本单机运行时,平均完成时间为18分钟;加入DGX Spark和RTX 5090后,平均时间缩短至8分48秒。

英伟达产品经理Seth Schneider在媒体简报会上描绘了一个更极致的场景:一个家庭中同时拥有RTX Spark笔记本、DGX Spark台式机、RTX 5090笔记本和MacBook Pro——这套设备合计约有165 TFLOPS的闲置算力。“这简直是藏在千家万户中的免费token宝库,”Schneider说。

PAIR测试版现已上线,源代码已在GitHub以Apache 2.0许可证开源。用户可前往英伟达官网下载体验。

(素材来自:英伟达 智算芯能前沿网综合)

本文由智算芯能前沿网编辑整理,转载请注明出处。