时间:2026-09-11
地点:美国加州圣克拉拉(NVIDIA 总部)
人物:NVIDIA 工程团队
事件详情:NVIDIA 推出 Personal AI Router(PAIR)beta 版,是一款"虚拟推理路由器",可将 AI 推理请求自动分发至本地网络中多台可用机器(如 RTX PC、Mac、Linux 工作站)。PAIR 通过代理 Ollama 和 LM Studio 等本地推理引擎的接口工作,agent harness 无需任何修改,节点可在 Windows 11、Linux 与 macOS 之间混合组网,支持 x64 与 arm64。
背景:随着多 agent 工作流(lead agent 拆解任务并分派给 sub-agent)成为常态,单 GPU 极易被并发请求打满。PAIR 正是为解决这一瓶颈而设计——它不做"GPU 合并"也不共享 VRAM,而是请求级别的智能路由:发现可用节点、追踪节点状态、将独立推理请求调度到合适节点、再把响应返回给发起调用的 agent。
影响:极客玩家和本地 AI 部署者可以零改造地扩展可用算力,RTX Spark、DGX Spark 与 RTX 5090 组合 demo 显示任务完成时间约 2 倍加速;隐私侧提示、数据与流量仍留在用户本地网络;NVIDIA 已将 PAIR 以 MIT 协议开源至 GitHub(NVIDIA/Personal-AI-Router),社区与 Reddit 用户已开始试用 Qwen 3.8 27B 等模型在三卡 RTX 5090 间的负载分发。
总结:NVIDIA PAIR 把"数据中心级调度"思路引入家庭网络,是本地 agent 部署走向规模化的关键一步。它降低了多 GPU 协同的工程门槛,也回应了近期"AI agent 是否压垮本地 GPU"的实际痛点。
参考来源:
- https://www.infoq.com/news/2026/09/nvidia-pair-ai-task-router/
- https://developer.nvidia.com/blog/nvidia-pair-virtual-inference-router-expands-available-compute-on-your-local-network/
- https://github.com/NVIDIA/Personal-AI-Router
- https://www.nvidia.com/en-us/ai-on-rtx/personal-ai-router/
- https://www.nvidia.com/en-us/ai/
- https://www.reddit.com/r/LocalLLM/comments/1wc61h2/nvidia_pair_is_actually_pretty_nice_for_multigpu/









