英伟达开源 PAIR 软件:支持局域网跨设备协同与本地 AI 任务调度
英伟达开源局域网调度软件PAIR,可将本地AI推理任务自动分派至空闲的Mac或RTX设备处理。
AI 深度解读
英伟达发布开源测试版 Personal AI Router(PAIR),把同一局域网内多台兼容设备上的 Ollama 或 LM Studio 连接成请求路由层,关注价值在于为多 Agent 并发任务提供本地算力调度方式。
- PAIR会发现并配对节点,根据设备是否在线、引擎状态、模型是否存在和当前负载,将独立请求分配给合适设备。
- 官方列出的支持范围包括 Windows、Linux、macOS,以及部分 RTX GPU、DGX Spark 和 Apple M4 及更新芯片设备。
- 应用继续使用兼容 Ollama 或 OpenAI 的代理接口,模型推理仍由被选中的单台设备完成。
- PAIR不合并显存、不切分单个模型,也不会把一次正在进行的推理拆到多台机器上,因此更适合并发请求而非单请求加速。
- 英伟达展示的五子 Agent 示例中,三设备集群平均用时8分48秒,单台 RTX Spark 笔记本为18分钟;官方注明这是特定配置的非正式演示,不代表普遍性能。
- 影响/看点:PAIR可能降低本地多任务的排队时间,但收益成立的前提是请求足够并行、节点持有所需模型且网络和设备持续可用;串行任务或只有一台设备满足模型要求时,效果可能有限。资料依据:
- NVIDIA Technical Blog(2026-09-03):https://developer.nvidia.com/blog/nvidia-pair-virtual-inference-router-expands-available-compute-on-your-local-network/
- NVIDIA Personal AI Router GitHub仓库(2026-09-03):https://github.com/NVIDIA/Personal-AI-Router
本内容由 AI 生成,仅供参考,请注意甄别