英伟达开源 PAIR 软件:支持局域网跨设备协同与本地 AI 任务调度

📡 IT之家2026-09-04 07:36

英伟达开源局域网调度软件PAIR,可将本地AI推理任务自动分派至空闲的Mac或RTX设备处理。

AI 深度解读

英伟达发布开源测试版 Personal AI Router(PAIR),把同一局域网内多台兼容设备上的 Ollama 或 LM Studio 连接成请求路由层,关注价值在于为多 Agent 并发任务提供本地算力调度方式。

  • PAIR会发现并配对节点,根据设备是否在线、引擎状态、模型是否存在和当前负载,将独立请求分配给合适设备。
  • 官方列出的支持范围包括 Windows、Linux、macOS,以及部分 RTX GPU、DGX Spark 和 Apple M4 及更新芯片设备。
  • 应用继续使用兼容 Ollama 或 OpenAI 的代理接口,模型推理仍由被选中的单台设备完成。
  • PAIR不合并显存、不切分单个模型,也不会把一次正在进行的推理拆到多台机器上,因此更适合并发请求而非单请求加速。
  • 英伟达展示的五子 Agent 示例中,三设备集群平均用时8分48秒,单台 RTX Spark 笔记本为18分钟;官方注明这是特定配置的非正式演示,不代表普遍性能。
  • 影响/看点:PAIR可能降低本地多任务的排队时间,但收益成立的前提是请求足够并行、节点持有所需模型且网络和设备持续可用;串行任务或只有一台设备满足模型要求时,效果可能有限。资料依据:
  • NVIDIA Technical Blog(2026-09-03):https://developer.nvidia.com/blog/nvidia-pair-virtual-inference-router-expands-available-compute-on-your-local-network/
  • NVIDIA Personal AI Router GitHub仓库(2026-09-03):https://github.com/NVIDIA/Personal-AI-Router

本内容由 AI 生成,仅供参考,请注意甄别

查看原文 ↗
看实时 AI 热点雷达 实时信息流 · 事件聚类 · 订阅推送 —— 完整产品在 aihot.aicxd.com
AI 助手