NVIDIA 推出测试版 Personal AI Router(PAIR),旨在解决本地多代理 AI 工作负载中单个 GPU 易过载的问题。该工具可将推理请求自动分配到本地网络中的多台计算机,兼容 Ollama、LM Studio 等主流本地推理服务,无需修改代理框架或底层架构。PAIR 通过识别请求的引擎与模型需求,自动匹配可用节点并完成调度,对智能代理保持单一连接透明。NVIDIA 演示显示,将 RTX Spark、DGX Spark 与 RTX 5090 组合使用后,多任务分析耗时较单机运行缩短约一半。PAIR 支持 Windows、Linux 和 macOS,可跨操作系统配对节点,但明确不合并 GPU 或整合 VRAM。该工具为本地大模型部署与智能代理系统提供了更高效的资源利用路径。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅