NVIDIA Personal AI Router 将 AI 任务分配到本地计算资源上
NVIDIA 发布 Personal AI Router(PAIR)测试版,可将本地网络中多台计算机的推理能力整合,并自动分配 AI 请求,主要面向本地多代理工作负载。PAIR 采用广度优先策略,将单个推理请求分配到可用系统,避免单块 GPU 过载,并与 Ollama、LM Studio 等本地推理服务集成,无需更改底层架构或代理框架。代理仍通过单一接口发送请求,PAIR 在后台识别引擎与模型要求并选择节点执行。演示中,PAIR 组合 RTX Spark、DGX Spark 和 RTX 5090,完成时间约为单台 RTX Spark 笔记本的一半。PAIR 支持 Windows 11、Linux 和 macOS,以及 x64 和 arm64,可跨操作系统配对节点。NVIDIA 强调,PAIR 不会合并 GPU 或整合 VRAM。
本文摘要由千智坊基于公开报道整理,查看完整内容:阅读原文(InfoQ)→
