NVIDIA PAIR 入门:把多台电脑组成本地 AI 推理集群

按官方 Playbook 安装 NVIDIA Personal AI Router(PAIR),完成首启、引擎与模型准备,用 curl 打通本地端点,再配对第二台机器验证跨节点路由。

入门2 课时38 分钟图文实操

免费学习无需登录

NVIDIA PAIR 入门:把多台电脑组成本地 AI 推理集群 课程封面

你将学会

  • 安装 PAIR 并完成首启引擎配置
  • 在本机通过 Endpoints 复制代理地址并用 curl 完成一次推理
  • 用六位 PIN 配对第二台电脑并确认跨节点路由
  • 理解 PAIR 只做请求路由、不合并显存的边界与环回安全约束

适合谁

  • 已有 Ollama 或 LM Studio、想把家里多台电脑算力拼起来的开发者
  • 本地跑多 Agent、需要并发本地推理的个人或小团队

课前准备

  • 至少一台受支持系统(Windows 11 / Linux / macOS;GeForce RTX 20 系及以上、RTX PRO、DGX Spark 或兼容节点)
  • 会使用终端执行 curl;若要做多机配对,两台设备需在同一受信局域网
  • 了解 Ollama 或 LM Studio 的基本用法更佳,但 PAIR 也可在首启时代装引擎

课程目录

2 课时 · 38 分钟
  1. 01安装 PAIR、准备引擎模型并用 curl 打通本地端点从 GitHub Releases 安装 PAIR,完成首启与模型下载,复制 Endpoints 地址,用 OpenAI 兼容 curl 验证推理成功。图文20 分钟开始本课
  2. 02配对多机、观察跨节点路由并接入应用用六位 PIN 配对第二台节点,准备相同模型,发送请求并在 Overview Jobs 中确认 Ran on,再按官方约束把应用指向本机环回端点。图文18 分钟开始本课

课程说明

本课程依据 NVIDIA 官方 Playbook 与 Personal AI Router 文档,带你在本机安装 PAIR、准备 Ollama/LM Studio 引擎与模型,用 curl 验证本机代理端点,再配对第二台电脑观察跨节点路由,并按官方安全策略把应用接到环回地址。

PAIR 把彼此独立的推理请求路由到有引擎、有模型、当前负载合适的节点;它不会合并显存,也不会把同一次推理拆到多机。适合已有本地模型、希望把家里多台电脑算力用于多 Agent 并发的开发者。

官方入口:https://build.nvidia.com/playbooks/pair · https://github.com/NVIDIA/Personal-AI-Router · https://www.nvidia.com/en-us/ai-on-rtx/personal-ai-router/