Nvidia lance PAIR en bêta, routeur d'inférence pour LAN domestique
TL;DR
- Sur une tâche à cinq sous-agents, un cluster PAIR à trois machines abaisse le temps moyen de 18 minutes à 8 minutes et 48 secondes.
- PAIR proxifie Ollama et LM Studio sur RTX 20 Series et plus récents, RTX PRO Turing+, DGX Spark et Apple M4+, sous Windows, macOS et Linux.
- Le routeur ne partage pas la VRAM et ne shardе pas les requêtes ; il découvre les nœuds en mDNS et chiffre les échanges en MTLS.
Sur une tâche à cinq sous-agents avec Qwen 3.6 35B A3B, un PC portable RTX Spark seul met 18 minutes en moyenne ; un cluster à trois machines — RTX Spark, DGX Spark et RTX 5090 — descend à 8 minutes et 48 secondes. C'est le repère que met en avant Nvidia dans un billet publié le 3 septembre sur son blog développeur, signé du senior product manager Seth Schneider, pour la bêta ouverte de PAIR, Personal AI Router.
« NVIDIA Personal AI Router (PAIR) routes independent inference requests across compatible systems on a local network to relieve multi-agent bottlenecks », résume le texte. Concrètement, PAIR se pose devant les runtimes d'inférence locaux et distribue les requêtes indépendantes entre plusieurs machines du même réseau. Il proxifie Ollama et LM Studio de sorte que « no agent harness changes are necessary » : les harnais d'agents en amont ne voient rien changer.
Le périmètre matériel couvre les GeForce RTX 20 Series et plus récents, les RTX PRO station de travail (Turing et suivantes), les DGX Spark et le silicium Apple M4+. La bêta tourne sur Windows, macOS et Linux, en interfaces graphique comme terminal. Découverte des nœuds en mDNS, échanges chiffrés en MTLS avec certificats générés.
Ce que PAIR n'est pas : un pool de VRAM ni un sharding de requêtes. Chaque prompt reste sur une machine ; le routeur en aiguille plusieurs en parallèle. C'est la troisième brique d'inférence locale à passer par notre veille en peu de temps, après Anker MindBase et le Portable Computer de Perplexity, lui aussi calé sur DGX Spark et RTX. Le dépôt est publié sur github.com/NVIDIA/Personal-AI-Router ; le billet indique que « The NVIDIA PAIR project is open source » sans nommer la licence.
Article original publié par developer.nvidia.com
Lire l'article original →Titre original : Nvidia lance PAIR à IFA 2026, un routeur d'inférence open source pour cluster IA maison