Nvidia випустила бета-версію PAIR для розподілу AI-запитів між локальними комп'ютерами

NVIDIA Personal AI Router Distributes AI Tasks across Local Compute

Компанія Nvidia випустила бета-версію Personal AI Router (PAIR) — інструменту, що розподіляє запити до AI-моделей між кількома комп'ютерами в локальній мережі. За даними Nvidia, PAIR насамперед призначений для мультиагентних робочих навантажень, де кілька незалежних викликів моделей можуть перевантажити один GPU, і інтегрується з такими локальними інференс-сервісами, як Ollama та LM Studio. У демонстрації компанії поєднання RTX Spark, DGX Spark та RTX 5090 через PAIR показало приблизно дворазове скорочення часу виконання завдання порівняно з одним ноутбуком RTX Spark. Nvidia уточнює, що PAIR не об'єднує GPU чи відеопам'ять в один більший пришвидшувач, а лише розподіляє окремі запити між доступними системами.

Мовою оригіналу · EN

Nvidia has released a beta version of Personal AI Router (PAIR), a tool that distributes AI inference requests across multiple computers on a local network, aimed primarily at multi-agent workloads…

Читати оригінал на InfoQ →

Чому в стрічці: Продукт Nvidia для розподілу мультиагентних AI-навантажень — суміжний з інтересом користувача до агентних систем.

← Назад до стрічки