Skip to content
DigitalNeuron
Herramientas y productos

NVIDIA anuncia PAIR, una IA local más rápida y los PC RTX Spark

NVIDIA announced its PAIR routing tool, local inference optimizations, simplified agent setup and RTX Spark Windows PCs at IFA 2026.

Por DigitalNeuron Desk3 min de lectura

Respuesta rápida

¿Qué anunció NVIDIA sobre la IA local en la IFA 2026?

NVIDIA announced PAIR, a free open-source tool that distributes AI inference across compatible computers on a local network. The company also introduced simplified local setup for several agent applications, new llama.cpp and vLLM optimizations, and RTX Spark Windows PCs from Acer and Lenovo scheduled to arrive in October 2026.

Claves

  • NVIDIA introduced PAIR, a free open-source tool for routing independent inference requests among compatible computers on a local network.
  • NVIDIA afirma que las nuevas optimizaciones de llama.cpp y vLLM aumentan el rendimiento de inferencia en determinadas configuraciones RTX y DGX.
  • Hermes Agent, OpenClaw and Perplexity Portable Computer are adding simplified support for running local models on NVIDIA hardware.
  • NVIDIA anunció que los PC con Windows RTX Spark de Acer y Lenovo llegarán en octubre de 2026.

NVIDIA anunció en la IFA 2026 un conjunto de novedades para la IA local, entre ellas una herramienta para compartir cargas de trabajo de inferencia entre ordenadores cercanos, optimizaciones de rendimiento para dos motores de inferencia y una configuración simplificada de modelos para aplicaciones de agentes. La compañía también indicó que los PC NVIDIA RTX Spark con Windows llegarán en octubre de 2026.

Distribución del trabajo entre ordenadores locales

NVIDIA presentó Personal AI Router, o PAIR, una herramienta de software gratuita y de código abierto que distribuye solicitudes independientes de inferencia de IA entre ordenadores compatibles de una red local. Según NVIDIA, PAIR detecta automáticamente los dispositivos compatibles, selecciona los sistemas con capacidad disponible y se adapta cuando se incorporan o desconectan dispositivos de la red.

La herramienta funciona con Ollama y LM Studio y está disponible en versión beta mediante interfaces gráficas y de terminal. NVIDIA indica que es compatible con Windows, macOS y Linux, así como con las GPU GeForce RTX de la serie 20 y posteriores, las GPU RTX PRO para estaciones de trabajo con arquitectura Turing o posterior, DGX Spark y chips Apple M4 o posteriores.

NVIDIA señaló que PAIR puede distribuir las tareas creadas por varios subagentes, en lugar de dejarlas en cola en una sola GPU. También puede trasladar las cargas de trabajo de IA a otro ordenador mientras el usuario emplea el sistema principal para jugar, realizar tareas creativas u otros trabajos.

Configuración simplificada de agentes

NVIDIA indicó que Hermes Agent, OpenClaw y Perplexity Portable Computer incorporarán una compatibilidad simplificada con modelos locales en su hardware. Los procesos de configuración utilizan llama.cpp e incluyen las optimizaciones de inferencia de NVIDIA.

En Hermes Agent, la configuración de modelos locales con un solo clic está disponible en Windows para sistemas RTX y DGX, mientras que la compatibilidad con Linux está prevista. NVIDIA explicó que el software detecta la GPU instalada, elige un modelo y una configuración, y ejecuta el modelo mediante una implementación integrada de llama.cpp. Hermes puede utilizar herramientas, conservar el contexto entre tareas, retener información entre sesiones y crear habilidades reutilizables.

Según NVIDIA, Perplexity Portable Computer está disponible en sistemas Linux equipados con GPU NVIDIA RTX que dispongan de al menos 24 GB de VRAM, y está previsto que llegue a Windows. NVIDIA señaló que la aplicación puede ejecutar flujos de trabajo localmente sin consumir créditos y solicitar permiso antes de enviar contenido a uno de los más de 15 modelos en la nube.

NVIDIA, Microsoft y OpenClaw también trabajan en una aplicación de OpenClaw para Windows. Según NVIDIA, esta simplifica la configuración de un modelo local optimizado en GPU RTX con al menos 24 GB de VRAM.

Mejoras en el rendimiento de la inferencia

NVIDIA informó de que llama.cpp puede ofrecer un rendimiento de procesamiento hasta 1,9 veces superior en una GeForce RTX 5090 gracias a cambios en los kernels, mejoras en la decodificación especulativa y una fase de prellenado más rápida. La compañía también registró una mejora de 1,2 veces en vLLM con una RTX PRO 6000 Blackwell Workstation Edition y de hasta 1,4 veces en dos clústeres DGX Spark.

NVIDIA indicó que las mejoras están disponibles a través de los motores de inferencia llama.cpp y vLLM, y que también pueden utilizarse mediante LM Studio y Ollama.

Sistemas RTX Spark

NVIDIA anunció que los PC RTX Spark con Windows comenzarán a distribuirse en octubre; Acer mostró un concepto de ordenador de sobremesa compacto y Lenovo presentó el Yoga Pro 9n y el convertible Yoga 9n 2-en-1. La compañía describió las configuraciones RTX Spark como sistemas dotados de una GPU RTX Blackwell de 1 petaflop, hasta 128 GB de memoria unificada y una CPU Grace de 20 núcleos.

El lanzamiento del modo AI PC de PhotoDirector, de CyberLink, también está previsto para octubre junto con RTX Spark. NVIDIA indicó que ofrecerá edición generativa, mejora de imágenes, eliminación de objetos, herramientas para fondos, retoque de retratos y creación de imágenes, con la posibilidad de elegir entre procesamiento local o en la nube.

Fuente: «Sparks Fly: NVIDIA Accelerates Local AI at IFA 2026», de NVIDIA, publicado el 3 de septiembre de 2026.

Preguntas frecuentes

What is NVIDIA PAIR?
NVIDIA describe Personal AI Router, o PAIR, como una herramienta gratuita y de código abierto que detecta ordenadores compatibles en una red local y dirige solicitudes de inferencia independientes a los sistemas con capacidad disponible.
Which operating systems and hardware does PAIR support?
NVIDIA afirma que la beta de PAIR está disponible para Windows, macOS y Linux. El hardware compatible incluye las GPU GeForce RTX de la serie 20 y posteriores, las GPU para estaciones de trabajo RTX PRO basadas en la arquitectura Turing o posteriores, DGX Spark y los chips Apple M4 o posteriores.
Which agent applications are receiving simplified local setup?
NVIDIA destacó a Hermes Agent, OpenClaw y Perplexity Portable Computer. La empresa afirmó que su compatibilidad con configuraciones locales utiliza llama.cpp e incorpora optimizaciones de inferencia de NVIDIA.
When will NVIDIA RTX Spark PCs arrive?
NVIDIA afirmó que los PC con Windows RTX Spark llegarán en octubre de 2026, incluidos modelos de Acer y Lenovo.

Fuentes

  1. Sparks Fly: NVIDIA Accelerates Local AI at IFA 2026 | NVIDIA BlogNVIDIA
Etiquetasnvidialocal-aiai-agentsrtxpairinferencewindows

Lecturas relacionadas

Anthropic lanza Claude Science, un entorno de trabajo para investigadores

Anthropic presentó Claude Science, un entorno de trabajo para la investigación que reúne herramientas científicas, agentes especializados, bases de datos y recursos informáticos. La versión beta está disponible en macOS y Linux para usuarios de Claude Pro, Max, Team y Enterprise, con funciones para realizar análisis reproducibles, revisar bibliografía, elaborar figuras y manuscritos y gestionar tareas informáticas.

3 min de lectura

Anthropic abre una versión preliminar de investigación del Model Hardware Standard

Anthropic abrió una versión preliminar de investigación del Model Hardware Standard, una especificación compartida para que los agentes de IA operen dispositivos físicos programables. La empresa afirma que MHS estandariza la comunicación con equipos como microscopios, manipuladores de líquidos y brazos robóticos, y que inicialmente está disponible para determinados laboratorios de investigación y fabricantes avanzados.

3 min de lectura

Google lanza el programa de ciberdefensa Fairwind para socios de confianza

Google lanzó el programa Fairwind, una iniciativa de acceso limitado para gobiernos, clientes de Google Cloud y socios de ciberseguridad. El programa combina Gemini 3.8 Flash Cyber con el entorno CodeMender de Google para detectar, verificar y corregir vulnerabilidades de forma autónoma. Según Google, más de 650 socios participan en todo el mundo y deben cumplir requisitos de seguridad operativa.

3 min de lectura