NVIDIA Pair: la IA local en casa ahora se instala con un solo clic

by Tecnoandroid
NVIDIA Pair: la IA local en casa ahora se instala con un solo clic

La IA local está viviendo un momento de expansión que hace un año habría parecido difícil de imaginar, con 1.300 millones de descargas de modelos de lenguaje y una calidad que empieza a mirar de tú a tú a la de la nube. En medio de este panorama, NVIDIA ha decidido tirar por tierra buena parte de las barreras técnicas que frenaban a los usuarios menos expertos, simplificando la instalación de agentes hasta reducirla a un solo clic y presentando NVIDIA Pair, una herramienta de código abierto que reparte la carga de trabajo entre los distintos aparatos de casa sin que uno note ralentizaciones al hacer otras cosas.

El interés por ejecutar modelos en el propio equipo no es casualidad. El coste elevado de algunas suscripciones de inteligencia artificial ha empujado a muchos usuarios y empresas a probar la IA local junto con agentes, buscando experimentación sin límites y un ahorro claro en tokens. Los números lo dejan bastante claro, ese 1.300 millones de descargas de LLM supone multiplicar por cuatro la cifra del año anterior.

Modelos que ya rozan el nivel de la nube

Lo curioso es que el salto no viene solo por precio, sino por rendimiento. En apenas cuatro meses, modelos locales como GLM 5.3 y Qwen 3.8 Flash Next han conseguido igualar en benchmarks al modelo Opus 4.7 de Anthropic, algo que hasta hace poco parecía reservado a la infraestructura en línea. Y en generación de vídeo la historia se repite, ya que el modelo local Minimax H3, presentado en agosto, se ha puesto a la altura en calidad del Gemini Omni Flash de Google.

Antes, montar todo esto en casa era un dolor de cabeza. Había que empaparse de cuantización, motores de inferencia y configuraciones que espantaban a cualquiera sin conocimientos técnicos. NVIDIA ha trabajado con los principales desarrolladores de agentes para dejarlo todo en un clic. Hermes Agent ofrecerá una configuración de IA local instantánea para GPUs NVIDIA RTX y sistemas DGX en Windows y Linux a partir de septiembre, siempre con tarjetas de 24 GB o más. OpenClaw 2.0 hace lo propio para GPUs con esa misma cantidad de VRAM. Y Perplexity Portable Computer, que ya estaba en DGX Spark, llega ahora a las RTX en Windows y Linux, permitiendo un enfoque híbrido con chats privados de tokens ilimitados y escalado automático a la nube cuando la tarea lo pide.

Link affiliato

Más velocidad y un enrutador de IA para el hogar

La otra pata de todo esto es el rendimiento. NVIDIA sigue colaborando con las comunidades de código abierto para exprimir la inferencia en local. Llama.cpp, con sus últimas actualizaciones, ofrece hasta 1,9 veces más de throughput gracias a optimizaciones de kernel, decodificación especulativa mejorada y un prellenado más rápido. vLLM, por su parte, mejora 1,2 veces en la GPU RTX Pro 6000 Blackwell y hasta 1,4 veces en sistemas DGX Spark. A esto se suma el lanzamiento del SoC N1X con arquitectura Blackwell para dar músculo a los nuevos equipos RTX Spark, con el respaldo de gigantes del videojuego como EA y Ubisoft.

La sorpresa del anuncio es NVIDIA Pair. No hablamos de un router físico, sino de una herramienta de software pensada para repartir de forma inteligente la inferencia de IA local entre los varios dispositivos de una casa. Se instala en cada PC y detecta automáticamente al resto de aparatos de la red mediante mDNS, emparejándolos con un código seguro de seis dígitos y comunicándose a través de canales cifrados mTLS.

Fuente
Imagen: hardzone.es

Related Articles