Nvidia lanza Nemotron 3.5 Lightning y NeMo Switchyard para bajar coste y acelerar la IA abierta

Nemotron 3.5 Lightning cabe en una sola GPU y, según Nvidia, responde hasta 4 veces más rápido. NeMo Switchyard asigna cada tarea al modelo más conveniente y reduce el coste a un tercio frente a Opus 4.8.

12 de agosto de 2026 a las 11:31h
Nvidia lanza Nemotron 3.5 Lightning y NeMo Switchyard para bajar coste y acelerar la IA abierta
Nvidia lanza Nemotron 3.5 Lightning y NeMo Switchyard para bajar coste y acelerar la IA abierta

Añadir Mangas Verdes como fuente preferida de Google de forma gratuita.

Mantente informado con las últimas noticias de actualidad.

Activar ahora

Nvidia quiere que la inteligencia artificial abierta no solo compita por calidad, sino también por coste y velocidad. Su nuevo movimiento combina un modelo gratuito de pesos abiertos para agentes con una herramienta pensada para decidir, tarea a tarea, qué modelo conviene usar sin disparar la factura.

Nemotron 3.5 Lightning cabe en una sola GPU

Nemotron 3.5 Lightning está diseñado para ejecutarse en una sola GPU dentro de un ordenador convencional.

Nvidia construyó este modelo mediante destilación a partir de versiones Nemotron más grandes. La idea resulta fácil de entender si se piensa en un resumen técnico bien hecho, porque el sistema intenta conservar lo útil de un modelo voluminoso en una versión mucho más ligera.

Además, la compañía asegura que genera respuestas hasta cuatro veces más rápido que sus referencias. También afirma que completa tareas un 30 % más rápido que modelos abiertos comparables.

Ese enfoque encaja con una carrera en la que no basta con tener un modelo capaz, porque cada segundo de espera y cada consulta encarecen el uso real. Ahí aparece una tensión muy clara entre la promesa de la IA abierta y el negocio del hardware, una relación que Nvidia ya había rozado en el control de chips y acceso, donde infraestructura y modelos acaban cruzándose.

Jensen Huang defiende que lo abierto también vende más chips

Jensen Huang, consejero delegado de Nvidia, no ha intentado esconder esa paradoja.

"La IA gratuita debería ser excelente para el hardware. La IA gratuita debería ser excelente para los chips" - Jensen Huang, consejero delegado de Nvidia

Su planteamiento va un paso más allá del gesto comercial. Huang también ha sostenido que los modelos abiertos terminan traduciéndose en una mayor demanda de chips, una manera de presentar la apertura no como renuncia al negocio, sino como combustible para él.

Mientras tanto, el clima alrededor de esta discusión se ha tensado con la llegada de Kimi K3 de Moonshot AI y con la carta abierta en la que Huang advirtió contra las restricciones prematuras a la innovación tecnológica. No es una discusión menor si el tablero empieza a llenarse de alternativas abiertas y de herramientas capaces de ejecutarse cada vez más cerca del usuario, como ya sugiere el avance de Kimi K3.

NeMo Switchyard reparte tareas para gastar menos

La segunda pieza del anuncio apunta menos al brillo del modelo y más a la cuenta final.

NeMo Switchyard es una herramienta de código abierto que asigna automáticamente cada tarea al modelo más adecuado según la precisión y el coste. Nvidia asegura que reduce el coste a un tercio frente a usar Opus 4.8 de Anthropic por sí solo.

La pregunta de fondo ya no es solo qué modelo responde mejor, sino cuál conviene poner a trabajar en cada momento. Si un agente necesita una operación sencilla, usar siempre la opción más cara puede parecer tan poco eficiente como mover un camión para entregar una carta.

Kari Briski, vicepresidenta de software de inteligencia artificial generativa para empresas en Nvidia, sitúa ahí otra capa del debate. Sus palabras apuntan a que estas herramientas ayudan a las empresas a proteger sus propios datos, un argumento que gana peso cuando el modelo puede descargarse, modificarse y ejecutarse sin coste.

Meta entra en la escena con Muse Spark para programar

Meta también ha movido ficha con Muse Spark, un modelo especializado en programación.

Mark Zuckerberg, consejero delegado de Meta, ha defendido que los modelos abiertos estadounidenses deberían aspirar a ser los mejores del mundo. La coincidencia temporal con el anuncio de Nvidia refuerza una disputa que ya no gira solo alrededor de quién lanza el sistema más capaz, sino de quién marca las reglas de la apertura.

Nemotron 3.5 Lightning puede descargarse, usarse y modificarse sin coste, y ya ha sido probado por CrowdStrike, CodeRabbit y Harvey. Está disponible en Hugging Face, ModelScope, OpenRouter y en la propia web de Nvidia.

Sobre el autor
Redacción
Ver biografía