NVIDIA presentó Nemotron 3.5 Lightning y NeMo Switchyard como parte de su estrategia para fortalecer el desarrollo de sistemas de agentes autónomos, un segmento que la compañía identifica como una evolución natural de los modelos conversacionales hacia arquitecturas más complejas y distribuidas. La nota oficial describe a Nemotron 3.5 Lightning como un modelo abierto de 30.000 millones de parámetros basado en mezcla de expertos, diseñado para tareas especializadas dentro de flujos de trabajo de agentes que operan de manera continua. Según la empresa, este modelo ofrece mejoras de velocidad y eficiencia en comparación con alternativas de su misma categoría, con incrementos de hasta cuatro veces en la velocidad de salida y reducciones del tiempo de finalización de tareas cercanas al 30%.
La compañía señala que Lightning puede ser postentrenado con datos propios de cada organización mediante la plataforma NeMo, lo que permite adaptar su comportamiento a dominios específicos como revisión de código, monitoreo de seguridad o atención a consultas operativas. NVIDIA menciona que miembros de la Nemotron Coalition contribuyeron con metodologías de evaluación, software de inferencia y conjuntos de datos para avanzar en el desarrollo del modelo. Empresas como CrowdStrike, Harvey, CodeRabbit y Lila Sciences figuran entre los primeros usuarios que han personalizado Lightning para cargas de trabajo en ciberseguridad, servicios legales, revisión de código y ciencias aplicadas.
El anuncio también incluye la disponibilidad de NeMo Switchyard, una biblioteca de código abierto para enrutamiento inteligente de modelos dentro de herramientas de agentes. La propuesta consiste en dirigir cada solicitud al modelo más adecuado según criterios como calidad, latencia o costo, sin que los desarrolladores deban modificar sus aplicaciones. NVIDIA afirma que esta capacidad permite mantener niveles de precisión similares a los de modelos de frontera, mientras reduce el costo de ejecución a aproximadamente un tercio en comparación con el uso exclusivo de un modelo avanzado como Opus 4.8. La empresa cita pruebas internas y colaboraciones con socios como Boomi, Cadence, Classmethod, Cognition, Kong, LangChain y Siemens, quienes reportaron mejoras en eficiencia, reducción de latencia y disminución del costo operativo en distintos escenarios.
El lanzamiento se enmarca en un contexto donde los modelos abiertos han ganado relevancia entre organizaciones que buscan mayor control sobre la infraestructura, la privacidad y la trazabilidad de sus sistemas de IA. Firmas de análisis como Gartner y Forrester han señalado que la adopción de arquitecturas de agentes está creciendo en sectores como servicios financieros, manufactura y seguridad informática, impulsada por la necesidad de automatizar tareas de alto volumen con modelos especializados. En paralelo, competidores como Meta y Mistral han reforzado su oferta de modelos abiertos, mientras que proveedores de modelos cerrados continúan ampliando capacidades de razonamiento y planificación para agentes complejos.
Fuente: NVIDIA | Editado por CDOL









































