En un movimiento que promete revolucionar el campo de la inteligencia artificial (IA) autónoma, NVIDIA ha anunciado la expansión de su familia de modelos Nemotron 3 con la introducción del Nemotron 3.5 Lightning. Este modelo, descrito como el más eficiente de su categoría para tareas de larga duración, se lanza como respuesta a la creciente demanda de modelos abiertos que ofrezcan un control completo sobre dónde y cómo se despliega y evoluciona la IA.
El Nemotron 3.5 Lightning, diseñado para realizar tareas especializadas dentro de sistemas multi-agentes más grandes, utiliza un enfoque de «mixture-of-experts» con 30 mil millones de parámetros. Esto le permite a las aplicaciones agentes ser más inteligentes y eficientes, cumpliendo con tareas específicas con mayor rapidez y precisión.
Además, NVIDIA ha lanzado NeMo Switchyard, una biblioteca de código abierto que permite la dirección inteligente de solicitudes dentro de herramientas de agentes populares. Esta biblioteca permite que las empresas desarrollen un enrutador personalizado según sus necesidades específicas, facilitando la dirección de cada solicitud al modelo más adecuado sin necesidad de reescribir aplicaciones.
Juntos, el Nemotron 3.5 Lightning y el NeMo Switchyard ofrecen un control mejorado sobre la implementación de la IA, permitiendo su funcionamiento eficaz tanto en PCs, estaciones de trabajo, centros de datos y entornos en la nube.
El auge de los agentes siempre activos ha llevado a una evolución en los sistemas que ahora operan como conjuntos de modelos especializados para diferentes tareas. Los modelos abiertos de NVIDIA Nemotron están diseñados para esta arquitectura, permitiendo que modelos de razonamiento de vanguardia planifiquen y organicen flujos de trabajo, mientras que modelos más pequeños y especializados, como el Nemotron 3.5 Lightning, pueden llevar a cabo tareas específicas como revisión de código, uso de herramientas, monitoreo de alertas de seguridad y preguntas sobre facturación.
El Nemotron 3.5 Lightning no solo destaca por su velocidad, que es hasta cuatro veces mayor que otros modelos de su clase, sino también por su capacidad de ser personalizado y entrenado con datos de dominio específicos. Empresas de diversas industrias ya están adaptando el modelo a sus cargas de trabajo, mejorando la precisión en tareas específicas del dominio, en campos que van desde la ciberseguridad hasta los servicios legales y el desarrollo de software.
Este modelo también ofrece una ventaja significativa en términos de privacidad y despliegue, pudiendo ejecutarse en sistemas locales de IA y permitiendo así a las organizaciones maximizar sus inversiones en infraestructuras existentes.
Por otro lado, el NeMo Switchyard introduce una optimización en el enrutamiento de modelos, garantizando que cada solicitud de IA se dirija al modelo más eficiente y capaz, lo que puede reducir significativamente los costos de completar tareas.
Empresas como Boomi, Cadence y Siemens, entre otras, ya están evaluando e integrando estas tecnologías para mejorar la eficiencia y reducir costos en sus operaciones con IA.
Con la disponibilidad del Nemotron 3.5 Lightning en plataformas como Hugging Face, ModelScope, OpenRouter y a través de una amplia red de socios en la nube de NVIDIA, se espera que esta nueva tecnología marque un avance significativo en la forma en que las aplicaciones basadas en IA son desarrolladas y desplegadas en todo el mundo. NeMo Switchyard también está disponible en GitHub, ampliando las posibilidades para los desarrolladores que buscan integrar rutas inteligentes de modelos en sus soluciones actuales.
Fuente: Zona de blogs y prensa de Nvidia











