NVIDIA presenta Nemotron 3.5 Lightning y NeMo Switchyard: Avances en IA Ágiles, Inteligentes y Eficientes

NVIDIA presenta Nemotron 3.5 Lightning y NeMo Switchyard: Avances en IA Ágiles, Inteligentes y Eficientes

La evolución de la inteligencia artificial está llevando a las empresas a explorar nuevas fronteras en el desarrollo de modelos más eficientes y personalizados. NVIDIA ha dado un paso significativo en este ámbito con el lanzamiento de Nemotron 3.5 Lightning, un modelo diseñado para optimizar las cargas de trabajo de inteligencia artificial autónoma. Este modelo, parte de la familia Nemotron, ha sido creado para satisfacer la creciente demanda de sistemas de IA que requieran un mayor control sobre su implementación y evolución.

El nuevo Nemotron 3.5 Lightning, que cuenta con 30 mil millones de parámetros, es el modelo más eficiente de su categoría. Su diseño lo hace ideal para tareas especializadas dentro de sistemas multicapa, contribuyendo a la creación de aplicaciones de IA más inteligentes y eficientes. Este avance se produce tras el lanzamiento de Nemotron 3 Nano y reafirma el compromiso de NVIDIA por mejorar sus modelos abiertos continuamente, aumentando su velocidad y precisión.

Junto con el Nemotron 3.5 Lightning, NVIDIA ha introducido NeMo Switchyard, una biblioteca de código abierto que permite la creación de sistemas de enrutamiento inteligentes dentro de herramientas de agentes populares. Esta innovadora herramienta permite a las empresas construir un enrutador ajustado a sus necesidades, redirigiendo las solicitudes a los modelos más adecuados sin necesidad de reescribir aplicaciones existentes. Esta capacidad promete un notable aumento en la eficiencia operativa, asegurando que las aplicaciones de IA se implementen de la mejor manera posible.

Nuevas Dimensiones en Sistemas de Modelos

Las actuales aplicaciones de IA funcionan cada vez más como sistemas de modelos, donde la especialización juega un papel clave. Los modelos de NVIDIA están diseñados para operar en esta arquitectura, permitiendo que modelos avanzados como Nemotron 3 Ultra coordinen workflows, mientras que Nemotron 3.5 Lightning puede ejecutarlos de manera eficiente y rápida, abordando tareas específicas como revisiones de código o alertas de seguridad.

La eficiencia de Nemotron 3.5 Lightning es notable, con una capacidad para generar resultados hasta cuatro veces más rápido, lo que implica un 30% de mejora en la finalización de tareas en comparación con otros modelos. Esto no solo se traduce en resultados más veloces, sino también en la posibilidad de personalizar el modelo para necesidades específicas de cada organización, mejorando la precisión de las tareas en función de los datos y herramientas disponibles.

Empresas líderes como CrowdStrike, Harvey y CodeRabbit están ya implementando Nemotron 3.5 Lightning para mejorar la efectividad en áreas como ciberseguridad, servicios legales y revisiones de código, mostrando así la versatilidad de esta tecnología en diversos sectores.

Optimización a través de Enrutamiento de Modelos

El enrutamiento inteligente de solicitudes es una de las características destacadas de NeMo Switchyard. Este sistema permite gestionar el tráfico de solicitudes de manera automática, dirigiendo cada prompt al modelo más adecuado basado en los requisitos específicos del workflow. Esto no solo mejora la calidad de las respuestas, sino que también reduce costos operativos significativamente.

Las pruebas internas han mostrado que NeMo Switchyard puede mantener precisiones de primer nivel mientras reduce el costo de finalización de tareas a casi un tercio de lo que implica operar un único modelo. Este enfoque se está implementando en varias plataformas, ayudando a empresas a mejorar la eficiencia en sus tareas diarias.

NVIDIA también está colaborando con múltiples aliados en el ecosistema de la inteligencia artificial para integrar esta tecnología de enrutamiento en las herramientas y plataformas que los desarrolladores ya utilizan, lo que promete transformar la eficiencia de la IA en el futuro.