NVIDIA Nemotron Alcanza un Rendimiento Líder en Benchmarks con el Harness Deep Agents de LangChain

El ajuste del harness LangChain Deep Agents para NVIDIA Nemotron 3 Ultra entrega un rendimiento líder y una conclusión de tareas más rápida en un stack abierto que las empresas pueden ejecutar, personalizar y controlar.
por

NVIDIA Nemotron 3 Ultra ofrece un rendimiento líder a un costo menor que los principales modelos cerrados, en la plataforma de orquestación de agentes de IA más grande y adoptada.

LangChain ajustó su harness Deep Agents para NVIDIA Nemotron 3 Ultra y alcanzó la mayor precisión entre los modelos abiertos, al completar más tareas con mayor throughput y operar con un costo de inferencia por ejecución 10 veces menor que el de los principales modelos cerrados.

En el benchmark Deep Agents de LangChain, Nemotron 3 Ultra también alcanzó paridad en tareas de negocio con los modelos cerrados de mayor puntuación. No fue necesario reentrenar el modelo. Toda la ganancia vino de la ingeniería del entorno alrededor del modelo, no del modelo en sí.

Con una décima parte del costo, los equipos que usan NVIDIA Nemotron 3 Ultra pueden ejecutar evaluaciones de forma continua, experimentar más rápido y crear agentes especializados en más áreas del negocio.

La plataforma de ingeniería de agentes de LangChain tiene más de 200 millones de descargas mensuales. Al ajustar su harness Deep Agents específicamente para NVIDIA Nemotron 3 Ultra, habilita agentes de alto rendimiento, que completan más tareas, se ejecutan más rápido y le dan a las empresas un stack totalmente abierto para personalizar, poseer y ejecutar donde quieran.

“El camino para construir mejores agentes es seguir mejorando el sistema alrededor del modelo”, dijo Harrison Chase, cofundador y CEO de LangChain. “La memoria, el uso de herramientas, la evaluación y el comportamiento del modelo se potencian cuando los equipos pueden ajustarlos en conjunto. Nuestro trabajo con NVIDIA muestra que las empresas pueden obtener un rendimiento sólido de un stack abierto y, al mismo tiempo, mantener el control sobre los sistemas de agentes que están construyendo.”

Abridge, Amdocs y Box están incorporando agentes especializados directamente en sus plataformas, y EY, integradora global de sistemas, está ampliando su capacidad de implementación de NVIDIA en torno a los blueprints NVIDIA NemoClaw para LangChain Deep Agents, lo que ayuda a los clientes a personalizar, evaluar y gobernar agentes especializados en workflows de alto valor.

El fundador y CEO de NVIDIA, Jensen Huang, conversó recientemente con Chase sobre por qué los últimos seis meses trajeron un salto en IA útil para las empresas.

Ingeniería de Harness, No Fine-Tuning

El equipo de LangChain ejecutó Nemotron 3 Ultra en su suite pública de benchmark Deep Agents y después analizó los traces de ejecución del deep agent para descubrir exactamente dónde perdía puntos. En lugar de reentrenar el modelo, el equipo ajustó el harness a su alrededor: system prompts, descripciones de herramientas y middleware.

Cualquier desarrollador que use LangChain Deep Agents con Nemotron 3 Ultra ya puede ponerlo en práctica hoy: el perfil ajustado está disponible directamente a través de LangChain.

Un Stack Abierto Hecho para Ser Tuyo

NVIDIA NemoClaw para LangChain Deep Agents es el blueprint abierto de referencia que empaqueta este trabajo para las empresas que construyen su propia IA especializada: sistemas de modelos, herramientas y runtime, ajustados para sus propios workflows. Combina LangChain Deep Agents Code, ajustado para Nemotron 3 Ultra, con el runtime seguro NVIDIA OpenShell para ejecutar acciones de agentes de forma segura.

Un modelo abierto, un harness abierto y un runtime seguro abierto significan que las empresas son dueñas del stack completo, de extremo a extremo. Pueden personalizarlo en torno a la expertise que diferencia su negocio, seguir mejorándolo y ejecutarlo donde quieran: infraestructura propia, nube propia, gobernanza propia.

Esa distinción pesa más a medida que los agentes asumen tareas de mayor riesgo. El cambio de asistentes de IA que responden preguntas a agentes que actúan dentro de los sistemas centrales altera lo que las empresas obtienen de su IA.

NemoClaw para LangChain Deep Agents y el perfil ajustado del modelo Nemotron 3 Ultra ya están disponibles. Los desarrolladores pueden descargar el harness Deep Agents ajustado directamente de LangChain o usar el blueprint NemoClaw para LangChain Deep Agents como punto de partida para crear agentes especializados desde cero.

Cómo Empezar

Los desarrolladores de LangChain pueden acceder a Nemotron 3 Ultra en las plataformas Baseten, Crusoe Cloud, DeepInfra, Fireworks, Nebius y Together AI, lo que les da un camino directo y hospedado para llevar el harness ajustado a producción.

EY puede ayudar a las empresas a comenzar a construir hoy sus propios agentes especializados con este stack de software abierto.

Conoce más sobre NVIDIA NemoClaw para LangChain Deep Agents y NVIDIA Nemotron.