Los costos de inferencia se desploman un 90%. Nvidia se asocia con LangChain para definir los estándares de agentes, apoderándose del nuevo punto de entrada para las aplicaciones de IA
El 8 de julio, NVIDIA y LangChain lanzaron el blueprint NeMoClaw Deep Agents, marcando la transición de NVIDIA hacia una plataforma de ecosistema integral. Esta arquitectura abierta prioriza la gobernanza, controlabilidad y seguridad de agentes empresariales, permitiendo personalización sin depender de sistemas cerrados. La solución destaca por reducir los costos de inferencia hasta un 90% mediante la sinergia entre software optimizado y hardware Blackwell. Esta estrategia trasciende la venta de GPU, fortaleciendo el software NeMo para capturar mayores márgenes, fidelizar clientes y establecer una barrera competitiva esencial ante la adopción masiva de agentes autónomos.

TradingKey - El 8 de julio, NVIDIA ( NVDA) y el marco de desarrollo de IA LangChain lanzaron conjuntamente el diseño de referencia NVIDIA NeMoClaw Deep Agents. Este movimiento representa la expansión integral de NVIDIA, pasando de ser un mero proveedor de potencia de cálculo de IA a convertirse en una plataforma de ecosistema que define los estándares de desarrollo de Agents de nivel empresarial, abriendo un nuevo espacio de crecimiento para su negocio de software.
El diseño de referencia proporciona a las empresas una arquitectura de referencia de agentes de IA abierta, personalizable y gobernable, con el objetivo de resolver desafíos fundamentales como la controlabilidad, la gobernanza y la evolución continua a los que se enfrentan las empresas en la implementación de agentes.
En lugar de simplemente mejorar las capacidades del modelo, este diseño de referencia enfatiza las capacidades de ingeniería de software de los Agents de nivel empresarial. Los datos oficiales muestran que esta solución no solo logra un rendimiento líder en múltiples pruebas de rendimiento, sino que también reduce los costos de inferencia de los Agents en más de 10 veces. De este modo, forma una sinergia de hardware y software con la plataforma de inferencia Blackwell para reducir aún más los costos de implementación de aplicaciones de IA.
A medida que la IA generativa avanza desde la generación de contenido hasta la ejecución autónoma de tareas, los Agents se están convirtiendo en la forma central de las aplicaciones de IA empresarial. Sin embargo, las empresas aún enfrentan desafíos como la seguridad, la controlabilidad y la dificultad de integración con los procesos comerciales durante el proceso de implementación.
El núcleo del diseño de referencia recientemente lanzado no es construir un nuevo marco de trabajo de Agents, sino proporcionar una arquitectura de referencia completa de nivel empresarial. Basado en la colaboración con LangChain, el diseño de referencia adopta un diseño de arquitectura abierta, lo que permite a las empresas tener un control total sobre el sistema subyacente, personalizar las capacidades de los Agents e iterar continuamente a medida que crece su negocio, en lugar de depender de una plataforma cerrada.
Enfoque en la gobernanza de agentes: resolución de puntos críticos en el despliegue de nivel empresarial
En lugar de enfatizar "qué tareas puede realizar un Agente", la solución introducida por NVIDIA esta vez se centra más en cómo se gobiernan, supervisan, auditan y optimizan continuamente los Agentes. Esta capacidad es especialmente crítica para industrias altamente reguladas como las finanzas, la atención médica y el sector gubernamental, y también reduce el umbral para que las empresas desplieguen Agentes a gran escala.
Harrison Chase, cofundador y CEO de LangChain, señaló: "La clave para crear mejores agentes es la mejora continua de los sistemas que rodean a los modelos. Cuando los equipos pueden ajustar simultáneamente la memoria, el uso de herramientas, la evaluación y el comportamiento del modelo, estas capacidades generan efectos sinérgicos. Nuestra colaboración con NVIDIA demuestra que las empresas no solo pueden lograr un rendimiento potente a través de una pila abierta, sino también mantener el control sobre los sistemas de agentes que construyen".
A medida que los Agentes asumen tareas de riesgo cada vez más alto, pasando de ser asistentes que responden preguntas a ejecutores capaces de tomar medidas dentro de los sistemas principales, las exigencias de las empresas en cuanto a la controlabilidad y seguridad de los sistemas de IA están aumentando.
La arquitectura abierta que proporciona el diseño de NeMo Guardrails permite a las empresas poseer la pila tecnológica completa de extremo a extremo, lo que les permite personalizar y mejorar continuamente en función de sus ventajas profesionales únicas, y ejecutar en cualquier entorno, incluidos su propia infraestructura, nubes privadas y marcos de gobernanza propios.
Reducción de costos mediante la sinergia entre hardware y software
El control de costos siempre ha sido el cuello de botella principal para la comercialización a gran escala de la IA, y el diseño de NeMoClaw demuestra una ventaja significativa en este sentido.
Según los datos de evaluación publicados por LangChain, el modelo Nemotron 3 Ultra, equipado con la suite Deep Agents, logró una puntuación integral de 0.86, con un costo de inferencia por tarea única de solo 4.48 dólares, mientras que el modelo de la competencia más cercano costaba hasta 43.48 dólares, lo que representa una reducción de aproximadamente el 90%. Este logro no se debió al reentrenamiento del modelo en sí, sino que se consiguió optimizando las estrategias de llamada a herramientas, los mecanismos de gestión del contexto y los flujos de trabajo de razonamiento intermedio.
A nivel de hardware, la arquitectura Blackwell de Nvidia ya ha reducido el costo de inferencia por token individual a aproximadamente 1/35 de la plataforma de la generación anterior a través de actualizaciones arquitectónicas, mejorando sustancialmente la eficiencia del rendimiento de inferencia.
El diseño de NeMoClaw aprovecha aún más el potencial del hardware desde el nivel de software. A través de la optimización sistemática de la planificación de tareas de los agentes, las llamadas a herramientas, la gestión del contexto y las rutas de razonamiento, permite que la misma potencia de cálculo admita más tareas, logrando la máxima eficiencia mediante la sinergia entre software y hardware.
Este lanzamiento es un paso clave para Nvidia en el perfeccionamiento de su ecosistema de software NeMo, llenando un vacío en la capa de desarrollo de agentes. En los últimos años, Nvidia ha creado una pila de software de IA completa en torno a CUDA, TensorRT, NIM y NeMo, con el objetivo de convertirse en una plataforma de enlace completo que abarque el entrenamiento de modelos, el despliegue de inferencias y el desarrollo de aplicaciones empresariales.
A medida que los agentes se convierten en el vehículo principal para las aplicaciones de IA, los marcos de desarrollo están emergiendo como las nuevas puertas de acceso al ecosistema. La alianza con LangChain permite a Nvidia integrar sus capacidades en los flujos de trabajo de IA empresarial a través de los marcos de trabajo convencionales, compitiendo por el dominio en la era de los agentes más allá de la mera infraestructura.
Para los mercados de capitales, este diseño estratégico es de gran importancia. La competencia actual en la infraestructura de IA está madurando, y depender únicamente de las ventas de GPU dificulta sostener la expansión de las valoraciones, mientras que los servicios de software y plataformas ofrecen mayores márgenes brutos y fidelidad de los clientes.
Al perfeccionar el ecosistema NeMo y expandirse hacia los estándares de agentes, Nvidia está evolucionando de ser un proveedor de hardware a una plataforma de ecosistema de IA de pila completa, sentando las bases para capturar más ingresos por software y primas de ecosistema en el futuro.
Actualmente, empresas como Abridge, Amdocs y Box han integrado agentes especializados en sus plataformas, mientras que integradores de sistemas como EY están expandiendo sus capacidades de despliegue de tecnología de Nvidia en torno al diseño de NeMoClaw para ayudar a los clientes a personalizar, evaluar y gobernar agentes dentro de flujos de trabajo de alto valor.
A largo plazo, el movimiento de Nvidia no solo tiene como objetivo capturar cuota de mercado en la era de los agentes, sino también construir una barrera de ecosistema de IA inquebrantable.
A través de una solución de pila completa que presenta una sinergia entre software y hardware, Nvidia está fidelizando firmemente a los clientes dentro de su ecosistema tecnológico, consolidando su posición central en la cadena de la industria de la IA y preparándose por completo para la próxima explosión de las aplicaciones de IA.
Este contenido ha sido traducido por IA y revisado por humanos. Se ofrece solo con fines de referencia e información general, y no constituye asesoramiento en materia de inversión.
Artículos Recomendados












Comentarios (0)
Haga clic en el botón $, introduzca el símbolo y seleccione si desea vincular una acción, un ETF o otro valor.