tradingkey.logo
tradingkey.logo
Buscar

Los costos de inferencia se desploman un 90%. Nvidia se asocia con LangChain para definir los estándares de agentes, apoderándose del nuevo punto de entrada para las aplicaciones de IA

TradingKey9 de jul de 2026 10:35
facebooktwitterlinkedin
Ver todos los comentarios0

El 8 de julio, NVIDIA y LangChain lanzaron el blueprint NeMoClaw Deep Agents, marcando la transición de NVIDIA hacia una plataforma de ecosistema integral. Esta arquitectura abierta prioriza la gobernanza, controlabilidad y seguridad de agentes empresariales, permitiendo personalización sin depender de sistemas cerrados. La solución destaca por reducir los costos de inferencia hasta un 90% mediante la sinergia entre software optimizado y hardware Blackwell. Esta estrategia trasciende la venta de GPU, fortaleciendo el software NeMo para capturar mayores márgenes, fidelizar clientes y establecer una barrera competitiva esencial ante la adopción masiva de agentes autónomos.

Resumen generado por IA

TradingKey - El 8 de julio, NVIDIA ( NVDA) y el marco de desarrollo de IA LangChain lanzaron conjuntamente el diseño de referencia NVIDIA NeMoClaw Deep Agents. Este movimiento representa la expansión integral de NVIDIA, pasando de ser un mero proveedor de potencia de cálculo de IA a convertirse en una plataforma de ecosistema que define los estándares de desarrollo de Agents de nivel empresarial, abriendo un nuevo espacio de crecimiento para su negocio de software.

El diseño de referencia proporciona a las empresas una arquitectura de referencia de agentes de IA abierta, personalizable y gobernable, con el objetivo de resolver desafíos fundamentales como la controlabilidad, la gobernanza y la evolución continua a los que se enfrentan las empresas en la implementación de agentes.

En lugar de simplemente mejorar las capacidades del modelo, este diseño de referencia enfatiza las capacidades de ingeniería de software de los Agents de nivel empresarial. Los datos oficiales muestran que esta solución no solo logra un rendimiento líder en múltiples pruebas de rendimiento, sino que también reduce los costos de inferencia de los Agents en más de 10 veces. De este modo, forma una sinergia de hardware y software con la plataforma de inferencia Blackwell para reducir aún más los costos de implementación de aplicaciones de IA.

A medida que la IA generativa avanza desde la generación de contenido hasta la ejecución autónoma de tareas, los Agents se están convirtiendo en la forma central de las aplicaciones de IA empresarial. Sin embargo, las empresas aún enfrentan desafíos como la seguridad, la controlabilidad y la dificultad de integración con los procesos comerciales durante el proceso de implementación.

El núcleo del diseño de referencia recientemente lanzado no es construir un nuevo marco de trabajo de Agents, sino proporcionar una arquitectura de referencia completa de nivel empresarial. Basado en la colaboración con LangChain, el diseño de referencia adopta un diseño de arquitectura abierta, lo que permite a las empresas tener un control total sobre el sistema subyacente, personalizar las capacidades de los Agents e iterar continuamente a medida que crece su negocio, en lugar de depender de una plataforma cerrada.

Enfoque en la gobernanza de agentes: resolución de puntos críticos en el despliegue de nivel empresarial

En lugar de enfatizar "qué tareas puede realizar un Agente", la solución introducida por NVIDIA esta vez se centra más en cómo se gobiernan, supervisan, auditan y optimizan continuamente los Agentes. Esta capacidad es especialmente crítica para industrias altamente reguladas como las finanzas, la atención médica y el sector gubernamental, y también reduce el umbral para que las empresas desplieguen Agentes a gran escala.

Harrison Chase, cofundador y CEO de LangChain, señaló: "La clave para crear mejores agentes es la mejora continua de los sistemas que rodean a los modelos. Cuando los equipos pueden ajustar simultáneamente la memoria, el uso de herramientas, la evaluación y el comportamiento del modelo, estas capacidades generan efectos sinérgicos. Nuestra colaboración con NVIDIA demuestra que las empresas no solo pueden lograr un rendimiento potente a través de una pila abierta, sino también mantener el control sobre los sistemas de agentes que construyen".

A medida que los Agentes asumen tareas de riesgo cada vez más alto, pasando de ser asistentes que responden preguntas a ejecutores capaces de tomar medidas dentro de los sistemas principales, las exigencias de las empresas en cuanto a la controlabilidad y seguridad de los sistemas de IA están aumentando.

La arquitectura abierta que proporciona el diseño de NeMo Guardrails permite a las empresas poseer la pila tecnológica completa de extremo a extremo, lo que les permite personalizar y mejorar continuamente en función de sus ventajas profesionales únicas, y ejecutar en cualquier entorno, incluidos su propia infraestructura, nubes privadas y marcos de gobernanza propios.

Reducción de costos mediante la sinergia entre hardware y software

El control de costos siempre ha sido el cuello de botella principal para la comercialización a gran escala de la IA, y el diseño de NeMoClaw demuestra una ventaja significativa en este sentido.

Según los datos de evaluación publicados por LangChain, el modelo Nemotron 3 Ultra, equipado con la suite Deep Agents, logró una puntuación integral de 0.86, con un costo de inferencia por tarea única de solo 4.48 dólares, mientras que el modelo de la competencia más cercano costaba hasta 43.48 dólares, lo que representa una reducción de aproximadamente el 90%. Este logro no se debió al reentrenamiento del modelo en sí, sino que se consiguió optimizando las estrategias de llamada a herramientas, los mecanismos de gestión del contexto y los flujos de trabajo de razonamiento intermedio.

A nivel de hardware, la arquitectura Blackwell de Nvidia ya ha reducido el costo de inferencia por token individual a aproximadamente 1/35 de la plataforma de la generación anterior a través de actualizaciones arquitectónicas, mejorando sustancialmente la eficiencia del rendimiento de inferencia.

El diseño de NeMoClaw aprovecha aún más el potencial del hardware desde el nivel de software. A través de la optimización sistemática de la planificación de tareas de los agentes, las llamadas a herramientas, la gestión del contexto y las rutas de razonamiento, permite que la misma potencia de cálculo admita más tareas, logrando la máxima eficiencia mediante la sinergia entre software y hardware.

Este lanzamiento es un paso clave para Nvidia en el perfeccionamiento de su ecosistema de software NeMo, llenando un vacío en la capa de desarrollo de agentes. En los últimos años, Nvidia ha creado una pila de software de IA completa en torno a CUDA, TensorRT, NIM y NeMo, con el objetivo de convertirse en una plataforma de enlace completo que abarque el entrenamiento de modelos, el despliegue de inferencias y el desarrollo de aplicaciones empresariales.

A medida que los agentes se convierten en el vehículo principal para las aplicaciones de IA, los marcos de desarrollo están emergiendo como las nuevas puertas de acceso al ecosistema. La alianza con LangChain permite a Nvidia integrar sus capacidades en los flujos de trabajo de IA empresarial a través de los marcos de trabajo convencionales, compitiendo por el dominio en la era de los agentes más allá de la mera infraestructura.

Para los mercados de capitales, este diseño estratégico es de gran importancia. La competencia actual en la infraestructura de IA está madurando, y depender únicamente de las ventas de GPU dificulta sostener la expansión de las valoraciones, mientras que los servicios de software y plataformas ofrecen mayores márgenes brutos y fidelidad de los clientes.

Al perfeccionar el ecosistema NeMo y expandirse hacia los estándares de agentes, Nvidia está evolucionando de ser un proveedor de hardware a una plataforma de ecosistema de IA de pila completa, sentando las bases para capturar más ingresos por software y primas de ecosistema en el futuro.

Actualmente, empresas como Abridge, Amdocs y Box han integrado agentes especializados en sus plataformas, mientras que integradores de sistemas como EY están expandiendo sus capacidades de despliegue de tecnología de Nvidia en torno al diseño de NeMoClaw para ayudar a los clientes a personalizar, evaluar y gobernar agentes dentro de flujos de trabajo de alto valor.

A largo plazo, el movimiento de Nvidia no solo tiene como objetivo capturar cuota de mercado en la era de los agentes, sino también construir una barrera de ecosistema de IA inquebrantable.

A través de una solución de pila completa que presenta una sinergia entre software y hardware, Nvidia está fidelizando firmemente a los clientes dentro de su ecosistema tecnológico, consolidando su posición central en la cadena de la industria de la IA y preparándose por completo para la próxima explosión de las aplicaciones de IA.

Este contenido ha sido traducido por IA y revisado por humanos. Se ofrece solo con fines de referencia e información general, y no constituye asesoramiento en materia de inversión.

Leer el original
Descargo de responsabilidad: El contenido de este artículo representa únicamente las opiniones personales del autor, y no refleja la postura oficial de Tradingkey. No debe considerarse como un consejo de inversión. El artículo tiene fines de referencia únicamente, y los lectores no deben basar ninguna decisión de inversión únicamente en su contenido. Tradingkey no se responsabiliza de los resultados comerciales derivados de la confianza en este artículo. Además, Tradingkey no puede garantizar la precisión del contenido del artículo. Antes de tomar cualquier decisión de inversión, es aconsejable consultar con un asesor financiero independiente para comprender por completo los riesgos asociados.

Comentarios (0)

Haga clic en el botón $, introduzca el símbolo y seleccione si desea vincular una acción, un ETF o otro valor.

0/500
Normas para comentar
Cargando...

Artículos Recomendados

tradingkey.logo
Advertencia de Riesgo: Nuestro sitio web y aplicación móvil solo proporcionan información general sobre ciertos productos de inversión. Finsights no proporciona, y la provisión de dicha información no debe interpretarse como que Finsights proporciona, asesoramiento financiero o recomendación para cualquier producto de inversión.
Los productos de inversión están sujetos a riesgos de inversión significativos, incluida la posible pérdida del monto principal invertido y pueden no ser adecuados para todos. El rendimiento pasado de los productos de inversión no es indicativo de su rendimiento futuro.
Finsights puede permitir que anunciantes o afiliados de terceros coloquen o entreguen anuncios en nuestro sitio web o aplicación móvil o en cualquier parte de los mismos y puede ser compensado por ellos en función de su interacción con los anuncios.
© Derechos de autor: FINSIGHTS MEDIA PTE. LTD. Todos los derechos reservados.