Anthropic presenta Claude Opus 5.5: costos un 40 % más bajos, mayor velocidad, seguridad mejorada y mayores capacidades para tareas de larga duración
El 22 de septiembre, hora del Este de Estados Unidos, Anthropic lanzó Claude Opus 5.5, mejorando la gestión de tareas complejas, reduciendo un 40% el costo por tarea y aumentando la velocidad de salida un 30%. El modelo destaca en programación a gran escala, análisis financiero e investigación, reduciendo errores y optimizando la caché. Además, refuerza la seguridad con auditorías automatizadas que limitan desvíos operativos, aunque mantiene restricciones estrictas en ciberseguridad y biología. Estas mejoras posicionan a la herramienta como un socio colaborador eficiente para entornos corporativos.

TradingKey - El 22 de septiembre, hora del Este de Estados Unidos, Anthropic anunció el lanzamiento de Claude Opus 5.5, que se centra en tres aspectos principales: una mayor capacidad para gestionar tareas complejas, menores costos operativos y un uso más seguro. En comparación con Opus 5, el costo por tarea se ha reducido un 40% y su velocidad de salida ha aumentado más de un 30%; asimismo, los precios de entrada, salida y lectura de caché se han reducido de forma simultánea.
Lo más destacable de esta actualización tal vez no sea ocupar el primer puesto en una sola prueba de rendimiento, sino que está empezando a comportarse más como un socio colaborador a largo plazo. Puede gestionar migraciones de código a gran escala, organizar materiales empresariales y generar informes analíticos, al tiempo que presenta las respuestas de forma más directa y facilita su revisión.
La programación compleja ahorra más tiempo
La capacidad más destacada de Opus 5.5 se concentra en tareas de programación a gran escala y de múltiples pasos que requieren una verificación continua. En una prueba, Opus 5.5 revisó y corrigió una base de código de 200.000 líneas en menos de 3 horas. Por su parte, Opus 5 tardó más de 20 horas y consumió aproximadamente 2,5 veces más tokens. Para las empresas, esto significa que el valor de la IA no radica solo en "si puede escribir código", sino también en si puede evitar rodeos y ahorrar tiempo.

[Fuente: Anthropic]
Los datos de las pruebas también muestran que Opus 5.5 obtuvo una puntuación del 66,4% en Terminal-Bench 4.0, del 54,4% en FrontierCode v1.1 y del 57,8% en CursorBench 4.0. Si bien estas cifras no pueden representar la totalidad del trabajo en el mundo real, demuestran su mayor capacidad para gestionar tareas de larga duración y de múltiples pasos.
Las capacidades de oficina y de investigación también mejoran
Los casos de uso de Opus 5.5 van más allá de los programadores. Las pruebas de Anthropic abarcan procesos empresariales, trabajo intelectual, investigación científica, manejo de ordenadores y reconocimiento de gráficos.
En la prueba de trabajo intelectual GDPval-AA v2.1, Opus 5.5 obtuvo 1.846 puntos, por encima de los 1.735 puntos de Fable 5.1 y los 1.708 puntos de Opus 5. En la prueba de manejo de ordenadores, su puntuación fue del 81,8%, mientras que alcanzó el 89% en la prueba de reconocimiento de gráficos.
Un detalle de las tareas de investigación resulta especialmente interesante. Los evaluadores pidieron a varios modelos que redactaran informes basados en información de estados financieros difícil de encontrar y que verificaran las cifras y las citas línea por línea. Opus 5.5 cumplió con los estándares de calidad 16 veces bajo diferentes configuraciones, mientras que los otros dos modelos no lograron superarlos ni una sola vez. Esto demuestra que otorga mayor importancia a las pruebas al organizar la información, aunque todavía no puede sustituir la verificación humana.
Por ejemplo, la firma de inversión Walleye Capital le encomendó la tarea de analizar una fusión empresarial ficticia. No solo completó el modelo financiero, sino que también identificó un error en las instrucciones de la prueba y lo corrigió de manera proactiva. Para los usuarios habituales, esta capacidad se traduce en análisis de mercado, organización de presupuestos y materiales de presentación más claros.
La caída de los precios es el cambio clave
Opus 5.5 tiene un precio inferior al de Opus 5. El precio de entrada por millón de tokens ha bajado de 5 a 4 dólares, el precio de salida, de 25 a 20 dólares, y el de la lectura de caché, de 0,50 a 0,20 dólares.

[Fuente: Anthropic]
Las lecturas de caché son especialmente importantes para tareas largas de programación y automatización, ya que muchos flujos de trabajo reutilizan repetidamente contenido que ya ha sido procesado. Tras la rebaja de precios, los equipos pueden permitir con mayor confianza que el modelo ejecute rondas adicionales de comprobación, en lugar de detenerlo prematuramente para ahorrar dinero.
Claude Code y Claude Platform también ofrecen un modo rápido, con velocidades de hasta 2,5 veces las del modo estándar. El precio de entrada del modo rápido es de 8 dólares por millón de tokens y el de salida es de 40 dólares, lo que lo hace adecuado para escenarios con mayores exigencias de velocidad de respuesta.
Las capacidades de seguridad cobran mayor relevancia
Anthropic afirmó que Opus 5.5 logró la mejor puntuación entre los modelos Claude actuales en su auditoría de comportamiento automatizada. Las pruebas abarcaron casi 2.000 escenarios simulados y se centraron en si el modelo traspasaría límites, realizaría acciones difíciles de revertir o se vería influenciado por la inyección de prompts.
En una prueba, Opus 5.5 intentó eludir los límites aproximadamente un 85% menos de veces que Opus 5, y todos los comportamientos relacionados se encuadraron en la categoría de baja gravedad e informaron de problemas de forma proactiva. Sin embargo, Anthropic también reconoció que las pruebas de seguridad no pueden descubrir con antelación todos los riesgos del mundo real.
Por lo tanto, Opus 5.5 ha implementado salvaguardas más strictly en los campos de la ciberseguridad y la biología. La depuración y corrección de errores en el desarrollo habitual de software siguen estando disponibles, pero un gran número de tareas de ciberseguridad se transferirá a otros modelos. Las instituciones que necesiten llevar a cabo investigaciones biológicas deberán solicitar los permisos correspondientes mediante una revisión del proyecto.
Este contenido ha sido traducido por IA y revisado por humanos. Se ofrece solo con fines de referencia e información general, y no constituye asesoramiento en materia de inversión.
Artículos Recomendados













Comentarios (0)
Haga clic en el botón $, introduzca el símbolo y seleccione si desea vincular una acción, un ETF o otro valor.