Blog IAExpertos

Descubre las últimas tendencias, guías y casos de estudio sobre cómo la Inteligencia Artificial está transformando los negocios.

Inteligencia Artificial 22/9/2026

Anthropic lanza Claude Opus 5.5: rendimiento de Fable 5.1 con un 40% menos de coste

Anthropic lanza Claude Opus 5.5: rendimiento de Fable 5.1 con un 40% menos de coste Generada con IA

1. Resumen Ejecutivo

Anthropic ha presentado Claude Opus 5.5, el primer modelo de su nueva familia Claude 5.5. La compañía sitúa su rendimiento al nivel de Claude Fable 5.1 en la mayor parte de las tareas y cifra el ahorro de coste de ejecución en un 40% frente a Opus 5. Se trata del primer lanzamiento de Anthropic desde su llamamiento público a «marcar el ritmo de la frontera», una postura con la que la compañía pide moderar la velocidad de despliegue de los modelos más capaces.

El modelo fue evaluado antes de su publicación por evaluadores externos, entre ellos Frontier Design y METR. En la auditoría automatizada de comportamiento de Anthropic —la prueba de alineación más completa que la compañía ejecuta— Opus 5.5 obtiene la mejor puntuación registrada hasta la fecha por un modelo de Anthropic. La compañía lo despliega con las salvaguardas reservadas a sus modelos más capaces.

El lanzamiento incluye tres ejes de mejora declarados: rendimiento, seguridad y relación coste-velocidad. Anthropic ha confirmado además que Claude Sonnet 5.5 y Claude Haiku 5.5 llegarán en las próximas semanas con mejoras equivalentes en eficiencia y seguridad.

Comunidad Oficial IAExpertos
Alertas de última hora en IA y chollos tech exclusivos en tiempo real.

2. Análisis Técnico: Rendimiento y Benchmarks

Anthropic publica una batería de benchmarks en la que Opus 5.5 lidera las categorías de codificación agéntica, uso de ordenador y trabajo de conocimiento. La compañía matiza, no obstante, que a estos niveles de capacidad los márgenes entre benchmarks han dejado de ser una guía fiable de las diferencias reales: en su propio uso interno, la distancia entre Opus 5.5 y Claude Fable 5.1 es menor de lo que sugieren las puntuaciones.

Área y benchmark Opus 5.5 Fable 5.1 Opus 5 GPT-6 Astra
Codificación agéntica · Terminal-Bench 4.0 66,4% 55,8% 52,3% 57,9%
Codificación agéntica · FrontierCode v1.1 54,4% 50,3% 48,0% 53,3%
Codificación agéntica · CursorBench 4.0 57,8% 51,8% 46,6%
Trabajo de conocimiento · GDPval-AA v2.1 1846 1735 1708 1542
Flujos de negocio · AutomationBench 40,0% 31,4% 26,9% 41,4%
Razonamiento multidisciplinar · Humanity's Last Exam 67,7% 65,6% 63,6% 57,2%
Investigación científica agéntica · Terminal-Bench-Science 0.1 58,7% 52,6% 29,0% 64,6%
Uso de ordenador · OSWorld 2.0 81,8% 80,7% 74,0%
Reconocimiento visual de gráficos · Chartography 89,0% 88,4% 83,4%

Anthropic acompaña las cifras con casos de uso reportados por probadores tempranos. Uno de ellos completó una migración de código de 680.000 líneas en menos de un día, un trabajo que la compañía estima que habría requerido semanas a un equipo de ingeniería. En una prueba de optimización de tiempos de carga sobre todas las páginas de una aplicación web, Opus 5.5 tuvo éxito en 39 de 40 intentos, mientras que Opus 5 logró mejoras menores que además alteraron el comportamiento de la aplicación. En una prueba separada en la que varios modelos de Claude debían construir un juego a partir de una única instrucción, Opus 5.5 obtuvo la puntuación más alta por la calidad de sus gráficos y su acabado.

Conviene señalar el matiz metodológico que la propia Anthropic introduce: los resultados de OSWorld 2.0, Humanity's Last Exam y Chartography corresponden a la modalidad «con herramientas» o parcial, según el caso, y no a ejecución sin asistencia. Las cifras de Terminal-Bench-Science 0.1 sitúan a GPT-6 Astra por delante de Opus 5.5 en esa categoría concreta, algo que la tabla oficial recoge sin ocultarlo.

3. Seguridad y Evaluación de Alineación

El apartado de seguridad concentra buena parte del mensaje de Anthropic. Opus 5.5 obtiene la mejor puntuación hasta la fecha en la auditoría automatizada de comportamiento de la compañía, un conjunto de pruebas de alineación que somete al modelo a miles de escenarios simulados. Según la documentación publicada, el modelo es menos propenso que los recientes a ejecutar acciones difíciles de revertir o a actuar fuera de los límites que se le han asignado, y presenta mayor resistencia a la inyección de instrucciones que Opus 5.

Anthropic ha ampliado el alcance de sus pruebas de alineación para cubrir tareas de mayor duración, tareas imposibles y escenarios modelados a partir de incidentes reales. La compañía reconoce explícitamente que el modelo «todavía tiene límites» y remite al System Card de Opus 5.5 para el detalle completo de la evaluación, que no se ha hecho público en forma de resumen de cifras en el anuncio.

Por su comportamiento declarado en biología y ciberseguridad, comparable al de Claude Mythos 5.1, Anthropic despliega Opus 5.5 con salvaguardas similares a las de Claude Fable 5.1. Las organizaciones verificadas pueden solicitar desde hoy el acceso a través del programa Life Sciences Verification Program para investigación biológica. La compañía ampliará en las próximas semanas el Cyber Verification Program, de modo que los profesionales de ciberseguridad acreditados puedan utilizar Opus 5.5 en su trabajo.

4. Coste, Velocidad y Disponibilidad

El argumento económico es explícito: Opus 5.5 consume menos cómputo que Opus 5 y su tarifa lo refleja. Anthropic cifra en un 40% el ahorro en cargas de trabajo típicas con la configuración por defecto. Los tokens de entrada y salida se facturan a 4 y 20 dólares por millón, un 20% menos que Opus 5. La lectura de caché, que según la compañía representa la mayor parte del coste en trabajo agéntico y de codificación, baja a 0,20 dólares por millón de tokens, un 60% menos.

Precio por millón de tokens Claude Opus 5.5 Claude Opus 5
Lectura de caché 0,20 $ 0,50 $
Tokens de entrada 4 $ 5 $
Tokens de salida 20 $ 25 $
Escritura de caché 5 $ 6,25 $

En velocidad, Anthropic afirma que Opus 5.5 genera salida más de un 30% más rápido que Opus 5. La compañía anunció además dos cambios comerciales que acompañan al lanzamiento: un aumento de los límites de uso de cinco horas en los planes Pro, Max, Team y Enterprise con licencia por puesto, y la posibilidad de que los suscriptores guarden un reinicio de límite de velocidad para emplearlo cuando lo consideren oportuno.

El modelo incorpora también un cambio de estilo en la redacción. Los probadores tempranos describen una escritura más clara y fácil de seguir que la de Opus 5, con la información más relevante situada al principio. Anthropic relaciona ese cambio con un beneficio de seguridad además de práctico: un texto más ordenado resulta más sencillo de revisar y verificar.

5. Impacto en el Sector y Hoja de Ruta

El movimiento refuerza la estrategia de Anthropic de competir por eficiencia y no solo por capacidad bruta. La rebaja del coste de lectura de caché es significativa para el segmento que más consume: agentes autónomos y asistentes de código, donde el coste acumulado procede mayoritariamente de releer contexto. Un recorte del 60% en ese concepto incide de forma directa en la economía de los despliegues en producción, más que una mejora puntual de benchmark.

La comparativa publicada por Anthropic sitúa a Opus 5.5 por delante de GPT-6 Astra y GPT-5.6 Sol en la mayoría de las categorías, aunque con excepciones notables: GPT-6 Astra supera a Opus 5.5 en AutomationBench (41,4% frente a 40,0%) y en Terminal-Bench-Science 0.1 (64,6% frente a 58,7%). La compañía no oculta esas casillas en su propia tabla, lo que refuerza la credibilidad del resto de las cifras.

La hoja de ruta anunciada contempla Claude Sonnet 5.5 y Claude Haiku 5.5 en las próximas semanas, con mejoras equivalentes en rendimiento, eficiencia y seguridad. Con ello, Anthropic extiende las capacidades de Opus 5.5 a los tramos de precio intermedio y bajo de su catálogo, que son los que sostienen el volumen de uso en aplicaciones comerciales.

El llamamiento de Anthropic a «marcar el ritmo de la frontera», junto con la evaluación externa por parte de METR y Frontier Design, dibuja una postura diferenciada en el sector: la compañía presenta la moderación en el despliegue como parte de su propuesta de valor. El anuncio no detalla compromisos de transparencia adicionales sobre el System Card ni plazos concretos más allá de la publicación de las variantes Sonnet y Haiku.

6. Conclusión

Claude Opus 5.5 es un lanzamiento orientado a economizar sin degradar prestaciones. Anthropic lo sitúa al nivel de Fable 5.1 en la mayoría de las tareas, con un ahorro declarado del 40% en coste de ejecución y una mejora superior al 30% en velocidad de generación. Los precios publicados —4 dólares por millón de tokens de entrada y 20 por salida, con la lectura de caché a 0,20— son datos concretos y verificables en la documentación oficial.

Para los equipos que ya operan agentes o asistentes de código en producción, la partida más relevante de este anuncio no es la mejora en los benchmarks, sino el recorte del coste de lectura de caché, precisamente el que domina la factura en esas cargas. La combinación de menor coste y mayor velocidad de salida es la que puede traducirse en decisiones de adopción a corto plazo.

Las preguntas abiertas son dos. La primera, cuánto de la ventaja sobre GPT-6 Astra se sostiene en escenarios de uso real: la propia Anthropic advierte que a este nivel de capacidad los márgenes de benchmark orientan poco. La segunda, hasta qué punto las salvaguardas de acceso restringido condicionan su adopción en ciberseguridad y ciencias de la vida, donde el modelo requiere verificación previa por parte de la compañía.

Fuente Original y Referencia Técnica
theverge.com
Verificación Editorial
Publicación contrastada en theverge.com
Consultar fuente oficial

Compromiso editorial de IAExpertos.net

Este artículo ha sido elaborado por el equipo editorial de IAExpertos.net tomando como punto de partida fuentes informativas y documentación verificadas. A partir de ellas, utilizamos herramientas de inteligencia artificial para estructurar, ampliar y contextualizar la información. Antes de su publicación, todo el contenido es revisado y validado por el equipo editorial.

Partners IAExpertos.net
BuscoMovil.es Banner

BuscoMovil.es

El comparador inteligente de los smartphones más potentes del mercado. Encuentra las mejores ofertas de las marcas líderes.

Visitar Buscomovil.es
🔥

Ofertas Exclusivas de Tecnología en Amazon

Descuentos Activos
IAExpertos Logo

Canal Oficial de Telegram

Únete a nuestro canal para recibir las últimas noticias sobre IA y ofertas exclusivas de hardware y tecnología recomendadas por IAExpertos.

IAExpertos Logo

Canal Oficial de WhatsApp

Sigue nuestro canal de WhatsApp para recibir alertas en tiempo real y chollos tech exclusivos recomendados por IAExpertos.

¿Quieres ser el primero en leer nuestros artículos?

Suscríbete y te avisamos cuando publiquemos nuevo contenido.