Anthropic publicó Opus 5.5 el 22 de septiembre de 2026

Claude Opus 5.5más trabajo, menos tokens

El primer modelo de la familia Claude 5.5. Alcanza el nivel de Claude Fable 5.1 en la mayoría de las tareas, cuesta un 40 % menos de ejecutar que Opus 5 y genera la salida más de un 30 % más rápido.

22 sep
Lanzamiento 2026
Primer modelo de la familia Claude 5.5
4 $ / 20 $
API entrada / salida
Por millón de tokens, frente a 5 $ / 25 $ de Opus 5
medium
Effort por defecto
Un nivel por debajo de Opus 5, que arranca en high
1 M / 128 K
Contexto / salida máxima
Misma ventana que Opus 5, conocimientos hasta junio de 2026

Ya disponible en la búsqueda de Felo

Pasa el expediente completo y luego pregunta.

Claude Opus 5.5 está disponible en la búsqueda de Felo para tareas con entradas largas: cuadrar cifras entre archivos, rastrear una afirmación hasta su fuente y devolver una respuesta que puedas pasar a otra persona.

Probar Opus 5.5 en la búsqueda de Felo

01

Sostener todo el contexto

Una ventana de contexto de un millón de tokens y conocimientos hasta junio de 2026. Un hilo largo, un repositorio entero o un conjunto de documentos caben en una sola tarea.

02

Comprobar la cifra, no solo la conclusión

En una prueba interna de Anthropic, 16 de 18 informes superaron el listón de calidad. Una sola cifra o cita inventada habría hecho fracasar el ejercicio.

03

Decir qué hizo y qué necesita

Anthropic rehizo la forma de comunicarse del modelo: lo más importante va primero y el informe dice sin rodeos qué está hecho, qué se encontró y qué queda abierto.

Guía rápida

Cambiar a Claude Opus 5.5 en Felo

Claude Opus 5.5 aparece en el selector de modelos junto a los demás modelos punteros de tu cuenta.

Abre el selector de modelos, elige Claude Opus 5.5 y empieza la tarea en el mismo espacio de trabajo.

La diferencia de Opus 5.5

La bajada de coste es el argumento.

Anthropic pone el foco en la eficiencia y no en una puntuación más alta: menos tokens por tarea, un precio por token más bajo y un 40 % menos de coste en cargas de trabajo típicas. Eso es lo que hace pagable dejar un agente trabajando durante horas.

01

Terminar el trabajo descomunal

Anthropic cuenta que un probador auditó y corrigió una base de código de 200.000 líneas en menos de tres horas, donde Opus 5 tardaba más de 20 horas y usaba 2,5 veces más tokens.

02

Cazar el error antes del merge

Deloitte informó de que, en el nivel de effort más bajo, Opus 5.5 detectó el 72 % de los errores conocidos en revisión de código, frente al 56 % de Opus 5 en high, con menos falsos positivos.

03

Dejar un informe que se pueda usar

Sus textos son más cortos y están mejor estructurados. Box informó de respuestas un 40 % menos verbosas sin perder precisión y con un tercio de los tokens de Opus 5.

Elección de modelo

Compara el coste de un token con el coste de equivocarse.

Los precios de abajo son tarifas públicas oficiales de la API por millón de tokens, no precios de suscripción ni de uso de Felo. La fila de effort importa tanto como la de precio: el mismo prompt puede costar muy distinto según dónde arranque cada modelo.

Factor de decisión
Claude Opus 5.5
Claude Fable 5.1
Claude Opus 5
GPT-6 Astra
Precio de API / millón de tokens
4 $ entrada / 20 $ salida
10 $ entrada / 50 $ salida
5 $ entrada / 25 $ salida
10 $ entrada / 50 $ salida
Lectura de caché / millón de tokens
0,20 $, 0,05 veces el precio de entrada
0,25 $, 0,025 veces el precio de entrada
0,50 $, el factor estándar de 0,1
Varía según el proveedor y el nivel de caché
Effort por defecto
medium. El razonamiento adaptativo está siempre activo y no se puede desactivar.
high. El razonamiento adaptativo está siempre activo.
high. El razonamiento se puede desactivar hasta high incluido.
Lo fija quien llama en cada petición
Dónde aporta valor
Programación agéntica de larga duración, revisión de código y trabajo de conocimiento a precio de gama media.
El razonamiento más difícil y las ejecuciones de agente más largas, cuando Opus 5.5 no llega ni con más effort.
La referencia Opus anterior. Compara su disponibilidad y latencia reales con tu propio tráfico.
La gama alta de OpenAI, en lo más alto de la tabla de precios.

Las tarifas públicas de la API y los valores por defecto se comprobaron el 23 de septiembre de 2026 en el anuncio de Claude Opus 5.5 de Anthropic, las páginas de modelos de Claude Platform y la página de GPT-6 Astra de OpenAI. El precio por token es solo una parte del coste total de una tarea. La afirmación de eficiencia de Anthropic es una bajada del 40 % en cargas típicas, que combina un precio por token menor con menos tokens por tarea.

Resultados publicados por Anthropic

Dónde lidera Opus 5.5 y dónde no.

Anthropic publicó sus propias cifras junto a Fable 5.1, Opus 5, GPT-6 Astra y GPT-5.6 Sol. Dos de los cuatro gráficos de abajo muestran precisión frente a coste por tarea en lugar de precisión a secas, porque esa es justo la comparación que plantea Anthropic.

Tabla comparativa publicada por Anthropic para Claude Opus 5.5 frente a Fable 5.1, Opus 5, GPT-6 Astra y GPT-5.6 Sol

La comparativa publicada al completo

Programación agéntica, trabajo de conocimiento, flujos de negocio, razonamiento multidisciplinar, investigación científica, uso del ordenador y lectura de gráficos, en los cinco modelos medidos.

Gráficos de programación agéntica publicados por Anthropic para Claude Opus 5.5

Programación agéntica

Terminal-Bench 4.0, FrontierCode v1.1 y CursorBench 4.0, representados como precisión frente a coste por tarea.

Gráficos de trabajo de conocimiento publicados por Anthropic para Claude Opus 5.5

Trabajo de conocimiento

GDPval-AA v2.1 en 44 ocupaciones, AutomationBench y WANDR, el benchmark de recogida de datos de Perplexity.

Gráficos de uso del ordenador y razonamiento publicados por Anthropic para Claude Opus 5.5

Uso del ordenador y razonamiento

OSWorld 2.0, Humanity's Last Exam y Chartography, este último mide la precisión al leer valores de un gráfico.

Gráficos de precisión frente a coste por tarea publicados por Anthropic para Claude Opus 5.5

Precisión frente a coste por tarea

La tesis central de Anthropic no es una puntuación más alta a cualquier precio, sino la misma puntuación o mejor por una fracción del coste por intento.

Cifras publicadas por el fabricante. Salvo que se indique lo contrario, Anthropic ejecutó Opus 5.5 con razonamiento adaptativo en max effort y lo evaluó con las protecciones de producción activadas. Cuando esas protecciones intervinieron, las tareas de ciberseguridad las completó Opus 4.8 y las de biología Opus 5, lo que probablemente rebaja las cifras publicadas de Opus 5.5 en esos benchmarks. Las cifras de GPT-6 Astra y GPT-5.6 Sol son las que reporta OpenAI. Las diferencias de benchmark entre fabricantes son una señal débil de las diferencias reales, algo que la propia Anthropic dice de estos números.

Si ya ejecutas Opus 5

Cuatro cambios que rompen el código existente.

Anthropic enumera cuatro cambios incompatibles para integraciones que ya corren sobre Claude Opus 5, más un quinto que altera la forma de la respuesta sin hacer fallar ninguna petición. Merece la pena leerlos antes de cambiar el ID del modelo, porque tres de ellos devuelven un error 400 en lugar de degradarse en silencio.

01

El razonamiento ya no se puede desactivar

En Opus 5 se podía desactivar el razonamiento hasta high incluido. En Opus 5.5 está siempre activo, y tanto la desactivación como un presupuesto manual de tokens devuelven un error 400. El effort pasa a ser el único control, y su valor por defecto cambia de high a medium.

thinking: {"type": "disabled"} -> 400 invalid_request_error

02

El uso forzado de herramientas se rechaza

tool_choice con "any" o con una herramienta concreta devuelve un error 400, también en el endpoint de conteo de tokens. Usa auto junto con uso estricto de herramientas o salidas estructuradas, y di en el prompt cuándo toca usar la herramienta.

tool_choice: {"type": "tool", "name": "..."} -> 400 invalid_request_error

03

Los bloques de razonamiento van atados al modelo

Cada bloque de razonamiento registra qué modelo lo produjo. Opus 5.5 lee los bloques de Opus 5 y de modelos Opus, Sonnet y Haiku anteriores, pero no los de Fable ni Mythos. Si un enrutador mueve la conversación a otro modelo, los turnos siguientes se ejecutan sin el razonamiento previo.

Opus 5.5 -> Fable 5.1 / Mythos 5.1 conservan el razonamiento; los demás modelos lo pierden

04

La herramienta antigua de uso del ordenador desaparece

En la API de Claude y Google Cloud, la herramienta computer_20251124 devuelve un error 400. Declara en su lugar el toolset computer_toolset_20260801, quita la cabecera beta y adapta el bucle del agente a los bloques member tool_use. En Amazon Bedrock la herramienta antigua sigue funcionando.

computer_20251124 -> computer_toolset_20260801

El effort es ahora el único control del razonamiento

Como el razonamiento no se puede desactivar, lo que se ajusta es el effort. Opus 5.5 admite los cinco niveles y arranca en medium, un nivel por debajo de Opus 5. La recomendación de Anthropic es repetir el barrido sobre tus propias evaluaciones en lugar de arrastrar un ajuste, y poner un max_tokens amplio en los niveles altos, porque los tokens de razonamiento cuentan para ese límite aunque no se devuelva el texto del razonamiento.

Nivel
Por defecto
Uso recomendado por Anthropic
low
No
El nivel más eficiente, con cierta pérdida de capacidad. Anthropic lo recomienda para tareas sencillas y subagentes.
medium
Sí
El valor por defecto de Opus 5.5. Según Anthropic, iguala o supera a Opus 5 en high en las evaluaciones de programación y trabajo de conocimiento.
high
No
El valor por defecto de la mayoría de los demás modelos Claude. Razonamiento complejo y problemas de programación difíciles.
xhigh
No
Trabajo agéntico y de programación de largo recorrido, de más de 30 minutos, con presupuestos de tokens en millones.
max
No
El razonamiento más profundo disponible, sin límite de gasto de tokens. Resérvalo para trabajos donde hayas medido una mejora de calidad.

El effort es una señal de comportamiento, no un presupuesto estricto de tokens: en un nivel bajo el modelo sigue razonando ante problemas realmente difíciles, solo que menos que en uno alto. Anthropic también señala que Opus 5.5 tiende a pensar más por turno que Opus 5 en el mismo nivel, sobre todo en xhigh y max, así que un ajuste heredado de Opus 5 producirá turnos más largos y más caros.

Dónde encaja

Trabajo demasiado largo para vigilarlo.

Opus 5.5 aporta valor cuando una tarea dura horas, abarca más archivos de los que una persona puede retener o produce algo que otra persona tiene que revisar. Son los casos que describen Anthropic y sus primeros probadores, no prompts de chat genéricos.

Migraciones y auditorías de todo el repositorio

Llevar un cambio por todo un repositorio grande hasta que pasen las pruebas, en lugar de parar en el primer parche que parece funcionar. Anthropic informa de una migración de 680.000 líneas terminada en menos de un día por un probador.

Revisión de código que encuentra el error real

Column, uno de los probadores citados por Anthropic, informó de que detectó un error consultando documentación externa de una integración de terceros que se había modelado mal varios commits antes.

Análisis financiero y de documentos

Construir el modelo y después el resumen de una página, manteniendo las salvedades. Anthropic informa de un análisis de fusión resuelto en 63 minutos frente a 93 de Opus 5, por la mitad de coste.

Equipos de agentes de larga duración

Delega en subagentes y ajusta su ritmo a un presupuesto de tiempo. Anthropic recomienda dar a una arquitectura multiagente una señal de tiempo transcurrido para que paralelice en vez de serializar.

Pruébalo con una tarea larga

01

Trae el contexto real

Añade el repositorio, los documentos y los requisitos que una respuesta útil tiene que tener en cuenta. La ventana de un millón de tokens está para eso.

02

Indica la condición de fin

Di qué tiene que cumplirse para dar el trabajo por terminado. El consejo de Anthropic para ejecuciones sin supervisión es mantener las partes de la tarea en una lista que el modelo actualice.

03

Compara el entregable final

Lanza la misma tarea en Opus 5.5, Opus 5 y Fable 5.1 dentro de Felo. Compara las pruebas, las salvedades y el consumo de tokens, no solo la respuesta.

Selecciona Claude Opus 5.5 cuando aparezca en el selector de modelos de tu cuenta.

Probar Opus 5.5 en Felo

Preguntas frecuentes sobre Claude Opus 5.5

Claude Opus 5.5 es el modelo de Anthropic para programación agéntica de larga duración y trabajo de conocimiento, publicado el 22 de septiembre de 2026 como primer modelo de la familia Claude 5.5. Según Anthropic, alcanza el nivel de Claude Fable 5.1 en la mayoría de las tareas y cuesta un 40 % menos de ejecutar que Claude Opus 5.

Ejecuta la tarea larga a menor precio.

Pon Claude Opus 5.5 junto a los demás modelos punteros en Felo y pruébalo con ese trabajo que llevas aplazando porque lleva horas.

Probar Opus 5.5 en Felo

Empieza en la búsqueda de Felo AI y selecciona el modelo donde esté disponible.