
Claude Opus 5.5 vs Claude Opus 5: ¿merece la pena actualizar?
400 en Opus 5.5, el effort por defecto baja de high a medium y el modelo piensa más por turno a un nivel de effort dado.La decisión de un vistazo
| Si su situación es | Haga esto | Porque |
|---|---|---|
| Carga nueva, sin base de Opus todavía | Empezar en Opus 5.5 | Valor por defecto recomendado por Anthropic, precio de lista más bajo, mismos límites |
Opus 5 en producción, thinking ya activo, tool_choice: auto | Pilotar 5.5 detrás de un canario | El código suele trasladarse una vez fijado effort explícitamente; revise igualmente los cinco riesgos de abajo (ajustes de thinking, elección de herramienta, texto de progreso, fallback de bloques de thinking, versión de computer use) |
Opus 5 en producción con thinking: disabled o elección forzada de herramienta | Arreglar primero las peticiones, luego pilotar | Ambos patrones devuelven 400 en 5.5 |
| Agente con mucha caché y un prefijo estable grande | Priorizar el piloto | Las lecturas de caché son un 60 % más baratas en 5.5 |
| Cadena de fallback que baja de Opus a Sonnet o Haiku a mitad de conversación | Volver a probar la ruta de fallback | Solo Fable 5.1 y Mythos 5.1 leen bloques de thinking de Opus 5.5 |
| UI de streaming que muestra texto entre llamadas a herramientas | Añadir manejo de thinking.display antes del despliegue | Ese texto ahora llega en bloques de thinking, vacíos por defecto |
| Sensible a la latencia, thinking desactivado por velocidad | Comparar effort low en 5.5 con Opus 5 sin thinking | El thinking no se puede desactivar; el effort es la única palanca |
No hay un ganador incondicional en esta tabla. La actualización compensa cuando su carga es de las que Anthropic optimizó y la forma de sus peticiones ya es compatible; cuando no, primero cuesta tiempo de ingeniería.
Qué cambió Anthropic
| Dimensión | Claude Opus 5 | Claude Opus 5.5 | Documentado en |
|---|---|---|---|
| Lanzamiento | 24 de julio de 2026 | 22 de septiembre de 2026 | Notas de versión |
| ID de modelo | claude-opus-5 | claude-opus-5-5 | Descripción de modelos |
| Entrada / salida | 5 $ / 25 $ por MTok | 4 $ / 20 $ por MTok | Precios |
| Escritura de caché 5m / 1h | 6,25 $ / 10 $ | 5 $ / 8 $ | Precios |
| Lectura de caché | 0,50 $ (10 % de la entrada) | 0,20 $ (5 % de la entrada) | Precios |
| Batch | 2,50 $ / 12,50 $ | 2 $ / 10 $ | Precios |
| Fast mode (solo Claude API) | 10 $ / 50 $ | 8 $ / 40 $ | Precios |
| Contexto / salida máx. | 1M / 128K | 1M / 128K | Descripción de modelos |
| Thinking | Activo por defecto; disabled permitido con effort high o inferior | Siempre activo; disabled y budget_tokens devuelven 400 | What's new |
| Effort por defecto | high | medium | Descripción de modelos |
Elección forzada de herramienta (any, tool) | Soportada | Devuelve 400 | What's new |
| Texto entre llamadas a herramientas | Bloques text | Bloques thinking de progreso, vacíos con la visualización por defecto | What's new |
| Portabilidad de bloques de thinking | Leídos por Opus 5.5, Fable 5.1, Mythos 5.1 | Leídos solo por Fable 5.1 y Mythos 5.1 | What's new |
| Computer use en Claude API / Google Cloud | Toolset o computer_20251124 | Solo toolset | What's new |
| Categorías de salvaguarda | cyber | cyber, bio, reasoning_extraction | What's new |
| Corte de conocimiento | Anterior | Junio de 2026 | Descripción de modelos |
| Fecha mínima de retirada | No antes del 24 de julio de 2027 | No antes del 22 de septiembre de 2027 | Descripción de modelos |
Todo lo de esta tabla es un cambio de contrato documentado que puede verificar. Las afirmaciones de capacidad de Anthropic son otra categoría: reporta resultados líderes en FrontierCode, paridad con Claude Fable 5.1 "on most work", salida más de un 30 % más rápida y un 40 % menos de coste de operación que Opus 5. Son afirmaciones sobre la mezcla de tareas de Anthropic. Trátelas como las hipótesis que su evaluación pone a prueba.
Coste sobre la misma base: ¿20 %, 60 % o 40 %?
Circulan tres cifras distintas y miden cosas distintas.
- 20 % es la diferencia de precio de lista en entrada y salida. Se aplica a cada token, antes de cualquier diferencia de comportamiento.
- 60 % es la diferencia de precio de lista en lecturas de caché. Se aplica solo a la parte de su entrada que se sirve desde la caché.
- 40 % es la estimación de Anthropic del coste total de operación en sus propias cargas. Agrupa las rebajas unitarias con menos tokens por tarea completada, así que depende de cómo se comporten sus tareas en el modelo nuevo.
La tabla siguiente aplica los precios de lista a tres mezclas fijas de tokens, por cada 1.000 tareas. Es un cálculo de precio, no un coste ajustado por calidad.
| Carga (por tarea) | Opus 5 | Opus 5.5 | Cambio |
|---|---|---|---|
| A. Una sola llamada, sin caché: 20K entrada, 4K salida | 200,00 $ | 160,00 $ | -20 % |
| B. Agente con mucha caché: 60K lecturas de caché, 10K entrada nueva, 5K escritura de caché, 6K salida | 261,25 $ | 197,00 $ | -25 % |
| C. Igual que A, pero 5.5 emite un 25 % más de tokens de salida con el mismo effort | 200,00 $ | 180,00 $ | -10 % |
xhigh y max, y el thinking se factura como salida. En la mezcla A, Opus 5.5 puede emitir hasta un 50 % más de tokens de salida antes de que su precio por tarea iguale al de Opus 5. Que lo haga depende del nivel de effort que elija y de si el modelo llega a un resultado aceptado en menos turnos, que es de donde sale la cifra del 40 % de Anthropic.Riesgos de compatibilidad, en el orden en que muerden
1. Peticiones que ahora fallan
400 de abajo son comportamiento de la API de Anthropic. En EvoLink, el gateway convierte los ajustes antiguos thinking: disabled y budget_tokens en razonamiento adaptativo en lugar de rechazarlos, mientras que la elección forzada de herramienta se rechaza tanto en el endpoint Chat Completions como en Messages; la página del modelo Claude Opus 5.5 documenta el comportamiento del gateway.thinking: {"type": "disabled"} y thinking: {"type": "enabled", "budget_tokens": N} devuelven ambos 400 invalid_request_error. tool_choice: {"type": "any"} y {"type": "tool", "name": ...} devuelven 400, incluido en el endpoint de conteo de tokens. En la Claude API y Google Cloud, una entrada de herramienta computer_20251124 devuelve 400; declare computer_toolset_20260801 en su lugar.thinking, o envíe el equivalente thinking: {"type": "adaptive"}, y fije output_config.effort de forma explícita. Mantenga tool_choice: auto, ponga strict: true en las herramientas que deban producir argumentos válidos según el esquema o mueva el esquema a structured outputs, y diga en el prompt cuándo aplica la herramienta. Después verifique en su bucle que realmente hubo una llamada a herramienta, porque auto no la garantiza.2. El valor por defecto que se mueve en silencio
effort corría en high en Opus 5 y corre en medium en Opus 5.5. Si sus peticiones de producción nunca fijan el effort, su primera repetición en Opus 5.5 no es una comparación en igualdad de condiciones. Fije el nivel explícitamente en ambos modelos antes de leer ningún resultado y luego barra low, medium y high en 5.5.3. Texto de progreso que desaparece
text. Opus 5.5 la devuelve como bloques thinking de progreso, como máximo uno antes de cada llamada, con el campo thinking vacío en el display: "omitted" por defecto. Nada da error; su UI de streaming simplemente se queda en silencio. Ponga thinking.display en "updates" (cabecera beta thinking-display-updates-2026-08-18) o "summarized", renderice cada bloque de thinking no vacío antes de la llamada a la que precede y devuelva los bloques sin cambios.4. Cadenas de fallback que pierden su razonamiento
400 por defecto al reenviar un bloque tras una edición así. Mantenga el historial solo de anexado y use mensajes de sistema a mitad de conversación en lugar de editar el system prompt o las herramientas.5. Nuevas categorías de rechazo
stop_reason: "refusal" con stop_details.category en bio o reasoning_extraction. El fallback del lado del servidor no reintenta reasoning_extraction. Si su integración de Opus 5 nunca inspeccionaba stop_reason, añada esa comprobación antes del piloto.Seis escenarios y qué debe demostrar cada uno
| Escenario | Entrada a salida | Qué significa "mejor" | Qué vigilar en Opus 5.5 |
|---|---|---|---|
| Cambio de código en varios archivos | Contexto del repositorio a parche | Las pruebas pasan; el revisor acepta con menos ediciones | Tokens de salida con el effort elegido; pasos hasta el verde |
| Agente de herramientas de varios turnos | Tarea más esquemas de herramientas a una secuencia de llamadas | Tarea completada; bucle recuperable tras fallo | auto sigue llamando a la herramienta; bloques de progreso renderizados; bloques de thinking devueltos |
| Análisis de documentos largos | Documentos e imágenes a conclusiones con fuente | Las afirmaciones coinciden con la evidencia; nada omitido | Comprobación de citas; Anthropic reporta menos cifras sin respaldo, verifíquelo |
| Extracción estructurada | Texto semiestructurado a una forma JSON fija | Tasa de validez de esquema; precisión de campos | strict: true sustituye a la elección forzada de herramienta |
| Flujo con mucha caché | Prefijo fijo más tarea nueva a resultado | La tasa de aceptación se mantiene; la factura baja de verdad | Proporción de aciertos de caché; elección entre escritura de 5m y 1h |
| Fallback multimodelo | Turno fallido o con timeout a una ruta alternativa | La conversación continúa; el coste queda acotado | Qué modelos pueden leer bloques de thinking de 5.5; categorías de rechazo |
Nada de esto son resultados. Son los registros de aceptación que hay que rellenar antes de mover tráfico, uno por clase de tarea, con los mismos prompts, herramientas, timeouts, niveles de effort, reglas de reintento y revisores en ambos modelos.
Cuándo quedarse con Opus 5
thinking: disabled o elección forzada de herramienta y el arreglo no se ha desplegado. Manténgalo como ruta de vuelta atrás de cada canario de 5.5 hasta que el canario haya corrido lo suficiente para ver la latencia p95 y el comportamiento de rechazo bajo carga real. Y manténgalo donde una cadena de fallback dependa de que los modelos posteriores lean los bloques de thinking de la conversación, hasta que esa cadena se haya vuelto a probar.Esperar no es pasivo mientras recopila bases. Anthropic lista Opus 5 como activo con una fecha mínima de retirada del 24 de julio de 2027 en las plataformas que opera, así que hay tiempo para moverse según la evidencia y no según la fecha de lanzamiento.
Un plan de migración seguro
1. Congelar la base de Opus 5
Elija tareas representativas de cada clase anterior. Registre la forma exacta de la petición, el nivel de effort, el conjunto de herramientas y los criterios de aceptación, y ejecútelas una vez más en Opus 5 para que la base sea reciente y no un recuerdo.
2. Arreglar la forma de la petición
thinking: disabled y budget_tokens, fije effort explícitamente, sustituya la elección forzada de herramienta por auto más strict, mueva computer use al toolset y añada el manejo de stop_reason. Despliegue esto primero en Opus 5; cada cambio también es válido allí, lo que le permite separar el arreglo de la petición del cambio de modelo.3. Ejecutar el barrido de effort
low, medium y high. Registre la tasa de tareas aceptadas, los tokens de salida, el tiempo de reloj y el coste por tarea aceptada en cada nivel. Elija el nivel más barato que cumpla el umbral de aceptación, por clase de tarea. No arrastre high desde Opus 5 por costumbre.4. Canario por clase de tarea
stop_reason y dimensiones facturadas en cada llamada. Promueva una clase cuando su coste por tarea aceptada y su calidad superen la puerta durante un ciclo completo de tráfico real, no un solo día bueno.5. Definir el camino de vuelta
claude-opus-5. Como Opus 5 no puede leer bloques de thinking de Opus 5.5, una vuelta atrás a mitad de conversación continúa sin el razonamiento anterior; empiece un límite de conversación nuevo cuando pueda. Deje por escrito quién puede activar la vuelta atrás y qué señal la activa antes de que empiece el canario.En EvoLink la selección del modelo es una cadena en su petición, así que los pasos 4 y 5 no requieren un despliegue de código.
Revisar la ruta de Claude Opus 5.5 y las tarifas actuales Mantener la ruta de Claude Opus 5 como vuelta atrásPreguntas frecuentes
¿Claude Opus 5.5 es más barato que Claude Opus 5?
Por token, sí: Anthropic lista la entrada y la salida un 20 % más bajas y las lecturas de caché un 60 % más bajas. Por tarea, depende de cuántos tokens gaste el modelo a su nivel de effort; la cifra del 40 % de Anthropic es su propia estimación sobre sus propias cargas.
¿Opus 5.5 es un reemplazo directo de Opus 5?
400. El effort por defecto también baja de high a medium, y el texto entre llamadas a herramientas pasa a bloques de thinking.¿Por qué Opus 5.5 podría costar más que Opus 5 en mi carga?
high.¿Puedo desactivar el thinking en Opus 5.5 por latencia?
effort: low y compárelo con su base de Opus 5 sin thinking en latencia y aceptación. La guía de Anthropic para prompts escritos con el thinking desactivado también sugiere eliminar instrucciones del tipo "no razones".¿Qué pasa con los bloques de thinking si caigo de Opus 5.5 a Opus 5?
Opus 5 no puede leerlos, así que la API los descarta antes de que el modelo vea la petición. La petición tiene éxito y los bloques descartados no se facturan, pero los turnos restantes corren sin el razonamiento anterior. De Opus 5 a Opus 5.5 se conservan.
¿Hay sustituto para la elección forzada de herramienta?
tool_choice: auto, ponga strict: true en la herramienta para que cualquier llamada respete su esquema y diga en el prompt cuándo aplica la herramienta. Para salida JSON pura, use structured outputs en lugar de una herramienta.¿Debe Opus 5 seguir disponible como fallback?
claude-opus-5 como activo con una fecha mínima de retirada del 24 de julio de 2027 en las plataformas que opera. Pruebe la ruta concreta a la que planea volver, incluido el comportamiento de los bloques de thinking descrito arriba.¿Qué cargas deberían moverse primero?
Las ejecuciones largas de programación agéntica, el análisis de documentos grandes y los agentes con mucha caché y prefijo estable, en ese orden de beneficio esperado. La programación diaria y el tráfico de alto volumen sensible a la latencia suelen pertenecer a Sonnet 5 y no a ninguno de los dos Opus.
Fuentes
- Anthropic: What's new in Claude Opus 5.5
- Anthropic: Migrating to Claude Opus 5.5
- Anthropic: Models overview
- Anthropic: Pricing
- Anthropic: Effort parameter
- Anthropic: Preserved thinking
- Anthropic: Refusals and fallback
- Anthropic: Introducing Claude Opus 5.5


