GPT Image 2.5 Flare & Sunburst ya están disponibles en EvoLinkProbar GPT Image 2.5
Portada comparativa de Claude Opus 5.5 vs 5 con caminos conectados en terracota y carbón
Comparación

Claude Opus 5.5 vs Claude Opus 5: ¿merece la pena actualizar?

EvoLink Team
EvoLink Team
Equipo de producto
22 de septiembre de 2026
17 min de lectura
Respuesta corta: pilote Claude Opus 5.5 en programación agéntica de larga duración, análisis de documentos grandes y trabajo visual con muchos gráficos, y mantenga Claude Opus 5 como ruta de vuelta atrás hasta que una repetición emparejada diga lo contrario. Según el precio de lista de Anthropic, Opus 5.5 cuesta un 20 % menos por token y un 60 % menos en lecturas de caché, y Anthropic afirma que termina las tareas con menos tokens. No es un reemplazo directo: cuatro patrones de petición que funcionan en Opus 5 devuelven 400 en Opus 5.5, el effort por defecto baja de high a medium y el modelo piensa más por turno a un nivel de effort dado.
Esta guía es para equipos que ya ejecutan Opus 5 en producción. Los hechos del lanzamiento y cómo se resolvió el rumor de "Opus 5.2" están en Lanzamiento de Claude Opus 5.5. Las tarifas actuales de EvoLink, el ID de modelo y los ajustes de integración están en la página del modelo Claude Opus 5.5 y la página del modelo Claude Opus 5. Los precios de abajo son los precios de lista publicados por Anthropic, usados solo para comparar ambos modelos sobre la misma base.

La decisión de un vistazo

Si su situación esHaga estoPorque
Carga nueva, sin base de Opus todavíaEmpezar en Opus 5.5Valor por defecto recomendado por Anthropic, precio de lista más bajo, mismos límites
Opus 5 en producción, thinking ya activo, tool_choice: autoPilotar 5.5 detrás de un canarioEl código suele trasladarse una vez fijado effort explícitamente; revise igualmente los cinco riesgos de abajo (ajustes de thinking, elección de herramienta, texto de progreso, fallback de bloques de thinking, versión de computer use)
Opus 5 en producción con thinking: disabled o elección forzada de herramientaArreglar primero las peticiones, luego pilotarAmbos patrones devuelven 400 en 5.5
Agente con mucha caché y un prefijo estable grandePriorizar el pilotoLas lecturas de caché son un 60 % más baratas en 5.5
Cadena de fallback que baja de Opus a Sonnet o Haiku a mitad de conversaciónVolver a probar la ruta de fallbackSolo Fable 5.1 y Mythos 5.1 leen bloques de thinking de Opus 5.5
UI de streaming que muestra texto entre llamadas a herramientasAñadir manejo de thinking.display antes del despliegueEse texto ahora llega en bloques de thinking, vacíos por defecto
Sensible a la latencia, thinking desactivado por velocidadComparar effort low en 5.5 con Opus 5 sin thinkingEl thinking no se puede desactivar; el effort es la única palanca

No hay un ganador incondicional en esta tabla. La actualización compensa cuando su carga es de las que Anthropic optimizó y la forma de sus peticiones ya es compatible; cuando no, primero cuesta tiempo de ingeniería.

Qué cambió Anthropic

DimensiónClaude Opus 5Claude Opus 5.5Documentado en
Lanzamiento24 de julio de 202622 de septiembre de 2026Notas de versión
ID de modeloclaude-opus-5claude-opus-5-5Descripción de modelos
Entrada / salida5 $ / 25 $ por MTok4 $ / 20 $ por MTokPrecios
Escritura de caché 5m / 1h6,25 $ / 10 $5 $ / 8 $Precios
Lectura de caché0,50 $ (10 % de la entrada)0,20 $ (5 % de la entrada)Precios
Batch2,50 $ / 12,50 $2 $ / 10 $Precios
Fast mode (solo Claude API)10 $ / 50 $8 $ / 40 $Precios
Contexto / salida máx.1M / 128K1M / 128KDescripción de modelos
ThinkingActivo por defecto; disabled permitido con effort high o inferiorSiempre activo; disabled y budget_tokens devuelven 400What's new
Effort por defectohighmediumDescripción de modelos
Elección forzada de herramienta (any, tool)SoportadaDevuelve 400What's new
Texto entre llamadas a herramientasBloques textBloques thinking de progreso, vacíos con la visualización por defectoWhat's new
Portabilidad de bloques de thinkingLeídos por Opus 5.5, Fable 5.1, Mythos 5.1Leídos solo por Fable 5.1 y Mythos 5.1What's new
Computer use en Claude API / Google CloudToolset o computer_20251124Solo toolsetWhat's new
Categorías de salvaguardacybercyber, bio, reasoning_extractionWhat's new
Corte de conocimientoAnteriorJunio de 2026Descripción de modelos
Fecha mínima de retiradaNo antes del 24 de julio de 2027No antes del 22 de septiembre de 2027Descripción de modelos

Todo lo de esta tabla es un cambio de contrato documentado que puede verificar. Las afirmaciones de capacidad de Anthropic son otra categoría: reporta resultados líderes en FrontierCode, paridad con Claude Fable 5.1 "on most work", salida más de un 30 % más rápida y un 40 % menos de coste de operación que Opus 5. Son afirmaciones sobre la mezcla de tareas de Anthropic. Trátelas como las hipótesis que su evaluación pone a prueba.

Coste sobre la misma base: ¿20 %, 60 % o 40 %?

Circulan tres cifras distintas y miden cosas distintas.

  • 20 % es la diferencia de precio de lista en entrada y salida. Se aplica a cada token, antes de cualquier diferencia de comportamiento.
  • 60 % es la diferencia de precio de lista en lecturas de caché. Se aplica solo a la parte de su entrada que se sirve desde la caché.
  • 40 % es la estimación de Anthropic del coste total de operación en sus propias cargas. Agrupa las rebajas unitarias con menos tokens por tarea completada, así que depende de cómo se comporten sus tareas en el modelo nuevo.

La tabla siguiente aplica los precios de lista a tres mezclas fijas de tokens, por cada 1.000 tareas. Es un cálculo de precio, no un coste ajustado por calidad.

Carga (por tarea)Opus 5Opus 5.5Cambio
A. Una sola llamada, sin caché: 20K entrada, 4K salida200,00 $160,00 $-20 %
B. Agente con mucha caché: 60K lecturas de caché, 10K entrada nueva, 5K escritura de caché, 6K salida261,25 $197,00 $-25 %
C. Igual que A, pero 5.5 emite un 25 % más de tokens de salida con el mismo effort200,00 $180,00 $-10 %
La carga C es la que hay que vigilar. La documentación de Anthropic dice que Opus 5.5 tiende a pensar más por turno que Opus 5 al mismo nivel de effort, sobre todo en xhigh y max, y el thinking se factura como salida. En la mezcla A, Opus 5.5 puede emitir hasta un 50 % más de tokens de salida antes de que su precio por tarea iguale al de Opus 5. Que lo haga depende del nivel de effort que elija y de si el modelo llega a un resultado aceptado en menos turnos, que es de donde sale la cifra del 40 % de Anthropic.
La única comparación que zanja una actualización es el coste por tarea aceptada: el gasto total del grupo de evaluación, incluidos fallos, reintentos y tarifas de herramientas, dividido por el número de tareas que pasaron la aceptación, con el tiempo de corrección humana reportado aparte. Hágalo después del barrido de effort de la siguiente sección, no antes.

Riesgos de compatibilidad, en el orden en que muerden

1. Peticiones que ahora fallan

Nota de alcance: los errores 400 de abajo son comportamiento de la API de Anthropic. En EvoLink, el gateway convierte los ajustes antiguos thinking: disabled y budget_tokens en razonamiento adaptativo en lugar de rechazarlos, mientras que la elección forzada de herramienta se rechaza tanto en el endpoint Chat Completions como en Messages; la página del modelo Claude Opus 5.5 documenta el comportamiento del gateway.
Busque en sus constructores de peticiones tres patrones. thinking: {"type": "disabled"} y thinking: {"type": "enabled", "budget_tokens": N} devuelven ambos 400 invalid_request_error. tool_choice: {"type": "any"} y {"type": "tool", "name": ...} devuelven 400, incluido en el endpoint de conteo de tokens. En la Claude API y Google Cloud, una entrada de herramienta computer_20251124 devuelve 400; declare computer_toolset_20260801 en su lugar.
Las sustituciones son mecánicas. Elimine el campo thinking, o envíe el equivalente thinking: {"type": "adaptive"}, y fije output_config.effort de forma explícita. Mantenga tool_choice: auto, ponga strict: true en las herramientas que deban producir argumentos válidos según el esquema o mueva el esquema a structured outputs, y diga en el prompt cuándo aplica la herramienta. Después verifique en su bucle que realmente hubo una llamada a herramienta, porque auto no la garantiza.

2. El valor por defecto que se mueve en silencio

Una petición que omite effort corría en high en Opus 5 y corre en medium en Opus 5.5. Si sus peticiones de producción nunca fijan el effort, su primera repetición en Opus 5.5 no es una comparación en igualdad de condiciones. Fije el nivel explícitamente en ambos modelos antes de leer ningún resultado y luego barra low, medium y high en 5.5.

3. Texto de progreso que desaparece

Entre llamadas a herramientas, Opus 5 devolvía una narración breve como bloques text. Opus 5.5 la devuelve como bloques thinking de progreso, como máximo uno antes de cada llamada, con el campo thinking vacío en el display: "omitted" por defecto. Nada da error; su UI de streaming simplemente se queda en silencio. Ponga thinking.display en "updates" (cabecera beta thinking-display-updates-2026-08-18) o "summarized", renderice cada bloque de thinking no vacío antes de la llamada a la que precede y devuelva los bloques sin cambios.

4. Cadenas de fallback que pierden su razonamiento

Los bloques de thinking registran el modelo que los produjo. Opus 5.5 lee bloques de Opus 5 y de modelos Opus, Sonnet y Haiku anteriores, así que una conversación que empieza en Opus 5 y pasa a 5.5 conserva su razonamiento. En sentido contrario, solo Claude Fable 5.1 y Mythos 5.1 leen bloques de Opus 5.5. Un enrutador que cae de Opus 5.5 a Opus 5, Sonnet 5 o Haiku 4.5 ejecuta los turnos restantes sin el razonamiento anterior; la petición tiene éxito y los bloques descartados no se facturan, pero el comportamiento cambia. La API también comprueba que nada anterior a un bloque de thinking de 5.5 se haya editado; las cuentas creadas el 31 de agosto de 2026 o después reciben 400 por defecto al reenviar un bloque tras una edición así. Mantenga el historial solo de anexado y use mensajes de sistema a mitad de conversación en lugar de editar el system prompt o las herramientas.

5. Nuevas categorías de rechazo

Opus 5.5 ejecuta un clasificador de biología junto al de ciberseguridad y puede rechazar peticiones que lo empujen a reproducir su razonamiento interno, devolviendo stop_reason: "refusal" con stop_details.category en bio o reasoning_extraction. El fallback del lado del servidor no reintenta reasoning_extraction. Si su integración de Opus 5 nunca inspeccionaba stop_reason, añada esa comprobación antes del piloto.

Seis escenarios y qué debe demostrar cada uno

EscenarioEntrada a salidaQué significa "mejor"Qué vigilar en Opus 5.5
Cambio de código en varios archivosContexto del repositorio a parcheLas pruebas pasan; el revisor acepta con menos edicionesTokens de salida con el effort elegido; pasos hasta el verde
Agente de herramientas de varios turnosTarea más esquemas de herramientas a una secuencia de llamadasTarea completada; bucle recuperable tras falloauto sigue llamando a la herramienta; bloques de progreso renderizados; bloques de thinking devueltos
Análisis de documentos largosDocumentos e imágenes a conclusiones con fuenteLas afirmaciones coinciden con la evidencia; nada omitidoComprobación de citas; Anthropic reporta menos cifras sin respaldo, verifíquelo
Extracción estructuradaTexto semiestructurado a una forma JSON fijaTasa de validez de esquema; precisión de camposstrict: true sustituye a la elección forzada de herramienta
Flujo con mucha cachéPrefijo fijo más tarea nueva a resultadoLa tasa de aceptación se mantiene; la factura baja de verdadProporción de aciertos de caché; elección entre escritura de 5m y 1h
Fallback multimodeloTurno fallido o con timeout a una ruta alternativaLa conversación continúa; el coste queda acotadoQué modelos pueden leer bloques de thinking de 5.5; categorías de rechazo

Nada de esto son resultados. Son los registros de aceptación que hay que rellenar antes de mover tráfico, uno por clase de tarea, con los mismos prompts, herramientas, timeouts, niveles de effort, reglas de reintento y revisores en ambos modelos.

Cuándo quedarse con Opus 5

Quédese con Opus 5 donde ya cumple sus objetivos de tasa de acierto, latencia y coste y la repetición no muestra una ventaja medible. Quédese donde sus constructores de peticiones aún envían thinking: disabled o elección forzada de herramienta y el arreglo no se ha desplegado. Manténgalo como ruta de vuelta atrás de cada canario de 5.5 hasta que el canario haya corrido lo suficiente para ver la latencia p95 y el comportamiento de rechazo bajo carga real. Y manténgalo donde una cadena de fallback dependa de que los modelos posteriores lean los bloques de thinking de la conversación, hasta que esa cadena se haya vuelto a probar.

Esperar no es pasivo mientras recopila bases. Anthropic lista Opus 5 como activo con una fecha mínima de retirada del 24 de julio de 2027 en las plataformas que opera, así que hay tiempo para moverse según la evidencia y no según la fecha de lanzamiento.

Un plan de migración seguro

1. Congelar la base de Opus 5

Elija tareas representativas de cada clase anterior. Registre la forma exacta de la petición, el nivel de effort, el conjunto de herramientas y los criterios de aceptación, y ejecútelas una vez más en Opus 5 para que la base sea reciente y no un recuerdo.

2. Arreglar la forma de la petición

Elimine thinking: disabled y budget_tokens, fije effort explícitamente, sustituya la elección forzada de herramienta por auto más strict, mueva computer use al toolset y añada el manejo de stop_reason. Despliegue esto primero en Opus 5; cada cambio también es válido allí, lo que le permite separar el arreglo de la petición del cambio de modelo.

3. Ejecutar el barrido de effort

Repita la base en Opus 5.5 con low, medium y high. Registre la tasa de tareas aceptadas, los tokens de salida, el tiempo de reloj y el coste por tarea aceptada en cada nivel. Elija el nivel más barato que cumpla el umbral de aceptación, por clase de tarea. No arrastre high desde Opus 5 por costumbre.

4. Canario por clase de tarea

Enrute una pequeña parte de una clase de tarea a Opus 5.5 con Opus 5 como fallback configurado, y registre modelo solicitado, modelo devuelto, effort, stop_reason y dimensiones facturadas en cada llamada. Promueva una clase cuando su coste por tarea aceptada y su calidad superen la puerta durante un ciclo completo de tráfico real, no un solo día bueno.

5. Definir el camino de vuelta

La vuelta atrás es un cambio de configuración: devuelva la clase a claude-opus-5. Como Opus 5 no puede leer bloques de thinking de Opus 5.5, una vuelta atrás a mitad de conversación continúa sin el razonamiento anterior; empiece un límite de conversación nuevo cuando pueda. Deje por escrito quién puede activar la vuelta atrás y qué señal la activa antes de que empiece el canario.

En EvoLink la selección del modelo es una cadena en su petición, así que los pasos 4 y 5 no requieren un despliegue de código.

Revisar la ruta de Claude Opus 5.5 y las tarifas actuales Mantener la ruta de Claude Opus 5 como vuelta atrás

Preguntas frecuentes

¿Claude Opus 5.5 es más barato que Claude Opus 5?

Por token, sí: Anthropic lista la entrada y la salida un 20 % más bajas y las lecturas de caché un 60 % más bajas. Por tarea, depende de cuántos tokens gaste el modelo a su nivel de effort; la cifra del 40 % de Anthropic es su propia estimación sobre sus propias cargas.

¿Opus 5.5 es un reemplazo directo de Opus 5?

No. Las peticiones que desactivan el thinking, fijan un presupuesto de thinking, fuerzan una elección de herramienta o declaran la herramienta antigua de computer use devuelven 400. El effort por defecto también baja de high a medium, y el texto entre llamadas a herramientas pasa a bloques de thinking.

¿Por qué Opus 5.5 podría costar más que Opus 5 en mi carga?

Porque tiende a pensar más por turno al mismo nivel de effort y el thinking se factura como salida. En una tarea de 20K de entrada y 4K de salida puede emitir un 50 % más de salida antes de igualar el precio de Opus 5, así que elija el effort a partir de un barrido en lugar de arrastrar high.

¿Puedo desactivar el thinking en Opus 5.5 por latencia?

No. Use effort: low y compárelo con su base de Opus 5 sin thinking en latencia y aceptación. La guía de Anthropic para prompts escritos con el thinking desactivado también sugiere eliminar instrucciones del tipo "no razones".

¿Qué pasa con los bloques de thinking si caigo de Opus 5.5 a Opus 5?

Opus 5 no puede leerlos, así que la API los descarta antes de que el modelo vea la petición. La petición tiene éxito y los bloques descartados no se facturan, pero los turnos restantes corren sin el razonamiento anterior. De Opus 5 a Opus 5.5 se conservan.

¿Hay sustituto para la elección forzada de herramienta?

Mantenga tool_choice: auto, ponga strict: true en la herramienta para que cualquier llamada respete su esquema y diga en el prompt cuándo aplica la herramienta. Para salida JSON pura, use structured outputs en lugar de una herramienta.

¿Debe Opus 5 seguir disponible como fallback?

Sí, al menos durante el canario. Anthropic lista claude-opus-5 como activo con una fecha mínima de retirada del 24 de julio de 2027 en las plataformas que opera. Pruebe la ruta concreta a la que planea volver, incluido el comportamiento de los bloques de thinking descrito arriba.

¿Qué cargas deberían moverse primero?

Las ejecuciones largas de programación agéntica, el análisis de documentos grandes y los agentes con mucha caché y prefijo estable, en ese orden de beneficio esperado. La programación diaria y el tráfico de alto volumen sensible a la latencia suelen pertenecer a Sonnet 5 y no a ninguno de los dos Opus.

Fuentes

Hechos verificados por última vez el 22 de septiembre de 2026. Los ejemplos de coste usan precios de lista de Anthropic y mezclas fijas de tokens; son aritmética de precios, no resultados medidos.

¿Listo para reducir tus costos de IA en un 89%?

Comienza a usar EvoLink hoy y experimenta el poder del enrutamiento inteligente de API.