GPT Image 2.5 Flare & Sunburst ya están disponibles en EvoLinkProbar GPT Image 2.5

Claude Haiku 5.5 API

Accede a Claude Haiku 5.5 de Anthropic —también buscado como Haiku 5.5— a través de la API de chat unificada de EvoLink. Prueba el uso de herramientas, la salida estructurada, la caché de prompts antes de integrar.

AnthropicGeneración de textoDisponible
Desde $0.096 / 1M tokens de entrada$0.100 precio oficial-4%
Pensamiento adaptativoControl de effortUso de herramientasSalida estructuradaCaché de promptsChat + Messages API
Ruta de producciónLive
Contexto
1M de contexto · 128K de salida máx.
Ideal para
Clasificación y extracción de alto volumen, enrutamiento, tareas de subagentes
Entrada
Texto + imágenes
Salida
Texto · JSON (salida estructurada) · llamadas a herramientas

Elegir Claude Haiku 5.5

El modelo Haiku más reciente de Anthropic para clasificación, extracción, enrutamiento y trabajo de subagentes de alto volumen. La longitud del prompt determina una de dos tablas de tarifas, y cinco dimensiones de facturación —entrada, escritura de caché, lectura de caché, salida y la herramienta de búsqueda web— se miden por separado.

Claude Haiku 5.5

El modelo Haiku más reciente de Anthropic

Seleccionado
ID del modelo
claude-haiku-5-5
Ideal para

Clasificación de tickets e intenciones, extracción de campos a JSON, enrutamiento de solicitudes y pasos de subagente bajo un modelo más grande: el trabajo de alto volumen y sensible a la latencia en el que una ruta con tarifa Haiku debería terminar la tarea sin escalar a Sonnet.

≤ 100K
Entrada
$0.096 / 1M-4%
6.5 cr / 1M$0.100precio oficial
Escritura de caché
$0.120 / 1M-5%
8.1 cr / 1M$0.125precio oficial
Lectura de caché
$0.011 / 1M
0.7 cr / 1M
Salida
$0.475 / 1M-5%
32.3 cr / 1M$0.500precio oficial
> 100K
Entrada
$0.478 / 1M-4%
32.5 cr / 1M$0.500precio oficial
Escritura de caché
$0.596 / 1M-5%
40.5 cr / 1M$0.625precio oficial
Lectura de caché
$0.052 / 1M
3.5 cr / 1M
Salida
$2.375 / 1M-5%
161.5 cr / 1M$2.500precio oficial

Todas las tarifas son por 1M de tokens, en USD y créditos, y reflejan los precios actuales de tu cuenta. A partir de 100K tokens de prompt se aplica el nivel de contexto largo (×5) a cada rol de token.

Precios de Claude Haiku 5.5

Estima el coste de una solicitud de Claude Haiku 5.5 antes de integrar. La calculadora usa las tarifas actuales de tu cuenta; los precios oficiales sirven de referencia.

Calculadora de solicitud

Introduce la combinación de tokens de una solicitud y el número de llamadas a herramientas exitosas.

Coste estimado por solicitud

Claude Haiku 5.5
Tarifa de contexto corto
USD$0.0003
Créditos0.0164

Estimación oficial $0.0003 · ahorras $0.0001 (4%)

Tokens de entrada0.0065 cr
Tokens de escritura de caché0 cr
Tokens de lectura de caché0.0002 cr
Tokens de salida0.0097 cr

Cargo mínimo: 0.01 créditos por solicitud. A partir de 100K tokens de prompt se aplica el nivel de contexto largo (×5) a cada rol de token.

Guía de presupuesto

Solicitudes aproximadas con la combinación actual de tokens.
Añadir créditos
$10
Unas 39634 solicitudes

Para pruebas rápidas

$50
Unas 207317 solicitudes

Para el desarrollo habitual

$100
Unas 414634 solicitudes

Para la evaluación en producción

Tarifas de herramientas del servidor

La búsqueda web depende de la ruta seleccionada y no está disponible en algunas rutas. Confirma la compatibilidad antes de enviar web_search; las tarifas siguientes solo se aplican donde se admite.
  • Búsqueda web$0.010/ llamada0.68 cr / llamada

API de Claude Haiku 5.5

Usa la API de Claude Haiku 5.5 mediante la pasarela unificada de EvoLink. Ejecuta clasificación, extracción, enrutamiento y llamadas de subagentes de alto volumen mediante la API unificada de EvoLink, con una ventana de contexto de 1M de tokens y hasta 128K tokens de salida. Compara $0.096 de entrada y $0.475 de salida por millón de tokens para prompts de hasta 100K tokens, reutiliza una clave API entre modelos y revisa los ajustes de thinking y max_tokens antes de tu primera solicitud.

Claude Haiku 5.5 se sirve en EvoLink con el ID de modelo claude-haiku-5-5 mediante Chat Completions · Anthropic Messages, con la misma clave API y saldo que usas para cualquier otro modelo. Ofrece una ventana de contexto de 1M y hasta 128K tokens de salida, además de el uso de herramientas, la salida estructurada, la caché de prompts.

Claude Haiku 5.5

Especificaciones y capacidades de Claude Haiku 5.5

Las cifras proceden de la configuración de ruta de EvoLink; las capacidades son las que la API expone hoy.

Ventana de contexto
1M tokens
Salida máx.
128K tokens
Entrada
Texto + imágenes
Salida
Texto · JSON (salida estructurada) · llamadas a herramientas
Razonamiento
Modo de pensamiento (activado por defecto)
Uso de herramientas
Llamadas a funciones con secuencias de herramientas de varios pasos
Caché de prompts
Tarifas de escritura + lectura de caché
Nivel de contexto largo
×5 a partir de 100K tokens de prompt
Protocolos
Chat Completions · Anthropic Messages
ID del modelo
claude-haiku-5-5

Cuándo Claude Haiku 5.5 es la ruta predeterminada adecuada

Haiku 5.5 es el Claude rápido y económico de Anthropic para trabajo de alto volumen y sensible a la latencia. Enruta hacia él según el coste de una tarea completada y ajusta el effort antes de tocar el prompt.

Clasificación, enrutamiento y extracción de alto volumen

Etiqueta tickets, detecta la intención, enruta solicitudes y extrae campos de documentos a JSON. Mantén cada prompt compacto y acota la respuesta con salida estructurada o una herramienta con valores enum, para que la respuesta sea corta y la solicitud se quede en la tabla de tarifas base.

Subagentes bajo un modelo más grande

Ejecuta la búsqueda, la lectura de archivos y otros pasos acotados en Haiku 5.5 mientras un modelo Opus o Sonnet planifica la tarea. Anthropic describe Haiku 5.5 como sustancialmente mejor que Haiku 4.5 al seguir instrucciones y al funcionar como subagente. Mide los pasos completados, no las respuestas sueltas.

Chat y asistentes de soporte de baja latencia

Responde preguntas rutinarias y llama a un conjunto reducido de herramientas con un prompt de sistema corto. Empieza con effort low para chat y tareas cortas con herramientas, y súbelo donde el asistente tenga que seguir reglas estrictas a lo largo de una conversación larga.

Cuándo otra ruta es mejor opción

La programación en varios archivos, los agentes de largo horizonte y la redacción de nivel analista corresponden a Claude Sonnet 5.5, con Claude Opus 5.5 por encima. Mantén Claude Haiku 4.5 donde una carga dependa de parámetros de muestreo, de un presupuesto de pensamiento o del prellenado del asistente y aún no se haya vuelto a probar.

Dos formas de usar Claude Haiku 5.5: API de EvoLink o Agente

Usa la API de EvoLink para backends de producto y trabajos por lotes, o llama a Claude Haiku 5.5 desde Codex, Claude o Gemini para flujos de código y análisis. Ambas vías comparten la misma clave API de EvoLink, saldo, ID de modelo e historial de solicitudes.

Opción 1

Integrar con la API de EvoLink

Ideal para: backends de producto, trabajos por lotes, pipelines automatizados

Envía a EvoLink solicitudes Chat Completions compatibles con OpenAI (o Anthropic Messages) y controla el ID de modelo, el prompt de sistema, el presupuesto de salida, las herramientas y la salida estructurada.

  1. 1Crea una clave API de EvoLink en la consola
  2. 2Apunta tu SDK de OpenAI o Anthropic a la URL base de EvoLink y selecciona el ID de modelo mostrado arriba
  3. 3Envía una solicitud representativa y lee el campo usage para tokens de entrada, en caché y de salida
  4. 4Define max_tokens y reintentos por tarea; conserva los ID y resultados de llamadas a herramientas entre turnos
Opción 2

Llamarlo con un Agente

Ideal para: tareas de código, revisión y análisis en Codex, Claude y Gemini

Dale al Agente la tarea, las entradas a incluir y los criterios de aceptación. Él arma la solicitud, llama a Claude Haiku 5.5 a través de EvoLink y devuelve la respuesta con el uso de tokens.

  1. 1Define EVOLINK_API_KEY en tu entorno local; nunca en código ni en un prompt
  2. 2Describe la tarea, las entradas a incluir y el formato de salida esperado
  3. 3Pide al Agente que llame a Claude Haiku 5.5 a través de EvoLink y muestre la solicitud antes de enviarla
  4. 4Deja que el Agente informe la respuesta, el uso de tokens y cualquier cuerpo de error

Ejemplo de código de la API de Claude Haiku 5.5 y manejo de errores

Este ejemplo muestra la solicitud ejecutable más corta: una llamada Chat Completions compatible con OpenAI con prompt de sistema, mensaje de usuario y presupuesto de salida. Abre la pestaña API para la referencia completa de parámetros y respuestas.

Ver documentación completa de la API
cURL
curl -X POST https://direct.evolink.ai/v1/chat/completions \
  -H "Authorization: Bearer $EVOLINK_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "claude-haiku-5-5",
    "messages": [
      { "role": "system", "content": "Classify each support ticket as billing, bug, or how-to. Reply with one word." },
      { "role": "user", "content": "I was charged twice for my subscription." }
    ],
    "max_tokens": 4096
  }'

# Thinking is on by default and counts toward max_tokens, so leave room for
# it. This Chat Completions request returns choices[0].message and usage
# (prompt_tokens, completion_tokens, and cache read / write tokens when
# caching applies).
# For the Anthropic Messages format at /v1/messages, follow the linked
# Claude reference; its request fields and response format are different.

Solicitud inválida o parámetro no admitido

Comprueba el ID de modelo, el array messages y los rangos de parámetros en la referencia de la API; elimina los campos que esta ruta no admite.

Problema de autenticación o saldo

Comprueba el token Bearer de Authorization y confirma el saldo disponible en la consola.

Longitud de contexto excedida

Los tokens del prompt superan la ventana de contexto de Claude Haiku 5.5. Recorta o recupera solo la evidencia relevante y reutiliza prefijos en caché.

Límite de tasa (429)

Espera y reintenta con jitter; agrupa o encola las solicitudes en lugar de ráfagas paralelas.

Contenido o llamada a herramienta rechazados

Revisa contenido sensible, argumentos de llamada a herramienta mal formados y desajustes del esquema JSON antes de reintentar.

Comprobaciones para integrar la API de Claude Haiku 5.5

Mantén un único cliente de EvoLink y una clave de API. La mayoría de las solicitudes siguen igual; los cuatro pasos siguientes cubren los ajustes que se comportan de forma distinta a Claude Haiku 4.5.

01

Cambia el ID del modelo

Apunta el cliente a EvoLink, conserva la misma clave de API y selecciona claude-haiku-5-5. Tanto el endpoint Chat Completions compatible con OpenAI como el endpoint Anthropic Messages lo aceptan.

Migración sencilla
02

Deja espacio para el pensamiento

El pensamiento está activado por defecto y cuenta dentro de max_tokens, así que un límite dimensionado para una respuesta de una sola palabra puede agotarse antes de que se escriba ningún texto. Sube max_tokens o baja el effort, y lee el contenido por tipo de bloque, porque una respuesta puede empezar con un bloque thinking.

Cambio de comportamiento
03

Elimina los ajustes exclusivos de Haiku 4.5

Anthropic rechaza en Haiku 5.5 los presupuestos de pensamiento, los valores de muestreo no predeterminados y el prellenado del asistente. EvoLink convierte un presupuesto de pensamiento en pensamiento adaptativo con un nivel de effort y elimina temperature, top_p y top_k; sustituye el prellenado por salida estructurada o una instrucción en el prompt de sistema.

Cambio incompatible
04

Vigila la línea de los 100K tokens de prompt

La entrada, las escrituras de caché y las lecturas de caché deciden juntas la tabla de tarifas. Recorta el historial, recupera menos o divide el trabajo para mantener las solicitudes de alto volumen en 100K tokens de prompt o menos, y presupuesta la tabla superior para las que necesiten más contexto.

Control de costes

Caché de prompts para contexto repetido

Almacena en caché prompts de sistema, esquemas de herramientas y documentos de referencia estables para reutilizarlos entre solicitudes. Las escrituras y las lecturas se facturan por separado. Anthropic ha reducido la longitud mínima de prompt que se puede almacenar en caché respecto a Haiku 4.5, así que ahora también se pueden almacenar prompts más cortos. Los tokens en caché siguen contando para la longitud del prompt que determina la tabla de tarifas.

Contexto de 1M de tokens con una tabla de tarifas que cambia en los 100K

La ruta registra una ventana de contexto de 1M de tokens y hasta 128K tokens de salida. Los prompts de hasta 100K tokens —entrada, escrituras de caché y lecturas de caché en conjunto— usan las tarifas base; por encima de 100K, toda la solicitud, salida incluida, se factura a 5×. El pensamiento cuenta dentro de max_tokens, así que déjale espacio.

El pensamiento está activado por defecto: effort es el control

Una solicitud que no configura thinking ejecuta pensamiento adaptativo, con effort medium salvo que elijas un nivel. El pensamiento se factura como salida y su texto se omite salvo que pidas resúmenes. thinking: disabled se sigue aceptando con effort high o inferior; Anthropic recomienda bajar el effort en su lugar.

Parámetros de Haiku 4.5 que ya no se aplican

Anthropic rechaza en Haiku 5.5 los presupuestos de pensamiento, los valores de muestreo no predeterminados y el prellenado del asistente. EvoLink convierte un presupuesto en pensamiento adaptativo con un nivel de effort y elimina temperature, top_p y top_k por compatibilidad. Forzar la elección de herramienta se acepta, pero entonces la respuesta empieza con la llamada a la herramienta y sin pensamiento.

Claude Haiku 5.5: dos tablas de tarifas y cinco dimensiones de facturación

Claude Haiku 5.5 no se factura con una tarifa única combinada. La longitud del prompt determina la tabla de tarifas, cada dimensión se mide por separado y el pensamiento se factura como salida.

Tokens de entrada y de salida, según la longitud del prompt

Para prompts de hasta 100K tokens: $0.096 por 1M de tokens de entrada y $0.475 por 1M de tokens de salida en EvoLink, frente a $0.100 y $0.500 de Anthropic. Por encima de 100K tokens de prompt, toda la solicitud pasa a la tabla de tarifas superior: $0.478 de entrada y $2.375 de salida. El pensamiento se factura como salida aunque su texto no se devuelva.

Escritura de caché de 5 minutos y lectura de caché

Guardar un prefijo durante 5 minutos cuesta $0.120 por 1M de tokens; reutilizarlo cuesta $0.011 por 1M de tokens. Los tokens en caché siguen contando para la longitud del prompt que determina la tabla de tarifas. Las tarifas de EvoLink se redondean hacia arriba a una unidad de facturación entera, así que la tarifa de lectura de caché puede quedar ligeramente por encima del precio de lista oficial; usa los precios mostrados al estimar el ahorro.

Herramienta de búsqueda web

En las rutas compatibles con web_search, cada búsqueda cuesta $0.010 y no se multiplica por la tabla de tarifas superior. Los tokens de los resultados de búsqueda se facturan como entrada normal. Confirma la compatibilidad de la ruta antes de integrar; un precio configurado no significa que todas las rutas admitan la herramienta.

Compara las rutas de Claude tras probar tus cargas

EvoLink

Comprueba primero si Haiku 5.5 mantiene la calidad en tus propias tareas con el nivel de effort que piensas usar. Después compara precio, contexto, caché y encaje con la carga para elegir la ruta de producción.

Claude Haiku 5.5
Entrada / salida$0.096 / $0.475
Contexto1M
CachéLectura + escritura
Ideal paraClasificación de tickets e intenciones, extracción de campos a JSON, enrutamiento de solicitudes y pasos de subagente bajo un modelo más grande: el trabajo de alto volumen y sensible a la latencia en el que una ruta con tarifa Haiku debería terminar la tarea sin escalar a Sonnet.
Claude Haiku 4.5
Entrada / salida$0.9 / $4.5
Contexto200K
CachéLectura + escritura
Ideal paraEl Haiku anterior, facturado con una sola tarifa para cualquier longitud de prompt; mantenlo donde una carga aún necesite parámetros de muestreo o un presupuesto de pensamiento.
Claude Sonnet 5.5
Entrada / salida$1.9 / $9.5
Contexto1M
CachéLectura + escritura
Ideal paraEl Sonnet más reciente de Anthropic, el escalón superior para programación en varios archivos, agentes con uso intensivo de herramientas y el trabajo que Haiku 5.5 no termina.

Familia de modelos Claude

Misma clave API y saldo: cambia de nivel sin tocar la integración.

Comparar todos los modelos Claude
Claude Sonnet 5.5

Claude Sonnet 5.5

El Sonnet más reciente de Anthropic, el escalón superior cuando Haiku 5.5 no termina la programación en varios archivos o el trabajo de agentes con uso intensivo de herramientas.

Ver modelo
Claude Opus 5.5

Claude Opus 5.5

El Opus más reciente de Anthropic, para la programación de largo horizonte más difícil, el trabajo de conocimiento y el análisis visual.

Ver modelo
Claude Fable 5.1

Claude Fable 5.1

El modelo más capaz de Anthropic, el nivel Fable por encima de Opus, para las cargas de agentes más largas y exigentes.

Ver modelo

Otros modelos de texto en EvoLink además de Claude Haiku 5.5

GPT-5.6

GPT-5.6

La familia de frontera por niveles de OpenAI para enrutar según capacidad, latencia y coste.

Ver modelo
Grok 4.5

Grok 4.5

La ruta de razonamiento y uso de herramientas de xAI con ventana de contexto de 500K y herramientas de búsqueda en el servidor.

Ver modelo
Kimi K3

Kimi K3

Un modelo de razonamiento de contexto largo para programación a escala de repositorio y trabajo con varios documentos.

Ver modelo
Gemini 3.6 Flash

Gemini 3.6 Flash

La ruta rápida y económica de Google para tráfico de producción de alto volumen.

Ver modelo

Lecturas relacionadas sobre Claude Haiku 5.5

Guía de precios de la API de Claude

Guía de precios de la API de Claude

Cómo se suman entrada, salida, escritura y lectura de caché y cargos por herramientas en toda la familia Claude.

Leer guía
Claude Sonnet 5.5 vs Opus 5.5: ¿cuál elegir?

Claude Sonnet 5.5 vs Opus 5.5: ¿cuál elegir?

Cómo elegir el modelo que planifica el trabajo cuando Haiku 5.5 ejecuta los pasos de subagente.

Leer guía

Preguntas frecuentes sobre la API de Claude Haiku 5.5

¿Qué es Claude Haiku 5.5?

Esta página presenta Claude Haiku 5.5, disponible en EvoLink con el ID de modelo "claude-haiku-5-5". Haiku es el nombre de una familia de modelos: especifica la versión exacta en la solicitud en lugar de enviar "haiku" como ID de modelo. Claude Haiku 4.5 tiene su propia página de modelo y sus propias tarifas.

¿Qué ID de modelo debo usar para la API de Claude Haiku 5.5?

Envía model "claude-haiku-5-5". El mismo ID funciona tanto en el endpoint Chat Completions compatible con OpenAI como en el endpoint Anthropic Messages.

¿Cuánto cuesta la API de Claude Haiku 5.5 en EvoLink?

Para prompts de hasta 100K tokens, EvoLink cobra $0.096 por 1M de tokens de entrada y $0.475 por 1M de tokens de salida, frente a $0.100 y $0.500 de Anthropic. Por encima de 100K tokens de prompt, las tarifas son $0.478 y $2.375.

¿Cómo funciona la tabla de tarifas de los 100K tokens?

La longitud del prompt es la suma de los tokens de entrada más los tokens de escritura y de lectura de caché. Con 100K o menos se aplican las tarifas base. Por encima de 100K, toda la solicitud se factura a 5× —entrada, salida, escrituras de caché y lecturas de caché—, no solo los tokens que superan la línea. Las llamadas de búsqueda web no se multiplican.

¿Claude Haiku 5.5 es más barato que Claude Haiku 4.5?

Anthropic publica para Haiku 5.5 una tarifa que es la décima parte de la de Haiku 4.5 en prompts de hasta 100K tokens y la mitad por encima de esa cifra. Haiku 5.5 usa un tokenizador más nuevo que cuenta aproximadamente un 30% más de tokens para el mismo texto, y el pensamiento está activado por defecto, así que compara el coste de una tarea completada en tu propia carga y no solo la tarifa por token.

¿Cómo se factura la caché de prompts de Claude Haiku 5.5?

En la tabla de tarifas base, las escrituras de caché de 5 minutos cuestan $0.120 por 1M de tokens y las lecturas de caché cuestan $0.011 en EvoLink; los precios de lista de Anthropic son $0.125 y $0.010. Se miden por separado, y ambas se facturan a 5× por encima de 100K tokens de prompt. Usa las tarifas mostradas, incluido el redondeo, para estimar tu carga.

¿Cómo se factura la herramienta de búsqueda web de Claude Haiku 5.5?

En las rutas compatibles con web_search, cada búsqueda cuesta $0.010. Los tokens de los resultados de búsqueda se facturan como entrada normal. Confirma la compatibilidad de la ruta antes de integrar; un precio configurado no significa que todas las rutas admitan la herramienta.

¿Puedo desactivar el pensamiento en Claude Haiku 5.5?

Sí, con effort high o inferior: envía thinking: disabled. Con xhigh o max Anthropic lo rechaza, así que baja el nivel de effort o usa pensamiento adaptativo. Anthropic recomienda bajar el effort en lugar de desactivar el pensamiento, porque con effort low el modelo puede omitir el pensamiento en solicitudes sencillas.

¿Qué nivel de effort debo usar en Claude Haiku 5.5?

El valor predeterminado es medium. Anthropic sugiere low para chat, tareas cortas con herramientas y solicitudes sencillas de alto volumen; medium para la mayor parte del trabajo, incluida la programación agéntica; y high para trabajo de conocimiento y seguimiento estricto de instrucciones. Compara xhigh y max con Claude Sonnet 5.5 antes de decidirte por ellos.

¿Qué cambia al migrar desde Claude Haiku 4.5?

Cambia el ID del modelo, sustituye los presupuestos de pensamiento por pensamiento adaptativo y un nivel de effort, elimina temperature, top_p y top_k, y sustituye el prellenado del asistente. El pensamiento está activado por defecto, así que lee el contenido por tipo de bloque y revisa los valores pequeños de max_tokens. El tokenizador cuenta más tokens para el mismo texto, el contexto crece hasta 1M de tokens, la salida máxima crece hasta 128K y, en la API de Claude, computer use requiere el computer toolset.

¿Por qué una solicitud corta de clasificación se detiene en max_tokens sin texto?

El pensamiento cuenta dentro de max_tokens. Un límite dimensionado para una respuesta de una sola palabra puede agotarse con el pensamiento, y entonces la respuesta termina después de un bloque thinking y antes de cualquier texto. Sube max_tokens para dejar espacio al pensamiento, o baja el nivel de effort.

¿Cómo es un rechazo de Claude Haiku 5.5?

Los clasificadores de seguridad pueden rechazar una solicitud. La respuesta es un éxito normal con stop_reason "refusal" y una categoría, así que comprueba stop_reason antes de leer el contenido. Anthropic no vuelve a servir en otro modelo una solicitud de Haiku 5.5 rechazada; gestiona el rechazo en tu cliente y prueba con otro prompt.

¿Qué protocolos y SDK funcionan con Claude Haiku 5.5?

Usa el endpoint Chat Completions compatible con OpenAI o el endpoint Anthropic Messages con la misma clave de API de EvoLink. Claude Code y otros clientes nativos de Anthropic funcionan apuntando la URL base a EvoLink.

¿Los límites de uso de la suscripción de Claude Code se aplican a la API de Claude Haiku 5.5 en EvoLink?

Las cuotas de suscripción de Claude son independientes de la facturación de la API de EvoLink. Las solicitudes a través de EvoLink consumen tu saldo de EvoLink a las tarifas mostradas y siguen sujetas a los límites de tu cuenta y de la ruta. Configura una clave API de EvoLink y el endpoint documentado en un cliente compatible.

¿Qué ventana de contexto y salida máxima admite Claude Haiku 5.5?

La ruta de EvoLink registra una ventana de contexto de 1.000.000 de tokens y hasta 128K tokens de salida por respuesta. El pensamiento cuenta dentro de max_tokens, y los prompts de más de 100K tokens se facturan con la tabla de tarifas superior.

¿Qué debe medir una evaluación de producción de Claude Haiku 5.5?

Mide el éxito a la primera, la salida estructurada válida, los reintentos, las solicitudes al modelo por tarea, los tokens de salida con el effort elegido, la tasa de aciertos de caché, la proporción de solicitudes por encima de 100K tokens de prompt, el tiempo hasta el resultado aceptado y las correcciones humanas, no solo la tarifa por token.