Claude Haiku 5.5 ya está disponible en Felo OpenAPI
El modelo más barato y rápido de Anthropic llega a Felo OpenAPI el día de su lanzamiento. $0.10/$0.50 por millón de tokens, 1M de contexto, pensamiento adaptativo — una sola clave API.
Anthropic lanzó Claude Haiku 5.5 el 7 de octubre de 2026. Puedes usarlo hoy mismo.
Felo OpenAPI añadió la ruta claude-haiku-5-5 el día del lanzamiento, con el precio oficial de Anthropic: $0.10 por millón de tokens de entrada y $0.50 por millón de tokens de salida para prompts de hasta 100,000 tokens. Esto representa un 90% menos que Haiku 4.5, lo que convierte al modelo más rápido de la familia Claude 5.5 también en el más económico de operar.
Prueba Claude Haiku 5.5 en Felo OpenAPI: https://openapi.felo.ai/models/anthropic/claude-haiku-5.5

Por qué importa este lanzamiento
Todos los modelos Haiku han sido económicos. Este es el primero que puede ejecutar un bucle de agente sin convertirse en el punto débil.
Anthropic describe Haiku 5.5 como el modelo pequeño más barato, rápido y capaz que ha lanzado. Los benchmarks respaldan esa afirmación. Compáralo con el modelo anterior:
| Claude Haiku 4.5 | Claude Haiku 5.5 | |
|---|---|---|
| Entrada / salida | $1 / $5 | $0.10 / $0.50 |
| Lectura de caché | $0.10 | $0.01 |
| Contexto / salida máxima | 200K / 64K tokens | 1M / 128K tokens |
| Control de esfuerzo | — | 5 niveles, medio por defecto |
| OSWorld 2.1 (uso de computadora) | 15.7% | 72.4% |
| Terminal-Bench 4.0 | 0.0% | 39.2% |
| GDPval-AA v2.1 | 735 | 1620 |
| Humanity's Last Exam (sin herramientas) | 10.2% | 45.9% |
Precios por millón de tokens, para prompts de hasta 100,000 tokens. Cifras de benchmarks según Anthropic.
El salto de capacidad supera la reducción de precio. En OSWorld 2.1, un benchmark de uso de computadora, Haiku 5.5 alcanza 72.4% donde Haiku 4.5 lograba 15.7%. Terminal-Bench 4.0 pasa de 0.0% a 39.2%. Tareas que antes requerían un modelo de gama media a veinte veces el precio ahora caben en la línea Haiku.
Explicación de los precios
Haiku 5.5 se diferencia del resto de la familia Claude en un aspecto importante: el precio depende de la longitud del prompt.
- Prompts de hasta 100,000 tokens: $0.10 entrada, $0.50 salida, $0.01 lectura de caché — por millón de tokens.
- Prompts de más de 100,000 tokens: $0.50 entrada, $2.50 salida, $0.05 lectura de caché.
Todos los demás modelos Claude actuales cobran una tarifa plana en toda su ventana de contexto. Haiku 5.5 es la excepción, así que conviene recalcular cualquier presupuesto en tokens.
En la mayoría de los casos, el límite no afecta. Anthropic indica que el 90% de las solicitudes a Haiku 4.5 quedan por debajo de 100,000 tokens, así que reciben el descuento completo del 90%. Además, como Haiku 5.5 utiliza el tokenizador más reciente de la familia — el mismo texto cuenta como aproximadamente un 30% más de tokens que en Haiku 4.5 — Anthropic estima la reducción promedio del costo en torno al 75% en vez de un 90% exacto.
El dato clave es ese $0.01 por lectura de caché. Los bucles de agentes gastan la mayor parte de su presupuesto de entrada releyendo contexto ya enviado; a un centavo por millón de tokens, mantener una conversación larga cuesta casi nada.

Qué más ha cambiado
Pensamiento adaptativo, ahora con control de esfuerzo. Haiku 5.5 es el primer Haiku que acepta el parámetro effort. El pensamiento se adapta a la tarea por defecto, y cinco niveles de esfuerzo — bajo, medio, alto, xhigh, max, con medio como valor predeterminado — permiten equilibrar costo y velocidad frente a calidad de respuesta. En esfuerzo bajo, el modelo omite el razonamiento en solicitudes simples.
Contexto de 1M de tokens, salida máxima de 128K. Cinco veces la ventana de contexto de Haiku 4.5 y el doble de salida máxima. Una ventana contiene aproximadamente 555,000 palabras, más que la mayoría de bases de código, transcripciones o conjuntos de documentos que quieras analizar en una sola llamada.
Un nuevo tokenizador. Haiku 5.5 utiliza el mismo tokenizador que Claude 4.7 y modelos posteriores. Las solicitudes y respuestas mantienen su estructura, pero el conteo de tokens aumenta para el mismo texto, así que los límites de max_tokens y las estimaciones de costo ajustadas para Haiku 4.5 requieren una revisión.
Uso de navegador y rechazos más firmes. El modelo admite el conjunto de herramientas para uso de navegador junto con el uso de computadora, y sus clasificadores de seguridad pueden rechazar una solicitud directamente — considera un stop_reason con valor "refusal" en tu cliente.
Cinco cambios incompatibles antes de migrar
Haiku 5.5 no es un simple reemplazo de ID de modelo para código que usaba Haiku 4.5. La guía de migración de Anthropic detalla los cambios; estos cinco afectan solicitudes existentes.
- Se rechazan presupuestos manuales de pensamiento.
thinking: {"type": "enabled", "budget_tokens": N}devuelve un 400. Usa pensamiento adaptativo y controla la profundidad coneffort. El texto de pensamiento ya no se muestra por defecto, así que configurathinking.displayen"summarized"si lo transmites. - Se rechazan los parámetros de muestreo. Omite por completo
temperature,top_pytop_k. Cualquier valor distinto al predeterminado devuelve un 400 — inclusotop_p: 1. - Se rechaza el prellenado del asistente. Termina
messagescon un turno de usuario. Para salidas estructuradas, utiliza salidas estructuradas o herramientas de clasificación con campos enum en lugar de trucos de prellenado. - El uso de computadora pasó a un conjunto de herramientas. Sustituye
computer_20250124porcomputer_toolset_20260801en la API de Claude y Google Cloud. - Los bloques de pensamiento son vinculados a la cuenta y solo se pueden añadir. Un bloque de pensamiento solo es válido en la cuenta que lo generó y mientras todo lo anterior permanezca igual. Mantén las conversaciones solo en modo añadir cuando envíes bloques de pensamiento de vuelta.
Un cambio más ocurre de forma silenciosa: los tokens de pensamiento cuentan para max_tokens, y una respuesta puede comenzar con un bloque de pensamiento antes de cualquier texto. Selecciona los bloques de contenido por su campo type, no por posición, y deja espacio en max_tokens para el razonamiento.
La guía de migración completa está en la documentación de Anthropic.
Cómo llamar a Haiku 5.5 en Felo OpenAPI
La ruta ya está disponible. Aquí tienes la integración completa.
curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"messages": [
{"role": "user", "content": "Classify this support ticket and extract the order ID."}
]
}'
Felo OpenAPI ofrece tres superficies compatibles, así que puedes mantener el cliente que ya usas:
| Superficie | Método | URL |
|---|---|---|
| Chat Completions | POST | https://openapi.felo.ai/api/v1/chat/completions |
| Responses | POST | https://openapi.felo.ai/api/v1/responses |
| Messages (compatible con Anthropic) | POST | https://openapi.felo.ai/api/v1/messages |
Como el endpoint Messages es compatible con Anthropic, los clientes estilo Claude solo necesitan apuntar la URL base a https://openapi.felo.ai/api. Los SDK de terceros funcionan igual — configura baseURL en https://openapi.felo.ai/api/v1 y mantén tu código existente.
Agrega "stream": true para eventos enviados por el servidor. La ruta admite razonamiento, llamadas a herramientas, salida en JSON, streaming y visión — la misma superficie que el resto del catálogo.
Si ya pagas Felo Pro, ya tienes acceso
Felo Pro incluye acceso API a los modelos de Felo OpenAPI. Si tienes suscripción, no necesitas una segunda cuenta para usar Haiku 5.5: crea una clave API, apunta tu agente al endpoint y tus créditos Felo existentes cubren las llamadas. La misma clave funciona en toda la línea — Haiku 5.5, Sonnet 5.5, Opus 5.5, GPT-6, Grok 4.7 y demás.
Dos puntos importantes:
- Los créditos de Felo Pro son un solo saldo. Búsquedas, agentes de investigación, presentaciones, imágenes y llamadas API consumen del mismo balance. Las llamadas a modelos se cobran por token, así que un uso intensivo de la API agota créditos más rápido que unas pocas búsquedas diarias.
- Las APIs de herramientas son independientes. Las llamadas a modelos están cubiertas por tu acceso Pro; herramientas como Web Fetch, X Search y generación de PPT utilizan créditos de Felo API Platform.
¿Aún no tienes Pro? Cada cuenta Felo recibe 200 créditos gratis al día, suficientes para hacer pruebas reales con Haiku 5.5 antes de decidir.
Dónde encaja Haiku 5.5

Haiku 5.5 es la ruta indicada cuando la tarea es sencilla pero el volumen es alto.
- Subagentes y compactación — Anthropic recomienda directamente tareas de resumen, compactación y subagentes. Ejecuta Opus 5.5 o Sonnet 5.5 para el razonamiento complejo y deja que Haiku 5.5 gestione el bucle alrededor a una décima parte del precio.
- Clasificación, enrutamiento y extracción de alto volumen — el costo por token determina si estas funciones se implementan o no. A $0.10 por millón de tokens de entrada y $0.50 por millón de tokens de salida, el costo marginal de una clasificación adicional deja de ser un problema de presupuesto.
- Bots de soporte y UX sensible a la latencia — la ruta más rápida de la línea, ahora con control de esfuerzo para recortar los últimos milisegundos.
- Trabajo con documentos largos — una ventana de 1M a precios Haiku permite procesar transcripciones completas, conjuntos de contratos o archivos de registro en una sola llamada sin sistemas de recuperación adicionales.
Si necesitas el máximo nivel de razonamiento complejo, Opus 5.5 sigue siendo el modelo principal y también está en Felo OpenAPI. Sonnet 5.5 sigue siendo el punto de equilibrio para la mayoría de cargas de trabajo en producción. Haiku 5.5 es el modelo que puedes usar donde antes el presupuesto lo impedía.
Pruébalo ahora
Haiku 5.5 ya está disponible en Felo OpenAPI, al precio oficial de Anthropic, con la clave que ya tienes.
Comienza en el Playground para probar prompts sin escribir código, luego crea una clave API y apunta tu agente al endpoint — subagentes, clasificadores y bots de soporte cuestan un 90% menos con solo cambiar el ID de modelo.
→ Prueba Claude Haiku 5.5 en Felo OpenAPI
Esta publicación también está disponible en English, 简体中文, 日本語, 한국어, 繁體中文, हिन्दी, Français, العربية, Русский, اردو, Bahasa Indonesia, Deutsch, Tiếng Việt, Türkçe, Italiano, ไทย, বাংলা and Português.