Claude Haiku 5.5 está disponível no Felo OpenAPI
O modelo mais barato e rápido da Anthropic chega ao Felo OpenAPI no dia do lançamento. $0,10/$0,50 por milhão de tokens, 1M de contexto, pensamento adaptativo — uma chave de API.
A Anthropic lançou o Claude Haiku 5.5 em 7 de outubro de 2026. Você pode utilizá-lo hoje.
O Felo OpenAPI adicionou a rota claude-haiku-5-5 no dia do lançamento, com o preço oficial da Anthropic: $0,10 por milhão de tokens de entrada e $0,50 por milhão de tokens de saída para prompts de até 100.000 tokens. Isso representa uma redução de 90% em relação ao Haiku 4.5, tornando o modelo mais rápido da família Claude 5.5 também o mais econômico para rodar.
Experimente o Claude Haiku 5.5 no Felo OpenAPI: https://openapi.felo.ai/models/anthropic/claude-haiku-5.5

Por que este lançamento importa
Todo Haiku sempre teve preço baixo. Este é o primeiro que executa loops de agente sem ser o gargalo.
A Anthropic define o Haiku 5.5 como o modelo pequeno mais barato, rápido e capaz que já lançou. Os benchmarks sustentam essa afirmação. Compare com o modelo anterior:
| Claude Haiku 4.5 | Claude Haiku 5.5 | |
|---|---|---|
| Entrada / saída | $1 / $5 | $0.10 / $0.50 |
| Leitura de cache | $0.10 | $0.01 |
| Contexto / saída máxima | 200K / 64K tokens | 1M / 128K tokens |
| Controle de esforço | — | 5 níveis, padrão médio |
| OSWorld 2.1 (uso de computador) | 15,7% | 72,4% |
| Terminal-Bench 4.0 | 0,0% | 39,2% |
| GDPval-AA v2.1 | 735 | 1620 |
| Humanity's Last Exam (sem ferramentas) | 10,2% | 45,9% |
Preços por milhão de tokens, para prompts de até 100.000 tokens. Números de benchmark conforme divulgado pela Anthropic.
O salto de capacidade supera a redução de preço. No OSWorld 2.1, um benchmark de uso de computador, o Haiku 5.5 atinge 72,4% onde o Haiku 4.5 alcançou 15,7%. No Terminal-Bench 4.0, o resultado vai de 0,0% para 39,2%. Tarefas que exigiam um modelo intermediário a um custo vinte vezes maior agora cabem na linha Haiku.
Sobre os preços
O Haiku 5.5 se diferencia do restante da família Claude em um ponto importante: o preço varia conforme o tamanho do prompt.
- Prompts de até 100.000 tokens: $0,10 entrada, $0,50 saída, $0,01 leitura de cache — por milhão de tokens.
- Prompts acima de 100.000 tokens: $0,50 entrada, $2,50 saída, $0,05 leitura de cache.
Todos os outros modelos Claude atuais cobram uma tarifa única para toda a janela de contexto. O Haiku 5.5 é a exceção, então vale recalcular qualquer orçamento baseado em tokens.
Na maioria dos casos, esse limite não afeta o uso. A Anthropic informa que 90% dos pedidos ao Haiku 4.5 ficam abaixo de 100.000 tokens, então recebem o desconto total de 90%. E como o Haiku 5.5 utiliza o tokenizador mais recente da família — o mesmo texto conta como cerca de 30% mais tokens do que no Haiku 4.5 — a Anthropic estima a redução média de custo em cerca de 75%, não os 90% completos.
O número mais importante é o $0,01 por leitura de cache. Loops de agente consomem a maior parte do orçamento de entrada relendo contexto já enviado; a um centavo por milhão de tokens, manter uma conversa longa ativa custa quase nada.

O que mais mudou
Pensamento adaptativo, agora com controle de esforço. O Haiku 5.5 é o primeiro Haiku que aceita o parâmetro effort. O pensamento se adapta à tarefa por padrão, e cinco níveis de esforço — baixo, médio, alto, xhigh, max, com médio como padrão — permitem equilibrar custo e velocidade em relação à qualidade da resposta. Em esforço baixo, o modelo não pensa em pedidos simples.
Contexto de 1M de tokens, saída máxima de 128K. Cinco vezes a janela de contexto do Haiku 4.5 e o dobro do limite de saída. Uma janela comporta cerca de 555.000 palavras, mais do que a maioria dos códigos, transcrições ou conjuntos de documentos que você analisaria em uma chamada.
Novo tokenizador. O Haiku 5.5 usa o mesmo tokenizador do Claude 4.7 e modelos posteriores. Pedidos e respostas mantêm o formato, mas o uso aumenta para o mesmo texto, então limites de max_tokens e estimativas de custo baseados no Haiku 4.5 precisam de revisão.
Uso de navegador e recusas mais firmes. O modelo oferece suporte ao conjunto de ferramentas de uso de navegador junto ao uso de computador, e seus classificadores de segurança podem recusar um pedido — planeje para um stop_reason igual a "refusal" no seu cliente.
Cinco mudanças incompatíveis antes de migrar
O Haiku 5.5 não substitui o ID do modelo em código rodando no Haiku 4.5. O guia de migração da Anthropic lista as mudanças; estas são as cinco que quebram pedidos existentes.
- Orçamentos manuais de pensamento são rejeitados.
thinking: {"type": "enabled", "budget_tokens": N}retorna 400. Use pensamento adaptativo e controle a profundidade comeffort. O texto de pensamento agora fica oculto por padrão, então definathinking.displaycomo"summarized"se quiser transmiti-lo. - Parâmetros de amostragem são rejeitados. Remova
temperature,top_petop_kcompletamente. Qualquer valor diferente do padrão retorna 400 — inclusivetop_p: 1. - Prefill de assistente é rejeitado. Termine
messagescom uma interação do usuário. Para saída estruturada, use outputs estruturados ou ferramentas de classificação com campos enum em vez de truques de prefill. - Uso de computador virou conjunto de ferramentas. Troque
computer_20250124porcomputer_toolset_20260801na API Claude e Google Cloud. - Blocos de pensamento são vinculados à conta e só permitem acréscimo. Um bloco de pensamento só vale na conta que o gerou e enquanto tudo anterior permanece igual. Mantenha conversas apenas com acréscimo ao enviar blocos de pensamento de volta.
Outra mudança ocorre sem aviso: tokens de pensamento contam para max_tokens, e uma resposta pode começar com bloco de pensamento antes de qualquer texto. Selecione blocos de conteúdo pelo campo type, não pela posição, e reserve espaço em max_tokens para pensar.
O guia completo de migração está na documentação da Anthropic.
Como usar o Haiku 5.5 no Felo OpenAPI
A rota está ativa. Veja a integração completa.
curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"messages": [
{"role": "user", "content": "Classify this support ticket and extract the order ID."}
]
}'
O Felo OpenAPI oferece três superfícies compatíveis, então você mantém o cliente que já utiliza:
| Superfície | Método | URL |
|---|---|---|
| Chat Completions | POST | https://openapi.felo.ai/api/v1/chat/completions |
| Responses | POST | https://openapi.felo.ai/api/v1/responses |
| Messages (compatível com Anthropic) | POST | https://openapi.felo.ai/api/v1/messages |
Como o endpoint Messages é compatível com Anthropic, clientes no estilo Claude só precisam apontar a URL base para https://openapi.felo.ai/api. SDKs de terceiros funcionam igual — defina baseURL como https://openapi.felo.ai/api/v1 e mantenha seu código atual.
Adicione "stream": true para eventos enviados pelo servidor. A rota suporta raciocínio, chamada de ferramentas, saída JSON, streaming e visão — igual ao restante do catálogo.
Se você já paga pelo Felo Pro, já tem acesso
O Felo Pro inclui acesso à API dos modelos do Felo OpenAPI. Se você assina, não precisa de outra conta para usar o Haiku 5.5: crie uma chave de API, aponte seu agente para o endpoint e seus créditos Felo já cobrem as chamadas. A mesma chave funciona em toda a linha — Haiku 5.5, Sonnet 5.5, Opus 5.5, GPT-6, Grok 4.7 e os demais.
Dois pontos para não confundir:
- Créditos do Felo Pro formam um saldo único. Busca, agentes de pesquisa, slides, imagens e chamadas de API usam o mesmo saldo. Chamadas de modelo cobram por token, então uso intenso de API consome créditos mais rápido do que algumas buscas por dia.
- APIs de ferramentas são separadas. Chamadas de modelo entram no seu acesso Pro; ferramentas como Web Fetch, X Search e geração de PPT usam créditos da Plataforma de API Felo.
Ainda não usa o Pro? Toda conta Felo recebe 200 créditos grátis por dia, suficientes para testar o Haiku 5.5 antes de decidir.
Onde o Haiku 5.5 se encaixa

O Haiku 5.5 é a rota ideal quando a tarefa é simples, mas o volume é alto.
- Subagentes e compactação — A Anthropic indica uso para sumarização, compactação e subagentes. Rode Opus 5.5 ou Sonnet 5.5 para raciocínio complexo e deixe o Haiku 5.5 cuidar do loop ao redor por um décimo do preço.
- Classificação, roteamento e extração em alto volume — o custo por token define se essas funções entram no produto. A $0,10 por milhão de tokens de entrada e $0,50 por milhão de saída, o custo marginal de mais uma classificação deixa de ser um problema de orçamento.
- Bots de suporte e UX sensível à latência — a rota mais rápida da linha, agora com controle de esforço para reduzir ainda mais o tempo de resposta.
- Trabalho com documentos longos — uma janela de 1M no preço do Haiku acomoda transcrições inteiras, contratos ou logs em uma chamada, sem precisar de sistemas de recuperação.
Se você precisa do máximo em raciocínio complexo, o Opus 5.5 ainda é o carro-chefe e está no Felo OpenAPI também. O Sonnet 5.5 permanece como ponto de equilíbrio para a maioria dos usos em produção. O Haiku 5.5 é o modelo para colocar onde o orçamento antes impedia.
Experimente agora
O Haiku 5.5 está disponível no Felo OpenAPI hoje, pelo preço oficial da Anthropic, usando a chave que você já possui.
Comece pelo Playground para testar prompts sem programar, depois gere uma chave de API e aponte seu agente para o endpoint — subagentes, classificadores e bots de suporte passam a custar 90% menos com apenas um novo ID de modelo.
→ Experimente o Claude Haiku 5.5 no Felo OpenAPI
Este post também está disponível em English, 简体中文, 日本語, 한국어, 繁體中文, हिन्दी, Français, العربية, Русский, اردو, Bahasa Indonesia, Deutsch, Tiếng Việt, Türkçe, Italiano, ไทย, Español and বাংলা.