Skip to main content

Claude Haiku 5.5 est disponible sur Felo OpenAPI

· 10 minutes de lecture
Felo Search Tips Buddy
Committed to answers at your fingertips

Le modèle le moins cher et le plus rapide d’Anthropic arrive sur Felo OpenAPI le jour du lancement. 0,10 $/0,50 $ par million de tokens, contexte de 1M, raisonnement adaptatif — une seule clé API.

Anthropic a lancé Claude Haiku 5.5 le 7 octobre 2026. Vous pouvez l’appeler dès aujourd’hui.

Felo OpenAPI a ajouté la route claude-haiku-5-5 le jour du lancement, au tarif officiel d’Anthropic : 0,10 $ par million de tokens d’entrée et 0,50 $ par million de tokens de sortie pour des prompts jusqu’à 100 000 tokens. Ce tarif coûte 90 % moins cher que Haiku 4.5, ce qui fait du modèle le plus rapide de la famille Claude 5.5 aussi le moins cher à utiliser.

Essayez Claude Haiku 5.5 sur Felo OpenAPI : https://openapi.felo.ai/models/anthropic/claude-haiku-5.5

Claude Haiku 5.5 sur Felo OpenAPI : la route Haiku la plus rapide d’Anthropic, 90 % moins chère que Haiku 4.5

Pourquoi cette version compte​

Chaque Haiku a coûté peu. Celui-ci peut exécuter une boucle d’agent sans devenir le point faible.

Anthropic décrit Haiku 5.5 comme le modèle petit le moins cher, le plus rapide et le plus performant qu’il ait publié. Les benchmarks confirment cette affirmation. Comparez-le au modèle précédent :

Claude Haiku 4.5Claude Haiku 5.5
Entrée / sortie1 $ / 5 $0,10 $ / 0,50 $
Lecture du cache0,10 $0,01 $
Contexte / sortie max200K / 64K tokens1M / 128K tokens
Contrôle de l’effort—5 niveaux, par défaut moyen
OSWorld 2.1 (utilisation ordinateur)15,7 %72,4 %
Terminal-Bench 4.00,0 %39,2 %
GDPval-AA v2.17351620
Humanity’s Last Exam (sans outils)10,2 %45,9 %

Tarifs par million de tokens, pour des prompts jusqu’à 100 000 tokens. Chiffres de benchmark rapportés par Anthropic.

L’augmentation de capacité dépasse la baisse de prix. Sur OSWorld 2.1, un benchmark d’utilisation informatique, Haiku 5.5 obtient 72,4 % là où Haiku 4.5 atteignait 15,7 %. Terminal-Bench 4.0 passe de 0,0 % à 39,2 %. Des tâches qui nécessitaient un modèle intermédiaire à vingt fois le prix tiennent désormais sur la gamme Haiku.

Explication des tarifs​

Haiku 5.5 se distingue du reste de la famille Claude sur un point important : le tarif dépend de la longueur du prompt.

  • Prompts jusqu’à 100 000 tokens : 0,10 $ entrée, 0,50 $ sortie, 0,01 $ lecture du cache — par million de tokens.
  • Prompts au-delà de 100 000 tokens : 0,50 $ entrée, 2,50 $ sortie, 0,05 $ lecture du cache.

Tous les autres modèles Claude actuels facturent un tarif unique sur toute la fenêtre de contexte. Haiku 5.5 fait exception, donc tout budget en tokens mérite une vérification.

Pour la plupart des usages, la limite ne pose pas de problème. Anthropic indique que 90 % des requêtes Haiku 4.5 restent sous 100 000 tokens, donc bénéficient de la réduction de 90 %. Et comme Haiku 5.5 utilise le tokenizer récent de la famille — le même texte compte environ 30 % de tokens en plus par rapport à Haiku 4.5 — Anthropic estime la réduction moyenne du coût d’utilisation à environ 75 % plutôt qu’un net 90 %.

Le chiffre à retenir : 0,01 $ lecture du cache. Les boucles d’agent consacrent la plupart de leur budget d’entrée à relire le contexte déjà envoyé ; à un cent par million de tokens, maintenir une longue conversation coûte presque rien.

Tarifs Claude Haiku 5.5 : 0,10 $ par million de tokens d’entrée jusqu’à un prompt de 100 000 tokens, et une baisse de 90 % par rapport à Haiku 4.5

Qu’est-ce qui a changé d’autre​

Raisonnement adaptatif, avec réglage de l’effort. Haiku 5.5 accepte le paramètre effort pour la première fois. Le raisonnement s’adapte à la tâche par défaut, et cinq niveaux d’effort — low, medium, high, xhigh, max, avec medium par défaut — permettent d’ajuster le coût et la vitesse selon la qualité de la réponse. À faible effort, le modèle ne raisonne pas sur les requêtes simples.

Contexte de 1M tokens, sortie max 128K. La fenêtre de contexte est cinq fois plus grande que celle de Haiku 4.5 et le plafond de sortie double. Une fenêtre contient environ 555 000 mots, ce qui dépasse la plupart des bases de code, des transcriptions ou des ensembles de documents à traiter en un seul appel.

Nouveau tokenizer. Haiku 5.5 utilise le même tokenizer que Claude 4.7 et les modèles suivants. Les requêtes et réponses gardent leur forme, mais le comptage de tokens augmente pour le même texte, donc les limites max_tokens et les estimations de coût calibrées sur Haiku 4.5 nécessitent une révision.

Utilisation navigateur et refus plus fermes. Le modèle prend en charge l’ensemble d’outils pour navigateur en plus de l’utilisation informatique, et ses classificateurs de sécurité peuvent refuser une requête — prévoyez un stop_reason de "refusal" dans votre client.

Cinq changements majeurs avant la migration​

Haiku 5.5 ne remplace pas simplement l’ID du modèle dans un code conçu pour Haiku 4.5. Le guide de migration d’Anthropic liste les changements ; voici les cinq qui cassent les requêtes existantes.

  1. Les budgets de raisonnement manuels sont refusés. thinking: {"type": "enabled", "budget_tokens": N} retourne un 400. Utilisez le raisonnement adaptatif et ajustez la profondeur avec effort. Le texte de raisonnement n’est plus inclus par défaut, donc définissez thinking.display sur "summarized" si vous le streamez.
  2. Les paramètres de sampling sont refusés. Omettez complètement temperature, top_p et top_k. Toute valeur différente de la valeur par défaut retourne un 400 — y compris top_p: 1.
  3. Le pré-remplissage assistant est refusé. Terminez messages par un tour utilisateur. Pour une sortie structurée, utilisez des sorties structurées ou des outils de classification avec des champs enum au lieu de techniques de pré-remplissage.
  4. L’utilisation informatique passe dans un ensemble d’outils. Remplacez computer_20250124 par computer_toolset_20260801 sur l’API Claude et Google Cloud.
  5. Les blocs de raisonnement sont liés au compte et ajoutés uniquement. Un bloc de raisonnement reste valide uniquement dans le compte qui l’a produit et tant que tout ce qui précède ne change pas. Gardez les conversations en ajout uniquement lorsque vous renvoyez des blocs de raisonnement.

Un changement silencieux : les tokens de raisonnement comptent dans max_tokens, et une réponse peut commencer par un bloc de raisonnement avant tout texte. Sélectionnez les blocs de contenu par leur champ type, pas par leur position, et laissez de la marge à max_tokens pour le raisonnement.

Le guide de migration complet se trouve sur la documentation d’Anthropic.

Appeler Haiku 5.5 sur Felo OpenAPI​

La route est active. Voici l’intégration complète.

curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"messages": [
{"role": "user", "content": "Classify this support ticket and extract the order ID."}
]
}'

Felo OpenAPI propose trois surfaces compatibles, donc vous pouvez garder le client que vous utilisez déjà :

SurfaceMéthodeURL
Chat CompletionsPOSThttps://openapi.felo.ai/api/v1/chat/completions
ResponsesPOSThttps://openapi.felo.ai/api/v1/responses
Messages (compatible Anthropic)POSThttps://openapi.felo.ai/api/v1/messages

Comme l’endpoint Messages est compatible Anthropic, les clients Claude n’ont qu’à pointer l’URL de base vers https://openapi.felo.ai/api. Les SDK tiers fonctionnent pareil — définissez baseURL sur https://openapi.felo.ai/api/v1 et gardez votre code existant.

Ajoutez "stream": true pour les événements envoyés par le serveur. La route prend en charge le raisonnement, l’appel d’outils, la sortie JSON, le streaming et la vision — la même surface que le reste du catalogue.

Si vous payez déjà pour Felo Pro, vous avez déjà accès​

Felo Pro inclut l’accès API aux modèles Felo OpenAPI. Si vous êtes abonné, vous n’avez pas besoin d’un second compte pour appeler Haiku 5.5 : créez une clé API, pointez votre agent vers l’endpoint, et vos crédits Felo existants couvrent les appels. La même clé fonctionne sur toute la gamme — Haiku 5.5, Sonnet 5.5, Opus 5.5, GPT-6, Grok 4.7, et les autres.

Deux points à retenir :

  • Les crédits Felo Pro forment un seul pool. Recherche, agents de recherche, slides, images et appels API utilisent le même solde. Les appels de modèles facturent par token, donc une utilisation intensive de l’API consomme les crédits plus vite que quelques recherches par jour.
  • Les API d’outils sont séparées. Les appels de modèles sont couverts par votre accès Pro ; l’utilisation d’outils comme Web Fetch, X Search et la génération de PPT consomme des crédits de la plateforme Felo API.

Pas encore sur Pro ? Chaque compte Felo reçoit 200 crédits gratuits par jour, assez pour tester Haiku 5.5 avant de s’engager.

Où Haiku 5.5 s’intègre​

Où Claude Haiku 5.5 s’intègre : classification, extraction et travail de sous-agent à gros volume entre Sonnet 5.5 et Opus 5.5

Haiku 5.5 est la route à choisir quand la tâche reste simple mais le volume augmente.

  • Sous-agents et compaction — Anthropic cible la synthèse, la compaction et le travail de sous-agent. Exécutez Opus 5.5 ou Sonnet 5.5 sur le raisonnement complexe et laissez Haiku 5.5 gérer la boucle autour à un dixième du prix.
  • Classification, routage et extraction à gros volume — le coût par token détermine si ces fonctionnalités sont déployées. À 0,10 $ par million de tokens d’entrée et 0,50 $ par million de tokens de sortie, le coût marginal d’une classification supplémentaire ne pose plus question.
  • Bots de support et UX sensible à la latence — la route la plus rapide de la gamme, maintenant avec un réglage d’effort pour réduire les dernières millisecondes.
  • Travail sur longs documents — une fenêtre de 1M tokens à prix Haiku permet d’intégrer des transcriptions entières, des ensembles de contrats ou des fichiers logs en un seul appel sans infrastructure de récupération.

Si vous cherchez le plafond absolu en raisonnement complexe, Opus 5.5 reste le modèle phare et il est aussi sur Felo OpenAPI. Sonnet 5.5 demeure le point d’équilibre pour la plupart des usages en production. Haiku 5.5 est le modèle à déployer partout où le budget refusait jusque-là.

Essayez-le maintenant​

Haiku 5.5 est actif sur Felo OpenAPI aujourd’hui, au tarif officiel d’Anthropic, derrière la clé que vous possédez déjà.

Commencez dans le Playground pour tester des prompts sans écrire de code, puis récupérez une clé API et pointez votre agent vers l’endpoint — sous-agents, classificateurs et bots de support coûtent 90 % moins cher à un changement d’ID de modèle.

→ Essayez Claude Haiku 5.5 sur Felo OpenAPI

→ Créez votre clé API


Cet article est également disponible en English, 简体中文, 日本語, 한국어, 繁體中文, हिन्दी, العربية, Русский, اردو, Bahasa Indonesia, Deutsch, Tiếng Việt, Türkçe, Italiano, ไทย, Español, বাংলা and Português.