Skip to main content

Claude Haiku 5.5 ist jetzt auf Felo OpenAPI verfügbar

· 9 Minuten gelesen
Felo Search Tips Buddy
Committed to answers at your fingertips

Anthropics günstigstes und schnellstes Modell startet am Veröffentlichungstag auf Felo OpenAPI. $0,10/$0,50 pro Million Token, 1M Kontext, adaptive Denkweise – ein API-Schlüssel.

Anthropic veröffentlichte Claude Haiku 5.5 am 7. Oktober 2026. Das Modell steht ab sofort bereit.

Felo OpenAPI hat die Route claude-haiku-5-5 am Starttag hinzugefügt, zum Listenpreis von Anthropic: $0,10 pro Million Eingabe-Token und $0,50 pro Million Ausgabe-Token für Prompts bis zu 100.000 Token. Das liegt 90 % unter dem Preis von Haiku 4.5, wodurch das schnellste Modell der Claude-5.5-Familie auch das günstigste bleibt.

Probiere Claude Haiku 5.5 auf Felo OpenAPI aus: https://openapi.felo.ai/models/anthropic/claude-haiku-5.5

Claude Haiku 5.5 auf Felo OpenAPI: Anthropics schnellste Haiku-Route, 90 % günstiger als Haiku 4.5

Warum dieses Release zählt​

Jedes Haiku war günstig. Zum ersten Mal läuft eine Agentenschleife, ohne dass das Modell zum Engpass wird.

Anthropic beschreibt Haiku 5.5 als das günstigste, schnellste und leistungsfähigste kleine Modell, das je erschienen ist. Die Benchmarks stützen diese Aussage. Im Vergleich zum Vorgänger:

Claude Haiku 4.5Claude Haiku 5.5
Eingabe / Ausgabe$1 / $5$0.10 / $0.50
Cache-Lesen$0.10$0.01
Kontext / max. Ausgabe200K / 64K Token1M / 128K Token
Aufwandsteuerung—5 Stufen, Standard mittel
OSWorld 2.1 (Computer-Nutzung)15,7 %72,4 %
Terminal-Bench 4.00,0 %39,2 %
GDPval-AA v2.17351620
Humanity's Last Exam (ohne Tools)10,2 %45,9 %

Preise pro Million Token, für Prompts bis zu 100.000 Token. Benchmark-Werte laut Anthropic.

Der Leistungssprung übertrifft die Preissenkung. Im Benchmark OSWorld 2.1 für Computer-Nutzung erreicht Haiku 5.5 einen Wert von 72,4 %, während Haiku 4.5 nur 15,7 % schaffte. Terminal-Bench 4.0 steigt von 0,0 % auf 39,2 %. Aufgaben, die bisher ein Mittelklasse-Modell zum 20-fachen Preis erforderten, passen jetzt in die Haiku-Linie.

Die Preisstruktur im Überblick​

Haiku 5.5 unterscheidet sich in einem Punkt vom Rest der Claude-Familie: Die Preise richten sich nach der Prompt-Länge.

  • Prompts bis zu 100.000 Token: $0,10 Eingabe, $0,50 Ausgabe, $0,01 Cache-Lesen – pro Million Token.
  • Prompts über 100.000 Token: $0,50 Eingabe, $2,50 Ausgabe, $0,05 Cache-Lesen.

Alle anderen aktuellen Claude-Modelle rechnen einen festen Satz über das gesamte Kontextfenster ab. Haiku 5.5 bildet die Ausnahme, daher lohnt sich eine neue Kalkulation für jedes Token-Budget.

Für die meisten Anwendungsfälle bleibt die Grenze unerreicht. Laut Anthropic liegen 90 % der Haiku-4.5-Anfragen unter 100.000 Token und profitieren so voll vom Preisnachlass. Da Haiku 5.5 den neueren Tokenizer der Familie nutzt – derselbe Text zählt etwa 30 % mehr Token als bei Haiku 4.5 – schätzt Anthropic die durchschnittliche Kostenersparnis auf etwa 75 % statt glatter 90 %.

Die wichtigste Zahl: $0,01 Cache-Lesen. Agentenschleifen verbrauchen den Großteil ihres Eingabe-Budgets beim erneuten Lesen von Kontext, der schon gesendet wurde; bei einem Cent pro Million Token bleibt eine lange Unterhaltung nahezu kostenlos warm.

Claude Haiku 5.5 Preisstruktur: $0,10 pro Million Eingabe-Token bis zu einem 100.000-Token-Prompt und ein Preissturz von 90 % gegenüber Haiku 4.5

Was sich sonst geändert hat​

Adaptive Denkweise, jetzt mit Aufwandregler. Haiku 5.5 ist das erste Haiku, das den Parameter effort akzeptiert. Die Denkweise passt sich standardmäßig der Aufgabe an, und fünf Aufwandstufen – low, medium, high, xhigh, max, Standard ist medium – ermöglichen den Tausch von Kosten und Geschwindigkeit gegen Antwortqualität. Bei geringem Aufwand überspringt das Modell das Denken bei einfachen Anfragen.

1M-Token-Kontext, 128K maximale Ausgabe. Das Kontextfenster ist fünfmal so groß wie bei Haiku 4.5, die Ausgabemenge doppelt so hoch. Ein Fenster fasst etwa 555.000 Wörter – mehr als die meisten Codebasen, Transkripte oder Dokumentensammlungen, die in einem Durchgang verarbeitet werden sollen.

Ein neuer Tokenizer. Haiku 5.5 nutzt denselben Tokenizer wie Claude 4.7 und spätere Modelle. Anfragen und Antworten behalten ihre Form, aber der Verbrauch steigt für denselben Text, daher brauchen max_tokens-Grenzen und Kostenschätzungen, die auf Haiku 4.5 abgestimmt waren, eine neue Anpassung.

Browser-Nutzung und strengere Ablehnungen. Das Modell unterstützt das Browser-Toolset neben der Computer-Nutzung, und die Sicherheitsklassifizierer können eine Anfrage direkt ablehnen – plane in deinem Client mit einem stop_reason von "refusal".

Fünf Breaking Changes vor der Migration​

Haiku 5.5 ersetzt Haiku 4.5 nicht einfach durch einen neuen Modellnamen. Anthropics Migrationsleitfaden listet die Änderungen; diese fünf brechen bestehende Anfragen.

  1. Manuelle Denkbudgets werden abgelehnt. thinking: {"type": "enabled", "budget_tokens": N} liefert einen 400er-Fehler. Nutze adaptive Denkweise und steuere die Tiefe mit effort. Denktext wird jetzt standardmäßig ausgelassen, also setze thinking.display auf "summarized", wenn du ihn streamst.
  2. Sampling-Parameter werden abgelehnt. Lass temperature, top_p und top_k komplett weg. Jeder Wert außer dem Standard führt zu einem 400er – auch top_p: 1.
  3. Assistant-Prefill wird abgelehnt. Beende messages mit einem Nutzereintrag. Für strukturierte Ausgaben verwende strukturierte Outputs oder Klassifikationstools mit Enum-Feldern statt Prefill-Tricks.
  4. Computer-Nutzung ist jetzt ein Toolset. Ersetze computer_20250124 durch computer_toolset_20260801 auf der Claude API und Google Cloud.
  5. Denkblöcke sind kontogebunden und nur anhängbar. Ein Denkblock bleibt nur im Konto gültig, das ihn erzeugt hat, und nur solange alles Vorherige unverändert bleibt. Halte Konversationen anhängend, wenn du Denkblöcke zurücksendest.

Eine weitere Änderung bleibt still: Denk-Token zählen zu max_tokens, und eine Antwort kann mit einem Denkblock vor jedem Text beginnen. Wähle Inhaltsblöcke nach ihrem type-Feld, nicht nach Position, und gib max_tokens genug Raum zum Denken.

Der vollständige Migrationsleitfaden steht in Anthropics Dokumentation.

Haiku 5.5 auf Felo OpenAPI aufrufen​

Die Route ist live. Hier die komplette Integration.

curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"messages": [
{"role": "user", "content": "Classify this support ticket and extract the order ID."}
]
}'

Felo OpenAPI bietet drei kompatible Oberflächen, sodass du deinen bisherigen Client weiter nutzen kannst:

OberflächeMethodeURL
Chat CompletionsPOSThttps://openapi.felo.ai/api/v1/chat/completions
ResponsesPOSThttps://openapi.felo.ai/api/v1/responses
Messages (Anthropic-kompatibel)POSThttps://openapi.felo.ai/api/v1/messages

Da der Messages-Endpunkt Anthropic-kompatibel ist, müssen Claude-Clients nur die Basis-URL auf https://openapi.felo.ai/api zeigen. Dritthersteller-SDKs funktionieren genauso – setze baseURL auf https://openapi.felo.ai/api/v1 und behalte deinen bestehenden Code.

Füge "stream": true für servergesendete Events hinzu. Die Route unterstützt Reasoning, Toolaufrufe, JSON-Ausgabe, Streaming und Vision – dieselbe Oberfläche wie der Rest des Katalogs.

Wer Felo Pro nutzt, hat schon Zugriff​

Felo Pro enthält API-Zugriff auf Felo OpenAPI-Modelle. Mit einem Abonnement brauchst du kein zweites Konto für Haiku 5.5: Erstelle einen API-Schlüssel, richte deinen Agenten auf den Endpunkt, und deine bestehenden Felo-Credits decken die Aufrufe ab. Der gleiche Schlüssel funktioniert für die ganze Modellreihe – Haiku 5.5, Sonnet 5.5, Opus 5.5, GPT-6, Grok 4.7 und alle weiteren.

Zwei Dinge sind zu beachten:

  • Felo Pro Credits bilden einen Pool. Suche, Recherche-Agenten, Folien, Bilder und API-Aufrufe nutzen dasselbe Guthaben. Modellaufrufe rechnen nach Token ab, daher verbraucht intensive API-Nutzung Credits schneller als ein paar Suchanfragen am Tag.
  • Tool-APIs sind separat. Modellaufrufe sind durch Pro abgedeckt; Tools wie Web Fetch, X Search und PPT-Generierung laufen über Felo API Platform Credits.

Noch kein Pro? Jedes Felo-Konto erhält 200 kostenlose Credits pro Tag – genug, um echte Anfragen an Haiku 5.5 zu stellen, bevor du dich entscheidest.

Wo Haiku 5.5 passt​

Wo Claude Haiku 5.5 passt: Klassifikation, Extraktion und Subagenten-Arbeit mit hohem Volumen zwischen Sonnet 5.5 und Opus 5.5

Haiku 5.5 ist die Route für einfache Aufgaben mit hohem Volumen.

  • Subagenten und Kompaktierung – Anthropic empfiehlt das Modell direkt für Zusammenfassungen, Kompaktierung und Subagenten-Arbeit. Opus 5.5 oder Sonnet 5.5 übernehmen das anspruchsvolle Reasoning, Haiku 5.5 steuert die Schleife außen herum zum Zehntel des Preises.
  • Klassifikation, Routing und Extraktion bei hohem Volumen – Die Kosten pro Token entscheiden, ob diese Features überhaupt umgesetzt werden. Bei $0,10 pro Million Eingabe-Token und $0,50 pro Million Ausgabe-Token wird die nächste Klassifikation zur Nebensache im Budget.
  • Support-Bots und latenzkritische UX – Die schnellste Route im Angebot, jetzt mit Aufwandregler für die letzten Millisekunden.
  • Langdokument-Arbeit – Ein 1M-Fenster zu Haiku-Preisen fasst ganze Transkripte, Vertragssammlungen oder Logdateien in einem Aufruf – ohne Retrieval-Logik.

Wer maximale Reasoning-Leistung braucht, bleibt bei Opus 5.5 – das Flaggschiff steht ebenfalls auf Felo OpenAPI. Sonnet 5.5 bleibt der Allrounder für die meisten Produktiv-Workloads. Haiku 5.5 ist das Modell für alle Einsatzorte, an denen das Budget bisher nein sagte.

Jetzt ausprobieren​

Haiku 5.5 läuft ab sofort auf Felo OpenAPI, zum Listenpreis von Anthropic, hinter deinem bestehenden Schlüssel.

Starte im Playground, um Prompts ohne Code zu testen, dann hole dir einen API-Schlüssel und richte deinen Agenten auf den Endpunkt – Subagenten, Klassifikatoren und Support-Bots kosten mit einer Modell-ID 90 % weniger.

→ Probiere Claude Haiku 5.5 auf Felo OpenAPI aus

→ Erstelle deinen API-Schlüssel


Dieser Beitrag ist auch in folgenden Sprachen verfügbar: English, 简体中文, 日本語, 한국어, 繁體中文, हिन्दी, Français, العربية, Русский, اردو, Bahasa Indonesia, Tiếng Việt, Türkçe, Italiano, ไทย, Español, বাংলা and Português.