Skip to main content

Claude Haiku 5.5 è disponibile su Felo OpenAPI

· 10 minuti di lettura
Felo Search Tips Buddy
Committed to answers at your fingertips

Il modello più economico e veloce di Anthropic arriva su Felo OpenAPI il giorno del lancio. $0,10/$0,50 per milione di token, contesto da 1M, pensiero adattivo — una sola chiave API.

Anthropic ha rilasciato Claude Haiku 5.5 il 7 ottobre 2026. Puoi utilizzarlo oggi.

Felo OpenAPI ha aggiunto il percorso claude-haiku-5-5 il giorno del lancio, al prezzo di listino di Anthropic: $0,10 per milione di token di input e $0,50 per milione di token di output per prompt fino a 100.000 token. Questo prezzo è inferiore del 90% rispetto a Haiku 4.5, rendendo il modello più veloce della famiglia Claude 5.5 anche il meno costoso da utilizzare.

Prova Claude Haiku 5.5 su Felo OpenAPI: https://openapi.felo.ai/models/anthropic/claude-haiku-5.5

Claude Haiku 5.5 su Felo OpenAPI: il percorso Haiku più veloce di Anthropic, 90% più economico di Haiku 4.5

Perché questo rilascio conta​

Ogni Haiku ha avuto un prezzo basso. Questo è il primo che gestisce un ciclo agente senza diventare il punto debole.

Anthropic descrive Haiku 5.5 come il modello piccolo più economico, veloce e capace che abbia mai rilasciato. I benchmark confermano questa affermazione. Confrontalo con il modello precedente:

Claude Haiku 4.5Claude Haiku 5.5
Input / output$1 / $5$0.10 / $0.50
Lettura cache$0.10$0.01
Contesto / output massimo200K / 64K token1M / 128K token
Controllo sforzo—5 livelli, medio predefinito
OSWorld 2.1 (uso computer)15,7%72,4%
Terminal-Bench 4.00,0%39,2%
GDPval-AA v2.17351620
Humanity's Last Exam (senza strumenti)10,2%45,9%

Prezzi per milione di token, per prompt fino a 100.000 token. Dati benchmark come riportato da Anthropic.

Il salto di capacità supera il taglio di prezzo. Su OSWorld 2.1, un benchmark sull’uso del computer, Haiku 5.5 ottiene il 72,4% dove Haiku 4.5 raggiungeva il 15,7%. Terminal-Bench 4.0 passa dallo 0,0% al 39,2%. Lavori che richiedevano un modello di fascia media a un prezzo venti volte superiore ora rientrano nella linea Haiku.

Il prezzo, spiegato​

Haiku 5.5 si distingue dal resto della famiglia Claude in un aspetto importante: il prezzo varia in base alla lunghezza del prompt.

  • Prompt fino a 100.000 token: $0,10 input, $0,50 output, $0,01 lettura cache — per milione di token.
  • Prompt oltre 100.000 token: $0,50 input, $2,50 output, $0,05 lettura cache.

Ogni altro modello Claude attuale applica un prezzo fisso su tutta la finestra di contesto. Haiku 5.5 è l’eccezione, quindi ogni budget calcolato in token va rivisto.

Per la maggior parte dei carichi di lavoro il limite non viene raggiunto. Anthropic indica che il 90% delle richieste Haiku 4.5 rimane sotto i 100.000 token, quindi ottengono il taglio completo del 90%. Poiché Haiku 5.5 usa il tokenizer più recente della famiglia — lo stesso testo conta circa il 30% di token in più rispetto a Haiku 4.5 — Anthropic stima una riduzione media del costo di circa il 75% invece di un netto 90%.

Il dato da evidenziare è $0,01 lettura cache. I cicli agente consumano la maggior parte del budget di input rileggendo il contesto già inviato; a un centesimo per milione di token, mantenere una conversazione lunga costa quasi nulla.

Prezzi Claude Haiku 5.5: $0,10 per milione di token di input fino a un prompt da 100.000 token, e un calo del 90% rispetto a Haiku 4.5

Cos’altro è cambiato​

Pensiero adattivo, ora con regolazione dello sforzo. Haiku 5.5 è il primo Haiku che accetta il parametro effort. Il pensiero si adatta al compito in modo predefinito, e cinque livelli di sforzo — basso, medio, alto, xhigh, max, con medio come predefinito — permettono di bilanciare costo e velocità rispetto alla qualità della risposta. A sforzo basso, il modello salta il pensiero su richieste semplici.

Contesto da 1M token, output massimo 128K. Cinque volte la finestra di contesto di Haiku 4.5 e il doppio del limite di output. Una finestra contiene circa 555.000 parole, più di molti codebase, trascrizioni o insiemi di documenti su cui ragionare in una sola chiamata.

Un nuovo tokenizer. Haiku 5.5 usa lo stesso tokenizer di Claude 4.7 e modelli successivi. Le richieste e le risposte mantengono la forma, ma il conteggio dei token aumenta per lo stesso testo, quindi i limiti max_tokens e le stime di costo impostate su Haiku 4.5 vanno riviste.

Uso browser e rifiuti più decisi. Il modello supporta il set di strumenti per l’uso browser insieme a quello per computer, e i classificatori di sicurezza possono rifiutare una richiesta — prevedi un stop_reason pari a "refusal" nel tuo client.

Cinque cambiamenti che interrompono la compatibilità prima della migrazione​

Haiku 5.5 non sostituisce semplicemente l’ID modello nel codice che gira su Haiku 4.5. La guida di migrazione di Anthropic elenca i cambiamenti; questi sono i cinque che interrompono le richieste esistenti.

  1. I budget di pensiero manuali vengono rifiutati. thinking: {"type": "enabled", "budget_tokens": N} restituisce un 400. Usa il pensiero adattivo e regola la profondità con effort. Il testo di pensiero ora viene omesso per impostazione predefinita, quindi imposta thinking.display su "summarized" se lo vuoi in streaming.
  2. I parametri di campionamento vengono rifiutati. Escludi completamente temperature, top_p e top_k. Qualsiasi valore diverso dal predefinito restituisce un 400 — incluso top_p: 1.
  3. Assistant prefill viene rifiutato. Termina messages con un turno utente. Per output strutturati, usa output strutturati o strumenti di classificazione con campi enum invece di trucchi di prefill.
  4. L’uso computer è passato a un set di strumenti. Sostituisci computer_20250124 con computer_toolset_20260801 su Claude API e Google Cloud.
  5. I blocchi di pensiero sono legati all’account e solo aggiuntivi. Un blocco di pensiero rimane valido solo nell’account che lo ha generato e solo finché tutto ciò che lo precede resta invariato. Mantieni le conversazioni solo aggiuntive quando invii blocchi di pensiero indietro.

Un altro cambiamento è silenzioso: i token di pensiero contano verso max_tokens, e una risposta può iniziare con un blocco di pensiero prima di qualsiasi testo. Seleziona i blocchi di contenuto dal campo type, non dalla posizione, e lascia spazio a max_tokens per pensare.

La guida completa alla migrazione si trova su Anthropic docs.

Chiamare Haiku 5.5 su Felo OpenAPI​

Il percorso è attivo. Ecco l’integrazione completa.

curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"messages": [
{"role": "user", "content": "Classify this support ticket and extract the order ID."}
]
}'

Felo OpenAPI offre tre superfici compatibili, così puoi mantenere il client che già usi:

SuperficieMetodoURL
Chat CompletionsPOSThttps://openapi.felo.ai/api/v1/chat/completions
ResponsesPOSThttps://openapi.felo.ai/api/v1/responses
Messages (compatibile Anthropic)POSThttps://openapi.felo.ai/api/v1/messages

Poiché l’endpoint Messages è compatibile Anthropic, i client in stile Claude richiedono solo l’URL base puntato su https://openapi.felo.ai/api. Gli SDK di terze parti funzionano allo stesso modo — imposta baseURL su https://openapi.felo.ai/api/v1 e mantieni il codice esistente.

Aggiungi "stream": true per eventi inviati dal server. Il percorso supporta ragionamento, chiamata strumenti, output JSON, streaming e visione — la stessa superficie del resto del catalogo.

Se hai già Felo Pro, hai già accesso​

Felo Pro include l’accesso API ai modelli Felo OpenAPI. Se hai un abbonamento, non serve un secondo account per chiamare Haiku 5.5: crea una chiave API, punta il tuo agente all’endpoint e i crediti Felo coprono le chiamate. La stessa chiave funziona su tutta la linea — Haiku 5.5, Sonnet 5.5, Opus 5.5, GPT-6, Grok 4.7 e gli altri.

Due cose da ricordare:

  • I crediti Felo Pro sono un unico pool. Ricerca, agenti di ricerca, slide, immagini e chiamate API consumano lo stesso saldo. Le chiamate modello vengono fatturate a token, quindi un uso intenso dell’API consuma crediti più rapidamente rispetto a qualche ricerca al giorno.
  • Le API degli strumenti sono separate. Le chiamate modello sono coperte dall’accesso Pro; strumenti come Web Fetch, X Search e generazione PPT utilizzano crediti Felo API Platform.

Non hai Pro? Ogni account Felo riceve 200 crediti gratuiti al giorno, sufficienti per eseguire richieste reali su Haiku 5.5 prima di decidere.

Dove si colloca Haiku 5.5​

Dove si colloca Claude Haiku 5.5: classificazione ad alto volume, estrazione e lavoro subagente tra Sonnet 5.5 e Opus 5.5

Haiku 5.5 è il percorso da scegliere quando il lavoro è semplice ma il volume è elevato.

  • Subagenti e compattazione — Anthropic indica direttamente sintesi, compattazione e lavoro subagente. Esegui Opus 5.5 o Sonnet 5.5 sul ragionamento complesso e lascia che Haiku 5.5 gestisca il ciclo intorno a esso a un decimo del prezzo.
  • Classificazione, routing ed estrazione ad alto volume — il costo per token determina se queste funzioni vengono implementate. A $0,10 per milione di token di input e $0,50 per milione di token di output, il costo marginale di una classificazione in più non rappresenta più un problema di budget.
  • Bot di supporto e UX sensibile alla latenza — il percorso più veloce della linea, ora con regolazione dello sforzo per ridurre al minimo i millisecondi.
  • Lavoro su documenti lunghi — una finestra da 1M a prezzi Haiku permette di inserire trascrizioni complete, set di contratti o file di log in una sola chiamata senza necessità di recupero.

Se serve il massimo livello di ragionamento complesso, Opus 5.5 resta il modello di punta ed è disponibile su Felo OpenAPI. Sonnet 5.5 rimane il punto di equilibrio per la maggior parte dei carichi di lavoro in produzione. Haiku 5.5 è il modello da usare ovunque il budget prima impediva l’implementazione.

Provalo ora​

Haiku 5.5 è attivo su Felo OpenAPI oggi, al prezzo di listino Anthropic, dietro la chiave che già possiedi.

Inizia dal Playground per testare i prompt senza scrivere codice, poi crea una chiave API e punta il tuo agente all’endpoint — subagenti, classificatori e bot di supporto costano il 90% in meno con un solo ID modello.

→ Prova Claude Haiku 5.5 su Felo OpenAPI

→ Crea la tua chiave API


Questo articolo è disponibile anche in English, 简体中文, 日本語, 한국어, 繁體中文, हिन्दी, Français, العربية, Русский, اردو, Bahasa Indonesia, Deutsch, Tiếng Việt, Türkçe, ไทย, Español, বাংলা and Português.