Skip to main content

Claude Opus 5.5 è ora in Felo Search: Risposte che resistono

· 8 minuti di lettura
Felo Search Tips Buddy
Committed to answers at your fingertips

Claude Opus 5.5 è disponibile in Felo Search: contesto da 1 milione, $4/$20 per milione di token, e risposte verificate con le prove prima di agire.

Anthropic ha rilasciato Claude Opus 5.5 il 22 settembre, e il dato che conta per la ricerca non si trova nella tabella dei benchmark. È il prezzo: $4 per milione di token in input e $20 per milione di token in output, rispetto ai $5 e $25 di Opus 5. Anthropic indica una riduzione dei costi operativi di circa il 40% su carichi di lavoro tipici, con output oltre il 30% più veloce.

Opus 5.5 è attivo in Felo Search. Più economico e più veloce già rappresentano un vantaggio. Il motivo per cui conviene passare a questo modello per la ricerca è che ha acquisito maggiore attenzione.

Claude Opus 5.5 in Felo Search: un contesto da un milione di token che tiene insieme fonti, prove e avvertenze

Cos’è davvero Claude Opus 5.5​

Opus 5.5 è il primo rilascio di Anthropic dopo che l’azienda ha richiesto pubblicamente di rallentare lo sviluppo di frontiera a settembre. Si trova al vertice della linea Opus, sopra Claude Sonnet 5, mentre la linea Fable è riservata a un altro tipo di impiego.

La specifica è pensata per lavori che devono essere difesi, non solo prodotti: una finestra di contesto da un milione di token, un output massimo di 128.000 token, e letture cache a $0.20 per milione di token che rendono accessibili sessioni lunghe e iterative.

SpecClaude Opus 5.5
Model IDclaude-opus-5-5
MakerAnthropic
Released22 settembre 2026
Context window1.000.000 token
Max output128.000 token
InputTesto, immagine
OutputTesto
Price$4 per milione in input, $20 per milione in output
Cached input$0.20 per milione di token
Prior generationOpus 5, rilasciato il 24 luglio 2026 a $5 / $25

Due righe di questa tabella fanno la differenza per un flusso di lavoro di ricerca.

Un milione di token di contesto. Sono circa 750.000 parole, una pila di documenti sorgente che altrimenti dovresti riassumere prima di porre una domanda. Riassumere introduce errori: il riassunto viene scritto da un modello che non conosce quale dettaglio servirà.

Letture cache a un quinto del prezzo di input. Un’indagine in Felo Search non si limita a una chiamata. Si compone di una prima analisi, una verifica, una revisione e una sintesi, ognuna delle quali rilegge le stesse fonti. La cache trasforma la rilettura ripetuta da costo a dettaglio trascurabile.

Perché la verifica è il vero problema nella ricerca AI​

Chiedi qualcosa a un motore di ricerca AI e ricevi una risposta ben scritta. Questo non rappresenta più una difficoltà. La difficoltà consiste nel capire se la frase su cui stai per agire resisterebbe a una verifica.

La verifica richiede competenze diverse dal riassunto. Consiste nel notare che due fonti descrivono la stessa statistica con denominatori differenti. Consiste nel segnalare che un’affermazione si basa solo su un comunicato stampa. Consiste nel restituire “le prove qui sono scarse” invece di un paragrafo sicuro.

Anthropic ha pubblicato quattro benchmark nell’annuncio di Opus 5.5, e il modello che emerge merita attenzione:

BenchmarkClaude Opus 5.5GPT-6 Astra
Terminal-Bench 4.066.4%57.9%
FrontierCode v1.1 (Main)54.4%53.3%
AutomationBench40.0%41.4%
Terminal-Bench-Science 0.158.7%64.6%

Anthropic guida due benchmark e ne segue due, un risultato più utile di una vittoria totale. Astra mantiene il vantaggio nei lavori scientifici e nell’automazione dei processi aziendali; Opus 5.5 domina nella codifica agentica generale e nel frontier-code.

La nota metodologica conta più dei punteggi. Anthropic ha valutato Opus 5.5 con le protezioni di produzione attive: la stessa configurazione fornita agli utenti, compreso il routing che invia richieste rischiose a un modello precedente. Un sistema di sicurezza che esiste solo nella valutazione non è un sistema di sicurezza. L’azienda riporta anche circa l’85% di tentativi in meno di aggirare i confini rispetto a Opus 5, e il risultato di allineamento più forte finora.

Per la ricerca, quella configurazione rappresenta il prodotto. Un modello che rifiuta di rispondere infastidisce. Un modello che risponde a una domanda che avrebbe dovuto rifiutare, con fluidità e citazioni, crea problemi maggiori.

1. Selezionalo nel selettore dei modelli. Apri Felo Search, scegli Claude Opus 5.5 e poni la domanda nella stessa casella di sempre.

2. Fornisci l’intero set di documenti, non un riassunto. La finestra da un milione di token serve quando smetti di comprimere in anticipo. Carica i documenti, gli articoli, la discussione, tutto, e poni la domanda sul testo completo.

3. Chiedi esplicitamente le avvertenze. “Cosa dovrebbe essere vero perché questa conclusione sia sbagliata?” e “quale di queste fonti è la più debole?” sono domande che un modello addestrato alla verifica affronta in modo diverso rispetto a un riassuntore.

4. Fagli mostrare il disaccordo. Quando le fonti sono in conflitto, chiedi di evidenziare dove concordano, dove divergono e quale affermazione si basa sulle prove più deboli. Questo è l’output che serve davvero in una ricerca.

5. Procedi nello stesso thread. Le letture cache costano poco; ricominciare no. Mantieni la verifica, la correzione e la sintesi finale in una sessione, così il modello conserva le prove originali.

Opus 5.5 è arrivato a distanza di un giorno da altri tre modelli di frontiera, e Felo Search li gestisce tutti e quattro.

ModelReleased byPrice per million tokensContextBuilt for
Grok 4.7SpaceXAI$2 in / $6 out500KRagionamento a lungo termine e lavori di conoscenza
Claude Opus 5.5Anthropic$4 in / $20 out1MRisposte che resistono alla verifica
GPT-6 LunaOpenAI$0.10 in / $0.50 out1.05MRicerca ad alto volume al costo più basso per chiamata
GPT-6 SolOpenAI$2 in / $10 out1.05MLoop agentici e chiamate ripetute a prezzo medio

Opus 5.5 è il più costoso dei quattro per l’output, ed è l’unico per cui il fornitore ha pubblicato la configurazione di sicurezza insieme ai punteggi. Usalo per le domande in cui sbagliare costa più che rallentare.

Cosa provare per primo​

Un’affermazione che vuoi ripetere. Scegli una statistica che stai per inserire in un documento e chiedi a Opus 5.5 di tracciarne l’origine. L’output interessante non è il numero, ma il percorso.

Una decisione con due risposte difendibili. Fornisci entrambe le opzioni e i vincoli, poi chiedi quale sostiene davvero le prove e cosa cambierebbe la risposta.

Un documento che stai per firmare. Contratti, policy e termini di servizio premiano un modello che segnala ciò che manca invece di ciò che è presente.

Un thread di ricerca già svolto. Ripeti una domanda posta un mese fa e confronta le avvertenze. Quel divario mostra ciò che la generazione precedente non faceva.

Claude Opus 5.5 è attivo in Felo Search con una finestra di contesto da un milione di token, prezzi $4/$20 e protezioni di produzione attive. Costa il 40% in meno rispetto al modello precedente e rappresenta la configurazione che Anthropic firma con il proprio nome.

Apri Claude Opus 5.5 in Felo Search →


Questo articolo è disponibile anche in English, 简体中文, 日本語, 한국어, 繁體中文, हिन्दी, Français, العربية, Русский, اردو, Bahasa Indonesia, Deutsch, Tiếng Việt, Türkçe, ไทย, Español, বাংলা and Português.