Claude Opus 5 ora su Felo: Funzionalità, Prezzi e Prova Gratuita di 7 Giorni
Felo ora supporta Claude Opus 5. Esplora funzionalità, benchmark, sicurezza e prezzi, poi prova gratuitamente per 7 giorni il modello agentico di Anthropic.
Felo ora supporta Claude Opus 5, il nuovo modello di livello Opus di Anthropic per coding agentico, analisi professionale e lavori di lunga durata. Sceglilo su Felo quando un compito richiede più di una semplice risposta iniziale: serve ricerca, verifica, iterazione e un risultato che puoi revisionare con sicurezza.
Per celebrare il lancio, gli abbonati Felo Pro possono utilizzare Claude Opus 5 senza costi aggiuntivi per sette giorni a partire dalla data di rilascio. Portagli un bug ostinato, un brief di ricerca con evidenze contrastanti, un’analisi multi-step o un documento che necessita più di una revisione per essere corretto—e giudicalo su lavori che contano davvero per te.

Immagine di copertina: opera originale dall’annuncio di Claude Opus 5 di Anthropic. Il contenuto visivo è invariato; Felo ha aggiunto solo il bordo grigio.
Questo è più di una nota di rilascio. Di seguito trovi una guida visiva su cosa è progettato Opus 5, cosa riporta Anthropic nelle sue valutazioni, dove rimangono i limiti e come testarlo su lavori reali in Felo.
Pronto a provarlo? Inizia la tua prova di 7 giorni di Claude Opus 5 su Felo ->
Funzionalità di Claude Opus 5: cosa è progettato per fare il modello
Anthropic ha rilasciato Claude Opus 5 il 24 luglio 2026, presentandolo come modello ad alta capacità per l’uso quotidiano in agenti di lunga durata, ingegneria software e lavori professionali di conoscenza. Nella descrizione di Anthropic, il cambiamento chiave non è semplicemente una risposta iniziale migliore. Opus 5 è pensato per lavorare in modo più deliberato: verificare risultati intermedi, mantenere il filo di un compito complesso e iterare quando il primo tentativo non risolve il vero problema.
Questa distinzione conta nel lavoro pratico. Una domanda di routine può richiedere solo una risposta rapida e concisa. Un incarico più grande può richiedere che il modello legga materiale di partenza, decida cosa deve ancora sapere, esegua un calcolo o uno strumento, confronti alternative, verifichi il suo output e spieghi il risultato. Sono questi i casi in cui un modello di livello Opus vale davvero la pena di essere scelto.
Anthropic evidenzia tre punti di forza sovrapposti:
- Coding agentico: funzionalità più grandi, debugging difficile, analisi delle cause profonde, refactoring e compiti che coinvolgono più di un file o strumento.
- Lavoro di conoscenza e analisi: ragionamento strutturato su materiale denso, lavoro numerico e su tabelle, due diligence, ricerca e supporto decisionale.
- Workflow di utilizzo del computer e automazione: completamento di una sequenza di passaggi invece di produrre una singola risposta isolata.
Nessuna di queste affermazioni significa che un modello debba essere lasciato senza controllo. Significa però che può produrre una bozza più completa di lavori difficili prima che una persona revisioni decisioni, evidenze e azioni finali.
Benchmark e capacità di Claude Opus 5
I benchmark dei modelli sono segnali utili, non una garanzia che il modello si comporterà allo stesso modo in ogni progetto. Dipendono dal compito, dal contesto, dalle impostazioni e dal metodo di valutazione. Tuttavia, il rilascio di Anthropic offre un quadro utile dei problemi che Opus 5 mira a risolvere.
Per l’ingegneria software, Anthropic riporta che Opus 5 guida la sua esecuzione interna di Frontier-Bench v0.1 e più che raddoppia la performance riportata di Opus 4.8 a un costo inferiore per compito. Il grafico qui sotto è utile perché rende concreto il compromesso: la serie arancione di Opus 5 supera i risultati precedenti di Opus su tutte le impostazioni di sforzo, non solo al punto più costoso.

Fonte: Anthropic, Introducing Claude Opus 5. Grafico originale mostrato invariato; bordo grigio aggiunto da Felo. Il grafico nota che l’esecuzione Frontier-Bench ha usato un harness mini-SWE-agent, backend GKE e ricompensa media su cinque tentativi per compito.
Su CursorBench 3.2, Anthropic afferma che il modello si avvicina entro lo 0,5% al punteggio massimo di Claude Fable 5 con massimo sforzo, mentre costa la metà per compito. Ecco perché Opus 5 è più interessante per compiti dove un primo tentativo di bassa qualità genera più lavoro: debugging su una codebase, costruzione di una funzionalità end-to-end o individuazione della causa principale invece di correggere il sintomo.
Per la risoluzione di problemi più ampia e lavori in stile ufficio, l’azienda riporta che Opus 5:
- ha ottenuto un punteggio tre volte superiore al modello successivo su ARC-AGI 3, una valutazione di problem solving innovativo;
- ha raggiunto circa 1,5 volte il tasso di successo del modello successivo allo stesso costo su Zapier AutomationBench, che testa l’automazione aziendale end-to-end;
- ha superato altri modelli a costo comparabile su OSWorld 2.0, un benchmark di utilizzo del computer; e
- è il suo modello migliore e più efficiente in termini di costo nelle valutazioni ARC-AGI 3, GDPval-AA v2, HLE, AutomationBench e DeepSearchQA.
Il quadro non si limita al codice. Il grafico GDPval-AA v2 di Anthropic traccia compiti di conoscenza reale su diversi livelli di sforzo. Aiuta a spiegare perché Opus 5 può essere rilevante per ricerca, finanza, legale, operations e altri lavori dove una risposta deve resistere alla revisione, non solo essere convincente al primo passaggio.

Fonte: Anthropic, Introducing Claude Opus 5. Grafico originale mostrato invariato; bordo grigio aggiunto da Felo.
Questi sono risultati pubblicati da Anthropic, inclusi test interni e feedback selezionato da early-access, non classifiche universali indipendenti. Il modo più produttivo di leggerli è come guida su dove testare il modello personalmente: compiti con lunghe catene di dipendenza, requisiti ambigui, uso di strumenti, verifica e conseguenze significative se una risposta superficiale passa inosservata.
Funzionalità di Claude Opus 5: perché lo “sforzo” cambia l’esperienza
Opus 5 supporta diverse impostazioni di sforzo. In breve, lo sforzo ti permette di bilanciare velocità di risposta e uso di token contro tempo di ragionamento aggiuntivo. I grafici di Anthropic confrontano il modello su vari livelli di sforzo, da impostazioni basse pensate per risparmiare token fino a sforzo alto, xhigh e massimo.
Questo è utile perché non ogni richiesta merita lo stesso budget. Usa un’impostazione bassa per una classificazione rapida, un outline o una revisione mirata. Aumenta lo sforzo quando il compito ha più vincoli, quando il modello deve conciliare fonti o diagnosticare perché un tentativo precedente è fallito. Per output critici, dedica il tempo risparmiato anche a una revisione: chiedi al modello di identificare assunzioni, citare fonti, testare edge case o spiegare cosa cambierebbe la sua raccomandazione.
Il lancio introduce anche una modalità Fast opzionale tramite la piattaforma di Anthropic. Anthropic afferma che funziona a circa 2,5 volte la velocità standard e costa il doppio del prezzo base lì. Disponibilità e controlli possono variare a seconda del prodotto, quindi su Felo dovresti usare le impostazioni mostrate nel tuo workspace invece di assumere che ogni opzione Anthropic sia identica ovunque.
La differenza si vede in come si verifica
Il tema più interessante del rilascio è la verifica. Anthropic descrive una valutazione in cui Opus 5 ha ricevuto un disegno di una parte meccanica senza modo diretto di visualizzarla. Invece di fermarsi, il modello avrebbe scritto una pipeline di computer vision per recuperare la geometria dai pixel grezzi, poi ricostruito la parte come modello 3D in FreeCAD. In un altro esempio, Anthropic afferma che il modello ha trovato la causa principale di un vero bug nel package manager e ha risolto un edge case sfuggito a una patch della community.
Esempi come questi vanno considerati come dimostrazioni del produttore, non come promesse. Ma suggeriscono un pattern concreto di prompting su Felo: non chiedere solo la risposta. Chiedi il ciclo di lavoro.
Indaga sul problema, poi proponi una soluzione.
Prima di finalizzare, verifica la soluzione rispetto ai requisiti dichiarati,
elenca eventuali assunzioni e identifica test o evidenze che potrebbero confutarla.
Restituisci la raccomandazione finale separatamente dalle note di lavoro.
Per la ricerca, lo stesso approccio può trasformare un prompt ampio in un processo revisionabile: raccogli fonti attuali, distingui fatti da inferenze, cerca controevidenze e produci un brief decisionale conciso. Il workflow multilingue di Felo è particolarmente utile quando materiale rilevante appare in più lingue; chiedi che la lingua originale sia preservata accanto a una sintesi chiara in inglese quando necessario.
Anthropic riporta anche risultati forti su OSWorld 2.0, un benchmark per l’uso del computer tramite interfacce multi-step. È un promemoria utile che il lavoro agentico spesso non è “un prompt, una risposta.” È una sequenza di verifica dello stato, scelta dell’azione successiva e validazione che il risultato soddisfi davvero l’obiettivo.

Fonte: Anthropic, Introducing Claude Opus 5. Grafico originale mostrato invariato; bordo grigio aggiunto da Felo.
La performance non è l’unico fattore: sicurezza e limiti
Anthropic riporta che il suo audit comportamentale pre-deployment ha trovato Opus 5 il modello più allineato tra quelli recenti. Dice che il modello ha mostrato comportamento meno disallineato, minore comportamento ingannevole e maggiore resistenza a prompt di abuso rispetto ad altri modelli Claude recenti. L’azienda afferma anche che Opus 5 non estende il confine delle capacità rischiose dual-use nei test di biologia e cybersecurity offensiva.
Il seguente grafico di audit è il riassunto visivo più chiaro di questa affermazione. Sulla scala Anthropic 1-10 di comportamento disallineato, più basso è meglio; Opus 5 è mostrato a 2,30, sotto gli altri modelli recenti nel confronto. È una valutazione interna di sicurezza, quindi dovrebbe informare—non sostituire—controlli umani attenti su lavori importanti.

Fonte: Anthropic, Introducing Claude Opus 5. Grafico originale mostrato invariato; bordo grigio aggiunto da Felo.
Il punto pratico importante è che le salvaguardie rimangono parte del prodotto. Anthropic afferma che Opus 5 può aiutare a trovare vulnerabilità nel codice sorgente ma applica barriere più forti su alcune attività cyber, inclusi vulnerability scanning su binari, penetration testing e generazione di exploit. Le richieste che attivano queste salvaguardie possono essere bloccate o, in alcuni prodotti Anthropic, passare a un altro modello.
Per tutti gli altri lavori, mantieni le stesse buone abitudini che useresti con qualsiasi modello capace:
- Revisiona affermazioni fattuali, calcoli, citazioni, codice e azioni finali prima di affidarti a loro.
- Non trattare la fluidità come evidenza. Chiedi fonti primarie e ispezionale.
- Mantieni una responsabilità umana per decisioni legali, finanziarie, mediche, di sicurezza e altre di rilievo.
- Dai al modello una condizione di successo chiara e i limiti che non deve superare.
Anthropic nota anche che Opus 5 ha ancora limiti importanti su compiti di ricerca autonoma di lunga durata. Capacità non è autonomia, e un ciclo di revisione umana ben progettato rimane parte di un workflow solido.
Prezzi di Claude Opus 5 e prova gratuita su Felo
Anthropic elenca Claude Opus 5 a $5 per milione di token input e $25 per milione di token output tramite l’API Claude, gli stessi prezzi base di Opus 4.8. I prezzi su piattaforme terze, abbonamenti e funzionalità possono variare, quindi usa le informazioni di prezzo e utilizzo mostrate nel prodotto che usi.
Per gli abbonati Felo Pro, il punto immediato è più semplice: Claude Opus 5 è gratuito da provare per sette giorni dal rilascio. Questo ti permette di valutarlo su compiti reali prima di decidere dove inserirlo nel tuo mix di modelli abituale. Un confronto sensato non è solo “Quale modello ha scritto la bozza migliore?” Prova lo stesso compito difficile con il modello che usi oggi, poi confronta completezza, tasso di errore, necessità di follow-up, qualità nella gestione delle fonti e quanto tempo di revisione richiede ciascun risultato.
Come provare Claude Opus 5 gratis per 7 giorni su Felo Pro
- Accedi al tuo account Felo Pro.
- Avvia un nuovo compito nel workspace Felo che usi normalmente per ricerca, scrittura, analisi o lavoro agentico.
- Seleziona Claude Opus 5 nel selettore dei modelli.
- Assegnagli un compito con un deliverable chiaro, file o contesto rilevante e un passaggio esplicito di verifica.
- Revisiona il risultato, affina l’istruzione dove necessario e confrontalo con il tuo workflow attuale durante l’offerta di lancio di sette giorni.
Inizia con lavori che rivelano i punti di forza del modello: un piano di progetto che richiede compromessi, un foglio di calcolo o report complesso, una code review difficile, una domanda di ricerca multi-fonte o un’analisi che deve resistere a domande successive. L’obiettivo non è far sembrare il modello impressionante con un prompt ingegnoso. È scoprire se rende il tuo lavoro reale più chiaro, affidabile e facile da completare.
Usa l’offerta su un compito che conta: Inizia la tua prova di Claude Opus 5 su Felo ->
Vale la pena provare Claude Opus 5?
Claude Opus 5 porta una nuova opzione su Felo per compiti che premiano la persistenza, il ragionamento accurato e la verifica. I suoi risultati pubblicati indicano progressi significativi in coding agentico, automazione, uso del computer e analisi professionale, mentre i suoi vincoli di sicurezza e limiti rimangono un contesto importante.
Per i prossimi sette giorni, gli abbonati Felo Pro possono valutarlo senza costi aggiuntivi per il modello. Porta un compito che conta davvero, chiedigli di mostrare e verificare il suo lavoro e decidi dal risultato se Claude Opus 5 merita un posto permanente nel tuo workflow.
Inizia la tua prova di 7 giorni di Claude Opus 5 su Felo ->
Fonti e approfondimenti
- Anthropic, "Introducing Claude Opus 5", 24 luglio 2026.
- Anthropic, "Prompting Claude Opus 5".
- Anthropic, Claude Platform pricing.
Questo articolo è disponibile anche in English, 简体中文, 日本語, 한국어, 繁體中文, हिन्दी, Français, العربية, Русский, اردو, Bahasa Indonesia, Deutsch, Tiếng Việt, Türkçe, ไทย, Español, বাংলা and Português.