Claude Opus 5
Il modello Opus di punta di Anthropic, uscito il 24 luglio 2026: intelligenza vicina alla frontiera a metà del prezzo di Claude Fable 5, con il ragionamento attivo per impostazione predefinita e l'intera scala di effort, da low a max.
1M tokens · Text / Vision / Code · Prompt cache
Claude Opus 5 è l'attuale modello Opus di punta di Anthropic, uscito il 24 luglio 2026 come successore di Opus 4.8. Si avvicina all'intelligenza di frontiera di Claude Fable 5 a metà prezzo e, su diverse valutazioni di coding e lavoro di conoscenza — tra cui Frontier-Bench v0.1 e GDPval-AA v2 — lo supera del tutto. Il prezzo resta quello di Opus 4.8, 5 $ in input e 25 $ in output per milione di token: è quindi una sostituzione diretta per gli agenti già in esecuzione sul livello Opus.
Cos'è Claude Opus 5?
Uscito il 24 luglio 2026 · Il livello di punta Opus di Anthropic: sotto Fable 5 come tetto assoluto, davanti a lui in diverse valutazioni agentiche e di lavoro di conoscenza, a metà del prezzo per token. La scelta predefinita su Okou per il lavoro agentico impegnativo.
Anthropic ha rilasciato Claude Opus 5 il 24 luglio 2026 su API Claude, app Claude, Amazon Bedrock, Google Cloud e Microsoft Foundry; Okou lo ha aggiunto come modello integrato il 25 luglio 2026. Succede a Opus 4.8 a parità di prezzo e ne raddoppia quasi il punteggio su Frontier-Bench v0.1: è questa la promessa centrale, molta più capacità allo stesso costo per token.
È posizionato come il cavallo di battaglia per il coding agentico e il lavoro di conoscenza aziendale — funzionalità che toccano più file, refactoring importanti, lunghe esecuzioni autonome e deliverable end-to-end — piuttosto che come il tetto assoluto di capacità. Fable 5 resta in testa sul set più difficile SWE-bench Pro e sull'ampiezza fattuale; Opus 5 vince sul costo per attività completata, il numero che compare in fattura quando il traffico agentico cresce.
Rispetto a Opus 4.8 cambiano due comportamenti dell'API. Il ragionamento è attivo per impostazione predefinita, quindi una richiesta che non configura nulla ora ragiona prima di rispondere, e disattivarlo è possibile solo con effort high o inferiore. Il prompt minimo memorizzabile in cache scende inoltre a 512 token, così i prompt di sistema brevi che prima non erano memorizzabili ora lo sono. Opus 5 arriva anche con tutele rafforzate sulla cybersicurezza: le richieste in ambiti vietati o ad alto rischio possono tornare come rifiuto.
Cosa rende notevole Claude Opus 5
Caratteristiche principali di architettura e capacità.
Opus 5 ha una finestra di contesto da 1 milione di token — il massimo coincide con il valore predefinito — e fino a 128K token di output, con conoscenza aggiornata a maggio 2026. Il ragionamento è attivo per impostazione predefinita e la profondità si imposta con i livelli di effort low, medium, high, xhigh e max; la catena di pensiero grezza non viene mai esposta, solo un riepilogo leggibile. Il prefill del messaggio dell'assistente non è supportato e i parametri di campionamento (temperature, top_p, top_k) vengono rifiutati: il comportamento si guida dal prompt. Gli input comprendono testo, visione ad alta risoluzione e codice.
Specifiche in breve
Benchmark di Claude Opus 5
Punteggi dichiarati dal fornitore, tratti dai materiali di lancio di Anthropic. Gli osservatori indipendenti riportano cifre diverse per gli stessi benchmark a seconda del dataset, del livello di effort e dello scaffold dell'agente: consideratele quindi dipendenti dalla configurazione.
Prezzi di Claude Opus 5
Prezzo di listino del provider, per 1M di token.
Come si comporta Claude Opus 5 nella pratica
Comportamento osservato dalle esecuzioni di agenti in produzione.
Costo per attività completata
Il motivo più chiaro per scegliere Opus 5 al posto di Fable 5: risultati comparabili sul lavoro agentico a circa metà del prezzo per token. Su AutomationBench di Zapier il tasso di successo è circa 1,5 volte quello del miglior modello successivo a parità di costo per attività e, anche al livello di effort più basso, completa più attività di qualsiasi altro modello.
Ragionamento attivo per impostazione predefinita
A differenza di Opus 4.8, una richiesta che omette il parametro di ragionamento riflette prima di rispondere. Tenetene conto: max_tokens limita insieme ragionamento e risposta, quindi un limite tarato su carichi senza ragionamento può troncare l'output. Disattivare il ragionamento è possibile solo con effort high o inferiore.
L'effort è la leva principale sui costi
low e medium sono insolitamente validi su questo modello e spesso eguagliano ciò che i modelli di punta precedenti producevano alle impostazioni massime. Partite da high — xhigh per le esecuzioni di coding e agentiche più difficili — poi scendete e mantenete il livello più economico che le vostre valutazioni continuano ad accettare.
Verifica il proprio lavoro
Opus 5 controlla il proprio output senza che glielo si chieda, quindi le istruzioni di verifica ereditate da modelli più vecchi tendono a produrre passaggi ridondanti. Scrive anche risposte più lunghe per impostazione predefinita: una breve istruzione di concisione funziona meglio che abbassare l'effort.
I migliori task per agenti con Claude Opus 5
La funzionalità multi-file che si chiude in una sola esecuzione
Dategli la specifica completa fin dall'inizio e lasciatelo lavorare. I guadagni di Opus 5 rispetto a Opus 4.8 sono massimi sul lavoro di ingegneria difficile e a più passaggi — refactoring ampi, funzionalità end-to-end — e minimi sulle modifiche in un solo turno: puntatelo quindi sulla parte alta della vostra scala di difficoltà.
L'agente notturno che potete permettervi di lasciare acceso
È nelle lunghe esecuzioni autonome che la differenza di prezzo si accumula. Con qualità vicina a Fable e metà del costo per token, un agente notturno di triage, migrazione o ricerca costa circa la metà per attività completata.
Il flusso di lavoro che deve concludersi, non solo rispondere
Attività a più passaggi con strumenti e uno stato finale reale: aprire ticket, aggiornare fogli di calcolo, riconciliare record. I risultati AutomationBench e OSWorld di Anthropic indicano la stessa cosa: porta a termine attività end-to-end che altri modelli abbandonano a metà.
Claude Opus 5 vs altri modelli
Claude Opus 5 vs Claude Opus 4.8
Stesso prezzo, stesso livello, capacità decisamente superiore: Opus 5 quasi raddoppia il punteggio Frontier-Bench di Opus 4.8 e aggiunge sette punti su SWE-bench Verified. La migrazione è il cambio dell'ID modello più la ritaratura dei prompt: ora il ragionamento è attivo per impostazione predefinita, quindi ricontrollate max_tokens ed eliminate le istruzioni tipo «verifica il tuo lavoro», che oggi generano solo passaggi ridondanti.
Claude Opus 5 vs GPT 5.6 Sol
Entrambi sono modelli agentici di primo livello. Opus 5 supera Sol su Frontier-Bench (43,3% contro 34,4%); Sol guida su DeepSWE v1.1 (72,7% contro 68,8%). Su Okou è una decisione di routing, non di acquisto: fate girare lo stesso agente su entrambi e confrontate.
In sintesi: dovresti usare Claude Opus 5?
Il modello di punta predefinito su Okou. Opus 5 si avvicina abbastanza al tetto di Fable 5 da rendere il prezzo il fattore decisivo per la maggior parte del lavoro agentico, e sostituisce senza attriti tutto ciò che gira già su Opus 4.8. Tenete Sonnet 5 per i loop di routine e riservate Fable 5 alle poche attività che richiedono davvero la parte alta della scala.
Domande frequenti
Quando è uscito Claude Opus 5?
Anthropic ha rilasciato Opus 5 il 24 luglio 2026 su API Claude e app Claude, oltre che su Amazon Bedrock, Google Cloud e Microsoft Foundry. Okou lo ha aggiunto come modello integrato il 25 luglio 2026 (ID modello claude-opus-5).
Claude Opus 5 è migliore di Claude Fable 5?
Su diverse valutazioni sì: Opus 5 supera Fable 5 su Frontier-Bench v0.1, GDPval-AA v2 e SWE-bench Verified. Fable 5 resta in testa sul set più difficile SWE-bench Pro e sull'ampiezza fattuale, e rimane il tetto più alto per il ragionamento più arduo. Per la maggior parte del lavoro agentico, Opus 5 vince sul costo per attività completata.
Il ragionamento è attivo per impostazione predefinita su Claude Opus 5?
Sì. Una richiesta che omette il parametro di ragionamento riflette prima di rispondere: è un cambiamento rispetto a Opus 4.8, dove il ragionamento era disattivato salvo richiesta esplicita. La profondità si controlla con l'effort (low fino a max) e la disattivazione è possibile solo con effort high o inferiore. La catena di pensiero grezza non viene mai restituita, solo un riepilogo leggibile.
Cosa cambia migrando da Opus 4.8?
L'ID del modello e poi la taratura dei prompt. Con il ragionamento attivo per impostazione predefinita, max_tokens copre ora sia il ragionamento sia la risposta; le istruzioni di verifica vanno rimosse anziché riscritte, perché Opus 5 si verifica da solo; e le risposte risultano più lunghe per impostazione predefinita, quindi aggiungete un'istruzione esplicita di concisione se la lunghezza conta.
Alternative
Usare Claude Opus 5 su Okou
Due modi per accedere a Claude Opus 5 su Okou
Okou supporta Claude Opus 5 come modello Built-in fatturato in crediti Okou e tramite bring-your-own con una Anthropic API key. Il percorso Built-in usa il routing Okou Managed e la fascia di prezzo spiegata qui sotto; il percorso bring-your-own ti fa fatturare direttamente dal fornitore a monte e salta del tutto la conversione in crediti Okou.
La raccomandazione di Okou
Okou posiziona Claude Opus 5 come modello principale per orchestrazione, lavoro sul codice e passaggi in cui una risposta errata è costosa.
Crediti e la fascia di prezzo $$$
Okou colloca ogni modello Built-in su una scala di crediti a quattro fasce — $, $$, $$$, $$$$ — mostrata come badge nel selettore dei modelli e sulla riga price tier di zero model ls. Claude Opus 5 si trova a $$$. È questa fascia a determinare quanto viene scalato dal tuo saldo di crediti Okou; il prezzo di listino del fornitore nella tabella qui sopra è quanto addebita il provider a monte prima che Okou lo converta in crediti.
Disponibile su Okou dal July 25, 2026.

