Cluster · Opus 5 vs Sonnet 5
Claude Opus 5 vs Sonnet 5
Confronto tra Claude Opus 5 e Sonnet 5: prezzi ufficiali, contesto, velocità e quando la differenza di costo si giustifica.
Tempo di lettura: 9 min
Guida operativa · Confronti modelli AI

Fra Claude Opus 5 e Claude Sonnet 5 ci sono due volte e mezzo di differenza di prezzo, contesto identico e una collocazione diversa sulla scala di velocità. È il confronto più frequente nella famiglia Claude, perché è quello in cui la scelta pesa davvero sul budget.
Tutti i dati che seguono sono verificati sulla documentazione ufficiale Anthropic il 19 agosto 2026.
In sintesi
- Opus 5 costa due volte e mezzo Sonnet 5: 5/25 $ contro 2/10 $.
- Stessa finestra di contesto: 1 milione di token per entrambi.
- Stesso output massimo: 128K token.
- Sonnet 5 è più veloce, Opus 5 più capace.
- Opus 5 è il punto di partenza consigliato dalla documentazione.
- Su alto volume e compiti semplici, Sonnet 5 risparmia molto.
I dati a confronto
| Caratteristica | Claude Opus 5 | Claude Sonnet 5 |
|---|---|---|
| Identificativo API | claude-opus-5 | claude-sonnet-5 |
| Input per milione di token | 5 $ | 2 $ |
| Output per milione di token | 25 $ | 10 $ |
| Finestra di contesto | 1M | 1M |
| Output massimo | 128K | 128K |
| Data limite conoscenza | maggio 2026 | gennaio 2026 |
| Livello ragionamento predefinito | alto | alto |
Come nel confronto con Fable 5.1, le caratteristiche strutturali coincidono: stessa finestra, stesso output massimo, stesso livello di ragionamento predefinito. Cambiano prezzo, velocità e capacità sui compiti difficili.
Questa uniformità è una buona notizia per chi deve decidere, perché riduce il problema a una sola domanda: il mio compito richiede la capacità in più, o pago per qualcosa che non uso?
Dove la differenza si vede
Il divario fra le due fasce non è uniforme sui compiti. Si concentra in aree precise, ed è utile sapere quali.
La capacità in più si manifesta soprattutto quando il compito richiede di tenere insieme più cose contemporaneamente: incrociare informazioni da fonti diverse, gestire eccezioni non previste dalle istruzioni, riconoscere che la richiesta contiene un presupposto sbagliato, concatenare deduzioni dove un errore al secondo passo rovina il risultato finale.
Su compiti di riconoscimento e riformulazione — classificare, estrarre, riassumere, rispondere citando un documento — il divario si assottiglia parecchio. Sono compiti in cui il modello intermedio fa già bene il suo mestiere, e la spesa aggiuntiva compra pochissimo.
Quanto si risparmia davvero
Un esempio concreto rende la differenza tangibile. Ipotizziamo 50.000 richieste al mese, ciascuna con 2.000 token di input e 600 di output.
| Voce | Opus 5 | Sonnet 5 |
|---|---|---|
| Input (100M token) | 500 $ | 200 $ |
| Output (30M token) | 750 $ | 300 $ |
| Totale mensile | 1.250 $ | 500 $ |
| Differenza annua | — | 9.000 $ risparmiati |
Novemila dollari all'anno su un volume medio. Se il compito è classificare messaggi o estrarre campi da documenti strutturati, è denaro speso per una capacità che non entra mai in gioco.
Al contrario, se il compito è un agente che concatena cinque passaggi e il modello economico fallisce un caso su quattro, quei novemila dollari si perdono in correzioni manuali e tentativi ripetuti. Il calcolo corretto è sul costo per compito completato, non sul listino: il metodo è in costo per task o prezzo per token.
Quando scegliere l'uno o l'altro
Sonnet 5
- Classificazione e instradamento di messaggi
- Estrazione di campi da documenti
- Sintesi e riformulazione di testi
- Risposte su base documentale
- Volumi alti, compiti ripetitivi
- Latenza percepita dall'utente
Opus 5
- Agenti che concatenano più passaggi
- Analisi che incrociano più fonti
- Interventi su codice esistente
- Casi in cui l'errore costa molto
- Volumi contenuti, valore alto
- Primo progetto senza riferimenti
L'ultima riga della colonna di destra merita una nota: se è il tuo primo progetto AI e non hai termini di paragone, partire da Opus 5 come indica la documentazione è ragionevole. Ti dà un riferimento di qualità. Il passo successivo, però, è provare a scendere: quasi sempre si scopre che Sonnet 5 bastava.
Esempi pratici
E-commerce, risposte automatiche di primo livello. Migliaia di richieste al mese, quasi tutte su spedizioni, resi e disponibilità. Sonnet 5 senza dubbi: il compito è riconoscere l'intento e rispondere da una base documentale, e la latenza conta perché il cliente aspetta.
Studio tecnico, analisi di capitolati. Poche decine di documenti al mese, ognuno lungo e articolato, con clausole che si richiamano fra loro. Qui la capacità di tenere insieme più elementi conta, i volumi sono bassi e il valore per documento è alto: Opus 5 si giustifica.
Azienda manifatturiera, estrazione da bolle e DDT. Volumi altissimi, struttura ripetitiva, documenti spesso scansionati male. Sonnet 5 come base, con un secondo passaggio su Opus 5 solo per i documenti che il primo segnala come illeggibili o incompleti.
La strategia a due modelli
Il terzo esempio descrive l'impostazione che funziona meglio nella pratica, e vale la pena esplicitarla.
Sonnet 5 gestisce tutto il traffico. Per ogni caso produce anche un'indicazione di quanto sia sicuro dell'esito. I casi sotto una certa soglia — documento anomalo, campo mancante, istruzione ambigua — non vengono chiusi: passano a Opus 5.
Se i casi difficili sono il dieci per cento del totale, il conto mensile dell'esempio precedente scende da 1.250 a circa 575 dollari, mantenendo la qualità della fascia alta dove serve davvero.
- Definisci un criterio esplicito di passaggio, non un'intuizione
- Misura la percentuale reale di casi che salgono
- Verifica che il modello leggero riconosca i propri limiti
- Registra gli esiti per tarare la soglia nel tempo
- Controlla a campione i casi chiusi dal modello leggero
L'ultimo punto è il controllo di sicurezza dell'intera impostazione: serve ad accorgersi se il modello economico sta chiudendo con sicurezza casi che avrebbe dovuto passare oltre.
Errori da evitare
- Scegliere Opus 5 per default e non verificare mai se Sonnet 5 basta.
- Scegliere Sonnet 5 solo per il prezzo su compiti multi-passo.
- Confrontare su casi facili. La differenza si vede sui difficili.
- Ignorare la latenza in scenari interattivi.
- Trascurare il cutoff se il compito dipende dalla conoscenza interna.
- Fissare la scelta per sempre senza rimisurarla ogni tanto.
Il quarto mese di conoscenza in più
La documentazione indica maggio 2026 per Opus 5 e gennaio 2026 per Sonnet 5: quattro mesi di differenza sulla data limite della conoscenza.
È una distanza più significativa del mese che separa Opus 5 da Fable 5.1, ma resta rilevante solo per una categoria di compiti: quelli in cui l'informazione deve venire dal modello anziché dai documenti che gli fornisci.
Se stai costruendo un assistente che risponde sulle procedure aziendali, sui contratti in essere o sui listini interni, la data limite non conta nulla: i fatti li dai tu. Se invece il sistema deve rispondere su normativa, su eventi o su qualunque cosa cambi nel tempo senza che tu la fornisca, la differenza diventa concreta — e la soluzione corretta non è scegliere il modello con il cutoff più recente, ma smettere di usare la conoscenza interna come fonte.
Il ragionamento completo, con le date dichiarate per tutta la famiglia, è in knowledge cutoff: cosa significa in pratica.
Cosa provare prima di decidere
C'è una configurazione intermedia che molti saltano e che spesso rende inutile il cambio di modello: Sonnet 5 con il livello di ragionamento alzato.
Alzare l'effort produce più token di output, quindi costa di più, ma il prezzo unitario resta la metà di Opus 5. In diversi casi questa combinazione colma buona parte del divario a un costo comunque inferiore, ed è la prima cosa da provare quando il modello economico non basta ma il salto di fascia sembra eccessivo.
| Configurazione | Costo relativo | Quando provarla |
|---|---|---|
| Sonnet 5, effort predefinito | Base | Sempre, come punto di partenza |
| Sonnet 5, effort alzato | Intermedio | Quando il predefinito non basta |
| Opus 5, effort predefinito | Alto | Quando il ragionamento è il collo di bottiglia |
| Opus 5, effort massimo | Molto alto | Casi difficili a basso volume |
L'ordine di questa tabella è anche l'ordine in cui conviene provare. Salire di riga solo quando la precedente ha fallito su casi reali è la disciplina che separa un progetto AI sostenibile da uno che costa tre volte il necessario. Il funzionamento del parametro è spiegato in reasoning effort: cosa cambia nei confronti.
Esempi pratici
E-commerce, risposte automatiche di primo livello. Migliaia di richieste al mese, quasi tutte su spedizioni, resi e disponibilità. Sonnet 5 senza dubbi: il compito è riconoscere l'intento e rispondere da una base documentale, e la latenza conta perché il cliente aspetta. Su questi volumi la differenza di prezzo si accumula in fretta.
Studio tecnico, analisi di capitolati. Poche decine di documenti al mese, ognuno lungo e articolato, con clausole che si richiamano fra loro. Qui la capacità di tenere insieme più elementi conta davvero, i volumi sono bassi e il valore per documento è alto: Opus 5 si giustifica.
Azienda manifatturiera, estrazione da bolle e DDT. Volumi altissimi, struttura ripetitiva, documenti spesso scansionati male. Sonnet 5 come base, con un secondo passaggio su Opus 5 solo per i documenti che il primo segnala come illeggibili o incompleti.
Come applicarlo in azienda
Il criterio pratico è semplice e va applicato in questo ordine: prova prima Sonnet 5.
Prendi dieci casi reali, di cui tre difficili e uno a cui manca l'informazione richiesta. Se sui tuoi casi non riesci a distinguere gli esiti dei due modelli, hai appena dimezzato la spesa. Se la differenza si vede solo sui casi difficili, la risposta non è salire di fascia su tutto: è l'impostazione a due livelli.
In quell'impostazione Sonnet 5 gestisce tutto il traffico e produce, per ogni caso, anche un'indicazione di quanto sia sicuro. I casi sotto soglia salgono a Opus 5. Se i casi difficili sono il dieci per cento, paghi la fascia alta su un decimo del volume e la spesa resta vicina a quella del modello economico. Il dettaglio è in strategia a modello misto.
C'è poi una configurazione intermedia che molti saltano e che spesso rende inutile il cambio di modello: Sonnet 5 con il livello di ragionamento alzato. Costa più della configurazione base ma il prezzo unitario resta la metà, e in diversi casi colma buona parte del divario. Il funzionamento del parametro è in reasoning effort: cosa cambia nei confronti.
Se vuoi progettare un sistema AI che usi il modello giusto al momento giusto, Giallo Studio aiuta PMI e team a costruire automazioni concrete, misurabili e sostenibili.
Conclusione
Opus 5 e Sonnet 5 condividono finestra, output massimo e livello di ragionamento predefinito. La differenza è nel prezzo — due volte e mezzo — nella velocità e nella capacità sui compiti che richiedono di tenere insieme più elementi.
Il criterio pratico è semplice: prova prima Sonnet 5. Se sui tuoi dieci casi reali non riesci a distinguerlo da Opus 5, hai appena dimezzato la spesa. Se la differenza si vede sui casi difficili, la strategia a due modelli ti dà la qualità dove serve al costo del modello economico ovunque.
Se vuoi progettare un sistema AI che usi il modello giusto al momento giusto, Giallo Studio costruisce agenti e automazioni su misura per le PMI.
Schema consigliato: Article + FAQPage + BreadcrumbList
Risorse correlate
FAQ
Quanto costa Sonnet 5 rispetto a Opus 5?
Secondo la documentazione ufficiale letta il 19 agosto 2026, Sonnet 5 costa 2 dollari per milione di token in input e 10 in output, mentre Opus 5 costa 5 e 25. Opus 5 costa quindi due volte e mezzo di più.
Hanno la stessa finestra di contesto?
Sì, entrambi dichiarano una finestra da 1 milione di token e un output massimo di 128K. Il contesto non è un criterio di scelta fra i due.
Qual è più veloce?
Nella scala di latenza relativa della documentazione ufficiale Sonnet 5 si colloca più vicino ai modelli veloci, Opus 5 più vicino a quelli capaci. Entrambi stanno in posizione intermedia fra Haiku 4.5 e Fable 5.1.
Quando conviene Sonnet 5?
Quando il compito è articolato ma non richiede ragionamento a molti passaggi concatenati: sintesi, risposte su documenti, estrazione strutturata, classificazione complessa. Su volumi alti il risparmio è sostanziale.
Quando conviene Opus 5?
Quando servono ragionamento multi-passo, flussi agentici o compiti in cui un errore costa molto più della chiamata. La documentazione ufficiale lo indica come punto di partenza consigliato della famiglia.
Cambia la data limite della conoscenza?
Sì. La documentazione indica maggio 2026 per Opus 5 e gennaio 2026 per Sonnet 5. La differenza conta solo per compiti che dipendono dalla conoscenza interna del modello, non da documenti forniti.




