Vai al contenuto
Giallo

I livelli di ragionamento di Claude Opus 5.5: cosa sono e quando alzarli

Cosa sono i cinque livelli di ragionamento di Claude Opus 5.5, cosa significa che pensa da solo, quando alzare il livello e quanto costa in tempo e token.

Di

Aggiornato il

Tempo di lettura: 10 min

I cinque livelli di ragionamento di Claude Opus 5.5

Claude Opus 5.5 ha cinque livelli di ragionamento — low, medium, high, xhigh e max — e una regola che li governa tutti: il modello pensa sempre prima di rispondere e decide da solo quanto, dentro il livello che hai impostato. Anthropic lo chiama ragionamento adattivo, e cambia due abitudini: non serve più chiedere di ragionare nel prompt, e il livello va scelto in base al compito, non tenuto al massimo per prudenza.

La scelta ha un costo in due valute — token e attesa — e un beneficio che non è lineare: su molti compiti il livello basso è già sufficiente, e su alcuni è perfino migliore di un modello precedente al livello alto. Dati verificati il 23 settembre 2026.

In sintesi

  • Cinque livelli: low, medium, high, xhigh, max. Default: medium.
  • Il modello pensa sempre e decide quanto, dentro il livello impostato.
  • Le righe "ragiona passo passo" nel prompt non servono: il livello si imposta altrove.
  • I benchmark ufficiali sono al massimo: non confrontarli con il tuo livello medio.
  • Alzare costa token di ragionamento e attesa iniziale.
  • Per revisione, estrazione, classificazione il livello basso spesso basta.

Cosa significa "ragionamento adattivo"

Nei modelli precedenti il ragionamento era in gran parte una cosa che chiedevi tu, nel prompt, con formule tipo "pensa passo passo". Con Opus 5.5 il ragionamento è sempre presente e dosato dal modello: davanti a una domanda semplice pensa poco, davanti a un problema con molte condizioni pensa di più, e il livello che imposti è il tetto dentro cui può muoversi.

La conseguenza pratica è doppia. Primo: le righe sul ragionamento vanno tolte dai prompt, perché non alzano il livello e allungano l'attesa. Secondo: se vuoi una risposta secca, la formula giusta è "rispondi direttamente", che riduce il ragionamento per quella risposta. Il resto della revisione dei prompt è in prompt per Claude Opus 5.5.

I cinque livelli, in pratica

Anthropic non pubblica una descrizione formale di ciascun livello, quindi quello che segue è una guida d'uso, non una specifica. Verifica sempre la documentazione ufficiale della piattaforma per i parametri esatti.

Livello Quando ha senso Cosa aspettarsi
low Classificare, estrarre, riassumere, rivedere un diff Risposte rapide, costo minimo
medium (default) Lavoro quotidiano: bozze, analisi brevi, domande Il compromesso che Anthropic ha scelto come base
high Problemi con molte condizioni, codice con logica non banale Più attesa, più token, risultati più stabili sui casi difficili
xhigh Compiti lunghi in più passaggi, migrazioni, audit Il livello usato da Anthropic su Terminal-Bench
max Ricerca, problemi aperti, quando un errore costa molto Il livello dei benchmark ufficiali

Il punto che sfugge più spesso: i numeri pubblicati nelle tabelle sono al massimo livello. Se usi Opus 5.5 a medium e confronti i risultati con la tabella, stai confrontando due cose diverse.

Cosa costa alzare il livello

Due voci, e vanno misurate separatamente.

I token di ragionamento. Il pensiero del modello si paga come output — a Opus 5.5, 20 dollari per milione di token — e non si vede nella risposta. A livello alto, su un compito complesso, possono superare i token della risposta stessa. Come si legge il conto è in cosa sono i token.

L'attesa prima della prima parola. Il ragionamento avviene tutto prima che compaia la risposta: più è lungo, più l'utente guarda uno schermo fermo. Per un'interfaccia usata da persone è il numero che conta di più, come spiegato in tempo al primo token. Per un lotto notturno non conta nulla.

Attenzione Alzare il livello "per sicurezza" su tutti i compiti è il modo più comune di raddoppiare il costo di un sistema senza migliorarne i risultati. Il livello si sceglie per compito, non per abitudine.

Il dato che ribalta l'intuizione

Per la revisione del codice Anthropic riporta che un primo utilizzatore ha visto Opus 5.5 al livello più basso trovare più bug di Opus 5 al livello alto, con meno falsi allarmi. È un dato riportato, non un benchmark, ma dice una cosa importante: il livello basso di Opus 5.5 non è una versione ridotta del modello — è lo stesso modello con meno tempo di riflessione, e su compiti di attenzione (leggere bene ogni riga) può bastare.

La lezione generale: prova prima il livello basso, misura, e alza solo dove i risultati lo chiedono. Il metodo per la revisione è in revisione del codice con Opus 5.5.

Come scegliere il livello per compito

  1. Prendi cinquanta casi reali del compito, con il criterio di correttezza scritto prima.
  2. Esegui a low. Conta i corretti. Se la percentuale è accettabile, hai finito: quel compito gira a low.
  3. Sali di un livello solo se i corretti non bastano, e riesegui sullo stesso campione.
  4. Fermati al primo livello che supera la soglia. Il livello successivo costa di più e non ti serve.
  5. Segna il livello scelto accanto al prompt, così quando cambierai modello saprai da dove ripartire.

Dove si imposta il livello

Il livello non si scrive nel prompt: si imposta nello strumento che usi.

Dove Come
App Claude Dalle impostazioni della conversazione o del progetto, dove disponibile per il piano
Claude Code Con il comando dedicato al livello di sforzo, per sessione o nel file di configurazione
API Con il parametro del ragionamento nella richiesta; il nome esatto è nella documentazione ufficiale
Piattaforme cloud Stesso parametro, esposto secondo la convenzione della piattaforma

Verifica sempre la documentazione della piattaforma prima di mettere un livello in produzione: i nomi dei parametri cambiano, e un livello impostato male su un sistema automatico si paga a ogni chiamata per mesi senza che nessuno se ne accorga. Il modo per accorgersene è una riga nel registro delle chiamate con il livello usato e i token di ragionamento consumati: se quella colonna cresce senza che i risultati migliorino, il livello è troppo alto.

Livello e velocità: due cose diverse

Il livello di ragionamento agisce prima della prima parola: più è alto, più il modello pensa prima di iniziare a scrivere. La modalità veloce di Opus 5.5 agisce dopo: fa uscire il testo più in fretta, allo stesso livello di ragionamento, a un costo doppio. Sono due manopole indipendenti, e si combinano: un livello basso in modalità veloce è la configurazione più reattiva possibile, un livello massimo in modalità standard la più riflessiva. Quando conviene pagare per la velocità è in Fast mode di Opus 5.5.

Esempi pratici

Azienda di logistica, 30 dipendenti, Piacenza. Smistamento delle mail in arrivo in sei categorie. A low: 96% di classificazioni corrette su cento mail. A medium: 97%. La differenza non valeva il costo e l'attesa: il sistema gira a low, e il risparmio sul mese è la voce più grande del progetto.

Studio di ingegneria, 5 persone, Trento. Verifica di capitolati con decine di condizioni incrociate. A low e medium il modello perdeva i vincoli fra sezioni lontane; a high li teneva. Lì il livello alto è giustificato, e siccome il compito è raro — qualche capitolato al mese — il costo è trascurabile. Stesso modello, due impostazioni opposte, entrambe giuste.

Errori da evitare

  • Chiedere di "pensare di più" nel prompt. Non alza il livello, confonde il modello.
  • Tenere max ovunque. Costo doppio, attesa lunga, risultati spesso identici.
  • Confrontare i tuoi risultati a medium con i benchmark, che sono a max.
  • Scegliere il livello a sensazione. Si misura su un campione, in un pomeriggio.
  • Usare lo stesso livello per l'interfaccia e per il lotto notturno. Hanno vincoli opposti.

Come applicarlo in azienda

Per chi ha sistemi in produzione, il livello di ragionamento è una voce di costo da governare come il modello stesso:

  1. Elenca i compiti automatici che girano su Opus 5.5 e il livello attuale di ciascuno.
  2. Misura a low tutti quelli di estrazione, classificazione e revisione: è probabile che la maggior parte regga.
  3. Lascia alto solo dove hai un motivo misurato, e scrivilo accanto al prompt.
  4. Riverifica quando cambi modello: i livelli non sono equivalenti fra versioni.

Per il quadro generale del modello — prezzi, benchmark, dove si usa — Claude Opus 5.5: cos'è.

Conclusione

I livelli di ragionamento di Opus 5.5 sono una manopola, non un'impostazione da mettere al massimo e dimenticare. Il modello pensa da solo; tu decidi quanto tempo gli lasci, e quel tempo si paga in token e in attesa. La regola è semplice: parti dal basso, misura, sali solo dove serve. È lì che si nasconde buona parte del −40% di costo che Anthropic dichiara.

L'AI diventa utile quando entra nei processi. Giallo Studio aiuta PMI e team a costruire automazioni concrete, misurabili e sostenibili.

Come lo applichiamo in azienda

Risorse correlate

Servizi di consulenza AI e automazione dei processi

FAQ

Quali sono i livelli di ragionamento di Claude Opus 5.5?

Cinque: low, medium, high, xhigh e max. Il livello predefinito è medium. I benchmark pubblicati da Anthropic sono ottenuti al massimo livello salvo dove indicato, quindi non sono confrontabili con esecuzioni a livello fisso più basso.

Cosa vuol dire che Opus 5.5 pensa da solo?

Che ragiona sempre prima di rispondere e decide quanto, in base al compito, dentro il livello impostato. Per questo le righe 'ragiona passo passo' nei prompt non servono più: il livello si sceglie nelle impostazioni o nei parametri, non nel testo.

Quando conviene alzare il livello?

Quando il compito richiede di tenere insieme parti lontane: bug fra sistemi diversi, analisi che si costruiscono a tappe, problemi con molte condizioni. Per estrarre dati, classificare, riassumere e per la revisione di un diff, i livelli bassi bastano.

Quanto costa alzare il livello?

Due cose: token di ragionamento, che si pagano come output, e attesa prima della prima parola. Il costo esatto dipende dal compito, per questo va misurato sui propri casi, non stimato.

Il livello basso è davvero utile?

Sì. Anthropic riporta che nella revisione del codice Opus 5.5 al livello più basso ha trovato più bug di Opus 5 al livello alto, con meno falsi allarmi. Il livello basso non è una versione ridotta: è il modello con meno tempo di riflessione.

Come si ottiene una risposta veloce senza cambiare livello?

Scrivendo 'rispondi direttamente' nel messaggio. Il modello riduce il ragionamento per quella risposta.

Applichiamolo

Trasformiamo la guida in un primo flusso live.

Raccontaci quale processo vuoi alleggerire: valutiamo fattibilita, ritorno e primo step operativo.