Salta al contenuto principale
Modelli AI 9 min

Claude Opus 5.5: prezzi, benchmark e migrazione

Costa meno di Opus 5, usa meno token e cambia alcune regole API: ecco quando aggiornare e quando confrontarlo con Fable 5.1

Entra nell'analisi

Risposta breve

Passa a Opus 5.5 se usi Opus 5 per coding, agenti o analisi professionale: il listino scende da $5/$25 a $4/$20 e la cache read da $0,50 a $0,20. Anthropic riporta anche prestazioni superiori nei propri test. Prima di cambiare l'ID, verifica thinking sempre attivo, tool choice, computer use e compatibilità dei blocchi di ragionamento.

  • Prezzo API: $4 input, $20 output e $0,20 cache read per 1M token.
  • Anthropic stima un costo tipico inferiore del 40% rispetto a Opus 5.
  • Fast mode costa $8 input e $40 output e arriva fino a 2,5 volte la velocità.
  • Il thinking adattivo è sempre attivo e non può essere disabilitato.
  • Il model ID è `claude-opus-5-5`.

Evidenze

Dati e benchmark citati

Grafico di Terminal-Bench 4.0 e FrontierCode per Opus 5.5, Fable 5.1, Opus 5 e GPT-6 Astra
Opus 5.5 nei benchmark Anthropic. Opus 5.5 guida i confronti mostrati su Terminal-Bench e FrontierCode. I punteggi sono pubblicati da Anthropic e includono effort e setup non sempre identici: usali per scegliere un test, non come verdetto assoluto. Anthropic, lancio Claude Opus 5.5
Grafico dei prezzi input, output e cache read di Opus 5.5, Opus 5 e Fable 5.1
Prezzi di Opus 5.5, Opus 5 e Fable 5.1. Opus 5.5 abbassa input, output e soprattutto cache read rispetto a Opus 5. Fable 5.1 costa di più sui token nuovi, ma la sua cache read resta vicina. Anthropic Claude Platform

Differenze

Il confronto che orienta la scelta

CriterioOpus 5.5Come cambia la scelta
Prezzo$4 input e $20 output per 1M token; cache read a $0,20.Costa meno di Opus 5 su ogni voce principale e meno della metà di Fable 5.1 su input e output.
Coding agentico66,4% su Terminal-Bench 4.0 a xhigh effort nella tabella Anthropic.Supera Fable 5.1, Opus 5 e GPT-6 Astra nei valori riportati, ma il margine su Astra è vicino all'errore standard di 2,6 punti dichiarato da Anthropic.
Knowledge work1846 Elo su GDPval-AA v2.1 a max effort.È il segnale più interessante per documenti, analisi e lavoro professionale, ma resta un risultato del vendor da verificare sui propri materiali.
Migrazione APIThinking adattivo sempre attivo, tool choice limitato e nuovi requisiti per computer use.Non sostituire soltanto il model ID: alcune configurazioni di Opus 5 restituiscono errori o cambiano lo streaming con Opus 5.5.
Fable 5.1Opus 5.5 è il punto di partenza più economico per la maggior parte dei task complessi.Prova Fable quando gli eval mostrano un vantaggio su agenti molto lunghi, ragionamento difficile o workload soggetti ai suoi safeguards.

Applicazione

Costi API a confronto

Le stime usano il listino Anthropic verificato il 23 settembre 2026. Non includono strumenti esterni, retry o maggiorazione per inferenza solo negli Stati Uniti.

01

Analisi senza cache

300K input · 50K output

Scenario
Opus 5.5: $2,20
Impatto economico
Opus 5: $2,75

Il listino riduce il costo del 20%. Il risparmio tipico dichiarato del 40% dipende anche dal minor numero di token usati.

02

Agente con molta cache

10M cache read · 50K output

Scenario
Opus 5.5: $3,00
Impatto economico
Opus 5: $6,25

La cache read a $0,20 incide molto nei loop lunghi. Vanno aggiunti cache write, input nuovo e strumenti per stimare il totale.

03

Fast mode

100K input · 20K output

Scenario
Standard: $0,80
Impatto economico
Fast: $1,60

Fast mode compra latenza, non maggiore capacità. Usalo quando l'attesa blocca una persona o un processo costoso.

01

Perché Opus 5.5 cambia il confronto

Opus 5.5 non è soltanto un aggiornamento prestazionale. Il listino scende da $5/$25 a $4/$20 e la cache read da $0,50 a $0,20. Anthropic dichiara inoltre che il modello usa meno token per completare lo stesso lavoro, una stima da verificare sui propri task.

  • Input e output costano il 20% in meno di Opus 5.
  • La cache read costa il 60% in meno.
  • L'output è oltre il 30% più veloce secondo Anthropic.
  • Fast mode offre più velocità allo stesso livello di capacità, raddoppiando il prezzo per token.
02

Cosa mostrano i benchmark

Anthropic riporta Opus 5.5 al 66,4% su Terminal-Bench 4.0, 54,4% su FrontierCode e 57,8% su CursorBench 4.0. Nella stessa tabella supera Opus 5 e Fable 5.1. Il risultato su Terminal-Bench va letto con cautela: l'errore standard dichiarato è di 2,6 punti e i modelli non usano sempre lo stesso effort.

  • Terminal-Bench misura task complessi dentro un terminale.
  • FrontierCode valuta anche test, stile e possibilità di unire la modifica.
  • GDPval-AA misura lavoro professionale in 44 occupazioni.
  • I benchmark del lancio non sostituiscono eval sul tuo repository o sui tuoi documenti.
03

Quando aggiornare da Opus 5

La migrazione è facile da giustificare se Opus 5 viene usato spesso: il nuovo modello costa meno e, nei dati Anthropic, completa più lavoro. Serve comunque un confronto controllato perché stile, thinking e gestione degli strumenti cambiano il comportamento dell'agente.

  • Aggiorna prima gli ambienti di test e i task con criteri automatici.
  • Confronta token totali, retry, test falliti e tempo di review.
  • Mantieni un fallback a Opus 5 durante la transizione.
  • Non cambiare a metà di una conversazione che conserva blocchi di ragionamento senza verificare la compatibilità.
04

Le incompatibilità da controllare

Opus 5.5 usa thinking adattivo sempre attivo. Le richieste che disabilitano thinking o forzano un tool con `any` o con un nome specifico vanno aggiornate. Sulla Claude API e su Google Cloud, il vecchio tool di computer use `computer_20251124` non è accettato.

  • Sostituisci le impostazioni thinking manuali con un livello di effort.
  • Usa tool choice `auto` e istruzioni più rigorose quando serve un tool preciso.
  • Aggiorna il toolset di computer use.
  • Controlla lo streaming: il testo tra tool call può arrivare in blocchi thinking con testo non mostrato.
05

Quando Fable 5.1 resta da provare

Opus 5.5 riduce molto il motivo economico per partire da Fable. Fable resta un'escalation possibile per task difficili o di lunga durata, ma costa $10/$50 contro $4/$20. Va mantenuto solo nei passaggi in cui produce più task accettati o riduce abbastanza la supervisione.

  • Confronta i due modelli sullo stesso harness e allo stesso effort effettivo.
  • Misura costo per task completato, non il punteggio più favorevole.
  • Considera i fallback dovuti ai safeguards nei domini sensibili.
  • Verifica retention e accesso prima di inviare dati riservati.
06

Quando Fast mode vale il doppio

Fast mode usa lo stesso modello su infrastruttura più veloce e costa $8 input e $40 output per milione di token. Ha senso per sessioni interattive, incidenti o processi in cui la latenza blocca il lavoro. Per batch e attività asincrone, Standard mantiene lo stesso livello di capacità a metà prezzo.

  • Misura il tempo totale del task, non solo i token al secondo.
  • Evitalo quando il lavoro può proseguire in background.
  • Non usarlo per compensare prompt o contesto mal progettati.

La newsletter di QualeAI

Le novità che meritano il tuo tempo.

Aggiornamenti editoriali su tool, modelli, prezzi e workflow. Solo quando c’è qualcosa di utile da capire.

Prima di chiudere

Domande frequenti

Quanto costa Claude Opus 5.5?

Sulla Claude API costa $4 per 1M token input, $20 per 1M output e $0,20 per 1M cache read. Fast mode costa $8/$40. Batch applica uno sconto del 50% su input e output.

Opus 5.5 sostituisce Opus 5?

È il candidato naturale perché costa meno e Anthropic riporta prestazioni superiori. La migrazione non è però una sostituzione cieca del model ID: controlla thinking, tool choice, computer use e streaming.

Opus 5.5 è migliore di Fable 5.1?

Nei benchmark pubblicati da Anthropic guida molti confronti e costa meno della metà su input e output. Il vantaggio reale va verificato sul tuo workload, soprattutto per agenti lunghi e domini soggetti a safeguards.

Opus 5.5 è disponibile in Claude Code?

Sì. È disponibile su Claude, Claude Code, Claude API, Amazon Bedrock, Google Cloud e Microsoft Foundry. Il model ID sulla Claude API è `claude-opus-5-5`.

Posso disabilitare il thinking in Opus 5.5?

No. Il thinking adattivo è sempre attivo. Puoi controllarne la profondità tramite effort, ma le configurazioni che lo disabilitano vanno rimosse durante la migrazione.

Prossime letture

Tre modi per continuare.

Tutti gli approfondimenti