Claude Opus 5.5: prezzi, benchmark e migrazione
Costa meno di Opus 5, usa meno token e cambia alcune regole API: ecco quando aggiornare e quando confrontarlo con Fable 5.1
Entra nell'analisiRisposta breve
Passa a Opus 5.5 se usi Opus 5 per coding, agenti o analisi professionale: il listino scende da $5/$25 a $4/$20 e la cache read da $0,50 a $0,20. Anthropic riporta anche prestazioni superiori nei propri test. Prima di cambiare l'ID, verifica thinking sempre attivo, tool choice, computer use e compatibilità dei blocchi di ragionamento.
- Prezzo API: $4 input, $20 output e $0,20 cache read per 1M token.
- Anthropic stima un costo tipico inferiore del 40% rispetto a Opus 5.
- Fast mode costa $8 input e $40 output e arriva fino a 2,5 volte la velocità.
- Il thinking adattivo è sempre attivo e non può essere disabilitato.
- Il model ID è `claude-opus-5-5`.
Evidenze
Dati e benchmark citati
Differenze
Il confronto che orienta la scelta
| Criterio | Opus 5.5 | Come cambia la scelta |
|---|---|---|
| Prezzo | $4 input e $20 output per 1M token; cache read a $0,20. | Costa meno di Opus 5 su ogni voce principale e meno della metà di Fable 5.1 su input e output. |
| Coding agentico | 66,4% su Terminal-Bench 4.0 a xhigh effort nella tabella Anthropic. | Supera Fable 5.1, Opus 5 e GPT-6 Astra nei valori riportati, ma il margine su Astra è vicino all'errore standard di 2,6 punti dichiarato da Anthropic. |
| Knowledge work | 1846 Elo su GDPval-AA v2.1 a max effort. | È il segnale più interessante per documenti, analisi e lavoro professionale, ma resta un risultato del vendor da verificare sui propri materiali. |
| Migrazione API | Thinking adattivo sempre attivo, tool choice limitato e nuovi requisiti per computer use. | Non sostituire soltanto il model ID: alcune configurazioni di Opus 5 restituiscono errori o cambiano lo streaming con Opus 5.5. |
| Fable 5.1 | Opus 5.5 è il punto di partenza più economico per la maggior parte dei task complessi. | Prova Fable quando gli eval mostrano un vantaggio su agenti molto lunghi, ragionamento difficile o workload soggetti ai suoi safeguards. |
Applicazione
Costi API a confronto
Le stime usano il listino Anthropic verificato il 23 settembre 2026. Non includono strumenti esterni, retry o maggiorazione per inferenza solo negli Stati Uniti.
Analisi senza cache
300K input · 50K output
- Scenario
- Opus 5.5: $2,20
- Impatto economico
- Opus 5: $2,75
Il listino riduce il costo del 20%. Il risparmio tipico dichiarato del 40% dipende anche dal minor numero di token usati.
Agente con molta cache
10M cache read · 50K output
- Scenario
- Opus 5.5: $3,00
- Impatto economico
- Opus 5: $6,25
La cache read a $0,20 incide molto nei loop lunghi. Vanno aggiunti cache write, input nuovo e strumenti per stimare il totale.
Fast mode
100K input · 20K output
- Scenario
- Standard: $0,80
- Impatto economico
- Fast: $1,60
Fast mode compra latenza, non maggiore capacità. Usalo quando l'attesa blocca una persona o un processo costoso.
Perché Opus 5.5 cambia il confronto
Opus 5.5 non è soltanto un aggiornamento prestazionale. Il listino scende da $5/$25 a $4/$20 e la cache read da $0,50 a $0,20. Anthropic dichiara inoltre che il modello usa meno token per completare lo stesso lavoro, una stima da verificare sui propri task.
- Input e output costano il 20% in meno di Opus 5.
- La cache read costa il 60% in meno.
- L'output è oltre il 30% più veloce secondo Anthropic.
- Fast mode offre più velocità allo stesso livello di capacità, raddoppiando il prezzo per token.
Cosa mostrano i benchmark
Anthropic riporta Opus 5.5 al 66,4% su Terminal-Bench 4.0, 54,4% su FrontierCode e 57,8% su CursorBench 4.0. Nella stessa tabella supera Opus 5 e Fable 5.1. Il risultato su Terminal-Bench va letto con cautela: l'errore standard dichiarato è di 2,6 punti e i modelli non usano sempre lo stesso effort.
- Terminal-Bench misura task complessi dentro un terminale.
- FrontierCode valuta anche test, stile e possibilità di unire la modifica.
- GDPval-AA misura lavoro professionale in 44 occupazioni.
- I benchmark del lancio non sostituiscono eval sul tuo repository o sui tuoi documenti.
Quando aggiornare da Opus 5
La migrazione è facile da giustificare se Opus 5 viene usato spesso: il nuovo modello costa meno e, nei dati Anthropic, completa più lavoro. Serve comunque un confronto controllato perché stile, thinking e gestione degli strumenti cambiano il comportamento dell'agente.
- Aggiorna prima gli ambienti di test e i task con criteri automatici.
- Confronta token totali, retry, test falliti e tempo di review.
- Mantieni un fallback a Opus 5 durante la transizione.
- Non cambiare a metà di una conversazione che conserva blocchi di ragionamento senza verificare la compatibilità.
Le incompatibilità da controllare
Opus 5.5 usa thinking adattivo sempre attivo. Le richieste che disabilitano thinking o forzano un tool con `any` o con un nome specifico vanno aggiornate. Sulla Claude API e su Google Cloud, il vecchio tool di computer use `computer_20251124` non è accettato.
- Sostituisci le impostazioni thinking manuali con un livello di effort.
- Usa tool choice `auto` e istruzioni più rigorose quando serve un tool preciso.
- Aggiorna il toolset di computer use.
- Controlla lo streaming: il testo tra tool call può arrivare in blocchi thinking con testo non mostrato.
Quando Fable 5.1 resta da provare
Opus 5.5 riduce molto il motivo economico per partire da Fable. Fable resta un'escalation possibile per task difficili o di lunga durata, ma costa $10/$50 contro $4/$20. Va mantenuto solo nei passaggi in cui produce più task accettati o riduce abbastanza la supervisione.
- Confronta i due modelli sullo stesso harness e allo stesso effort effettivo.
- Misura costo per task completato, non il punteggio più favorevole.
- Considera i fallback dovuti ai safeguards nei domini sensibili.
- Verifica retention e accesso prima di inviare dati riservati.
Quando Fast mode vale il doppio
Fast mode usa lo stesso modello su infrastruttura più veloce e costa $8 input e $40 output per milione di token. Ha senso per sessioni interattive, incidenti o processi in cui la latenza blocca il lavoro. Per batch e attività asincrone, Standard mantiene lo stesso livello di capacità a metà prezzo.
- Misura il tempo totale del task, non solo i token al secondo.
- Evitalo quando il lavoro può proseguire in background.
- Non usarlo per compensare prompt o contesto mal progettati.
Prima di chiudere
Domande frequenti
Quanto costa Claude Opus 5.5?
Sulla Claude API costa $4 per 1M token input, $20 per 1M output e $0,20 per 1M cache read. Fast mode costa $8/$40. Batch applica uno sconto del 50% su input e output.
Opus 5.5 sostituisce Opus 5?
È il candidato naturale perché costa meno e Anthropic riporta prestazioni superiori. La migrazione non è però una sostituzione cieca del model ID: controlla thinking, tool choice, computer use e streaming.
Opus 5.5 è migliore di Fable 5.1?
Nei benchmark pubblicati da Anthropic guida molti confronti e costa meno della metà su input e output. Il vantaggio reale va verificato sul tuo workload, soprattutto per agenti lunghi e domini soggetti a safeguards.
Opus 5.5 è disponibile in Claude Code?
Sì. È disponibile su Claude, Claude Code, Claude API, Amazon Bedrock, Google Cloud e Microsoft Foundry. Il model ID sulla Claude API è `claude-opus-5-5`.
Posso disabilitare il thinking in Opus 5.5?
No. Il thinking adattivo è sempre attivo. Puoi controllarne la profondità tramite effort, ma le configurazioni che lo disabilitano vanno rimosse durante la migrazione.
Prossime letture

