Guida7 min di letturaPubblicato il 2026-09-28

Opus 5.5 o Sonnet 5.5: due punti di differenza e il doppio del prezzo

In sei giorni Anthropic ha rilasciato Claude Opus 5.5 e Claude Sonnet 5.5. Prezzi, benchmark a confronto e una regola pratica per decidere quale usare senza tirare a indovinare.

In sintesi

Opus 5.5 costa 4$ e 20$ per milione di token, Sonnet 5.5 costa 2$ e 10$. Sul knowledge work li separano due punti Elo su 1846. Sul coding agentico da terminale Sonnet 5.5 sta addirittura sopra. Dove Opus 5.5 resta avanti in modo chiaro è il ragionamento profondo, otto punti su FrontierCode, e i compiti lunghi senza supervisione. La conclusione pratica: parti da Sonnet 5.5 e passa a Opus 5.5 solo dove le tue prove mostrano che serve, ricordando che i due modelli hanno un effort predefinito diverso e quindi non si confrontano appaiandoli e basta.

Due rilasci in sei giorni

Il 22 settembre è uscito Claude Opus 5.5, il 28 Claude Sonnet 5.5. Sei giorni.

Per chi deve prendere una decisione tecnica, il problema non è la velocità dei rilasci ma il fatto che il confronto tradizionale non funziona più. La regola che tutti usavano, modello di punta per le cose serie e modello medio per il volume, presupponeva un divario ampio. Su questa generazione il divario, su buona parte dei compiti, si misura in decimali.

I due modelli sulla carta

Opus 5.5 costa 4$ per milione di token in ingresso e 20$ in uscita. Sonnet 5.5 costa 2$ e 10$: esattamente la metà.

Il resto delle caratteristiche coincide. Un milione di token di contesto, 128.000 di output massimo, conoscenza affidabile a giugno 2026, ragionamento adattivo, disponibilità su API Claude, Amazon Bedrock, Google Cloud e Microsoft Foundry. La lettura della cache costa 0,20$ per milione su entrambi, che in proporzione al prezzo di ingresso conviene di più su Opus.

Una differenza va segnata perché falsa qualsiasi confronto fatto in fretta: l'effort predefinito. Su Opus 5.5 è medium, su Sonnet 5.5 è high. Chi mette i due modelli uno accanto all'altro senza toccare niente sta confrontando il modello di punta a metà sforzo con quello medio a sforzo alto. È il modo più rapido per arrivare alla conclusione sbagliata, in una direzione o nell'altra.

Dove i benchmark li separano davvero

Sui test pubblicati da Anthropic il quadro è questo.

Sul knowledge work, GDPval-AA v2.1, Opus 5.5 segna 1846 punti Elo e Sonnet 5.5 ne segna 1844. Due punti. Su AA-Briefcase, 1822 contro 1811.

Sul coding agentico da terminale, Terminal-Bench 4.0, Sonnet 5.5 sta sopra: 70,6% contro 66,4%. Il punteggio di Opus è misurato a effort xhigh, quindi non è un confronto simmetrico, ma resta il fatto che il modello che costa la metà non perde su quel test.

Dove la gerarchia si vede è il ragionamento. Su FrontierCode v1.1 Opus 5.5 segna 54,4% contro il 46,2% di Sonnet 5.5: otto punti, il distacco più ampio della tabella. Su Humanity's Last Exam con strumenti, 67,7% contro 64,5%.

Tradotto: sui compiti dove il lavoro consiste nell'eseguire bene qualcosa di ben definito, i due modelli si equivalgono. Sui compiti dove il lavoro consiste nel capire cosa fare, il modello di punta è ancora il modello di punta.

Non sai quale modello conviene ai tuoi processi?

30 minuti per discutere il tuo caso specifico.

Prenota una call

Quando il doppio prezzo si ripaga

Il prezzo per token non è il costo. Il costo è quanto spendi per portare a termine un compito, e su quello incidono tre cose che non compaiono nel listino.

Quante volte devi rifare il lavoro. Un modello che sbaglia un'analisi su cinque costa molto più della differenza di listino, se qualcuno deve controllare tutte e cinque.

Quanto contesto rilegge. Negli agenti la voce dominante sono i token riletti dalla cache a ogni passo. Opus 5.5 legge la cache a 0,20$ su un prezzo base di 4$, cioè il 5%, mentre su Sonnet 5.5 quello stesso 0,20$ vale il 10% del prezzo base. Su carichi molto agentici il rapporto tra i due modelli si stringe rispetto a quello che suggerisce il listino.

Quanti passaggi servono. Anthropic dichiara per Sonnet 5.5 meno chiamate agli strumenti a parità di compito, che è un risparmio composto: meno passaggi, meno contesto riletto, meno tempo.

La regola pratica che ne esce: Opus 5.5 si ripaga sui compiti lunghi, poco supervisionati e ad alto valore unitario, dove un errore costa più della differenza di prezzo. Sonnet 5.5 vince su tutto il resto, cioè sulla stragrande maggioranza del lavoro d'ufficio.

La regola che usiamo nei progetti

Nei progetti che costruiamo non scegliamo un modello, ne instradiamo diversi.

Haiku per classificazione, estrazione e instradamento: compiti dove la differenza di qualità non si vede e il volume è alto.

Sonnet 5.5 come predefinito per tutto il lavoro applicativo: sintesi, generazione, analisi di documenti, agenti su volume, correzione di codice.

Opus 5.5 sui compiti che si riconoscono da tre segnali: durano a lungo, nessuno li controlla mentre girano, e sbagliare costa. Analisi documentali profonde, agenti autonomi su processi critici, decisioni che poi qualcuno firma.

Fable 5.1 resta sopra a tutti sui carichi estremi, a 10$ e 50$ per milione di token, e ha senso solo quando le prove su Opus 5.5 ad effort alto non bastano ancora.

Questo non è un principio di architettura elegante, è aritmetica: il costo medio per richiesta crolla e la qualità resta dove serve. Ne ho scritto più in dettaglio nel confronto tra Sonnet, Opus e Haiku.

Come si decide senza tirare a indovinare

Il metodo è meno sofisticato di quanto si pensi, e quasi nessuno lo applica.

Si prendono venti o trenta richieste vere, prese dal lavoro dell'azienda e non inventate. Si definisce cosa vuol dire risposta accettabile, in modo che due persone diverse diano lo stesso giudizio. Si fanno girare su Sonnet 5.5 a effort medium e high, e su Opus 5.5 a medium e high. Si contano gli errori e si guarda il conto.

Nella maggior parte dei casi che abbiamo visto succede una cosa sola: il modello economico a effort alto pareggia il modello di punta a effort medio, e il divario si apre solo su una fascia di compiti riconoscibile, che a quel punto si può instradare per conto suo.

Un pomeriggio di lavoro, e la decisione smette di essere un'opinione. Vale per questa generazione e varrà per la prossima, che dai tempi di Anthropic arriverà tra poche settimane.

Con Maverick lavoriamo esattamente su questo: scegliere e calibrare i modelli sui carichi reali dell'azienda, non sui benchmark di chi li produce.

FT
Federico Thiella·Founder, Maverick AI

Lavora con aziende italiane ed europee sull'adozione di Claude e dell'ecosistema Anthropic. Ha guidato implementazioni AI in private equity, consulenza, manifattura e servizi professionali.

LinkedIn

Non sai quale modello conviene ai tuoi processi?

Progettiamo architetture multi modello sui carichi reali dell'azienda, misurando qualità e costo prima di decidere. Se stai valutando un'implementazione Claude, scrivici.

Scrivici

Domande frequenti su Opus 5.5 e Sonnet 5.5

Opus 5.5 costa 4$ per milione di token in ingresso e 20$ in uscita, Sonnet 5.5 costa 2$ e 10$: esattamente la metà. La lettura della cache costa 0,20$ per milione su entrambi, che in proporzione pesa meno su Opus. Su un carico molto agentico, dove il contesto viene riletto a ogni passo, la differenza reale è quindi minore di quella che suggerisce il listino.
Sui compiti lunghi, poco supervisionati e ad alto valore, dove sbagliare costa più della differenza di prezzo: analisi documentali profonde, agenti autonomi su processi critici, ragionamento complesso. Il distacco più ampio nei benchmark è su FrontierCode, otto punti, che misura proprio il ragionamento applicato al codice. Sul lavoro ben definito i due modelli si equivalgono.
Perché hanno un effort predefinito diverso: medium su Opus 5.5, high su Sonnet 5.5. Chi li prova appaiati senza impostare l'effort confronta il modello di punta a metà sforzo con quello medio a sforzo alto. Per un confronto onesto va fissato lo stesso livello su entrambi, e vanno provati almeno due livelli.
No, e con questa generazione ancora meno. Un instradamento per tipo di compito, con Haiku sulle attività semplici ad alto volume, Sonnet 5.5 come predefinito e Opus 5.5 sui compiti critici, abbassa il costo medio per richiesta senza perdere qualità dove serve. È aritmetica, non gusto architetturale.
Sopra entrambi sui carichi estremi, a 10$ e 50$ per milione di token, con la lettura della cache a 0,25$. Ha senso quando le prove su Opus 5.5 a effort alto non bastano ancora: ricerca e analisi tecnica molto complessa, compiti agentici lunghissimi. Per il lavoro quotidiano di un'azienda è quasi sempre sovradimensionato.

Rimani informato sull'AI per il business

Ricevi aggiornamenti su Claude AI, casi d'uso aziendali e strategie di implementazione. Niente spam, solo contenuti utili.

Vuoi saperne di più?

Contattaci per scoprire come possiamo aiutare la tua azienda con soluzioni AI su misura.

System integrator specializzato su Claude AI in Italia. Lavoriamo con aziende in PE, pharma, fashion, manifattura e consulting.

Articoli correlati

News & Aggiornamenti

Claude Opus 5.5: il prezzo scende del 20%, e nell'aggiornamento c'è una trappola

Il 22 settembre 2026 Anthropic ha rilasciato Claude Opus 5.5. Input e output costano il 20% in meno di Opus 5, la lettura della cache il 60% in meno. I benchmark, i quattro breaking change e l'impostazione che cambia da sola quando aggiorni.

News & Aggiornamenti

Claude Sonnet 5.5 batte Opus 5.5 sul coding agentico e costa un quinto

Il 28 settembre 2026 Anthropic ha rilasciato Claude Sonnet 5.5. Stesso prezzo di Sonnet 5, 30% di velocità in più e il punteggio più alto della famiglia su Terminal-Bench 4.0. Cosa cambia davvero per le aziende e cosa si rompe nel codice.

Tecnico

Claude Sonnet vs Opus vs Haiku: quale modello usare

Haiku 4.5, Sonnet 5 e Opus 5 a confronto: prestazioni, prezzi 2026 e come scegliere il modello giusto per ogni caso aziendale.

News & Aggiornamenti

Claude Fable 5.1: la cache costa il 75% in meno e per gli agenti cambia il conto

Il 1 settembre 2026 Anthropic ha rilasciato Claude Fable 5.1 e Mythos 5.1. Cosa dicono i benchmark, perché il taglio del 75% sulla lettura della cache conta più dei benchmark e i tre breaking change API da sistemare prima di aggiornare.

Strategia

Quanto costa Claude AI per le aziende: pricing, piani e costi reali

Guida completa ai costi di Claude AI per le aziende. Pricing API per modello, piani enterprise, costi tipici di un progetto di integrazione e come ottimizzare la spesa.

Novità

Claude Opus 5: il modello di punta ora ha una "manopola" per il costo — cosa cambia per le aziende

Anthropic ha rilasciato Claude Opus 5: vicino a Fable 5 su molti task a metà del costo per task, con un "effort dial" che regola quanto far ragionare il modello. Prezzo, benchmark e cosa significa per chi usa l'AI in azienda.

Tecnico

Claude API: guida all'integrazione per sviluppatori

Guida tecnica completa all'integrazione di Claude API: setup, autenticazione, scelta del modello, gestione del contesto, rate limit e best practice per il deployment in produzione.

Prenota una call conoscitiva
Opus 5.5 vs Sonnet 5.5: quale modello Claude scegliere | Maverick AI