Vai al contenuto
wojciech.io
Confronti tra modelli
AI SystemsAIClaudeAI Systems

Anthropic ha tagliato ogni prezzo di Claude Opus 5.5. La fattura contro Opus 5 è salita lo stesso.

Opus 5.5 taglia i token del 20% e la cache del 60%, e segna 58 contro il 51 di Opus 5. Il costo per attività dell'indice è salito comunque a 5,98 dollari. E quattro rotture.

Wojciech Luszczynski

Wojciech Luszczynski

GTM Architect & Growth Operator · Insights · 23 settembre 2026 · 10 min di lettura

Condividi

In breve · I punti chiave

  • Opus 5.5 è listato a 4 / 20 dollari contro i 5 / 25 di Opus 5, e le letture di cache scendono da 0,50 a 0,20 perché Anthropic ha spostato questo modello su un moltiplicatore di cache di 0,05x invece del consueto 0,1x.
  • Artificial Analysis assegna a Opus 5.5 58 e a Opus 5 51, primo su 212 modelli contro undicesimo. Il costo per attività dell'indice si è mosso appena: 5,98 contro 5,86 dollari, perché Opus 5.5 ha scritto 260 milioni di token contro i 140 di Opus 5.
  • L'indicazione di aggiornamento di Anthropic pone l'intervallo tra circa 40% in meno e circa 20% in più per attività risolta. La misurazione indipendente è caduta vicino all'estremo alto, non a quello basso.
  • Quattro cambiamenti rompono il codice già in esecuzione su Opus 5: il pensiero non si può disattivare, l'uso forzato degli strumenti restituisce 400, i blocchi di pensiero sono legati al modello, e il vecchio strumento di computer use viene rifiutato.

Anthropic ha tagliato ogni prezzo della linea Opus e ha rilasciato un modello migliore. Ingresso giù del 20%, uscita giù del 20%, letture di cache giù del 60%, sette punti in più nell’indice indipendente.

Poi Artificial Analysis ha eseguito il suo benchmark su entrambi e il modello più recente è costato di più. Non molto di più, il 2%, ma di più. Quella cifra è l’intero articolo, perché è quella che vedrà il suo reparto finanziario e non vedrà il riassunto dell’annuncio.

InfoClaude Opus 5.5Claude Opus 5
Ingresso / uscita per 1 mln$4 / $20$5 / $25
Hit e aggiornamenti di cache$0.20$0.50
Scritture di cache 5 min / 1 h$5 / $8$6.25 / $10
Intelligence Index v4.3.25851
Posizione su 212 modelli1°11°
Costo per attività dell'indice$5.98$5.86
Token generati nell'indice260 mln140 mln
Velocità di uscita, token/scirca 95circa 54
Sforzo di ragionamento predefinitomediumhigh
Contesto / uscita massima1 mln / 128K1 mln / 128K

Prezzi dalla pagina prezzi di Anthropic. Punteggio dell'indice, costo per attività, token e velocità dalle pagine modello di Artificial Analysis, entrambi misurati a max effort. Consultato il 23 settembre 2026.

La riga della cache è il vero taglio di prezzo

Tutti citeranno il passaggio da $5 a $4. Non è la riga che muove una fattura agentica.

Anthropic tariffa hit e aggiornamenti di cache su Opus 5.5 a 0,05x il prezzo base di ingresso, dove ogni altro modello della gamma usa 0,1x. Questo porta una lettura di cache da $0.50 a $0.20 per milione di token, un taglio del 60%, sulla componente che domina i cicli a lunga durata.

La guida ai costi di Anthropic dice che i cicli agentici leggono una mediana dell’84% del proprio ingresso dalla cache su una giornata intera di traffico reale. Se questo descrive il suo carico, il lato ingresso della fattura è appena sceso di oltre la metà. Il 20% del titolo è la metà piccola della storia.

Key takeaway

Opus 5.5 legge ora la cache a $0.20 per milione, la stessa tariffa di GPT-6 Sol, su un modello listato al doppio del prezzo di ingresso di Sol. Confronti i fornitori sulla riga che il suo traffico tocca davvero.

Sette punti in su, e ora primo

Artificial Analysis assegna a Opus 5.5 58 e a Opus 5 51 nell’Intelligence Index v4.3.2. Opus 5.5 è primo dei 212 modelli di quella classe. Opus 5 era undicesimo.

Lo stesso sito ha già messo un avviso di obsolescenza sulla pagina di Opus 5, che dice ai lettori che Anthropic ha rilasciato un modello più recente e suggerisce di considerarlo. Anche la panoramica dei modelli di Anthropic si è mossa: la riga che prima mandava i lettori incerti a Opus 5 ora li manda a Opus 5.5.

Perché il dato per attività è andato nella direzione sbagliata

Opus 5.5 ha generato 260 milioni di token eseguendo l’indice. Opus 5 ne ha generati 140 milioni. A max effort il modello più recente pensa quasi il doppio del tempo, e un taglio di tariffa del 20% non copre un aumento dell’86% nei token scritti.

Anthropic è onesta su questo nella propria guida ai costi. La riga sull’aggiornamento dice che il modello attuale risolve più attività, a un costo per attività risolta che va da circa 40% in meno a circa 20% in più. È un intervallo con un estremo brutto, non una promessa di risparmio, e la sessione indipendente è caduta vicino all’estremo brutto.

Quindi: meglio per attività, all’incirca pari per dollaro, a max effort. Il risparmio si cattura abbassando lo sforzo. Cambiare l’identificativo del modello e aspettare che migliori la fattura non basterà, e se aveva già messo a bilancio quel 20% come risparmio conviene rimettere quella riga al suo posto finché una sessione sul suo carico non dice altro.

Quattro cose che romperanno la sua migrazione

Questa è la parte che manca da ogni riassunto che ho letto questa settimana. Anthropic documenta quattro cambiamenti che rompono il codice già in esecuzione su Opus 5.

CambiamentoCosa succedeLa soluzione
Il pensiero non si può disattivareUna richiesta con thinking type disabled, o un budget_tokens manuale, restituisce 400 invalid_request_error.Ometta il campo thinking oppure invii adaptive, poi usi effort per controllare la profondità.
L'uso forzato degli strumenti spariscetool_choice su any, o su uno strumento specifico, restituisce 400. Il conteggio token valida allo stesso modo.Lasci tool_choice su auto con uso rigoroso degli strumenti, o sposti lo schema sulle uscite strutturate.
I blocchi di pensiero sono legati al modelloOpus 5.5 legge blocchi da Opus 5 e da Opus, Sonnet e Haiku precedenti, ma non da Fable o Mythos.Selezioni i blocchi di contenuto per tipo invece che per posizione, e restituisca i blocchi di pensiero senza modificarli.
Vecchio strumento di computer use rifiutatoSull'API di Claude e su Google Cloud computer_20251124 non viene accettato.Passi all'attuale set di computer use prima di cambiare l'identificativo del modello.
Testo tra chiamate agli strumenti (non rompe)Arriva ora dentro blocchi di pensiero vuoti nell'impostazione di visualizzazione predefinita, quindi i flussi di avanzamento ammutoliscono.Imposti un valore di visualizzazione che restituisca il testo se gli utenti guardano quel flusso.

Dalla pagina delle novità di Anthropic per Opus 5.5. I primi tre valgono anche per Claude Fable 5.1.

La quinta riga è quella che raggiungerà i suoi utenti invece dei suoi log. Un’applicazione che trasmette il testo tra gli strumenti come indicatore di avanzamento non va in errore. Semplicemente ammutolisce tra una chiamata e l’altra, e il silenzio sembra un blocco.

Il predefinito si è spostato, quindi il comportamento si è spostato

Su Opus 5.5 il pensiero adattivo è sempre attivo ed effort controlla la profondità, e il predefinito di questo modello è medium dove quasi tutta la gamma usa high.

Due conseguenze. Primo, una migrazione diretta di una chiamata a Opus 5 che si affidava al predefinito riceve un modello più superficiale di prima, il che sembra una regressione di qualità ed è in realtà un cambio di configurazione. Secondo, ogni benchmark pubblicato per Opus 5.5, inclusi i $5.98 di questo articolo, è misurato a max effort. Nessuna di quelle cifre descrive il predefinito.

Se la qualità cala dopo la migrazione, alzi lo sforzo prima di incolpare il modello. Se salgono i costi, lo abbassi.

Quale userei

Opus 5, onestamente, non ha più alcun caso a suo favore. È più caro su ogni riga, sette punti indietro, e Artificial Analysis lo ha marcato come obsoleto. La domanda non è se migrare, ma come.

La situazioneFaccia questoPerché
Cicli agentici con molta cache su Opus 5Migri subitoLe letture di cache scendono del 60%. È la singola riga più grande di quella fattura.
Codice con uso forzato degli strumenti o pensiero disattivatoPrima ripari, poi migriEntrambi restituiscono 400 su Opus 5.5. La migrazione fallisce rumorosamente alla prima chiamata.
Interfaccia che trasmette avanzamento tra le chiamateImposti display, poi migriNessun errore, solo silenzio. Peggio di un guasto perché nulla la avvisa.
Il costo è già il vincoloMigri e abbassi lo sforzoIl risparmio viene da medium effort, non dall'identificativo del modello. A max effort si è misurato il 2% in più per attività.
Conversazioni che saltano a Fable o MythosControlli i blocchi di pensieroOpus 5.5 non legge i blocchi di pensiero di Fable né di Mythos.

L'aggiornamento vale la pena. Metta in conto un pomeriggio per i quattro cambiamenti che rompono, invece di trattarlo come una sostituzione di stringa.

Per la versione tra fornitori di questa decisione, GPT-6 Sol contro Opus 5.5 ha l’aritmetica per attività. Tutte le altre coppie sono nei confronti tra modelli.

Cosa mi farebbe cambiare idea

Una misurazione a medium effort. Ogni cifra per attività qui è max effort su un modello il cui predefinito è medium, e il divario potrebbe invertirsi al predefinito.

Entrambe le domande con cui questa sezione si apriva hanno ormai risposta, ed entrambe sono andate a favore di Opus 5.5. Genera a circa 95 token di uscita al secondo contro i 54 di Opus 5, e nel Coding Agent Index Claude Code con Opus 5.5 segna 66 a $13.04 per attività contro il 60 di Opus 5 a $10.79. Sei punti per il 21% in più per attività è l’argomento più chiaro a favore dell’aggiornamento in questa pagina.

Domande che mi sono state fatte

Claude Opus 5.5 costa meno di Claude Opus 5?

Per token sì, del 20%: $4 per milione di token in ingresso e $20 in uscita contro $5 e $25. Le letture di cache scendono di più, da $0.50 a $0.20, perché Anthropic tariffa gli hit di cache su Opus 5.5 a 0,05x l’ingresso base invece del consueto 0,1x. Per attività completata non è automatico. Artificial Analysis ha misurato $5.98 per attività dell’indice su Opus 5.5 e $5.86 su Opus 5, perché il modello più recente ha scritto 260 milioni di token contro i 140 del precedente a max effort.

Claude Opus 5.5 è migliore di Claude Opus 5?

Sì, di sette punti nell’indice indipendente. Artificial Analysis assegna a Opus 5.5 58 e a Opus 5 51 nell’Intelligence Index v4.3.2, il che rende Opus 5.5 primo su 212 modelli dove Opus 5 era undicesimo. Anthropic ha inoltre spostato la propria raccomandazione predefinita su Opus 5.5 e Artificial Analysis marca ora Opus 5 come obsoleto.

Cosa si rompe passando da Claude Opus 5 a Opus 5.5?

Quattro cose, secondo le note di migrazione di Anthropic. Il pensiero non si può disattivare, quindi una richiesta con thinking type disabled o un budget di token manuale restituisce 400. L’uso forzato degli strumenti sparisce, quindi tool_choice su any o su uno strumento specifico restituisce 400. I blocchi di pensiero sono legati al modello che li ha prodotti, quindi le conversazioni spostate tra famiglie di modelli richiedono attenzione. E sull’API di Claude e su Google Cloud lo strumento computer_20251124 non viene accettato. Un quinto cambiamento è più silenzioso: il testo tra le chiamate agli strumenti arriva ora dentro blocchi di pensiero vuoti nell’impostazione di visualizzazione predefinita, quindi i flussi di avanzamento ammutoliscono finché non cambia quell’impostazione.

Devo passare da Claude Opus 5 a Opus 5.5?

Sì, ma misuri il risparmio invece di darlo per scontato. Il prezzo per token è inferiore del 20%, le letture di cache del 60%, e il modello risolve di più. L’intervallo di Anthropic per l’aggiornamento va da circa 40% in meno a circa 20% in più per attività risolta, e la sessione indipendente dell’indice è uscita del 2% più cara. Abbassi lo sforzo dopo la migrazione, perché il predefinito è passato da high a medium e tutti i confronti pubblicati sono misurati a max.

Se sta pianificando questa migrazione su uno stack di agenti in produzione, la pagina dei contatti è la via più rapida per raggiungermi.

Condividi l'articolo

Sull'autore

Wojciech Luszczynski

Wojciech Luszczynski

GTM Architect e growth operator che costruisce sistemi di ricavi nativi per l'AI per aziende B2B SaaS e tecnologiche. Collego posizionamento, SEO, contenuti, acquisizione a pagamento, CRM, automazione, analytics e flussi di lavoro con AI in un'infrastruttura di crescita che funziona.

Newsletter

Ricevi il prossimo per primo.

Quando pubblico un articolo nuovo su sistemi di AI, architettura GTM o modelli operativi di crescita, lo saprai per primo.

Iscriviti