Anthropic ha tagliato ogni prezzo di Claude Opus 5.5. La fattura contro Opus 5 è salita lo stesso.
Opus 5.5 taglia i token del 20% e la cache del 60%, e segna 58 contro il 51 di Opus 5. Il costo per attività dell'indice è salito comunque a 5,98 dollari. E quattro rotture.
GTM Architect & Growth Operator · Insights · 23 settembre 2026 · 10 min di lettura
In breve · I punti chiave
- Opus 5.5 è listato a 4 / 20 dollari contro i 5 / 25 di Opus 5, e le letture di cache scendono da 0,50 a 0,20 perché Anthropic ha spostato questo modello su un moltiplicatore di cache di 0,05x invece del consueto 0,1x.
- Artificial Analysis assegna a Opus 5.5 58 e a Opus 5 51, primo su 212 modelli contro undicesimo. Il costo per attività dell'indice si è mosso appena: 5,98 contro 5,86 dollari, perché Opus 5.5 ha scritto 260 milioni di token contro i 140 di Opus 5.
- L'indicazione di aggiornamento di Anthropic pone l'intervallo tra circa 40% in meno e circa 20% in più per attività risolta. La misurazione indipendente è caduta vicino all'estremo alto, non a quello basso.
- Quattro cambiamenti rompono il codice già in esecuzione su Opus 5: il pensiero non si può disattivare, l'uso forzato degli strumenti restituisce 400, i blocchi di pensiero sono legati al modello, e il vecchio strumento di computer use viene rifiutato.
Anthropic ha tagliato ogni prezzo della linea Opus e ha rilasciato un modello migliore. Ingresso giù del 20%, uscita giù del 20%, letture di cache giù del 60%, sette punti in più nell’indice indipendente.
Poi Artificial Analysis ha eseguito il suo benchmark su entrambi e il modello più recente è costato di più. Non molto di più, il 2%, ma di più. Quella cifra è l’intero articolo, perché è quella che vedrà il suo reparto finanziario e non vedrà il riassunto dell’annuncio.
| Info | Claude Opus 5.5 | Claude Opus 5 |
|---|---|---|
| Ingresso / uscita per 1 mln | $4 / $20 | $5 / $25 |
| Hit e aggiornamenti di cache | $0.20 | $0.50 |
| Scritture di cache 5 min / 1 h | $5 / $8 | $6.25 / $10 |
| Intelligence Index v4.3.2 | 58 | 51 |
| Posizione su 212 modelli | 1° | 11° |
| Costo per attività dell'indice | $5.98 | $5.86 |
| Token generati nell'indice | 260 mln | 140 mln |
| Velocità di uscita, token/s | circa 95 | circa 54 |
| Sforzo di ragionamento predefinito | medium | high |
| Contesto / uscita massima | 1 mln / 128K | 1 mln / 128K |
Prezzi dalla pagina prezzi di Anthropic. Punteggio dell'indice, costo per attività, token e velocità dalle pagine modello di Artificial Analysis, entrambi misurati a max effort. Consultato il 23 settembre 2026.
La riga della cache è il vero taglio di prezzo
Tutti citeranno il passaggio da $5 a $4. Non è la riga che muove una fattura agentica.
Anthropic tariffa hit e aggiornamenti di cache su Opus 5.5 a 0,05x il prezzo base di ingresso, dove ogni altro modello della gamma usa 0,1x. Questo porta una lettura di cache da $0.50 a $0.20 per milione di token, un taglio del 60%, sulla componente che domina i cicli a lunga durata.
La guida ai costi di Anthropic dice che i cicli agentici leggono una mediana dell’84% del proprio ingresso dalla cache su una giornata intera di traffico reale. Se questo descrive il suo carico, il lato ingresso della fattura è appena sceso di oltre la metà. Il 20% del titolo è la metà piccola della storia.
Opus 5.5 legge ora la cache a $0.20 per milione, la stessa tariffa di GPT-6 Sol, su un modello listato al doppio del prezzo di ingresso di Sol. Confronti i fornitori sulla riga che il suo traffico tocca davvero.
Sette punti in su, e ora primo
Artificial Analysis assegna a Opus 5.5 58 e a Opus 5 51 nell’Intelligence Index v4.3.2. Opus 5.5 è primo dei 212 modelli di quella classe. Opus 5 era undicesimo.
Lo stesso sito ha già messo un avviso di obsolescenza sulla pagina di Opus 5, che dice ai lettori che Anthropic ha rilasciato un modello più recente e suggerisce di considerarlo. Anche la panoramica dei modelli di Anthropic si è mossa: la riga che prima mandava i lettori incerti a Opus 5 ora li manda a Opus 5.5.
Perché il dato per attività è andato nella direzione sbagliata
Opus 5.5 ha generato 260 milioni di token eseguendo l’indice. Opus 5 ne ha generati 140 milioni. A max effort il modello più recente pensa quasi il doppio del tempo, e un taglio di tariffa del 20% non copre un aumento dell’86% nei token scritti.
Anthropic è onesta su questo nella propria guida ai costi. La riga sull’aggiornamento dice che il modello attuale risolve più attività, a un costo per attività risolta che va da circa 40% in meno a circa 20% in più. È un intervallo con un estremo brutto, non una promessa di risparmio, e la sessione indipendente è caduta vicino all’estremo brutto.
Quindi: meglio per attività, all’incirca pari per dollaro, a max effort. Il risparmio si cattura abbassando lo sforzo. Cambiare l’identificativo del modello e aspettare che migliori la fattura non basterà, e se aveva già messo a bilancio quel 20% come risparmio conviene rimettere quella riga al suo posto finché una sessione sul suo carico non dice altro.
Quattro cose che romperanno la sua migrazione
Questa è la parte che manca da ogni riassunto che ho letto questa settimana. Anthropic documenta quattro cambiamenti che rompono il codice già in esecuzione su Opus 5.
| Cambiamento | Cosa succede | La soluzione |
|---|---|---|
| Il pensiero non si può disattivare | Una richiesta con thinking type disabled, o un budget_tokens manuale, restituisce 400 invalid_request_error. | Ometta il campo thinking oppure invii adaptive, poi usi effort per controllare la profondità. |
| L'uso forzato degli strumenti sparisce | tool_choice su any, o su uno strumento specifico, restituisce 400. Il conteggio token valida allo stesso modo. | Lasci tool_choice su auto con uso rigoroso degli strumenti, o sposti lo schema sulle uscite strutturate. |
| I blocchi di pensiero sono legati al modello | Opus 5.5 legge blocchi da Opus 5 e da Opus, Sonnet e Haiku precedenti, ma non da Fable o Mythos. | Selezioni i blocchi di contenuto per tipo invece che per posizione, e restituisca i blocchi di pensiero senza modificarli. |
| Vecchio strumento di computer use rifiutato | Sull'API di Claude e su Google Cloud computer_20251124 non viene accettato. | Passi all'attuale set di computer use prima di cambiare l'identificativo del modello. |
| Testo tra chiamate agli strumenti (non rompe) | Arriva ora dentro blocchi di pensiero vuoti nell'impostazione di visualizzazione predefinita, quindi i flussi di avanzamento ammutoliscono. | Imposti un valore di visualizzazione che restituisca il testo se gli utenti guardano quel flusso. |
Dalla pagina delle novità di Anthropic per Opus 5.5. I primi tre valgono anche per Claude Fable 5.1.
La quinta riga è quella che raggiungerà i suoi utenti invece dei suoi log. Un’applicazione che trasmette il testo tra gli strumenti come indicatore di avanzamento non va in errore. Semplicemente ammutolisce tra una chiamata e l’altra, e il silenzio sembra un blocco.
Il predefinito si è spostato, quindi il comportamento si è spostato
Su Opus 5.5 il pensiero adattivo è sempre attivo ed effort controlla la profondità, e il predefinito di questo modello è medium dove quasi tutta la gamma usa high.
Due conseguenze. Primo, una migrazione diretta di una chiamata a Opus 5 che si affidava al predefinito riceve un modello più superficiale di prima, il che sembra una regressione di qualità ed è in realtà un cambio di configurazione. Secondo, ogni benchmark pubblicato per Opus 5.5, inclusi i $5.98 di questo articolo, è misurato a max effort. Nessuna di quelle cifre descrive il predefinito.
Se la qualità cala dopo la migrazione, alzi lo sforzo prima di incolpare il modello. Se salgono i costi, lo abbassi.
Quale userei
Opus 5, onestamente, non ha più alcun caso a suo favore. È più caro su ogni riga, sette punti indietro, e Artificial Analysis lo ha marcato come obsoleto. La domanda non è se migrare, ma come.
| La situazione | Faccia questo | Perché |
|---|---|---|
| Cicli agentici con molta cache su Opus 5 | Migri subito | Le letture di cache scendono del 60%. È la singola riga più grande di quella fattura. |
| Codice con uso forzato degli strumenti o pensiero disattivato | Prima ripari, poi migri | Entrambi restituiscono 400 su Opus 5.5. La migrazione fallisce rumorosamente alla prima chiamata. |
| Interfaccia che trasmette avanzamento tra le chiamate | Imposti display, poi migri | Nessun errore, solo silenzio. Peggio di un guasto perché nulla la avvisa. |
| Il costo è già il vincolo | Migri e abbassi lo sforzo | Il risparmio viene da medium effort, non dall'identificativo del modello. A max effort si è misurato il 2% in più per attività. |
| Conversazioni che saltano a Fable o Mythos | Controlli i blocchi di pensiero | Opus 5.5 non legge i blocchi di pensiero di Fable né di Mythos. |
L'aggiornamento vale la pena. Metta in conto un pomeriggio per i quattro cambiamenti che rompono, invece di trattarlo come una sostituzione di stringa.
Per la versione tra fornitori di questa decisione, GPT-6 Sol contro Opus 5.5 ha l’aritmetica per attività. Tutte le altre coppie sono nei confronti tra modelli.
Cosa mi farebbe cambiare idea
Una misurazione a medium effort. Ogni cifra per attività qui è max effort su un modello il cui predefinito è medium, e il divario potrebbe invertirsi al predefinito.
Entrambe le domande con cui questa sezione si apriva hanno ormai risposta, ed entrambe sono andate a favore di Opus 5.5. Genera a circa 95 token di uscita al secondo contro i 54 di Opus 5, e nel Coding Agent Index Claude Code con Opus 5.5 segna 66 a $13.04 per attività contro il 60 di Opus 5 a $10.79. Sei punti per il 21% in più per attività è l’argomento più chiaro a favore dell’aggiornamento in questa pagina.
Domande che mi sono state fatte
Claude Opus 5.5 costa meno di Claude Opus 5?
Per token sì, del 20%: $4 per milione di token in ingresso e $20 in uscita contro $5 e $25. Le letture di cache scendono di più, da $0.50 a $0.20, perché Anthropic tariffa gli hit di cache su Opus 5.5 a 0,05x l’ingresso base invece del consueto 0,1x. Per attività completata non è automatico. Artificial Analysis ha misurato $5.98 per attività dell’indice su Opus 5.5 e $5.86 su Opus 5, perché il modello più recente ha scritto 260 milioni di token contro i 140 del precedente a max effort.
Claude Opus 5.5 è migliore di Claude Opus 5?
Sì, di sette punti nell’indice indipendente. Artificial Analysis assegna a Opus 5.5 58 e a Opus 5 51 nell’Intelligence Index v4.3.2, il che rende Opus 5.5 primo su 212 modelli dove Opus 5 era undicesimo. Anthropic ha inoltre spostato la propria raccomandazione predefinita su Opus 5.5 e Artificial Analysis marca ora Opus 5 come obsoleto.
Cosa si rompe passando da Claude Opus 5 a Opus 5.5?
Quattro cose, secondo le note di migrazione di Anthropic. Il pensiero non si può disattivare, quindi una richiesta con thinking type disabled o un budget di token manuale restituisce 400. L’uso forzato degli strumenti sparisce, quindi tool_choice su any o su uno strumento specifico restituisce 400. I blocchi di pensiero sono legati al modello che li ha prodotti, quindi le conversazioni spostate tra famiglie di modelli richiedono attenzione. E sull’API di Claude e su Google Cloud lo strumento computer_20251124 non viene accettato. Un quinto cambiamento è più silenzioso: il testo tra le chiamate agli strumenti arriva ora dentro blocchi di pensiero vuoti nell’impostazione di visualizzazione predefinita, quindi i flussi di avanzamento ammutoliscono finché non cambia quell’impostazione.
Devo passare da Claude Opus 5 a Opus 5.5?
Sì, ma misuri il risparmio invece di darlo per scontato. Il prezzo per token è inferiore del 20%, le letture di cache del 60%, e il modello risolve di più. L’intervallo di Anthropic per l’aggiornamento va da circa 40% in meno a circa 20% in più per attività risolta, e la sessione indipendente dell’indice è uscita del 2% più cara. Abbassi lo sforzo dopo la migrazione, perché il predefinito è passato da high a medium e tutti i confronti pubblicati sono misurati a max.
Se sta pianificando questa migrazione su uno stack di agenti in produzione, la pagina dei contatti è la via più rapida per raggiungermi.



