Claude Opus 5.5 batte GPT-6 Astra in ogni punteggio e costa comunque di più per finire il lavoro
Opus 5.5 segna 58 contro il 53 di Astra, costa il 60% in meno per token e fattura comunque 5,98 per attività contro 3,26. Scrive 260 mln di token contro 60.
GTM Architect & Growth Operator · Insights · 28 settembre 2026 · 8 min di lettura
In breve · I punti chiave
- Artificial Analysis assegna a Claude Opus 5.5 58 e a GPT-6 Astra 53. Opus 5.5 è primo su 211 modelli, Astra sesto. Opus 5.5 è inoltre listato al 60% in meno per token, 4 / 20 dollari contro 10 / 50.
- Nonostante entrambe le cose, Astra è il modello più economico per attività completata: 3,26 contro 5,98 dollari. Opus 5.5 ha scritto 260 milioni di token nella sessione dell'indice e Astra 60 milioni.
- Opus 5.5 genera più in fretta, circa 95 token di uscita al secondo contro 64, e impiega comunque molto più tempo dall'inizio alla fine, perché la velocità per token perde contro quattro volte i token.
- Come agente di programmazione la forma si ripete. Claude Code con Opus 5.5 guida il Coding Agent Index con 66 contro il 62 di Codex con Astra, e costa 13,04 dollari per attività in 1,1 ore contro 7,47 in 29,4 minuti.
Due modelli di punta, e il tabellone dice una cosa mentre la fattura ne dice un’altra.
Claude Opus 5.5 è primo su 211 modelli nell’indice indipendente. È anche il 60% più economico per token di GPT-6 Astra. Entrambe le cose sono vere, e ad Astra costa comunque meno portare a termine un lavoro.
| Info | GPT-6 Astra | Claude Opus 5.5 |
|---|---|---|
| Ingresso / uscita per 1 mln | $10 / $50 | $4 / $20 |
| Ingresso in cache per 1 mln | $1.00 | $0.20 |
| Intelligence Index v4.3.2 | 53 | 58 |
| Posizione su 211 modelli | 6° | 1° |
| Costo per attività dell'indice | $3.26 | $5.98 |
| Token generati nell'indice | 60 mln | 260 mln |
| Velocità di uscita, token/s | circa 64 | circa 95 |
| Sopra 272K token in ingresso, in / out | $20 / $75 | $4 / $20 |
| Contesto / uscita massima | 1 mln / 128K | 1 mln / 128K |
| Taglio delle conoscenze | apr 2026 | giu 2026 |
Prezzi e la regola dei 272K dalla pagina del modello GPT-6 Astra di OpenAI e dalle pagine prezzi e modelli di Anthropic. Punteggio dell'indice, costo per attività, token e velocità dalle pagine modello di Artificial Analysis, entrambi a max effort. Consultato il 28 settembre 2026.
Opus 5.5 vince il tabellone senza discussione
Cinque punti nell’indice, 58 contro 53, e le posizioni lo rendono concreto: primo su 211 contro sesto. La pagina dei modelli di Anthropic manda ora i lettori incerti a Opus 5.5 per la maggior parte dei carichi.
Ha anche i dati di addestramento più freschi, giugno 2026 contro aprile, il che conta più del solito in un anno in cui i modelli confrontati sono usciti a settembre.
E perde la fattura
Per token Opus 5.5 è quello economico con ampio margine. $4 e $20 contro $10 e $50. L’ingresso in cache costa $0.20 contro $1, perché Anthropic tariffa gli hit di cache su questo modello a 0,05x l’ingresso base dove il resto della gamma usa 0,1x.
Poi la sessione misurata arriva a 5,98 dollari per attività contro 3,26.
L’intera inversione sta in una riga della tabella. Opus 5.5 ha scritto 260 milioni di token nell’indice e Astra 60 milioni. Quattro volte e un terzo di uscita, al 40% del prezzo per token, dà un saldo di circa l’80% in più sulla fattura.
Due modelli, e il listino più economico appartiene al modello più caro. Se fa il preventivo da un tariffario invece che da una sessione misurata, questa è la coppia che la coglierà in fallo.
Il dato sulla velocità è una trappola per conto suo
Artificial Analysis misura Opus 5.5 a circa 95 token di uscita al secondo e Astra a circa 64. Opus 5.5 è il modello più veloce, e Artificial Analysis definisce Astra più lento della media.
Finisce comunque molto più tardi. I token al secondo sono una velocità, e Opus 5.5 ha quattro volte più strada da fare. Nel benchmark di programmazione, dove il tempo reale è misurato direttamente, questo si legge come 1,1 ore per attività contro 29,4 minuti.
Un modello più veloce che finisce nel doppio del tempo non è una contraddizione. È la differenza tra un tachimetro e un orario di arrivo, e solo uno dei due è sul suo calendario.
Agenti di programmazione: la stessa forma, più forte
Opus 5.5 è ora nel Coding Agent Index di Artificial Analysis, dove non era quando questi modelli sono usciti.
| Info | Codex + Astra | Claude Code + Opus 5.5 |
|---|---|---|
| Coding Agent Index v1.5 | 62 | 66 |
| DeepSWE v1.1 | 68% | 68% |
| Terminal-Bench 4.0 | 56% | 63% |
| SWE-Atlas-QnA | 62% | 66% |
| Costo per attività | $7.47 | $13.04 |
| Tempo per attività | 29,4 min | 1,1 h |
| Token per attività | 3,3 mln | 15,6 mln |
Coding Agent Index v1.5, ogni modello nel proprio harness. Opus 5.5 guida ogni benchmark tranne DeepSWE, dove pareggiano.
Opus 5.5 prende la testa di quella tabella e guida Terminal-Bench di sette punti, il benchmark che separa un modello che scrive codice da uno capace di guidare un ambiente. Fattura il 75% in più per attività e impiega più del doppio del tempo reale per farlo.
Noti l’avvertenza sull’harness valida per ogni riga: i numeri di Astra vengono da Codex e quelli di Opus 5.5 da Claude Code, e l’harness sposta i risultati quanto il modello.
La linea dei 272K resta di Anthropic
OpenAI ritariffa un prompt di Astra sopra i 272K token in ingresso per l’intera richiesta: doppio su ingresso e cache, una volta e mezza in uscita, quindi $20 / $75. Anthropic fattura l’intera finestra da 1 milione di Opus 5.5 a una sola tariffa.
Oltre quella linea Opus 5.5 costa un quinto di Astra in ingresso e meno di un terzo in uscita, oltre a essere già più economico per token. Per documenti lunghi, basi di codice grandi tenute in contesto, o qualunque ciclo la cui conversazione cresca oltre i 272K, l’inversione per attività vista sopra smette di proteggere Astra.
Quale userei
| Il lavoro | Modello | Perché |
|---|---|---|
| La risposta decide l'esito | Claude Opus 5.5 | Primo su 211, e guida ogni benchmark di programmazione tranne quello in cui pareggiano. |
| Alto volume, pagando per attività completata | GPT-6 Astra | $3.26 contro $5.98 nell'indice, $7.47 contro $13.04 sulla programmazione. |
| Qualcuno sta aspettando | GPT-6 Astra | 29,4 minuti contro 1,1 ore, pur essendo il modello più lento per token. |
| Prompt che superano i 272K token | Claude Opus 5.5 | Una sola tariffa su 1 milione, mentre l'intera richiesta di Astra raddoppia in ingresso. |
| Cicli agentici con molta cache | Claude Opus 5.5 | $0.20 contro $1 sulla riga che domina la fattura di un ciclo lungo. |
| Guidare un terminale | Claude Opus 5.5 | Sette punti su Terminal-Bench 4.0, il benchmark che separa lo scrivere codice dall'eseguirlo. |
Opus 5.5 per qualità, prompt lunghi e cicli con molta cache. Astra per il throughput e per tutto ciò che una persona sta aspettando.
Dentro la gamma di OpenAI, Sol contro Astra è la versione economica di questa decisione. Contro il salto interno di Anthropic, Opus 5.5 contro Opus 5 copre i quattro cambiamenti che rompono nell’aggiornamento.
Cosa mi farebbe cambiare idea
Entrambi i modelli in un solo harness. Ogni cifra di programmazione qui è Astra in Codex contro Opus 5.5 in Claude Code, e sono due variabili che si muovono insieme.
Una misurazione a sforzo variabile. Opus 5.5 usa medium come predefinito e ogni cifra sopra è max effort, da cui arrivano i suoi 260 milioni di token. Il divario per attività potrebbe chiudersi o invertirsi al predefinito.
Un cambiamento alla regola dei 272K. È l’unica riga che rende Opus 5.5 diverse volte più economico sui prompt lunghi.
Domande che mi sono state fatte
Claude Opus 5.5 è migliore di GPT-6 Astra?
Su ogni punteggio pubblicato sì. Artificial Analysis colloca Opus 5.5 a 58 nell’Intelligence Index v4.3.2 e Astra a 53, il che rende Opus 5.5 primo su 211 modelli e Astra sesto. Nell’harness di programmazione tiene lo stesso ordine: Claude Code con Opus 5.5 segna 66 e Codex con Astra segna 62, e Opus 5.5 guida Terminal-Bench 4.0 di sette punti e SWE-Atlas-QnA di quattro, con DeepSWE v1.1 pari al 68%.
Quale costa meno, GPT-6 Astra o Claude Opus 5.5?
Dipende da quale cifra intende, e le due non concordano. Per token Opus 5.5 costa il 60% in meno: $4 in ingresso e $20 in uscita per milione contro i $10 e $50 di Astra, e $0.20 contro $1 per l’ingresso in cache. Per attività completata Astra costa il 45% in meno: Artificial Analysis ha misurato $3.26 contro $5.98, perché Opus 5.5 ha generato 260 milioni di token nella sessione dell’indice e Astra 60 milioni. Sulle attività di programmazione il divario si allarga a $7.47 contro $13.04.
Quale è più veloce, GPT-6 Astra o Claude Opus 5.5?
Opus 5.5 genera più in fretta e finisce più tardi. Artificial Analysis misura circa 95 token di uscita al secondo per Opus 5.5 e circa 64 per Astra, ma Opus 5.5 scrive circa quattro volte più token, quindi impiega molto più tempo sullo stesso lavoro. Nel benchmark di programmazione questo appare come 1,1 ore per attività contro 29,4 minuti.
Devo usare GPT-6 Astra o Claude Opus 5.5?
Opus 5.5 quando la qualità della risposta decide l’esito, quando i prompt si allungano, o quando il lavoro vive già in Claude Code: segna più alto ovunque, costa un quinto di Astra sull’ingresso in cache e mantiene una sola tariffa su tutta la finestra da 1 milione. Astra quando paga per attività completata e il volume è alto, oppure quando una persona sta aspettando, perché costa circa la metà per attività e consegna in una frazione del tempo.
Se sta scegliendo un modello di punta per un prodotto agentico e vuole la regola di instradamento messa per iscritto, la pagina dei contatti è la via più rapida per raggiungermi.



