Vai al contenuto
wojciech.io
Confronti tra modelli
AI SystemsAIOpenAIClaudeAI Systems

Claude Opus 5.5 ha vinto l'indice. GPT-6 Sol ha vinto la fattura.

Opus 5.5 segna 58 contro il 48 di Sol e costa 5,98 dollari per attività contro 1,06. Entrambi leggono la cache a 0,20. Dove il divario è reale e dove sparisce.

Wojciech Luszczynski

Wojciech Luszczynski

GTM Architect & Growth Operator · Insights · 23 settembre 2026 · 8 min di lettura

Condividi

In breve · I punti chiave

  • Artificial Analysis assegna a Claude Opus 5.5 un punteggio di 58 e a GPT-6 Sol 48 nell'Intelligence Index v4.3.2. Opus 5.5 è primo su 212 modelli. Sol è diciottesimo.
  • Per token Opus 5.5 costa esattamente il doppio di Sol: 4 / 20 dollari contro 2 / 10. Per attività nell'indice sono 5,6 volte, 5,98 contro 1,06, perché a max effort ha scritto 260 milioni di token contro i 77 di Sol.
  • Entrambi i modelli leggono la cache a 0,20 dollari per milione di token. In un ciclo agentico che legge la maggior parte dell'ingresso dalla cache, il lato ingresso della fattura è pari e tutto il divario sta nell'uscita.
  • I 5,98 dollari sono Opus 5.5 a max effort. Il valore predefinito dell'API è medium, quindi quella cifra è il tetto del modello, non il prezzo del suo utilizzo.

Due fornitori hanno rilasciato un nuovo predefinito lo stesso giorno. OpenAI ha messo GPT-6 Sol nell’API a $2 / $10. Anthropic ha messo Claude Opus 5.5 in cima alla propria gamma a $4 / $20 e ha detto a tutti di partire da lì.

Il listino dice che uno costa il doppio dell’altro. L’indice indipendente dice dieci punti. La fattura dice 5,6 volte. Tutte e tre sono corrette, e la differenza tra loro è il punto in cui vive la decisione operativa.

InfoGPT-6 SolClaude Opus 5.5
Ingresso / uscita per 1 mln$2 / $10$4 / $20
Ingresso in cache per 1 mln$0.20$0.20
Intelligence Index v4.3.24858
Posizione su 212 modelli18°1°
Costo per attività dell'indice$1.06$5.98
Token generati nell'indice77 mln260 mln
Velocità di uscita, token/scirca 125circa 95
Contesto / uscita massima1.050.000 / 128.0001 mln / 128K
Taglio delle conoscenze20 apr 2026giu 2026
Sforzo di ragionamento predefinitomediummedium

Prezzi e limiti dalla pagina del modello GPT-6 Sol di OpenAI e dalle pagine prezzi e modelli di Anthropic. Punteggio dell'indice, costo per attività, conteggio token e velocità dalle pagine modello di Artificial Analysis, misurati a max effort. Consultato il 23 settembre 2026.

Dieci punti, e sono reali

Artificial Analysis assegna a Opus 5.5 58 e a Sol 48 nell’Intelligence Index v4.3.2. Non è uno scarto da arrotondamento. Opus 5.5 è primo dei 212 modelli della sua classe. Sol è diciottesimo.

Dieci punti comprano qualcosa. Non lo comprano a poco prezzo, e i due modelli non competono per lo stesso posto. OpenAI descrive Sol come costruito per programmazione complessa e flussi agentici, con un prezzo pensato per eseguirne molti. Anthropic le dice di partire da Opus 5.5 per la maggior parte dei carichi e di salire a Fable 5.1 solo quando Opus 5.5 a sforzo più alto resta comunque insufficiente.

Il dato per attività è 5,6 volte, e la verbosità è il motivo

Per token il divario è esattamente due. Per attività nello stesso indice sono 5,98 contro 1,06 dollari.

Il moltiplicatore viene dal volume di uscita. Eseguendo l’indice, Opus 5.5 ha generato 260 milioni di token e Sol 77 milioni. Artificial Analysis definisce Opus 5.5 molto verboso rispetto a una mediana di 88 milioni, e Sol piuttosto conciso. Un modello che pensa a lungo paga quel pensiero due volte: una in token, una nella tariffa di uscita.

Key takeaway

Il prezzo per token sottostima questo divario di un fattore tre. Se fa il preventivo da un listino invece che da una sessione misurata, sbaglierà nella direzione costosa.

La riga che nessuno ha messo in un annuncio: le letture di cache pareggiano

Sol legge l’ingresso in cache a $0.20 per milione, il 10% della sua tariffa di ingresso di $2. Opus 5.5 legge l’ingresso in cache a $0.20 per milione, il 5% della sua tariffa di $4. Anthropic ha cambiato il moltiplicatore proprio per questo modello: gli hit di cache su Opus 5.5 costano 0,05x l’ingresso base, mentre il resto della gamma usa 0,1x. Opus 5 leggeva la cache a $0.50.

Quindi i due modelli fanno pagare lo stesso prezzo per rileggere un prompt.

Pesa più di quanto sembri, perché i cicli agentici sono soprattutto letture di cache. La guida ai costi di Anthropic riporta che, su una giornata intera di traffico reale, i cicli agentici leggono una mediana dell’84% del proprio ingresso dalla cache, e il decimo superiore degli harness legge il 94% o più. In un ciclo così il lato ingresso della fattura è pari e ogni dollaro di differenza sono token di uscita.

Dove vanno i soldiGPT-6 SolClaude Opus 5.5Divario
Ingresso in cache, il grosso di un ciclo agentico$0.20$0.20nessuno
Ingresso nuovo$2$42x
Uscita$10$202x
Token di uscita effettivamente scritti77 mln260 mln3,4x

Per milione di token. La combinazione delle ultime due righe è ciò che trasforma un listino 2x in una fattura 5,6x.

5,98 dollari sono il tetto, non il prezzo

Il dato di Artificial Analysis è Opus 5.5 a max effort con fallback predefinito. Il valore predefinito dell’API per il modello è medium.

Anthropic ha reso il pensiero adattivo sempre attivo su Opus 5.5 e ha spostato il controllo della profondità sul parametro effort, il cui predefinito su questo modello è medium invece dell’high usato quasi ovunque nella gamma. Ogni confronto che leggerà questa settimana cita il dato a max effort, perché è quello che Artificial Analysis pubblica. Il suo ciclo non girerà lì a meno che non ce lo metta lei.

Tratti i 5,98 dollari come ciò che il modello costa quando gli chiede tutto quello che ha, e abbassi lo sforzo prima di concludere che è troppo caro.

Agenti di programmazione: la misurazione è incompleta, e conta

Nel Coding Agent Index v1.5 di Artificial Analysis, Codex con GPT-6 Sol segna 57 a $2.99 per attività e 22,3 minuti. La voce Anthropic più vicina era Claude Code con Opus 5, a 60 e $10.79 per attività in 41,9 minuti.

Opus 5.5 è ormai misurato e guida quella tabella: Claude Code con Opus 5.5 segna 66 a $13.04 per attività in 1,1 ore. Quattro punti e quattro volte la fattura rispetto a Sol, per un lavoro che richiede il triplo del tempo. L’harness sposta i risultati quanto il modello, e i numeri di Sol mostrano perché: batte Astra su DeepSWE v1.1, 69% contro 68%, e perde Terminal-Bench 4.0 di tredici punti. Un modello, due risposte molto diverse a seconda del benchmark.

Quale userei

Il lavoroModelloPerché
Programmazione agentica ad alto volume con test o verificatoreGPT-6 Sol$1.06 contro $5.98 per attività. Riesegua i fallimenti a un livello superiore invece di pagare profondità a ogni giro.
Il passo di ragionamento più difficile di un cicloClaude Opus 5.5Primo su 212 nell'indice. Dieci punti vale la pena comprarli sul passo che decide l'esito.
Divisione tra esecutore e consulenteEntrambiSol regge il ciclo, Opus 5.5 viene consultato quando si blocca. Prima quantifichi il consulente da solo e misuri il tasso di consultazione.
Agenti a lunga durata con molta cachePiù vicini di quanto sembriEntrambi leggono la cache a $0.20. Confronti sui token di uscita, non sulla riga di ingresso.
Team già sulla piattaforma di AnthropicClaude Opus 5.5Raccomandazione predefinita della stessa Anthropic, e 20% più economico per token dell'Opus 5 che usa oggi.

Sol vince il volume. Opus 5.5 vince il passo difficile. La maggior parte dei cicli in produzione vuole una regola che scelga tra i due per singola richiesta.

Per il lato Anthropic dell’aggiornamento, Opus 5.5 contro Opus 5 copre i quattro cambiamenti che rompono una migrazione ingenua. Per il lato OpenAI, Sol contro Astra è la decisione di instradamento dentro un unico fornitore.

Cosa mi farebbe cambiare idea

Una misurazione a medium effort. Ogni cifra per attività qui è max effort. Il predefinito del modello è medium, e il divario al predefinito potrebbe essere la metà di quanto sembra.

Domande che mi sono state fatte

Claude Opus 5.5 è migliore di GPT-6 Sol?

Nell’indice indipendente, chiaramente. Artificial Analysis assegna a Claude Opus 5.5 58 e a GPT-6 Sol 48 nell’Intelligence Index v4.3.2, il che colloca Opus 5.5 primo su 212 modelli e Sol diciottesimo. I due non puntano allo stesso lavoro: OpenAI descrive Sol come costruito per programmazione complessa e flussi agentici a $2 / $10, e Anthropic raccomanda Opus 5.5 come predefinito per la maggior parte dei carichi a $4 / $20.

Quanto costa in più Claude Opus 5.5 rispetto a GPT-6 Sol?

Il doppio per token e 5,6 volte per attività. Opus 5.5 è listato a $4 per milione di token in ingresso e $20 in uscita contro i $2 e $10 di Sol. Artificial Analysis ha misurato $5.98 per attività eseguendo il suo indice su Opus 5.5 a max effort e $1.06 su Sol, perché Opus 5.5 ha generato 260 milioni di token contro i 77 di Sol. L’ingresso in cache costa $0.20 per milione su entrambi.

Quale è più veloce, GPT-6 Sol o Claude Opus 5.5?

Sol. Artificial Analysis misura circa 125 token di uscita al secondo per Sol e circa 95 per Opus 5.5, e Sol scrive inoltre circa un terzo dei token per attività, quindi finisce prima per due ragioni distinte, non per una.

Devo usare GPT-6 Sol o Claude Opus 5.5?

Sol per programmazione agentica ad alto volume dove può verificare l’uscita, e per tutto ciò in cui il costo per attività completata decide l’architettura. Opus 5.5 per il ragionamento più difficile del ciclo, per team già sulla piattaforma di Anthropic, e come modello consulente che un esecutore più economico chiama quando si blocca. Instradi tra i due invece di scegliere un unico predefinito.

Se sta scegliendo un livello di modello per un prodotto agentico e vuole la regola di instradamento messa per iscritto, la pagina dei contatti è la via più rapida per raggiungermi.

Condividi l'articolo

Sull'autore

Wojciech Luszczynski

Wojciech Luszczynski

GTM Architect e growth operator che costruisce sistemi di ricavi nativi per l'AI per aziende B2B SaaS e tecnologiche. Collego posizionamento, SEO, contenuti, acquisizione a pagamento, CRM, automazione, analytics e flussi di lavoro con AI in un'infrastruttura di crescita che funziona.

Newsletter

Ricevi il prossimo per primo.

Quando pubblico un articolo nuovo su sistemi di AI, architettura GTM o modelli operativi di crescita, lo saprai per primo.

Iscriviti