GPT-6 Sol tiene testa a GPT-6 Astra sul codice a un quinto del prezzo, poi sbatte contro un terminale
Sol è listato a un quinto di Astra e segna 48 contro 53. Nello stesso harness Codex vince DeepSWE e perde Terminal-Bench. Instradi per attività, non per livello.
GTM Architect & Growth Operator · Insights · 23 settembre 2026 · 7 min di lettura
In breve · I punti chiave
- GPT-6 Sol è listato a 2 / 10 dollari per milione di token e GPT-6 Astra a 10 / 50. Cinque volte il prezzo per cinque punti nell'indice di Artificial Analysis, 48 contro 53.
- Per attività il divario si restringe a circa tre volte: 1,06 contro 3,26 dollari, perché Astra è il più conciso dei due, con 60 milioni di token nella sessione contro i 77 di Sol.
- Nello stesso harness Codex, Sol segna 69% su DeepSWE v1.1 contro il 68% di Astra, poi perde Terminal-Bench 4.0 di tredici punti, 43% contro 56%. Un modello, due risposte opposte.
- Sol genera a circa 125 token di uscita al secondo contro i 53 di Astra, e ha chiuso il benchmark di programmazione in 22,3 minuti per attività contro 29,4.
OpenAI vende ora due modelli per lo stesso lavoro con cinque volte di differenza di prezzo. La tabella dei livelli dice: scelga Astra quando il lavoro è difficile. La tabella dei benchmark dice che quel consiglio è troppo grossolano per essere usato.
Nello stesso harness, lo stesso giorno, Sol vince un benchmark di programmazione e ne perde un altro di tredici punti. Quella è una regola di instradamento, non un livello.
| Info | GPT-6 Sol | GPT-6 Astra |
|---|---|---|
| Ingresso / uscita per 1 mln | $2 / $10 | $10 / $50 |
| Ingresso in cache per 1 mln | $0.20 | $1.00 |
| Sopra 272K token in ingresso, in / out | $4 / $15 | $20 / $75 |
| Intelligence Index v4.3.2 | 48 | 53 |
| Costo per attività dell'indice | $1.06 | $3.26 |
| Token generati nell'indice | 77 mln | 60 mln |
| Velocità di uscita, token/s | circa 125 | circa 53 |
| Coding Agent Index, harness Codex | 57 | 62 |
| Costo per attività di programmazione | $2.99 | $7.47 |
| Tempo per attività di programmazione | 22,3 min | 29,4 min |
Prezzi e la regola dei 272K dalle pagine modello di OpenAI. Punteggio dell'indice, costo per attività, token e velocità dalle pagine modello di Artificial Analysis; dati di programmazione dal suo Coding Agent Index v1.5. Consultato il 23 settembre 2026.
Cinque punti, cinque volte il prezzo
Artificial Analysis assegna ad Astra 53 e a Sol 48 nell’Intelligence Index v4.3.2. Astra è sesto su 212 modelli, Sol diciottesimo.
Sul listino quella differenza costa cinque volte tanto per token. Su un’attività completata costa circa tre volte, 3,26 contro 1,06 dollari, e il motivo è che Astra è il più conciso dei due: 60 milioni di token nella sessione dell’indice contro i 77 di Sol, il che recupera parte di quanto il listino porta via. Astra pensa meno. Fa pagare di più ogni parola di quel pensiero.
La divisione tra i benchmark è la parte utile
Entrambi i modelli sono stati misurati nell’harness Codex sugli stessi tre benchmark di programmazione. Il risultato non si allinea in un unico ordine.
| Benchmark | GPT-6 Sol | GPT-6 Astra | Cosa significa |
|---|---|---|---|
| DeepSWE v1.1 | 69% | 68% | Ingegneria del software su scala di repository. Sol è alla pari con un modello che costa cinque volte tanto. |
| Terminal-Bench 4.0 | 43% | 56% | Lavoro agentico su terminale e ambiente. Tredici punti, il divario più ampio dell'insieme. |
| SWE-Atlas-QnA | 58% | 62% | Domande sulla base di codice. Quattro punti ad Astra. |
| Coding Agent Index | 57 | 62 | Il composito. Il vantaggio di Astra sul terminale ne regge quasi tutto il peso. |
| Token per attività | 9,8 mln | 3,3 mln | Sol scrive il triplo per arrivarci, e fattura comunque meno. |
Entrambi i modelli misurati dentro Codex, quindi l'harness resta costante. Il composito nasconde una divisione che conta più del composito stesso.
Sol tiene testa ad Astra nello scrivere e correggere codice, e crolla nel guidare un terminale. Se la parte difficile del suo agente è l’ambiente e non il diff, il modello economico non è la destinazione del suo instradamento.
La velocità è l’altra differenza di cinque volte
Sol genera a circa 125 token di uscita al secondo. Astra si ferma a circa 53, che Artificial Analysis segnala come notevolmente lento tra i modelli che monitora.
Sulle attività di programmazione questo è risultato 22,3 minuti contro 29,4. Il divario è minore di quanto suggerisca la sola velocità, perché Sol scrive il triplo dei token per arrivare allo stesso punto. Resta il fatto che, se una persona guarda un indicatore di avanzamento, Sol è il modello che mantiene vivo il ciclo.
La regola dei 272K prende entrambi
Qualunque prompt sopra i 272K token in ingresso viene ritariffato per l’intera richiesta su entrambi i modelli: doppio su ingresso e cache, una volta e mezza in uscita. Sol passa a $4 / $15, Astra a $20 / $75.
Il rapporto tra i due non si muove. Quindi non è una ragione per preferire l’uno all’altro: è una ragione per tenere i prompt sotto quella linea su entrambi.
Quale userei
| Il lavoro | Modello | Perché |
|---|---|---|
| Scrivere e correggere codice in un repository | GPT-6 Sol | Alla pari su DeepSWE v1.1, 69% contro 68%, al 40% del costo per attività. |
| Agenti su terminale, shell e ambiente | GPT-6 Astra | Tredici punti avanti su Terminal-Bench 4.0. L'unico punto in cui il divario di prezzo è guadagnato. |
| Qualsiasi cosa attesa da una persona | GPT-6 Sol | Circa 125 token di uscita al secondo contro 53. |
| Esecuzioni ad alto volume con verificatore | GPT-6 Sol | Esegua tutto sul livello economico e ripeta i fallimenti su Astra. La divisione si ripaga sotto un tasso di fallimento del 30%. |
| Il singolo passaggio di ragionamento più difficile | GPT-6 Astra | Cinque punti di indice, e ci arriva con un terzo di token in meno. |
Sol è il predefinito e Astra l'eccezione, con il lavoro su terminale come l'eccezione facile da nominare in anticipo.
Tra fornitori, Sol contro Claude Opus 5.5 è la stessa domanda con un’altra scala di prezzi. Tutte le altre coppie sono nei confronti tra modelli.
Cosa mi farebbe cambiare idea
Un risultato di Terminal-Bench che si chiude. Tredici punti è l’unico divario qui che cambia un’architettura, e una versione minore potrebbe dimezzarlo.
Sol a un livello di sforzo più basso. Ogni cifra qui è max effort. Il vantaggio di Sol è il costo, e gran parte di quel costo è pensiero di cui potrebbe non aver bisogno.
Un harness diverso da Codex. Entrambi i modelli sono stati misurati dentro lo stesso harness, che è il controllo giusto, ma resta un solo harness.
Domande che mi sono state fatte
GPT-6 Astra è migliore di GPT-6 Sol?
Di cinque punti nell’indice generale e non in modo uniforme sulla programmazione. Artificial Analysis assegna ad Astra 53 e a Sol 48 nell’Intelligence Index v4.3.2. Nelle misurazioni di programmazione nell’harness Codex, Astra guida l’indice con 62 contro 57 e Terminal-Bench 4.0 di tredici punti, ma Sol lo supera di poco su DeepSWE v1.1, 69% contro 68%. L’ordine per livelli tiene in media e si rompe su forme specifiche di attività.
Quanto costa meno GPT-6 Sol rispetto a GPT-6 Astra?
Cinque volte per token e circa tre volte per attività. Sol è listato a $2 per milione di token in ingresso e $10 in uscita contro i $10 e $50 di Astra, e l’ingresso in cache costa $0.20 contro $1. Artificial Analysis ha misurato $1.06 per attività dell’indice su Sol e $3.26 su Astra; sulle attività di programmazione nell’harness Codex le cifre erano $2.99 e $7.47.
Quale è più veloce, GPT-6 Sol o GPT-6 Astra?
Sol, di oltre il doppio. Artificial Analysis misura circa 125 token di uscita al secondo per Sol e circa 53 per Astra, che definisce notevolmente lento. Sulle attività di programmazione Sol ha registrato una media di 22,3 minuti contro i 29,4 di Astra.
Devo usare GPT-6 Sol o GPT-6 Astra?
Sol come predefinito per il volume: programmazione agentica, recupero, tutto ciò che esegue migliaia di volte o che può verificare e ripetere. Astra per il lavoro su terminale e ambiente, dove guida di tredici punti, e per i passaggi difficili in cui cinque punti di indice cambiano l’esito. Entrambi ritariffano sopra i 272K token in ingresso, quindi il contesto lungo costa caro su entrambi.
Se vuole la regola di instradamento tra questi due scritta dentro uno stack di agenti funzionante, la pagina dei contatti è la via più rapida per raggiungermi.



