GPT-6 Sol iguala a GPT-6 Astra en código por un quinto del precio, y luego choca con un terminal
Sol figura a un quinto del precio de Astra y saca 48 frente a 53. En el mismo arnés Codex gana DeepSWE y pierde Terminal-Bench. Enrute por tarea, no por nivel.
GTM Architect & Growth Operator · Insights · 23 de septiembre de 2026 · 7 min de lectura
Resumen · Lo esencial
- GPT-6 Sol figura a 2 / 10 dólares por millón de tokens y GPT-6 Astra a 10 / 50. Cinco veces el precio por cinco puntos en el índice de Artificial Analysis, 48 frente a 53.
- Por tarea la distancia se estrecha a unas tres veces: 1,06 frente a 3,26 dólares, porque Astra es el más conciso de los dos, con 60 millones de tokens en la ejecución frente a los 77 de Sol.
- En el mismo arnés Codex, Sol saca 69% en DeepSWE v1.1 frente al 68% de Astra, y luego pierde Terminal-Bench 4.0 por trece puntos, 43% contra 56%. Un modelo, dos respuestas opuestas.
- Sol genera a unos 125 tokens de salida por segundo frente a los 53 de Astra, y terminó el benchmark de programación en 22,3 minutos por tarea frente a 29,4.
OpenAI vende ahora dos modelos para el mismo trabajo con cinco veces de diferencia de precio. La tabla de niveles dice: elija Astra cuando el trabajo sea duro. La tabla de benchmarks dice que ese consejo es demasiado grueso para usarlo.
En el mismo arnés, el mismo día, Sol gana un benchmark de programación y pierde otro por trece puntos. Eso es una regla de enrutado, no un nivel.
| Info | GPT-6 Sol | GPT-6 Astra |
|---|---|---|
| Entrada / salida por 1 M | $2 / $10 | $10 / $50 |
| Entrada en caché por 1 M | $0.20 | $1.00 |
| Por encima de 272K de entrada, ent / sal | $4 / $15 | $20 / $75 |
| Intelligence Index v4.3.2 | 48 | 53 |
| Coste por tarea del índice | $1.06 | $3.26 |
| Tokens generados en el índice | 77 M | 60 M |
| Velocidad de salida, tokens/s | unos 125 | unos 53 |
| Coding Agent Index, arnés Codex | 57 | 62 |
| Coste por tarea de programación | $2.99 | $7.47 |
| Tiempo por tarea de programación | 22,3 min | 29,4 min |
Precios y la regla de 272K de las páginas de modelo de OpenAI. Puntuación del índice, coste por tarea, tokens y velocidad de las páginas de modelo de Artificial Analysis; cifras de programación de su Coding Agent Index v1.5. Consultado el 23 de septiembre de 2026.
Cinco puntos, cinco veces el precio
Artificial Analysis puntúa a Astra con 53 y a Sol con 48 en el Intelligence Index v4.3.2. Astra es sexto entre 212 modelos, Sol decimoctavo.
En la lista de precios esa diferencia cuesta cinco veces más por token. En una tarea terminada cuesta unas tres veces, 3,26 frente a 1,06 dólares, y el motivo es que Astra es el más conciso de los dos: 60 millones de tokens en la ejecución del índice frente a los 77 de Sol, lo que recupera parte de lo que se lleva la tarifa. Astra piensa menos. Cobra más por cada palabra de ese pensamiento.
La división de los benchmarks es la parte útil
Ambos modelos se midieron en el arnés Codex sobre los mismos tres benchmarks de programación. El resultado no se ordena en una sola secuencia.
| Benchmark | GPT-6 Sol | GPT-6 Astra | Qué significa |
|---|---|---|---|
| DeepSWE v1.1 | 69% | 68% | Ingeniería de software a escala de repositorio. Sol queda a la par de un modelo que cuesta cinco veces más. |
| Terminal-Bench 4.0 | 43% | 56% | Trabajo agéntico de terminal y entorno. Trece puntos, la mayor distancia del conjunto. |
| SWE-Atlas-QnA | 58% | 62% | Preguntas sobre la base de código. Cuatro puntos para Astra. |
| Coding Agent Index | 57 | 62 | El compuesto. La ventaja de Astra en terminal carga con casi todo. |
| Tokens por tarea | 9,8 M | 3,3 M | Sol escribe el triple para llegar, y aun así factura menos. |
Ambos modelos medidos dentro de Codex, así que el arnés queda constante. El compuesto esconde una división que importa más que el propio compuesto.
Sol iguala a Astra escribiendo y arreglando código, y se desmorona conduciendo un terminal. Si la parte dura de su agente es el entorno y no el diff, el modelo barato no es el destino de su enrutado.
La velocidad es la otra diferencia de cinco veces
Sol genera a unos 125 tokens de salida por segundo. Astra se queda en unos 53, que Artificial Analysis señala como notablemente lento entre los modelos que sigue.
En tareas de programación eso salió como 22,3 minutos frente a 29,4. La distancia es menor de lo que sugiere la tasa bruta, porque Sol escribe el triple de tokens para llegar al mismo sitio. Aun así, si hay una persona mirando un indicador de progreso, Sol es el modelo que mantiene el bucle con vida.
La regla de 272K atrapa a ambos
Cualquier prompt por encima de 272K tokens de entrada se retarifa para la petición completa en ambos modelos: el doble de entrada y caché, una vez y media la salida. Sol pasa a $4 / $15, Astra a $20 / $75.
La proporción entre ellos no se mueve. Así que esto no es una razón para elegir uno sobre otro: es una razón para mantener los prompts por debajo de esa línea en cualquiera de los dos.
Cuál usaría yo
| El trabajo | Modelo | Por qué |
|---|---|---|
| Escribir y arreglar código en un repositorio | GPT-6 Sol | A la par en DeepSWE v1.1, 69% frente a 68%, al 40% del coste por tarea. |
| Agentes de terminal, shell y entorno | GPT-6 Astra | Trece puntos por delante en Terminal-Bench 4.0. El único sitio donde la diferencia de precio se gana. |
| Cualquier cosa que alguien esté esperando | GPT-6 Sol | Unos 125 tokens de salida por segundo frente a 53. |
| Ejecuciones de alto volumen con verificador | GPT-6 Sol | Ejecute todo en el nivel barato y repita los fallos en Astra. El reparto se paga solo por debajo de un 30% de fallos. |
| El paso de razonamiento más duro | GPT-6 Astra | Cinco puntos de índice, y llega con un tercio menos de tokens. |
Sol es el valor por defecto y Astra la excepción, con el trabajo de terminal como la excepción fácil de nombrar de antemano.
Entre proveedores, Sol frente a Claude Opus 5.5 es la misma pregunta con otra escalera de precios. Todas las demás parejas están en las comparativas de modelos.
Qué me haría cambiar de opinión
Un resultado de Terminal-Bench que se cierre. Trece puntos es la única distancia aquí que cambia una arquitectura, y una versión menor podría reducirla a la mitad.
Sol en un nivel de esfuerzo más bajo. Todas las cifras de aquí son max effort. La ventaja de Sol es el coste, y la mayor parte de ese coste es pensamiento que quizá no necesita.
Un arnés distinto de Codex. Ambos modelos se midieron dentro del mismo arnés, que es el control correcto, pero es un solo arnés.
Preguntas que me hicieron
¿Es GPT-6 Astra mejor que GPT-6 Sol?
Por cinco puntos en el índice general y no de forma uniforme en programación. Artificial Analysis puntúa a Astra con 53 y a Sol con 48 en el Intelligence Index v4.3.2. En sus mediciones de programación en el arnés Codex, Astra lidera el índice con 62 frente a 57 y Terminal-Bench 4.0 por trece puntos, pero Sol le gana por poco en DeepSWE v1.1, 69% frente a 68%. El orden por niveles se sostiene de media y se rompe en formas concretas de tarea.
¿Cuánto más barato es GPT-6 Sol que GPT-6 Astra?
Cinco veces por token y unas tres veces por tarea. Sol figura a $2 por millón de tokens de entrada y $10 de salida frente a los $10 y $50 de Astra, y la entrada en caché cuesta $0.20 frente a $1. Artificial Analysis midió $1.06 por tarea del índice en Sol y $3.26 en Astra; en tareas de programación dentro del arnés Codex las cifras fueron $2.99 y $7.47.
¿Cuál es más rápido, GPT-6 Sol o GPT-6 Astra?
Sol, por más del doble. Artificial Analysis mide unos 125 tokens de salida por segundo para Sol y unos 53 para Astra, al que califica de notablemente lento. En tareas de programación Sol promedió 22,3 minutos frente a los 29,4 de Astra.
¿Debo usar GPT-6 Sol o GPT-6 Astra?
Sol por defecto para volumen: programación agéntica, recuperación, cualquier cosa que ejecute miles de veces o que pueda verificar y repetir. Astra para trabajo de terminal y entorno, donde lidera por trece puntos, y para los pasos duros donde cinco puntos de índice cambian el resultado. Ambos retarifan por encima de 272K tokens de entrada, así que el contexto largo sale caro en cualquiera de los dos.
Si quiere la regla de enrutado entre estos dos escrita dentro de un stack de agentes en funcionamiento, la página de contacto es la vía más rápida para llegar a mí.



