Claude Opus 5.5 ganó el índice. GPT-6 Sol ganó la factura.
Opus 5.5 saca 58 frente al 48 de Sol y cuesta 5,98 dólares por tarea frente a 1,06. Ambos leen caché a 0,20. Dónde la distancia es real y dónde desaparece.
GTM Architect & Growth Operator · Insights · 23 de septiembre de 2026 · 9 min de lectura
Resumen · Lo esencial
- Artificial Analysis puntúa a Claude Opus 5.5 con 58 y a GPT-6 Sol con 48 en el Intelligence Index v4.3.2. Opus 5.5 es primero entre 212 modelos. Sol es decimoctavo.
- Por token, Opus 5.5 cuesta exactamente el doble que Sol: 4 / 20 dólares frente a 2 / 10. Por tarea en el índice son 5,6 veces, 5,98 frente a 1,06, porque a max effort escribió 260 millones de tokens frente a los 77 de Sol.
- Ambos modelos leen caché a 0,20 dólares por millón de tokens. En un bucle de agente que lee la mayor parte de su entrada desde caché, el lado de entrada de la factura queda empatado y toda la distancia está en la salida.
- Los 5,98 dólares son Opus 5.5 a max effort. Su valor por defecto en la API es medium, así que esa cifra es el techo del modelo, no el precio de usarlo.
Dos proveedores lanzaron un nuevo modelo por defecto el mismo día. OpenAI puso GPT-6 Sol en la API a $2 / $10. Anthropic puso Claude Opus 5.5 en lo alto de su gama a $4 / $20 y dijo a todo el mundo que empezara ahí.
La lista de precios dice que uno cuesta el doble que el otro. El índice independiente dice diez puntos. La factura dice 5,6 veces. Las tres son correctas, y la diferencia entre ellas es donde vive la decisión operativa.
| Info | GPT-6 Sol | Claude Opus 5.5 |
|---|---|---|
| Entrada / salida por 1 M | $2 / $10 | $4 / $20 |
| Entrada en caché por 1 M | $0.20 | $0.20 |
| Intelligence Index v4.3.2 | 48 | 58 |
| Puesto entre 212 modelos | 18.º | 1.º |
| Coste por tarea del índice | $1.06 | $5.98 |
| Tokens generados en el índice | 77 M | 260 M |
| Velocidad de salida, tokens/s | unos 125 | unos 95 |
| Contexto / salida máxima | 1.050.000 / 128.000 | 1 M / 128K |
| Corte de conocimiento | 20 abr 2026 | jun 2026 |
| Esfuerzo de razonamiento por defecto | medium | medium |
Precios y límites de la página de modelo de GPT-6 Sol de OpenAI y de las páginas de precios y modelos de Anthropic. Puntuación del índice, coste por tarea, recuento de tokens y velocidad de las páginas de modelo de Artificial Analysis, medidos a max effort. Consultado el 23 de septiembre de 2026.
Diez puntos, y son reales
Artificial Analysis puntúa a Opus 5.5 con 58 y a Sol con 48 en el Intelligence Index v4.3.2. No es una diferencia de redondeo. Opus 5.5 es primero entre los 212 modelos de su clase. Sol es decimoctavo.
Diez puntos compran algo. No lo compran barato, y los dos modelos no compiten por el mismo hueco. OpenAI describe a Sol como construido para programación compleja y flujos agénticos, con un precio pensado para ejecutar muchos. Anthropic le dice que empiece con Opus 5.5 para la mayoría de las cargas y que suba a Fable 5.1 solo cuando Opus 5.5 con más esfuerzo siga quedándose corto.
La cifra por tarea es 5,6 veces, y la verbosidad es el motivo
Por token la distancia es exactamente dos. Por tarea en el mismo índice son 5,98 frente a 1,06 dólares.
El multiplicador viene del volumen de salida. Al ejecutar el índice, Opus 5.5 generó 260 millones de tokens y Sol generó 77 millones. Artificial Analysis califica a Opus 5.5 de muy verboso frente a una mediana de 88 millones, y a Sol de bastante conciso. Un modelo que piensa largo paga ese pensamiento dos veces: una en tokens, otra en la tarifa de salida.
El precio por token subestima esta distancia en un factor de tres. Si presupuesta a partir de una lista de precios en lugar de una ejecución medida, se equivocará en la dirección cara.
La línea que nadie puso en un anuncio: la lectura de caché empata
Sol lee entrada en caché a $0.20 por millón, el 10% de su tarifa de entrada de $2. Opus 5.5 lee entrada en caché a $0.20 por millón, el 5% de su tarifa de $4. Anthropic cambió el multiplicador para este modelo en concreto: los aciertos de caché en Opus 5.5 se tarifan a 0,05x la entrada base, mientras el resto de la gama usa 0,1x. Opus 5 leía caché a $0.50.
Así que los dos modelos cobran lo mismo por releer un prompt.
Eso pesa más de lo que parece, porque los bucles de agente son sobre todo lecturas de caché. La propia guía de costes de Anthropic indica que, durante un día completo de tráfico real, los bucles de agente leen una mediana del 84% de su entrada desde caché, y el decil superior de arneses lee el 94% o más. En un bucle así, el lado de entrada de la factura queda empatado y cada dólar de diferencia son tokens de salida.
| Adónde va el dinero | GPT-6 Sol | Claude Opus 5.5 | Distancia |
|---|---|---|---|
| Entrada en caché, el grueso de un bucle de agente | $0.20 | $0.20 | ninguna |
| Entrada nueva | $2 | $4 | 2x |
| Salida | $10 | $20 | 2x |
| Tokens de salida realmente escritos | 77 M | 260 M | 3,4x |
Por millón de tokens. La combinación de las dos últimas filas es lo que convierte una lista de precios de 2x en una factura de 5,6x.
5,98 dólares es el techo, no el precio
La cifra de Artificial Analysis es Opus 5.5 a max effort con el fallback por defecto. El valor por defecto de la API para el modelo es medium.
Anthropic dejó el pensamiento adaptativo siempre activo en Opus 5.5 y movió el control de profundidad al parámetro de esfuerzo, cuyo valor por defecto en este modelo es medium en lugar del high que usa casi toda la gama. Toda comparativa que lea esta semana cita la cifra a max effort, porque es la que publica Artificial Analysis. Su bucle no correrá ahí salvo que usted lo ponga ahí.
Trate los 5,98 dólares como lo que cuesta el modelo cuando le pide todo lo que tiene, y baje el esfuerzo antes de concluir que es demasiado caro.
Agentes de programación: la medición está incompleta, y eso importa
En el Coding Agent Index v1.5 de Artificial Analysis, Codex con GPT-6 Sol saca 57 a $2.99 por tarea y 22,3 minutos. La entrada más cercana de Anthropic era Claude Code con Opus 5, con 60 y $10.79 por tarea en 41,9 minutos.
Opus 5.5 ya está medido, y encabeza esa tabla: Claude Code con Opus 5.5 saca 66 a $13.04 por tarea en 1,1 horas. Cuatro puntos y cuatro veces la factura frente a Sol, por un trabajo que tarda el triple. El arnés mueve los resultados tanto como el modelo, y las propias cifras de Sol muestran por qué: gana a Astra en DeepSWE v1.1, 69% frente a 68%, y pierde Terminal-Bench 4.0 por trece puntos. Un modelo, dos respuestas muy distintas según el benchmark.
Cuál usaría yo
| El trabajo | Modelo | Por qué |
|---|---|---|
| Programación agéntica de alto volumen con tests o verificador | GPT-6 Sol | $1.06 frente a $5.98 por tarea. Reejecute los fallos en un nivel superior en vez de pagar profundidad en cada ejecución. |
| El paso de razonamiento más duro de un bucle | Claude Opus 5.5 | Primero entre 212 en el índice. Diez puntos merecen pagarse en el paso que decide el resultado. |
| Reparto entre ejecutor y asesor | Ambos | Sol sostiene el bucle, a Opus 5.5 se le consulta cuando se atasca. Tarife primero al asesor por separado y mida la tasa de consulta. |
| Agentes largos con mucha caché | Más cerca de lo que parece | Ambos leen caché a $0.20. Compare por tokens de salida, no por la línea de entrada. |
| Equipo ya en la plataforma de Anthropic | Claude Opus 5.5 | Recomendación por defecto de la propia Anthropic, y un 20% más barato por token que el Opus 5 que usa hoy. |
Sol gana el volumen. Opus 5.5 gana el paso duro. La mayoría de los bucles en producción quieren una regla que elija entre ambos por petición.
Por el lado de Anthropic, Opus 5.5 frente a Opus 5 cubre los cuatro cambios que rompen una migración ingenua. Por el lado de OpenAI, Sol frente a Astra es la decisión de enrutado dentro de un mismo proveedor.
Qué me haría cambiar de opinión
Un barrido de esfuerzo a medium. Todas las cifras por tarea de aquí son max effort. El valor por defecto del modelo es medium, y la distancia por defecto podría ser la mitad de lo que parece.
Preguntas que me hicieron
¿Es Claude Opus 5.5 mejor que GPT-6 Sol?
En el índice independiente, con claridad. Artificial Analysis puntúa a Claude Opus 5.5 con 58 y a GPT-6 Sol con 48 en el Intelligence Index v4.3.2, lo que sitúa a Opus 5.5 primero entre 212 modelos y a Sol decimoctavo. No apuntan al mismo trabajo: OpenAI describe a Sol como construido para programación compleja y flujos agénticos a $2 / $10, y Anthropic recomienda Opus 5.5 por defecto para la mayoría de las cargas a $4 / $20.
¿Cuánto más cuesta Claude Opus 5.5 que GPT-6 Sol?
El doble por token y 5,6 veces por tarea. Opus 5.5 figura a $4 por millón de tokens de entrada y $20 de salida frente a los $2 y $10 de Sol. Artificial Analysis midió $5.98 por tarea al ejecutar su índice sobre Opus 5.5 a max effort y $1.06 sobre Sol, porque Opus 5.5 generó 260 millones de tokens frente a los 77 de Sol. La entrada en caché cuesta $0.20 por millón en ambos.
¿Cuál es más rápido, GPT-6 Sol o Claude Opus 5.5?
Sol. Artificial Analysis mide unos 125 tokens de salida por segundo para Sol y unos 95 para Opus 5.5, y además Sol escribe alrededor de un tercio de los tokens por tarea, así que termina antes por dos razones distintas, no por una.
¿Debo usar GPT-6 Sol o Claude Opus 5.5?
Sol para programación agéntica de alto volumen donde pueda revisar la salida, y para todo aquello donde el coste por tarea terminada decida la arquitectura. Opus 5.5 para el razonamiento más duro del bucle, para equipos que ya trabajan en la plataforma de Anthropic, y como modelo asesor al que llama un ejecutor más barato cuando se atasca. Enrute entre ambos en lugar de elegir un único valor por defecto.
Si está eligiendo un nivel de modelo para un producto agéntico y quiere la regla de enrutado por escrito, la página de contacto es la vía más rápida para llegar a mí.



