Saltar al contenido
wojciech.io
Comparativas de modelos
AI SystemsAIOpenAIClaudeAI Systems

Claude Opus 5.5 ganó el índice. GPT-6 Sol ganó la factura.

Opus 5.5 saca 58 frente al 48 de Sol y cuesta 5,98 dólares por tarea frente a 1,06. Ambos leen caché a 0,20. Dónde la distancia es real y dónde desaparece.

Wojciech Luszczynski

Wojciech Luszczynski

GTM Architect & Growth Operator · Insights · 23 de septiembre de 2026 · 9 min de lectura

Compartir

Resumen · Lo esencial

  • Artificial Analysis puntúa a Claude Opus 5.5 con 58 y a GPT-6 Sol con 48 en el Intelligence Index v4.3.2. Opus 5.5 es primero entre 212 modelos. Sol es decimoctavo.
  • Por token, Opus 5.5 cuesta exactamente el doble que Sol: 4 / 20 dólares frente a 2 / 10. Por tarea en el índice son 5,6 veces, 5,98 frente a 1,06, porque a max effort escribió 260 millones de tokens frente a los 77 de Sol.
  • Ambos modelos leen caché a 0,20 dólares por millón de tokens. En un bucle de agente que lee la mayor parte de su entrada desde caché, el lado de entrada de la factura queda empatado y toda la distancia está en la salida.
  • Los 5,98 dólares son Opus 5.5 a max effort. Su valor por defecto en la API es medium, así que esa cifra es el techo del modelo, no el precio de usarlo.

Dos proveedores lanzaron un nuevo modelo por defecto el mismo día. OpenAI puso GPT-6 Sol en la API a $2 / $10. Anthropic puso Claude Opus 5.5 en lo alto de su gama a $4 / $20 y dijo a todo el mundo que empezara ahí.

La lista de precios dice que uno cuesta el doble que el otro. El índice independiente dice diez puntos. La factura dice 5,6 veces. Las tres son correctas, y la diferencia entre ellas es donde vive la decisión operativa.

InfoGPT-6 SolClaude Opus 5.5
Entrada / salida por 1 M$2 / $10$4 / $20
Entrada en caché por 1 M$0.20$0.20
Intelligence Index v4.3.24858
Puesto entre 212 modelos18.º1.º
Coste por tarea del índice$1.06$5.98
Tokens generados en el índice77 M260 M
Velocidad de salida, tokens/sunos 125unos 95
Contexto / salida máxima1.050.000 / 128.0001 M / 128K
Corte de conocimiento20 abr 2026jun 2026
Esfuerzo de razonamiento por defectomediummedium

Precios y límites de la página de modelo de GPT-6 Sol de OpenAI y de las páginas de precios y modelos de Anthropic. Puntuación del índice, coste por tarea, recuento de tokens y velocidad de las páginas de modelo de Artificial Analysis, medidos a max effort. Consultado el 23 de septiembre de 2026.

Diez puntos, y son reales

Artificial Analysis puntúa a Opus 5.5 con 58 y a Sol con 48 en el Intelligence Index v4.3.2. No es una diferencia de redondeo. Opus 5.5 es primero entre los 212 modelos de su clase. Sol es decimoctavo.

Diez puntos compran algo. No lo compran barato, y los dos modelos no compiten por el mismo hueco. OpenAI describe a Sol como construido para programación compleja y flujos agénticos, con un precio pensado para ejecutar muchos. Anthropic le dice que empiece con Opus 5.5 para la mayoría de las cargas y que suba a Fable 5.1 solo cuando Opus 5.5 con más esfuerzo siga quedándose corto.

La cifra por tarea es 5,6 veces, y la verbosidad es el motivo

Por token la distancia es exactamente dos. Por tarea en el mismo índice son 5,98 frente a 1,06 dólares.

El multiplicador viene del volumen de salida. Al ejecutar el índice, Opus 5.5 generó 260 millones de tokens y Sol generó 77 millones. Artificial Analysis califica a Opus 5.5 de muy verboso frente a una mediana de 88 millones, y a Sol de bastante conciso. Un modelo que piensa largo paga ese pensamiento dos veces: una en tokens, otra en la tarifa de salida.

Key takeaway

El precio por token subestima esta distancia en un factor de tres. Si presupuesta a partir de una lista de precios en lugar de una ejecución medida, se equivocará en la dirección cara.

La línea que nadie puso en un anuncio: la lectura de caché empata

Sol lee entrada en caché a $0.20 por millón, el 10% de su tarifa de entrada de $2. Opus 5.5 lee entrada en caché a $0.20 por millón, el 5% de su tarifa de $4. Anthropic cambió el multiplicador para este modelo en concreto: los aciertos de caché en Opus 5.5 se tarifan a 0,05x la entrada base, mientras el resto de la gama usa 0,1x. Opus 5 leía caché a $0.50.

Así que los dos modelos cobran lo mismo por releer un prompt.

Eso pesa más de lo que parece, porque los bucles de agente son sobre todo lecturas de caché. La propia guía de costes de Anthropic indica que, durante un día completo de tráfico real, los bucles de agente leen una mediana del 84% de su entrada desde caché, y el decil superior de arneses lee el 94% o más. En un bucle así, el lado de entrada de la factura queda empatado y cada dólar de diferencia son tokens de salida.

Adónde va el dineroGPT-6 SolClaude Opus 5.5Distancia
Entrada en caché, el grueso de un bucle de agente$0.20$0.20ninguna
Entrada nueva$2$42x
Salida$10$202x
Tokens de salida realmente escritos77 M260 M3,4x

Por millón de tokens. La combinación de las dos últimas filas es lo que convierte una lista de precios de 2x en una factura de 5,6x.

5,98 dólares es el techo, no el precio

La cifra de Artificial Analysis es Opus 5.5 a max effort con el fallback por defecto. El valor por defecto de la API para el modelo es medium.

Anthropic dejó el pensamiento adaptativo siempre activo en Opus 5.5 y movió el control de profundidad al parámetro de esfuerzo, cuyo valor por defecto en este modelo es medium en lugar del high que usa casi toda la gama. Toda comparativa que lea esta semana cita la cifra a max effort, porque es la que publica Artificial Analysis. Su bucle no correrá ahí salvo que usted lo ponga ahí.

Trate los 5,98 dólares como lo que cuesta el modelo cuando le pide todo lo que tiene, y baje el esfuerzo antes de concluir que es demasiado caro.

Agentes de programación: la medición está incompleta, y eso importa

En el Coding Agent Index v1.5 de Artificial Analysis, Codex con GPT-6 Sol saca 57 a $2.99 por tarea y 22,3 minutos. La entrada más cercana de Anthropic era Claude Code con Opus 5, con 60 y $10.79 por tarea en 41,9 minutos.

Opus 5.5 ya está medido, y encabeza esa tabla: Claude Code con Opus 5.5 saca 66 a $13.04 por tarea en 1,1 horas. Cuatro puntos y cuatro veces la factura frente a Sol, por un trabajo que tarda el triple. El arnés mueve los resultados tanto como el modelo, y las propias cifras de Sol muestran por qué: gana a Astra en DeepSWE v1.1, 69% frente a 68%, y pierde Terminal-Bench 4.0 por trece puntos. Un modelo, dos respuestas muy distintas según el benchmark.

Cuál usaría yo

El trabajoModeloPor qué
Programación agéntica de alto volumen con tests o verificadorGPT-6 Sol$1.06 frente a $5.98 por tarea. Reejecute los fallos en un nivel superior en vez de pagar profundidad en cada ejecución.
El paso de razonamiento más duro de un bucleClaude Opus 5.5Primero entre 212 en el índice. Diez puntos merecen pagarse en el paso que decide el resultado.
Reparto entre ejecutor y asesorAmbosSol sostiene el bucle, a Opus 5.5 se le consulta cuando se atasca. Tarife primero al asesor por separado y mida la tasa de consulta.
Agentes largos con mucha cachéMás cerca de lo que pareceAmbos leen caché a $0.20. Compare por tokens de salida, no por la línea de entrada.
Equipo ya en la plataforma de AnthropicClaude Opus 5.5Recomendación por defecto de la propia Anthropic, y un 20% más barato por token que el Opus 5 que usa hoy.

Sol gana el volumen. Opus 5.5 gana el paso duro. La mayoría de los bucles en producción quieren una regla que elija entre ambos por petición.

Por el lado de Anthropic, Opus 5.5 frente a Opus 5 cubre los cuatro cambios que rompen una migración ingenua. Por el lado de OpenAI, Sol frente a Astra es la decisión de enrutado dentro de un mismo proveedor.

Qué me haría cambiar de opinión

Un barrido de esfuerzo a medium. Todas las cifras por tarea de aquí son max effort. El valor por defecto del modelo es medium, y la distancia por defecto podría ser la mitad de lo que parece.

Preguntas que me hicieron

¿Es Claude Opus 5.5 mejor que GPT-6 Sol?

En el índice independiente, con claridad. Artificial Analysis puntúa a Claude Opus 5.5 con 58 y a GPT-6 Sol con 48 en el Intelligence Index v4.3.2, lo que sitúa a Opus 5.5 primero entre 212 modelos y a Sol decimoctavo. No apuntan al mismo trabajo: OpenAI describe a Sol como construido para programación compleja y flujos agénticos a $2 / $10, y Anthropic recomienda Opus 5.5 por defecto para la mayoría de las cargas a $4 / $20.

¿Cuánto más cuesta Claude Opus 5.5 que GPT-6 Sol?

El doble por token y 5,6 veces por tarea. Opus 5.5 figura a $4 por millón de tokens de entrada y $20 de salida frente a los $2 y $10 de Sol. Artificial Analysis midió $5.98 por tarea al ejecutar su índice sobre Opus 5.5 a max effort y $1.06 sobre Sol, porque Opus 5.5 generó 260 millones de tokens frente a los 77 de Sol. La entrada en caché cuesta $0.20 por millón en ambos.

¿Cuál es más rápido, GPT-6 Sol o Claude Opus 5.5?

Sol. Artificial Analysis mide unos 125 tokens de salida por segundo para Sol y unos 95 para Opus 5.5, y además Sol escribe alrededor de un tercio de los tokens por tarea, así que termina antes por dos razones distintas, no por una.

¿Debo usar GPT-6 Sol o Claude Opus 5.5?

Sol para programación agéntica de alto volumen donde pueda revisar la salida, y para todo aquello donde el coste por tarea terminada decida la arquitectura. Opus 5.5 para el razonamiento más duro del bucle, para equipos que ya trabajan en la plataforma de Anthropic, y como modelo asesor al que llama un ejecutor más barato cuando se atasca. Enrute entre ambos en lugar de elegir un único valor por defecto.

Si está eligiendo un nivel de modelo para un producto agéntico y quiere la regla de enrutado por escrito, la página de contacto es la vía más rápida para llegar a mí.

Compartir artículo

Sobre el autor

Wojciech Luszczynski

Wojciech Luszczynski

Arquitecto de GTM y operador de crecimiento que construye sistemas de ingresos nativos de IA para empresas B2B SaaS y tecnológicas. Conecto posicionamiento, SEO, contenido, adquisición de pago, CRM, automatización, analítica y flujos de trabajo con IA en una infraestructura de crecimiento que funciona.

Newsletter

Recibe el próximo antes que nadie.

Cuando publique un artículo nuevo sobre sistemas de IA, arquitectura GTM o modelos operativos de crecimiento, serás el primero en saberlo.

Suscribirse