Saltar al contenido
wojciech.io
Comparativas de modelos
AI SystemsAIClaudeAI Systems

Anthropic bajó todos los precios de Claude Opus 5.5. La factura frente a Opus 5 subió igualmente.

Opus 5.5 recorta un 20% el token y un 60% la caché, y saca 58 frente al 51 de Opus 5. El coste por tarea del índice subió igualmente a 5,98 dólares. Y cuatro cambios que rompen.

Wojciech Luszczynski

Wojciech Luszczynski

GTM Architect & Growth Operator · Insights · 23 de septiembre de 2026 · 10 min de lectura

Compartir

Resumen · Lo esencial

  • Opus 5.5 figura a 4 / 20 dólares frente a los 5 / 25 de Opus 5, y las lecturas de caché bajan de 0,50 a 0,20 porque Anthropic movió este modelo a un multiplicador de caché de 0,05x en lugar del habitual 0,1x.
  • Artificial Analysis puntúa a Opus 5.5 con 58 y a Opus 5 con 51, primero entre 212 modelos frente a undécimo. El coste por tarea del índice apenas se movió: 5,98 frente a 5,86, porque Opus 5.5 escribió 260 millones de tokens frente a los 140 de Opus 5.
  • La propia guía de actualización de Anthropic sitúa el rango entre un 40% menos y un 20% más por tarea resuelta. La medición independiente cayó cerca del extremo alto, no del bajo.
  • Cuatro cambios rompen el código que ya corre en Opus 5: el pensamiento no se puede desactivar, el uso forzado de herramientas devuelve 400, los bloques de pensamiento quedan ligados al modelo, y la herramienta antigua de computer use se rechaza.

Anthropic bajó todos los precios de la línea Opus y lanzó un modelo mejor. Entrada un 20% abajo, salida un 20% abajo, lecturas de caché un 60% abajo, siete puntos más en el índice independiente.

Después Artificial Analysis ejecutó su benchmark en ambos y el modelo más nuevo costó más. No mucho más, un 2%, pero más. Esa cifra es el artículo entero, porque es la que verá su departamento financiero y no verá el resumen del anuncio.

InfoClaude Opus 5.5Claude Opus 5
Entrada / salida por 1 M$4 / $20$5 / $25
Aciertos y refrescos de caché$0.20$0.50
Escrituras de caché 5 min / 1 h$5 / $8$6.25 / $10
Intelligence Index v4.3.25851
Puesto entre 212 modelos1.º11.º
Coste por tarea del índice$5.98$5.86
Tokens generados en el índice260 M140 M
Velocidad de salida, tokens/sunos 95unos 54
Esfuerzo de razonamiento por defectomediumhigh
Contexto / salida máxima1 M / 128K1 M / 128K

Precios de la página de precios de Anthropic. Puntuación del índice, coste por tarea, tokens y velocidad de las páginas de modelo de Artificial Analysis, ambos medidos a max effort. Consultado el 23 de septiembre de 2026.

La línea de la caché es el recorte de precio real

Todo el mundo citará el paso de $5 a $4. No es la línea que mueve una factura de agente.

Anthropic tarifa los aciertos y refrescos de caché en Opus 5.5 a 0,05x el precio base de entrada, donde el resto de modelos de la gama usa 0,1x. Eso lleva una lectura de caché de $0.50 a $0.20 por millón de tokens, un recorte del 60%, en el componente que domina los bucles largos.

La propia guía de costes de Anthropic dice que los bucles de agente leen una mediana del 84% de su entrada desde caché durante un día completo de tráfico real. Si eso describe su carga, el lado de entrada de su factura acaba de caer más de la mitad. El 20% del titular es la mitad pequeña de la historia.

Key takeaway

Opus 5.5 lee ahora caché a $0.20 por millón, la misma tarifa que cobra GPT-6 Sol, en un modelo cuya entrada figura al doble que la de Sol. Compare proveedores por la línea que su tráfico toca de verdad.

Siete puntos arriba, y ahora primero

Artificial Analysis puntúa a Opus 5.5 con 58 y a Opus 5 con 51 en el Intelligence Index v4.3.2. Opus 5.5 es primero entre los 212 modelos de esa clase. Opus 5 era undécimo.

El mismo sitio ya ha puesto un aviso de obsolescencia en la página de Opus 5 que dice a los lectores que Anthropic lanzó un modelo más nuevo y les sugiere considerarlo. El resumen de modelos de Anthropic también se movió: la línea que antes mandaba a los lectores indecisos a Opus 5 ahora los manda a Opus 5.5.

Por qué la cifra por tarea fue en la dirección equivocada

Opus 5.5 generó 260 millones de tokens al ejecutar el índice. Opus 5 generó 140 millones. A max effort el modelo más nuevo piensa casi el doble de tiempo, y un recorte de tarifa del 20% no cubre un aumento del 86% en tokens escritos.

Anthropic es honesta sobre esto en su propia guía de costes. Su fila de actualización dice que el modelo actual resuelve más tareas, a un coste por tarea resuelta que va de un 40% menos a un 20% más. Eso es un rango con un extremo malo, no una promesa de ahorro, y la ejecución independiente cayó cerca del extremo malo.

Así que: mejor por tarea, aproximadamente igual por dólar, a max effort. El ahorro se captura bajando el esfuerzo. Cambiar el identificador del modelo y esperar a que mejore la factura no bastará, y si ya había presupuestado ese 20% como ahorro debería devolver esa línea a su sitio hasta que una ejecución sobre su propia carga diga otra cosa.

Cuatro cosas que romperán su migración

Esta es la parte que falta en todos los resúmenes que he leído esta semana. Anthropic documenta cuatro cambios que rompen el código que ya corre en Opus 5.

CambioQué pasaLa solución
El pensamiento no se puede desactivarUna petición con thinking type disabled, o un budget_tokens manual, devuelve 400 invalid_request_error.Omita el campo thinking o envíe adaptive, y controle la profundidad con effort.
Desaparece el uso forzado de herramientastool_choice en any, o en una herramienta concreta, devuelve 400. El recuento de tokens valida igual.Deje tool_choice en auto con uso estricto de herramientas, o mueva el esquema a salidas estructuradas.
Los bloques de pensamiento van ligados al modeloOpus 5.5 lee bloques de Opus 5 y de Opus, Sonnet y Haiku anteriores, pero no de Fable ni Mythos.Seleccione bloques de contenido por tipo y no por posición, y devuelva los bloques de pensamiento sin modificar.
Se rechaza la herramienta antigua de computer useEn la API de Claude y en Google Cloud no se acepta computer_20251124.Pase al conjunto actual de computer use antes de cambiar el identificador del modelo.
Texto entre llamadas a herramientas (no rompe)Ahora llega dentro de bloques de pensamiento vacíos en el ajuste de visualización por defecto, así que los flujos de progreso enmudecen.Fije un valor de visualización que devuelva el texto si sus usuarios miran ese flujo.

De la propia página de novedades de Anthropic para Opus 5.5. Los tres primeros aplican también a Claude Fable 5.1.

La quinta fila es la que llegará a sus usuarios en vez de a sus registros. Una aplicación que emite el texto entre herramientas como indicador de progreso no da error. Simplemente enmudece entre llamadas, y el silencio parece un cuelgue.

Se movió el valor por defecto, así que se movió su comportamiento

En Opus 5.5 el pensamiento adaptativo está siempre activo y effort controla la profundidad, y el valor por defecto de este modelo es medium donde casi toda la gama usa high.

Dos consecuencias. Primera, una migración directa de una llamada a Opus 5 que dependía del valor por defecto recibe un modelo más superficial que antes, lo que parece una regresión de calidad y en realidad es un cambio de configuración. Segunda, todo benchmark publicado para Opus 5.5, incluidos los $5.98 de este artículo, se mide a max effort. Ninguna de esas cifras describe el valor por defecto.

Si la calidad baja tras la migración, suba el esfuerzo antes de culpar al modelo. Si sube el coste, bájelo.

Cuál usaría yo

Opus 5, sinceramente, no tiene ningún caso que lo sostenga. Es más caro en todas las líneas, va siete puntos por detrás, y Artificial Analysis lo ha marcado como obsoleto. La cuestión no es si migrar, sino cómo.

La situaciónHaga estoPor qué
Bucles de agente con mucha caché en Opus 5Migre yaLas lecturas de caché caen un 60%. Es la línea individual más grande de esa factura.
Código con uso forzado de herramientas o pensamiento desactivadoArregle primero, migre despuésAmbos devuelven 400 en Opus 5.5. La migración falla ruidosamente en la primera llamada.
Interfaz que emite progreso entre llamadas a herramientasFije display y migreSin error, solo silencio. Peor que un fallo porque nada le avisa.
El coste ya es la restricciónMigre y baje el esfuerzoEl ahorro viene de medium effort, no del identificador del modelo. A max effort se midió un 2% más por tarea.
Conversaciones que saltan a Fable o MythosRevise los bloques de pensamientoOpus 5.5 no lee bloques de pensamiento de Fable ni de Mythos.

La actualización merece la pena. Reserve una tarde para los cuatro cambios que rompen en vez de tratarla como un cambio de cadena de texto.

Para la versión entre proveedores de esta decisión, GPT-6 Sol frente a Opus 5.5 tiene la aritmética por tarea. Todas las demás parejas están en las comparativas de modelos.

Qué me haría cambiar de opinión

Una medición a medium effort. Todas las cifras por tarea de aquí son max effort en un modelo cuyo valor por defecto es medium, y la distancia podría invertirse en ese valor.

Las dos preguntas con las que abrió esta sección ya tienen respuesta, y ambas fueron a favor de Opus 5.5. Genera a unos 95 tokens de salida por segundo frente a los 54 de Opus 5, y en el Coding Agent Index Claude Code con Opus 5.5 saca 66 a $13.04 por tarea frente al 60 de Opus 5 a $10.79. Seis puntos por un 21% más por tarea es el argumento más claro a favor de la actualización en esta página.

Preguntas que me hicieron

¿Es Claude Opus 5.5 más barato que Claude Opus 5?

Por token sí, un 20%: $4 por millón de tokens de entrada y $20 de salida frente a $5 y $25. Las lecturas de caché bajan más, de $0.50 a $0.20, porque Anthropic tarifa los aciertos de caché en Opus 5.5 a 0,05x la entrada base en lugar del habitual 0,1x. Por tarea terminada no es automático. Artificial Analysis midió $5.98 por tarea del índice en Opus 5.5 y $5.86 en Opus 5, porque el modelo más nuevo escribió 260 millones de tokens frente a los 140 del anterior a max effort.

¿Es Claude Opus 5.5 mejor que Claude Opus 5?

Sí, por siete puntos en el índice independiente. Artificial Analysis puntúa a Opus 5.5 con 58 y a Opus 5 con 51 en el Intelligence Index v4.3.2, lo que hace a Opus 5.5 primero entre 212 modelos donde Opus 5 era undécimo. Anthropic también ha movido su recomendación por defecto a Opus 5.5 y Artificial Analysis marca ahora Opus 5 como obsoleto.

¿Qué se rompe al pasar de Claude Opus 5 a Opus 5.5?

Cuatro cosas, según las propias notas de migración de Anthropic. El pensamiento no se puede desactivar, así que una petición con thinking type disabled o un presupuesto manual de tokens devuelve 400. El uso forzado de herramientas desaparece, así que tool_choice en any o en una herramienta concreta devuelve 400. Los bloques de pensamiento quedan ligados al modelo que los produjo, así que las conversaciones movidas entre familias de modelos requieren cuidado. Y en la API de Claude y en Google Cloud no se acepta la herramienta computer_20251124. Un quinto cambio es más silencioso: el texto entre llamadas a herramientas llega ahora en bloques de pensamiento vacíos en el ajuste de visualización por defecto, así que los flujos de progreso enmudecen hasta que cambie ese ajuste.

¿Debo pasar de Claude Opus 5 a Opus 5.5?

Sí, pero mida el ahorro en lugar de darlo por hecho. El precio por token es un 20% menor, las lecturas de caché un 60% menores, y el modelo resuelve más. El rango de la propia Anthropic para la actualización va de un 40% menos a un 20% más por tarea resuelta, y la ejecución independiente del índice salió un 2% más cara. Baje el esfuerzo después de la migración, porque el valor por defecto pasó de high a medium y todas las comparativas publicadas se miden a max.

Si está planificando esta migración en un stack de agentes en producción, la página de contacto es la vía más rápida para llegar a mí.

Compartir artículo

Sobre el autor

Wojciech Luszczynski

Wojciech Luszczynski

Arquitecto de GTM y operador de crecimiento que construye sistemas de ingresos nativos de IA para empresas B2B SaaS y tecnológicas. Conecto posicionamiento, SEO, contenido, adquisición de pago, CRM, automatización, analítica y flujos de trabajo con IA en una infraestructura de crecimiento que funciona.

Newsletter

Recibe el próximo antes que nadie.

Cuando publique un artículo nuevo sobre sistemas de IA, arquitectura GTM o modelos operativos de crecimiento, serás el primero en saberlo.

Suscribirse