Modelos

Anthropic y OpenAI se declaran la guerra de precios

El 22 de septiembre de 2026, Anthropic presentó Claude Opus 5.5 y, poco después, ese mismo día, OpenAI respondió con GPT-6 Sol y GPT-6 Luna. Los tres salen más baratos, pero las rebajas no se miden igual: el 40 % de Anthropic no es el precio del token, y el 50 % de OpenAI se calcula sobre una tarifa promocional. Además, Opus 5.5 pasará la mayoría de los encargos de ciberseguridad a un modelo anterior.

Recibe el resumen diario de IA

Cada mañana, lo esencial de la inteligencia artificial en tu correo, sin humo. Al día con la IA.

Frecuencia:

Caricatura de un duelo del Oeste: un vaquero bajito con la cabeza en forma de asterisco naranja y un pistolero alto con gabardina negra rotulada OpenAI se encaran en el desierto, sudando, cada uno con unas tijeras enormes con las que parte monedas de oro; las mitades caen al suelo entre los dos.
📷 Imagen generada con IA

En resumen

  • Claude Opus 5.5 cuesta 4 $ por millón de tokens de entrada y 20 $ de salida, un 20 % menos que Opus 5; la lectura de caché baja un 60 %, hasta 0,20 $.
  • El 40 % de ahorro que anuncia Anthropic suma ese abaratamiento y que el modelo gasta menos tokens por tarea; lo mide la propia empresa.
  • GPT-6 Sol cuesta 2 $ y 10 $ por millón de tokens y GPT-6 Luna, 0,10 $ y 0,50 $: OpenAI lo presenta como un recorte del 50 % sobre el precio promocional de GPT-5.6 (en la salida de Luna, del 58 %).
  • Artificial Analysis, que se define como empresa independiente de medición de la IA, pone a Opus 5.5 primero de 212 en su índice de inteligencia, con 58 puntos.
  • La mayoría de las tareas de ciberseguridad que reciba Opus 5.5 se desviarán a Claude Opus 4.8.

Dos lanzamientos en la misma tarde

Anthropic, el laboratorio estadounidense que desarrolla Claude, publicó Claude Opus 5.5 el 22 de septiembre de 2026. Es el primer modelo de la familia Claude 5.5 y, según la empresa, rinde en la mayor parte del trabajo al nivel de Claude Fable 5.1, que cuesta 2,5 veces más por token. Sonnet 5.5 y Haiku 5.5 llegarán «en las próximas semanas». Opus 5.5 está en todas sus plataformas y también en AWS, Google Cloud y Microsoft Azure.

Poco después, ese mismo día, OpenAI, la empresa de ChatGPT, presentó GPT-6 Sol y GPT-6 Luna, dos modelos más baratos entrenados «con métodos similares» a GPT-6 Astra, que salió este mes y sigue siendo su mejor modelo. Están en ChatGPT Work y Codex para los planes Plus, Pro, Business, Enterprise y Edu, y los usuarios de Free y Go tienen Luna en la aplicación de escritorio. En la API se llaman gpt-6-sol y gpt-6-luna. Todavía no están en Chat, el modo de conversación de ChatGPT.

El 40 % de Anthropic no es el precio del token

Precios por millón de tokens
Modelo Entrada Salida Lectura de caché Modelo anterior (entrada / salida / caché)
Claude Opus 5.5 4 $ 20 $ 0,20 $ Opus 5: 5 $ / 25 $ / 0,50 $
GPT-6 Sol 2 $ 10 $ Hasta un 90 % de descuento GPT-5.6 Sol: 4 $ / 20 $
GPT-6 Luna 0,10 $ 0,50 $ Hasta un 90 % de descuento GPT-5.6 Luna: 0,20 $ / 1,20 $
Precios por millón de tokens publicados por cada empresa; el recorte de OpenAI se mide contra el precio promocional de GPT-5.6. OpenAI publica para la caché un descuento de hasta el 90 % sobre la entrada, no una tarifa por modelo.

La rebaja visible de Opus 5.5 es del 20 % en el precio del token. El 40 % que anuncia Anthropic sale de sumarle otra cosa: el modelo gasta menos tokens para terminar la misma tarea. En palabras de la empresa, «cuesta menos por token que Opus 5 y usa menos tokens por tarea, lo que se traduce en una caída del 40 % en los costes». Es una medición propia, con la configuración por defecto y sobre lo que llama cargas de trabajo típicas.

Donde más baja el precio es en la lectura de caché, que según Anthropic es la mayor parte del coste en el trabajo con agentes y en programación. Hay además un modo rápido, en Claude Code y Claude Platform, hasta 2,5 veces más veloz, que se cobra a 8 $ la entrada y 40 $ la salida por millón. Y suben los límites de uso de cinco horas en los planes Pro, Max, Team y Enterprise por puesto.

OpenAI habla de un recorte del 50 % en Sol y Luna, pero contra el precio promocional de GPT-5.6, no contra la tarifa ordinaria. Su caché descuenta hasta un 90 % la lectura de tokens de entrada ya guardados, y llega con puntos de corte explícitos, un panel y una herramienta de diagnóstico.

Las pruebas de Anthropic: gana casi siempre, no siempre

Pruebas de referencia publicadas por Anthropic
Prueba Opus 5.5 Fable 5.1 Opus 5 GPT-6 Astra GPT-5.6 Sol
Terminal-Bench 4.0 66,4 % 55,8 % 52,3 % 57,9 % 37,3 %
FrontierCode v1.1 54,4 % 50,3 % 48,0 % 53,3 % 47,5 %
AutomationBench 40,0 % 31,4 % 26,9 % 41,4 % 28,8 %
Terminal-Bench-Science 0.1 58,7 % 52,6 % 29,0 % 64,6 % 22,4 %
Cifras comunicadas por Anthropic, que vende el modelo. En Terminal-Bench 4.0, Opus 5.5 en esfuerzo xhigh y GPT-6 Astra en high, con la cifra que da OpenAI: la mejor de cada uno. AutomationBench la ejecuta y publica Zapier.

En las pruebas de referencia que publica Anthropic, Opus 5.5 supera a Fable 5.1 y a Opus 5 en todas. Frente a GPT-6 Astra el resultado se reparte: Opus 5.5 gana en Terminal-Bench 4.0 y en FrontierCode, pero Astra queda por delante en AutomationBench, la prueba que hace y publica Zapier, la plataforma de automatización entre aplicaciones, y en Terminal-Bench-Science.

Dos reservas. Todas las cifras las recopila y publica Anthropic, que vende el modelo; las de AutomationBench las midió Zapier y las de Astra las da OpenAI. En Terminal-Bench cada uno aparece con su mejor resultado, Opus 5.5 en esfuerzo xhigh y Astra en high: no compiten en igualdad de condiciones. La propia Anthropic advierte de que los márgenes en estas pruebas «se han vuelto una guía menos fiable de las diferencias reales».

OpenAI se compara con el Opus anterior

Lo que dice OpenAI de GPT-6 Sol
Prueba GPT-6 Sol Rival de Anthropic Coste por tarea
AutomationBench 33,2 % (xhigh) Claude Opus 5 (max): 26,9 % Sol 0,27 $; Opus 5, 11,1 veces más
DeepSWE v1.1 68,8 % (max) Claude Fable 5 (xhigh): 69,9 % Sol, alrededor de un 80 % menos
Cifras medidas y publicadas por OpenAI, que vende el modelo. No incluyen a Claude Opus 5.5, presentado el mismo día.

OpenAI también se mide con cifras propias. En AutomationBench, Sol en esfuerzo xhigh supera a Claude Opus 5 en su nivel máximo con un coste por tarea de 0,27 $, y Opus 5 necesita 11,1 veces ese gasto. En DeepSWE v1.1, una prueba de ingeniería de software sobre código real, Sol se queda a 1,1 puntos de Claude Fable 5 con un coste por tarea «alrededor de un 80 % menor».

Pero OpenAI enfrenta a Sol con Opus 5, Fable 5 y Fable 5.1, no con Opus 5.5, que salió el mismo día con un precio por token más bajo que el de Opus 5 y, según Anthropic, con menos tokens por tarea.

Artificial Analysis pone a Opus 5.5 en cabeza; Sol y Luna ganan en precio

Calidad contra coste en el índice de Artificial Analysis
40 50 60 0,1$ 0,3$ 1$ 3$ 10$ Coste medio por tarea del índice · escala logarítmica Índice de inteligencia Claude Opus 5.5 — Coste medio por tarea del índice: 5,98$ · Índice de inteligencia: 58puntos Claude Opus 5.5 Claude Fable 5.1 — Coste medio por tarea del índice: 7,63$ · Índice de inteligencia: 53puntos Claude Fable 5.1 GPT-6 Astra — Coste medio por tarea del índice: 3,26$ · Índice de inteligencia: 53puntos GPT-6 Astra GPT-6 Sol — Coste medio por tarea del índice: 1,06$ · Índice de inteligencia: 48puntos GPT-6 Sol GPT-6 Luna — Coste medio por tarea del índice: 0,07$ · Índice de inteligencia: 37puntos GPT-6 Luna
Ver los datos en tabla
Coste medio por tarea del índice Índice de inteligencia
Claude Opus 5.5 5,98$ 58puntos
Claude Fable 5.1 7,63$ 53puntos
GPT-6 Astra 3,26$ 53puntos
GPT-6 Sol 1,06$ 48puntos
GPT-6 Luna 0,07$ 37puntos
Artificial Analysis Intelligence Index, coste medio por tarea, consultado el 23-09-2026. Medición de Artificial Analysis, ajena a Anthropic y a OpenAI. Opus 5.5 y Fable 5.1 se miden con su modelo de reserva activado.

Artificial Analysis, una empresa de San Francisco que se define como independiente y mide modelos, nubes y chips, respaldada por inversores particulares como Nat Friedman, Daniel Gross y Andrew Ng, publica su propio índice de inteligencia. En él, Opus 5.5 es primero de 212 modelos con 58 puntos, por delante de Fable 5.1 y de Astra, empatados a 53.

El otro eje es lo que cuesta, de media, cada tarea del índice con cada modelo. Opus 5.5 sale más barato que Fable 5.1 y más caro que Astra; Sol y Luna ceden puntos a cambio de costar una fracción. El coste va en escala logarítmica porque del más barato al más caro hay dos órdenes de magnitud.

Opus 5.5 no hará casi nada de ciberseguridad

El anuncio trae además un cambio de alcance. Anthropic considera que Opus 5.5 tiene capacidades de ciberseguridad «extremadamente fuertes» y le aplica salvaguardas parecidas a las de Fable 5.1: se podrán encontrar y arreglar fallos en el propio código, pero «la mayoría de las tareas de ciberseguridad se redirigirán a Opus 4.8», un modelo anterior. Las de biología que activen las salvaguardas y las de desarrollo de modelos de lenguaje frontier pasan a Opus 5, de forma transparente. Anthropic no detalla cuántos encargos se desvían ni cómo se avisa.

Es el primer Opus con salvaguardas de la clase de Fable 5.1 en ciberseguridad, biología y destilación, y se nota en la tabla, porque las pruebas se hicieron con ellas activadas: cuando saltaban, terminaba el encargo un modelo de reserva, lo que según Anthropic probablemente rebaja la nota de Opus 5.5. En AutomationBench, Zapier no usó modelo de reserva y contó cada intervención como un fallo, y según Anthropic esa cifra queda por debajo de lo que el modelo lograría en la práctica. Para defensores verificados ampliará su Cyber Verification Program, y en biología abre un Life Sciences Verification Program.

Anthropic lo presenta como su primer lanzamiento desde que pidió marcar el ritmo de la frontier. Antes de salir lo evaluaron organizaciones externas, entre ellas METR, una entidad de investigación sin ánimo de lucro que mide si los sistemas de IA podrían causar daños catastróficos; se financia con donaciones y dice no aceptar dinero de las empresas de IA, aunque sí usa tokens gratuitos para sus pruebas. La empresa dice ver señales de que Opus 5.5 «a menudo sospecha que está siendo evaluado», lo que dificulta saber cómo se comportará fuera de las pruebas.

Conclusión

El 22 de septiembre dejó dos maneras de cobrar menos. OpenAI baja la tarifa de sus modelos de segunda línea y deja a Astra arriba y a su precio; Anthropic abarata su modelo principal y apuesta a que la factura dependa de los tokens por tarea y de la caché, más que del precio de lista. Las dos rebajas las mide quien vende, y la comparación limpia entre Opus 5.5 y Sol todavía no la ha publicado nadie.

Fuentes primarias

Comentarios

Sé respetuoso. Los comentarios se moderan.

    Recibe el resumen diario de IA

    Cada mañana, lo esencial de la inteligencia artificial en tu correo, sin humo. Al día con la IA.

    Frecuencia:

    ← Volver al blog