Modelos
Anthropic y OpenAI se declaran la guerra de precios
El 22 de septiembre de 2026, Anthropic presentó Claude Opus 5.5 y, poco después, ese mismo día, OpenAI respondió con GPT-6 Sol y GPT-6 Luna. Los tres salen más baratos, pero las rebajas no se miden igual: el 40 % de Anthropic no es el precio del token, y el 50 % de OpenAI se calcula sobre una tarifa promocional. Además, Opus 5.5 pasará la mayoría de los encargos de ciberseguridad a un modelo anterior.
Recibe el resumen diario de IA
Cada mañana, lo esencial de la inteligencia artificial en tu correo, sin humo. Al día con la IA.
Al suscribirte aceptas recibir el newsletter de AI Informator. Puedes darte de baja cuando quieras.
En resumen
- Claude Opus 5.5 cuesta 4 $ por millón de tokens de entrada y 20 $ de salida, un 20 % menos que Opus 5; la lectura de caché baja un 60 %, hasta 0,20 $.
- El 40 % de ahorro que anuncia Anthropic suma ese abaratamiento y que el modelo gasta menos tokens por tarea; lo mide la propia empresa.
- GPT-6 Sol cuesta 2 $ y 10 $ por millón de tokens y GPT-6 Luna, 0,10 $ y 0,50 $: OpenAI lo presenta como un recorte del 50 % sobre el precio promocional de GPT-5.6 (en la salida de Luna, del 58 %).
- Artificial Analysis, que se define como empresa independiente de medición de la IA, pone a Opus 5.5 primero de 212 en su índice de inteligencia, con 58 puntos.
- La mayoría de las tareas de ciberseguridad que reciba Opus 5.5 se desviarán a Claude Opus 4.8.
Dos lanzamientos en la misma tarde
Anthropic, el laboratorio estadounidense que desarrolla Claude, publicó Claude Opus 5.5 el 22 de septiembre de 2026. Es el primer modelo de la familia Claude 5.5 y, según la empresa, rinde en la mayor parte del trabajo al nivel de Claude Fable 5.1, que cuesta 2,5 veces más por token. Sonnet 5.5 y Haiku 5.5 llegarán «en las próximas semanas». Opus 5.5 está en todas sus plataformas y también en AWS, Google Cloud y Microsoft Azure.
Poco después, ese mismo día, OpenAI, la empresa de ChatGPT, presentó GPT-6 Sol y GPT-6 Luna, dos modelos más baratos entrenados «con métodos similares» a GPT-6 Astra, que salió este mes y sigue siendo su mejor modelo. Están en ChatGPT Work y Codex para los planes Plus, Pro, Business, Enterprise y Edu, y los usuarios de Free y Go tienen Luna en la aplicación de escritorio. En la API se llaman gpt-6-sol y gpt-6-luna. Todavía no están en Chat, el modo de conversación de ChatGPT.
El 40 % de Anthropic no es el precio del token
| Modelo | Entrada | Salida | Lectura de caché | Modelo anterior (entrada / salida / caché) |
|---|---|---|---|---|
| Claude Opus 5.5 | 4 $ | 20 $ | 0,20 $ | Opus 5: 5 $ / 25 $ / 0,50 $ |
| GPT-6 Sol | 2 $ | 10 $ | Hasta un 90 % de descuento | GPT-5.6 Sol: 4 $ / 20 $ |
| GPT-6 Luna | 0,10 $ | 0,50 $ | Hasta un 90 % de descuento | GPT-5.6 Luna: 0,20 $ / 1,20 $ |
La rebaja visible de Opus 5.5 es del 20 % en el precio del token. El 40 % que anuncia Anthropic sale de sumarle otra cosa: el modelo gasta menos tokens para terminar la misma tarea. En palabras de la empresa, «cuesta menos por token que Opus 5 y usa menos tokens por tarea, lo que se traduce en una caída del 40 % en los costes». Es una medición propia, con la configuración por defecto y sobre lo que llama cargas de trabajo típicas.
Donde más baja el precio es en la lectura de caché, que según Anthropic es la mayor parte del coste en el trabajo con agentes y en programación. Hay además un modo rápido, en Claude Code y Claude Platform, hasta 2,5 veces más veloz, que se cobra a 8 $ la entrada y 40 $ la salida por millón. Y suben los límites de uso de cinco horas en los planes Pro, Max, Team y Enterprise por puesto.
OpenAI habla de un recorte del 50 % en Sol y Luna, pero contra el precio promocional de GPT-5.6, no contra la tarifa ordinaria. Su caché descuenta hasta un 90 % la lectura de tokens de entrada ya guardados, y llega con puntos de corte explícitos, un panel y una herramienta de diagnóstico.
Las pruebas de Anthropic: gana casi siempre, no siempre
| Prueba | Opus 5.5 | Fable 5.1 | Opus 5 | GPT-6 Astra | GPT-5.6 Sol |
|---|---|---|---|---|---|
| Terminal-Bench 4.0 | 66,4 % | 55,8 % | 52,3 % | 57,9 % | 37,3 % |
| FrontierCode v1.1 | 54,4 % | 50,3 % | 48,0 % | 53,3 % | 47,5 % |
| AutomationBench | 40,0 % | 31,4 % | 26,9 % | 41,4 % | 28,8 % |
| Terminal-Bench-Science 0.1 | 58,7 % | 52,6 % | 29,0 % | 64,6 % | 22,4 % |
En las pruebas de referencia que publica Anthropic, Opus 5.5 supera a Fable 5.1 y a Opus 5 en todas. Frente a GPT-6 Astra el resultado se reparte: Opus 5.5 gana en Terminal-Bench 4.0 y en FrontierCode, pero Astra queda por delante en AutomationBench, la prueba que hace y publica Zapier, la plataforma de automatización entre aplicaciones, y en Terminal-Bench-Science.
Dos reservas. Todas las cifras las recopila y publica Anthropic, que vende el modelo; las de AutomationBench las midió Zapier y las de Astra las da OpenAI. En Terminal-Bench cada uno aparece con su mejor resultado, Opus 5.5 en esfuerzo xhigh y Astra en high: no compiten en igualdad de condiciones. La propia Anthropic advierte de que los márgenes en estas pruebas «se han vuelto una guía menos fiable de las diferencias reales».
OpenAI se compara con el Opus anterior
| Prueba | GPT-6 Sol | Rival de Anthropic | Coste por tarea |
|---|---|---|---|
| AutomationBench | 33,2 % (xhigh) | Claude Opus 5 (max): 26,9 % | Sol 0,27 $; Opus 5, 11,1 veces más |
| DeepSWE v1.1 | 68,8 % (max) | Claude Fable 5 (xhigh): 69,9 % | Sol, alrededor de un 80 % menos |
OpenAI también se mide con cifras propias. En AutomationBench, Sol en esfuerzo xhigh supera a Claude Opus 5 en su nivel máximo con un coste por tarea de 0,27 $, y Opus 5 necesita 11,1 veces ese gasto. En DeepSWE v1.1, una prueba de ingeniería de software sobre código real, Sol se queda a 1,1 puntos de Claude Fable 5 con un coste por tarea «alrededor de un 80 % menor».
Pero OpenAI enfrenta a Sol con Opus 5, Fable 5 y Fable 5.1, no con Opus 5.5, que salió el mismo día con un precio por token más bajo que el de Opus 5 y, según Anthropic, con menos tokens por tarea.
Artificial Analysis pone a Opus 5.5 en cabeza; Sol y Luna ganan en precio
Ver los datos en tabla
| Coste medio por tarea del índice | Índice de inteligencia | |
|---|---|---|
| Claude Opus 5.5 | 5,98$ | 58puntos |
| Claude Fable 5.1 | 7,63$ | 53puntos |
| GPT-6 Astra | 3,26$ | 53puntos |
| GPT-6 Sol | 1,06$ | 48puntos |
| GPT-6 Luna | 0,07$ | 37puntos |
Artificial Analysis, una empresa de San Francisco que se define como independiente y mide modelos, nubes y chips, respaldada por inversores particulares como Nat Friedman, Daniel Gross y Andrew Ng, publica su propio índice de inteligencia. En él, Opus 5.5 es primero de 212 modelos con 58 puntos, por delante de Fable 5.1 y de Astra, empatados a 53.
El otro eje es lo que cuesta, de media, cada tarea del índice con cada modelo. Opus 5.5 sale más barato que Fable 5.1 y más caro que Astra; Sol y Luna ceden puntos a cambio de costar una fracción. El coste va en escala logarítmica porque del más barato al más caro hay dos órdenes de magnitud.
Opus 5.5 no hará casi nada de ciberseguridad
El anuncio trae además un cambio de alcance. Anthropic considera que Opus 5.5 tiene capacidades de ciberseguridad «extremadamente fuertes» y le aplica salvaguardas parecidas a las de Fable 5.1: se podrán encontrar y arreglar fallos en el propio código, pero «la mayoría de las tareas de ciberseguridad se redirigirán a Opus 4.8», un modelo anterior. Las de biología que activen las salvaguardas y las de desarrollo de modelos de lenguaje frontier pasan a Opus 5, de forma transparente. Anthropic no detalla cuántos encargos se desvían ni cómo se avisa.
Es el primer Opus con salvaguardas de la clase de Fable 5.1 en ciberseguridad, biología y destilación, y se nota en la tabla, porque las pruebas se hicieron con ellas activadas: cuando saltaban, terminaba el encargo un modelo de reserva, lo que según Anthropic probablemente rebaja la nota de Opus 5.5. En AutomationBench, Zapier no usó modelo de reserva y contó cada intervención como un fallo, y según Anthropic esa cifra queda por debajo de lo que el modelo lograría en la práctica. Para defensores verificados ampliará su Cyber Verification Program, y en biología abre un Life Sciences Verification Program.
Anthropic lo presenta como su primer lanzamiento desde que pidió marcar el ritmo de la frontier. Antes de salir lo evaluaron organizaciones externas, entre ellas METR, una entidad de investigación sin ánimo de lucro que mide si los sistemas de IA podrían causar daños catastróficos; se financia con donaciones y dice no aceptar dinero de las empresas de IA, aunque sí usa tokens gratuitos para sus pruebas. La empresa dice ver señales de que Opus 5.5 «a menudo sospecha que está siendo evaluado», lo que dificulta saber cómo se comportará fuera de las pruebas.
Conclusión
El 22 de septiembre dejó dos maneras de cobrar menos. OpenAI baja la tarifa de sus modelos de segunda línea y deja a Astra arriba y a su precio; Anthropic abarata su modelo principal y apuesta a que la factura dependa de los tokens por tarea y de la caché, más que del precio de lista. Las dos rebajas las mide quien vende, y la comparación limpia entre Opus 5.5 y Sol todavía no la ha publicado nadie.
Fuentes primarias
- Anthropic — Introducing Claude Opus 5.5 ↗
- OpenAI — Introducing GPT-6 Sol and Luna ↗
- OpenAI — Better prompt caching for GPT-6 ↗
- Artificial Analysis — Claude Opus 5.5 ↗
- Artificial Analysis — GPT-6 Sol ↗
- AI Informator — Amodei propone tres pasos para marcar el ritmo de la IA frontier ↗
- AI Informator — OpenAI lanza GPT-6 Astra ↗
- AI Informator — Anthropic lanza Fable 5.1 y Mythos 5.1 ↗
Recibe el resumen diario de IA
Cada mañana, lo esencial de la inteligencia artificial en tu correo, sin humo. Al día con la IA.
Al suscribirte aceptas recibir el newsletter de AI Informator. Puedes darte de baja cuando quieras.
Comentarios