Models

Anthropic i OpenAI es declaren la guerra de preus

El 22 de setembre de 2026, Anthropic va presentar Claude Opus 5.5 i, poc després, aquell mateix dia, OpenAI va respondre amb GPT-6 Sol i GPT-6 Luna. Tots tres surten més barats, però les rebaixes no es mesuren igual: el 40 % d'Anthropic no és el preu del token, i el 50 % d'OpenAI es calcula sobre una tarifa promocional. A més, Opus 5.5 passarà la majoria dels encàrrecs de ciberseguretat a un model anterior.

Rep el resum diari d'IA

Cada matí, l'essencial de la intel·ligència artificial al teu correu, sense fum. Al dia amb la IA.

Freqüència:

Caricatura d'un duel de l'Oest: un vaquer baixet amb el cap en forma d'asterisc taronja i un pistoler alt amb gavardina negra retolada OpenAI s'encaren al desert, suant, cadascun amb unes tisores enormes amb què parteix monedes d'or; les meitats cauen a terra entre tots dos.
📷 Imatge generada amb IA

En resum

  • Claude Opus 5.5 costa 4 $ per milió de tokens d'entrada i 20 $ de sortida, un 20 % menys que Opus 5; la lectura de memòria cau baixa un 60 %, fins a 0,20 $.
  • El 40 % d'estalvi que anuncia Anthropic suma aquest abaratiment i que el model gasta menys tokens per tasca; ho mesura la mateixa empresa.
  • GPT-6 Sol costa 2 $ i 10 $ per milió de tokens i GPT-6 Luna, 0,10 $ i 0,50 $: OpenAI ho presenta com una retallada del 50 % sobre el preu promocional de GPT-5.6 (en la sortida de Luna, del 58 %).
  • Artificial Analysis, que es defineix com a empresa independent de mesura de la IA, posa Opus 5.5 el primer de 212 en el seu índex d'intel·ligència, amb 58 punts.
  • La majoria de les tasques de ciberseguretat que rebi Opus 5.5 es desviaran a Claude Opus 4.8.

Dos llançaments la mateixa tarda

Anthropic, el laboratori nord-americà que desenvolupa Claude, va publicar Claude Opus 5.5 el 22 de setembre de 2026. És el primer model de la família Claude 5.5 i, segons l'empresa, rendeix en la major part de la feina al nivell de Claude Fable 5.1, que costa 2,5 vegades més per token. Sonnet 5.5 i Haiku 5.5 arribaran «en les pròximes setmanes». Opus 5.5 és a totes les seves plataformes i també a AWS, Google Cloud i Microsoft Azure.

Poc després, aquell mateix dia, OpenAI, l'empresa de ChatGPT, va presentar GPT-6 Sol i GPT-6 Luna, dos models més barats entrenats «amb mètodes similars» a GPT-6 Astra, que va sortir aquest mes i continua sent el seu millor model. Són a ChatGPT Work i Codex per als plans Plus, Pro, Business, Enterprise i Edu, i els usuaris de Free i Go tenen Luna a l'aplicació d'escriptori. A l'API es diuen gpt-6-sol i gpt-6-luna. Encara no són a Chat, el mode de conversa de ChatGPT.

El 40 % d'Anthropic no és el preu del token

Preus per milió de tokens
Model Entrada Sortida Lectura de memòria cau Model anterior (entrada / sortida / memòria cau)
Claude Opus 5.5 4 $ 20 $ 0,20 $ Opus 5: 5 $ / 25 $ / 0,50 $
GPT-6 Sol 2 $ 10 $ Fins a un 90 % de descompte GPT-5.6 Sol: 4 $ / 20 $
GPT-6 Luna 0,10 $ 0,50 $ Fins a un 90 % de descompte GPT-5.6 Luna: 0,20 $ / 1,20 $
Preus per milió de tokens publicats per cada empresa; la retallada d'OpenAI es mesura respecte al preu promocional de GPT-5.6. Per a la memòria cau, OpenAI publica un descompte de fins al 90 % sobre l'entrada, no una tarifa per model.

La rebaixa visible d'Opus 5.5 és del 20 % en el preu del token. El 40 % que anuncia Anthropic surt de sumar-hi una altra cosa: el model gasta menys tokens per acabar la mateixa tasca. En paraules de l'empresa, «costa menys per token que Opus 5 i fa servir menys tokens per tasca, cosa que es tradueix en una caiguda del 40 % en els costos». És una mesura pròpia, amb la configuració per defecte i sobre el que anomena càrregues de treball típiques.

On més baixa el preu és en la lectura de memòria cau, que segons Anthropic és la major part del cost en la feina amb agents i en programació. Hi ha, a més, un mode ràpid, a Claude Code i Claude Platform, fins a 2,5 vegades més veloç, que es cobra a 8 $ l'entrada i 40 $ la sortida per milió. I pugen els límits d'ús de cinc hores als plans Pro, Max, Team i Enterprise per lloc.

OpenAI parla d'una retallada del 50 % a Sol i Luna, però respecte al preu promocional de GPT-5.6, no respecte a la tarifa ordinària. La seva memòria cau descompta fins a un 90 % la lectura de tokens d'entrada ja desats, i arriba amb punts de tall explícits, un tauler i una eina de diagnosi.

Les proves d'Anthropic: guanya gairebé sempre, no sempre

Proves de referència publicades per Anthropic
Prova Opus 5.5 Fable 5.1 Opus 5 GPT-6 Astra GPT-5.6 Sol
Terminal-Bench 4.0 66,4 % 55,8 % 52,3 % 57,9 % 37,3 %
FrontierCode v1.1 54,4 % 50,3 % 48,0 % 53,3 % 47,5 %
AutomationBench 40,0 % 31,4 % 26,9 % 41,4 % 28,8 %
Terminal-Bench-Science 0.1 58,7 % 52,6 % 29,0 % 64,6 % 22,4 %
Xifres comunicades per Anthropic, que ven el model. A Terminal-Bench 4.0, Opus 5.5 en esforç xhigh i GPT-6 Astra en high, amb la xifra que dona OpenAI: la millor de cadascun. AutomationBench l'executa i la publica Zapier.

En les proves de referència que publica Anthropic, Opus 5.5 supera Fable 5.1 i Opus 5 en totes. Davant de GPT-6 Astra el resultat es reparteix: Opus 5.5 guanya a Terminal-Bench 4.0 i a FrontierCode, però Astra queda per davant a AutomationBench, la prova que fa i publica Zapier, la plataforma d'automatització entre aplicacions, i a Terminal-Bench-Science.

Dues reserves. Totes les xifres les recopila i publica Anthropic, que ven el model; les d'AutomationBench les va mesurar Zapier i les d'Astra les dona OpenAI. A Terminal-Bench cadascun hi apareix amb el seu millor resultat, Opus 5.5 en esforç xhigh i Astra en high: no competeixen en igualtat de condicions. La mateixa Anthropic adverteix que els marges en aquestes proves «s'han tornat una guia menys fiable de les diferències reals».

OpenAI es compara amb l'Opus anterior

El que diu OpenAI de GPT-6 Sol
Prova GPT-6 Sol Rival d'Anthropic Cost per tasca
AutomationBench 33,2 % (xhigh) Claude Opus 5 (max): 26,9 % Sol 0,27 $; Opus 5, 11,1 vegades més
DeepSWE v1.1 68,8 % (max) Claude Fable 5 (xhigh): 69,9 % Sol, al voltant d'un 80 % menys
Xifres mesurades i publicades per OpenAI, que ven el model. No inclouen Claude Opus 5.5, presentat el mateix dia.

OpenAI també es mesura amb xifres pròpies. A AutomationBench, Sol en esforç xhigh supera Claude Opus 5 en el seu nivell màxim amb un cost per tasca de 0,27 $, i Opus 5 necessita 11,1 vegades aquesta despesa. A DeepSWE v1.1, una prova d'enginyeria de programari sobre codi real, Sol es queda a 1,1 punts de Claude Fable 5 amb un cost per tasca «al voltant d'un 80 % menor».

Però OpenAI enfronta Sol amb Opus 5, Fable 5 i Fable 5.1, no amb Opus 5.5, que va sortir el mateix dia amb un preu per token més baix que el d'Opus 5 i, segons Anthropic, amb menys tokens per tasca.

Artificial Analysis posa Opus 5.5 al capdavant; Sol i Luna guanyen en preu

Qualitat contra cost a l'índex d'Artificial Analysis
40 50 60 0,1$ 0,3$ 1$ 3$ 10$ Cost mitjà per tasca de l'índex · escala logarítmica Índex d'intel·ligència Claude Opus 5.5 — Cost mitjà per tasca de l'índex: 5,98$ · Índex d'intel·ligència: 58punts Claude Opus 5.5 Claude Fable 5.1 — Cost mitjà per tasca de l'índex: 7,63$ · Índex d'intel·ligència: 53punts Claude Fable 5.1 GPT-6 Astra — Cost mitjà per tasca de l'índex: 3,26$ · Índex d'intel·ligència: 53punts GPT-6 Astra GPT-6 Sol — Cost mitjà per tasca de l'índex: 1,06$ · Índex d'intel·ligència: 48punts GPT-6 Sol GPT-6 Luna — Cost mitjà per tasca de l'índex: 0,07$ · Índex d'intel·ligència: 37punts GPT-6 Luna
Ver los datos en tabla
Cost mitjà per tasca de l'índex Índex d'intel·ligència
Claude Opus 5.5 5,98$ 58punts
Claude Fable 5.1 7,63$ 53punts
GPT-6 Astra 3,26$ 53punts
GPT-6 Sol 1,06$ 48punts
GPT-6 Luna 0,07$ 37punts
Artificial Analysis Intelligence Index, cost mitjà per tasca, consultat el 23-09-2026. Mesura d'Artificial Analysis, aliena a Anthropic i a OpenAI. Opus 5.5 i Fable 5.1 es mesuren amb el model de reserva activat.

Artificial Analysis, una empresa de San Francisco que es defineix com a independent i mesura models, núvols i xips, amb el suport d'inversors particulars com Nat Friedman, Daniel Gross i Andrew Ng, publica el seu propi índex d'intel·ligència. Hi apareix Opus 5.5 com el primer de 212 models amb 58 punts, per davant de Fable 5.1 i d'Astra, empatats a 53.

L'altre eix és el que costa, de mitjana, cada tasca de l'índex amb cada model. Opus 5.5 surt més barat que Fable 5.1 i més car que Astra; Sol i Luna cedeixen punts a canvi de costar una fracció. El cost va en escala logarítmica perquè del més barat al més car hi ha dos ordres de magnitud.

Opus 5.5 no farà gairebé res de ciberseguretat

L'anunci porta a més un canvi d'abast. Anthropic considera que Opus 5.5 té capacitats de ciberseguretat «extremadament fortes» i li aplica salvaguardes semblants a les de Fable 5.1: es podran trobar i arreglar errors en el propi codi, però «la majoria de les tasques de ciberseguretat es redirigiran a Opus 4.8», un model anterior. Les de biologia que activin les salvaguardes i les de desenvolupament de models de llenguatge frontier passen a Opus 5, de manera transparent. Anthropic no detalla quants encàrrecs es desvien ni com se n'avisa.

És el primer Opus amb salvaguardes de la classe de Fable 5.1 en ciberseguretat, biologia i destil·lació, i es nota a la taula, perquè les proves es van fer amb les salvaguardes activades: quan saltaven, acabava l'encàrrec un model de reserva, cosa que segons Anthropic probablement rebaixa la nota d'Opus 5.5. A AutomationBench, Zapier no va fer servir model de reserva i va comptar cada intervenció com una fallada, i segons Anthropic aquesta xifra queda per sota del que el model aconseguiria a la pràctica. Per als defensors verificats ampliarà el seu Cyber Verification Program, i en biologia obre un Life Sciences Verification Program.

Anthropic ho presenta com el seu primer llançament des que va demanar marcar el ritme de la frontier. Abans de sortir el van avaluar organitzacions externes, entre les quals METR, una entitat de recerca sense ànim de lucre que mesura si els sistemes d'IA podrien causar danys catastròfics; es finança amb donacions i diu que no accepta diners de les empreses d'IA, tot i que sí que fa servir tokens gratuïts per a les proves. L'empresa diu que veu senyals que Opus 5.5 «sovint sospita que l'estan avaluant», cosa que fa difícil saber com es comportarà fora de les proves.

Conclusió

El 22 de setembre va deixar dues maneres de cobrar menys. OpenAI abaixa la tarifa dels seus models de segona línia i deixa Astra al capdamunt i al seu preu; Anthropic abarateix el seu model principal i aposta perquè la factura depengui dels tokens per tasca i de la memòria cau, més que del preu de llista. Totes dues rebaixes les mesura qui ven, i la comparació neta entre Opus 5.5 i Sol encara no l'ha publicada ningú.

Fonts primàries

Comentarios

Sé respetuoso. Los comentarios se moderan.

    Rep el resum diari d'IA

    Cada matí, l'essencial de la intel·ligència artificial al teu correu, sense fum. Al dia amb la IA.

    Freqüència:

    ← Torna al blog