Empreses

OpenAI retalla un 80% el preu de Luna i pressiona Anthropic camí de la seva sortida a borsa

La directora financera d'OpenAI, Sarah Friar, va assegurar el 7 de setembre a la conferència Communacopia + Technology de Goldman Sachs que la companyia ha rebaixat un 80% el preu de GPT-5.6 Luna i que el seu ús s'ha multiplicat per deu. El moviment arriba just quan Anthropic prepara la documentació de la seva sortida a borsa i respon també abaixant tarifes, en una escalada que trasllada la competència del terreny de la capacitat al del cost.

Rep el resum diari d'IA

Cada matí, l'essencial de la intel·ligència artificial al teu correu, sense fum. Al dia amb la IA.

Freqüència:

En resum

  • OpenAI va retallar un 80% el preu de GPT-5.6 Luna i l'ús del model es va multiplicar aproximadament per deu, segons la seva directora financera.
  • Codex, l'assistent de programació d'OpenAI, va arribar als 25 milions d'usuaris.
  • Anthropic va contraatacar amb Fable 5.1, un 25% més barat que Fable 5 en càrregues de treball típiques, i va comprometre uns 80.000 milions de dòlars en còmput en cinc dies.
  • Segons Artificial Analysis, GLM-5.3 de Z.ai puntua per damunt de Luna en el seu índex d'intel·ligència, cosa que situa l'avantatge d'OpenAI en el preu i no en la capacitat.

La retallada de preus dispara l'ús de Luna

Friar va intervenir el 7 de setembre a la conferència Communacopia + Technology de Goldman Sachs a San Francisco, i Reuters va informar de les seves declaracions el 9 de setembre. L'executiva va xifrar en un 80% la rebaixa aplicada al model econòmic GPT-5.6 Luna i va sostenir que el consum es va multiplicar aproximadament per deu després de l'ajust. També va situar en 25 milions d'usuaris l'abast de Codex, l'eina de programació assistida de la companyia.

The Information ja havia escrit a l'agost que Luna generava més del doble d'ús de tokens (unitats mínimes de text que processen els models) que Opus 5 i Sonnet 5 d'Anthropic a OpenRouter, el servei que fan servir els desenvolupadors per accedir a models diferents des d'un únic punt. Després de la retallada, OpenAI va passar a ostentar la quota més gran en aquesta plataforma.

La mètrica ja no és el preu per token sinó el cost per tasca

Friar va defensar que la referència rellevant és el cost per tasca completada i no el preu per token: un model més car pot resultar més econòmic si resol l'encàrrec en menys intents. La idea no és nova en el seu discurs, ja que l'havia formulada en un missatge públic del 17 de juliol sota l'etiqueta 'Useful Intelligence per Dollar' (intel·ligència útil per dòlar).

En aquesta mateixa línia, OpenAI està provant un model de preus vinculat al resultat obtingut pel client en lloc del consum de còmput. És un gir comercial rellevant per a un sector acostumat a facturar per volum i que trasllada part del risc de rendiment al proveïdor.

Jalapeño, el xip propi d'inferència, entra en l'equació

Friar va presentar Jalapeño, un xip d'inferència (la fase d'execució d'un model ja entrenat) dissenyat conjuntament amb Broadcom i destinat a ús intern. OpenAI afirma que va passar del concepte al tapeout (tancament del disseny per a l'enviament a fabricació) en nou mesos amb l'ajuda dels seus propis models i reclama entre 1,5 i 1,9 vegades més rendiment per watt que els GB200 i GB300 de Nvidia executant GPT-OSS 120B, DeepSeek R1 i Kimi K2.5.

Convé prendre aquestes xifres amb cautela: són dades pròpies d'OpenAI i, tot i que SemiAnalysis va observar les proves, no va reproduir la suite completa de manera independent. La companyia ofereix a més els seus models per al disseny de xips, ciències de la vida i finances, sense pretendre substituir les eines EDA (automatització del disseny electrònic).

Anthropic respon amb preu i amb una compra massiva de còmput

La pressió arriba en un moment delicat per a Anthropic, la documentació de sortida a borsa de la qual s'espera que es faci pública pròximament i la taxa d'ingressos anualitzada de la qual voltava els 65.000 milions de dòlars a finals de juliol. La resposta immediata va ser tarifària: Fable 5.1, presentat la setmana passada, costa un 25% menys que Fable 5 per a càrregues de treball típiques, segons la mateixa companyia.

En paral·lel, Anthropic va comprometre en cinc dies al voltant de 80.000 milions de dòlars en còmput amb neoclouds (proveïdors de núvol especialitzats en GPU), amb un acord de 45.000 milions a sis anys amb Nscale i un altre de 35.000 milions amb Lambda, a més d'accés al clúster Colossus 1 de 300 MW i unes 220.000 GPU de NVIDIA vinculat a xAI/SpaceX.

Conclusió

L'ofensiva d'OpenAI desplaça l'eix de la competència des de la capacitat bruta cap a l'economia unitària de l'ús de models, just quan Anthropic necessita un relat sòlid de marges per a la seva sortida a borsa. El matís l'aporta l'anàlisi independent: segons Artificial Analysis, GLM-5.3 de Z.ai puntua per damunt de Luna en el seu índex d'intel·ligència, de manera que l'avantatge d'OpenAI es juga en la factura i no en el rendiment. Per a les empreses que integren aquests models, la conseqüència pràctica és immediata: cal mesurar el cost real per tasca resolta i no donar per bona cap xifra d'eficiència que no hagi estat verificada per tercers.

Fonts primàries

Comentarios

Sé respetuoso. Los comentarios se moderan.

    Rep el resum diari d'IA

    Cada matí, l'essencial de la intel·ligència artificial al teu correu, sense fum. Al dia amb la IA.

    Freqüència:

    ← Torna al blog