Models

Gemini 4 Argon: barat mentre duri l'oferta

Gemini 4 Argon, el model frontier que Google DeepMind va presentar el 30 de setembre i encara no ven, ja té nota de qui no el fabrica: 53 punts d'Intelligence Index i 1,99 dòlars per tasca, segons les mesures que Artificial Analysis tenia publicades el 2 d'octubre de 2026. Aquest cost està calculat amb la tarifa d'estrena: Google publica en una nota al peu que, quan l'estrena s'acabi, el preu per token es duplica.

Rep el resum diari d'IA

Cada matí, l'essencial de la intel·ligència artificial al teu correu, sense fum. Al dia amb la IA.

Freqüència:

Vinyeta: dins d'una cambra cuirassada oberta, un aparell blanc amb la marca Gemini reposa damunt d'un pedestal que duu una altra placa amb la mateixa marca. Un únic visitant amb una credencial penjada del coll entra caminant, i un porter amb vestit i un full a la mà li franqueja el pas per damunt d'un cordó de vellut vermell. A l'altra banda del cordó, una multitud crida i agita les carteres obertes sense poder passar.
📷 Imatge generada amb IA

En resum

  • Segons les mesures que Artificial Analysis tenia publicades el 2 d'octubre de 2026, Gemini 4 Argon treu 53 punts d'Intelligence Index i completa una tasca de l'índex per 1,99 dòlars.
  • En aquest índex Argon empata a 53 amb GPT-6 Astra i Claude Fable 5.1, per sota de Claude Sonnet 5.5 (56) i de l'ajust màxim de Claude Opus 5.5 (58).
  • De les 178 entrades de la classificació amb índex i cost, 146 costen menys que Argon, i només una li guanya en les dues columnes alhora: Claude Opus 5.5 a l'ajust «high», amb 54 punts i 1,82 dòlars per tasca, cobrant per token el doble que la tarifa d'estrena d'Argon.
  • Google avisa en nota al peu que, quan l'estrena expiri, la seva tarifa passa a 4 dòlars d'entrada i 20 de sortida per milió de tokens. No diu quan expira.
  • De les xifres que Google publica de si mateix, la de ciberseguretat és la que explica per què no el ven: a CWE-bench v1 Argon empata en el primer lloc amb un 68 %.

Google el va presentar com a model frontier i no el ven

El 30 de setembre de 2026, Google DeepMind —la divisió d'intel·ligència artificial de Google, que desenvolupa els models Gemini— va anunciar Gemini 4 Argon. Signa l'anunci Koray Kavukcuoglu, vicepresident sènior de Google DeepMind i Chief AI Architect de Google, amb un títol que no deixa dubtes: «Gemini 4 Argon: our next era of frontier intelligence».

El que no va fer Google va ser posar-lo a la venda. Argon arriba «a un conjunt de defensors de confiança en ciberseguretat» pel programa Fairwind, i la companyia diu que està «participant activament en el procés voluntari del govern dels Estats Units per a l'accés a models abans del llançament». L'obertura posterior començarà, segons l'anunci, pels «clients de l'API de pagament i els subscriptors de Google AI Ultra».

Amb el model fora del mercat, totes les xifres de l'anunci sortien de qui el fabrica. Les de la classificació d'Artificial Analysis, no.

El que surt quan el mesura qui no ven el model

El que mesura Artificial Analysis: índex contra cost per tasca
52 54 56 58 2 $ 4 $ 6 $ 8 $ Cost per tasca Intelligence Index Claude Opus 5.5 (max) — Cost per tasca: 5,98 $ · Intelligence Index: 58 punts Claude Opus 5.5 (max) Claude Sonnet 5.5 — Cost per tasca: 7,67 $ · Intelligence Index: 56 punts Claude Sonnet 5.5 Claude Fable 5.1 — Cost per tasca: 7,63 $ · Intelligence Index: 53 punts Claude Fable 5.1 GPT-6 Astra — Cost per tasca: 3,26 $ · Intelligence Index: 53 punts GPT-6 Astra Gemini 4 Argon — Cost per tasca: 1,99 $ · Intelligence Index: 53 punts Gemini 4 Argon GPT-6.1 Sol — Cost per tasca: 0,72 $ · Intelligence Index: 52 punts GPT-6.1 Sol Claude Opus 5.5 (high) — Cost per tasca: 1,82 $ · Intelligence Index: 54 punts Claude Opus 5.5 (high)
Veure les dades en una taula
Cost per tasca Intelligence Index
Claude Opus 5.5 (max) 5,98 $ 58 punts
Claude Sonnet 5.5 7,67 $ 56 punts
Claude Fable 5.1 7,63 $ 53 punts
GPT-6 Astra 3,26 $ 53 punts
Gemini 4 Argon 1,99 $ 53 punts
GPT-6.1 Sol 0,72 $ 52 punts
Claude Opus 5.5 (high) 1,82 $ 54 punts
Ho mesura Artificial Analysis, sobre les seves pròpies proves, i no ven cap d'aquests models; dades consultades el 2 d'octubre de 2026. Cada model va amb l'ajust d'esforç que publica el lloc: Gemini 4 Argon en «high»; Claude Sonnet 5.5 i Claude Fable 5.1 en «max with fallback»; GPT-6 Astra i GPT-6.1 Sol en «max». De Claude Opus 5.5 hi van els dos ajustos que el lloc publica per separat, «max with fallback» i «high with fallback» —nom llarg, «Claude Opus 5.5 (Adaptive Reasoning, High Effort, Default Fallback)»—: el segon és l'única de les 178 entrades amb índex i cost que supera Argon en les dues columnes alhora, i la seva tarifa és de 4 dòlars per milió de tokens d'entrada i 20 per milió de sortida. L'índex es publica arrodonit i Argon, Astra i Fable 5.1 comparteixen el mateix 53. El cost per tasca d'Argon està calculat amb la seva tarifa d'estrena.

A la taula consultada el 2 d'octubre, Argon surt amb 53 punts d'Intelligence Index, el mateix número que el lloc dona a GPT-6 Astra i a Claude Fable 5.1.

L'altra columna és el diner, i ser barat no distingeix Argon: de les 178 entrades de la classificació amb índex i cost alhora, 146 completen les proves per menys del que costa ell. El que estreny la llista és demanar les dues coses, i aleshores en queda una: Claude Opus 5.5 a l'ajust «high» és l'única entrada que treu més índex que Argon i, a més, costa menys per tasca. Més nota i menys diner, cobrant per token el doble que la tarifa d'estrena d'Argon: exactament el que Argon cobrarà quan l'estrena s'acabi.

Un detall que el mateix lloc deixa escrit: cada model es mesura amb l'ajust d'esforç que ofereix el seu proveïdor, i no són el mateix. El repartiment va al peu del gràfic.

Llegir-ne més: Artificial Analysis — Model leaderboard (02-10-2026) ↗

El preu amb què es mesura és el de l'oferta

Les dues tarifes de Gemini 4 Argon
Tarifa de Gemini 4 Argon Entrada / milió Sortida / milió
D'estrena 2 $ 10 $
En acabar l'estrena 4 $ 20 $
Entrada en memòria cau, durant l'estrena 95 % de descompte —
Les dues tarifes les publica Google DeepMind a l'anunci del 30 de setembre de 2026; la segona, en una nota al peu. Google no diu quan s'acaba el període d'estrena. El cost per tasca que mesura Artificial Analysis està calculat amb la tarifa d'estrena.

La fitxa d'Argon a Artificial Analysis registra els preus amb què fa aquest compte, i són els de l'estrena: els 1,99 dòlars per tasca són el preu de l'oferta, no el de després.

Les dues tarifes les publica Google, no qui mesura. L'anunci dona la d'estrena al cos i deixa la de després a la nota al peu número u, en lletra petita: «Quan el període introductori expiri, s'aplicarà el preu de 4 dòlars per milió de tokens d'entrada i 20 dòlars per milió de sortida».

Quan expira no ho diu. I quant costaria aleshores una tasca de l'índex no es pot deduir des de fora: comptant-hi el 95 % de descompte de la memòria cau, el total no es duplica multiplicant per dos. El que sí que es pot afirmar és el que importa a l'hora de triar: la xifra barata s'aguanta en una tarifa que Google ja ha dit que apujarà.

Llegir-ne més: Artificial Analysis — Gemini 4 Argon, fitxa del model (02-10-2026) ↗

La xifra que explica per què no el ven és la de ciberseguretat

Google posa número a diverses proves seves, i les que va donar el 30 de setembre —51,3 % a AutomationBench, 77,9 % a DeepSWE v1.1, 91,7 % a LVBench— són mesures pròpies sobre el seu model, en proves diferents que no es comparen entre si. La que explica l'accés restringit és una altra: CWE-bench v1, que avalua la capacitat del model per reparar vulnerabilitats de programari. Allà, diu l'anunci, «Argon empata en el primer lloc amb una puntuació màxima del 68 %», per damunt del que ja feia 3.8 Flash Cyber en la versió anterior de la mateixa prova. És un empat al capdavant, no un primer lloc en solitari, i Google no diu amb qui empata.

Aquesta capacitat és també la raó declarada per no vendre'l. «Per a defensors de confiança i per als nostres propis equips interns a Google alliberarem Argon sense guardarails de ciberseguretat, perquè puguin aprofitar del tot la seva capacitat de defensa de nivell frontier», escriu la companyia. El que millor se li dona és justament el que no vol deixar anar.

Hi ha un exemple en marxa: Wiz —empresa de seguretat al núvol— ja fa servir Argon a la seva iniciativa Scan for Good, «un programa dedicat a protegir infraestructura pública crítica de manera gratuïta». Amb ell, explica Google, el model «va descobrir una vulnerabilitat crítica que exposava informació personal sensible en programari sanitari usat per hospitals de tot el món», un risc greu que els models frontier anteriors havien passat per alt.

Les altres dues proves de ciberseguretat de l'anunci van sense xifra: el banc de vulnerabilitats intern de Google, amb codi en 20 llenguatges de programació, i el banc de proves de penetració de caixa negra de Wiz, que mesura si analitza sistemes web en viu sense veure el codi. En tots dos, Google diu que Argon millora 3.8 Flash Cyber; en cap no publica quant.

Llegir-ne més: Google — «Gemini 4 Argon: our next era of frontier intelligence» (30-09-2026) ↗

El que Google anomena «líder» i no quantifica

Fora de la ciberseguretat, l'anunci repeteix una fórmula sense números. Argon és «el model líder» al Vals Index —Vals és una empresa que manté índexs d'avaluació de models per sectors econòmics, i aquest pondera finances, programació, treball jurídic i fiscal pel seu pes al PIB dels Estats Units—. I la companyia veu «un rendiment igualment destacat» a Vals Finance Agent v2 i al banc de proves legals de Harvey, empresa de programari jurídic amb IA que el manté.

La mateixa fórmula en seguretat: Argon «lidera en robustesa davant la injecció d'instruccions» al banc de proves d'injecció indirecta de Gray Swan, una empresa de seguretat d'IA que el manté.

En cap dels tres no hi ha xifra, i l'absència també informa. Quan Google té un número que l'afavoreix, el posa, com a CWE-bench o a AutomationBench. Quan diu «líder» i no el posa, el que publica és una valoració pròpia que ningú de fora no pot contrastar.

Conclusió

El que queda en peu de l'anunci quan el mesura algú de fora és menys èpic i més concret. Argon és a dalt, compartint graó amb models que ja hi eren. Surt barat d'usar, tot i que ja hi ha qui dona més índex per menys diner, i la tarifa que l'abarateix és la que Google ja ha dit que duplicarà, sense data per al canvi. I de les xifres que la companyia publica de si mateixa, la que explica per què encara no es pot comprar és la de ciberseguretat: un empat al primer lloc en la prova d'apedaçar vulnerabilitats, que és justament la capacitat que no vol deixar anar.

Fonts primàries

Comentaris

Sigues respectuós. Els comentaris es moderen.

    Rep el resum diari d'IA

    Cada matí, l'essencial de la intel·ligència artificial al teu correu, sense fum. Al dia amb la IA.

    Freqüència:

    ← Torna al blog