Models
Gemini 4 Argon: barat mentre duri l'oferta
Gemini 4 Argon, el model frontier que Google DeepMind va presentar el 30 de setembre i encara no ven, ja té nota de qui no el fabrica: 53 punts d'Intelligence Index i 1,99 dòlars per tasca, segons les mesures que Artificial Analysis tenia publicades el 2 d'octubre de 2026. Aquest cost està calculat amb la tarifa d'estrena: Google publica en una nota al peu que, quan l'estrena s'acabi, el preu per token es duplica.
Rep el resum diari d'IA
Cada matí, l'essencial de la intel·ligència artificial al teu correu, sense fum. Al dia amb la IA.
En subscriure-t'hi acceptes rebre el butlletí d'AI Informator. Pots donar-te de baixa quan vulguis.
En resum
- Segons les mesures que Artificial Analysis tenia publicades el 2 d'octubre de 2026, Gemini 4 Argon treu 53 punts d'Intelligence Index i completa una tasca de l'índex per 1,99 dòlars.
- En aquest índex Argon empata a 53 amb GPT-6 Astra i Claude Fable 5.1, per sota de Claude Sonnet 5.5 (56) i de l'ajust màxim de Claude Opus 5.5 (58).
- De les 178 entrades de la classificació amb índex i cost, 146 costen menys que Argon, i només una li guanya en les dues columnes alhora: Claude Opus 5.5 a l'ajust «high», amb 54 punts i 1,82 dòlars per tasca, cobrant per token el doble que la tarifa d'estrena d'Argon.
- Google avisa en nota al peu que, quan l'estrena expiri, la seva tarifa passa a 4 dòlars d'entrada i 20 de sortida per milió de tokens. No diu quan expira.
- De les xifres que Google publica de si mateix, la de ciberseguretat és la que explica per què no el ven: a CWE-bench v1 Argon empata en el primer lloc amb un 68 %.
Google el va presentar com a model frontier i no el ven
El 30 de setembre de 2026, Google DeepMind —la divisió d'intel·ligència artificial de Google, que desenvolupa els models Gemini— va anunciar Gemini 4 Argon. Signa l'anunci Koray Kavukcuoglu, vicepresident sènior de Google DeepMind i Chief AI Architect de Google, amb un títol que no deixa dubtes: «Gemini 4 Argon: our next era of frontier intelligence».
El que no va fer Google va ser posar-lo a la venda. Argon arriba «a un conjunt de defensors de confiança en ciberseguretat» pel programa Fairwind, i la companyia diu que està «participant activament en el procés voluntari del govern dels Estats Units per a l'accés a models abans del llançament». L'obertura posterior començarà, segons l'anunci, pels «clients de l'API de pagament i els subscriptors de Google AI Ultra».
Amb el model fora del mercat, totes les xifres de l'anunci sortien de qui el fabrica. Les de la classificació d'Artificial Analysis, no.
El que surt quan el mesura qui no ven el model
Veure les dades en una taula
| Cost per tasca | Intelligence Index | |
|---|---|---|
| Claude Opus 5.5 (max) | 5,98 $ | 58 punts |
| Claude Sonnet 5.5 | 7,67 $ | 56 punts |
| Claude Fable 5.1 | 7,63 $ | 53 punts |
| GPT-6 Astra | 3,26 $ | 53 punts |
| Gemini 4 Argon | 1,99 $ | 53 punts |
| GPT-6.1 Sol | 0,72 $ | 52 punts |
| Claude Opus 5.5 (high) | 1,82 $ | 54 punts |
A la taula consultada el 2 d'octubre, Argon surt amb 53 punts d'Intelligence Index, el mateix número que el lloc dona a GPT-6 Astra i a Claude Fable 5.1.
L'altra columna és el diner, i ser barat no distingeix Argon: de les 178 entrades de la classificació amb índex i cost alhora, 146 completen les proves per menys del que costa ell. El que estreny la llista és demanar les dues coses, i aleshores en queda una: Claude Opus 5.5 a l'ajust «high» és l'única entrada que treu més índex que Argon i, a més, costa menys per tasca. Més nota i menys diner, cobrant per token el doble que la tarifa d'estrena d'Argon: exactament el que Argon cobrarà quan l'estrena s'acabi.
Un detall que el mateix lloc deixa escrit: cada model es mesura amb l'ajust d'esforç que ofereix el seu proveïdor, i no són el mateix. El repartiment va al peu del gràfic.
Llegir-ne més: Artificial Analysis — Model leaderboard (02-10-2026) ↗
El preu amb què es mesura és el de l'oferta
| Tarifa de Gemini 4 Argon | Entrada / milió | Sortida / milió |
|---|---|---|
| D'estrena | 2 $ | 10 $ |
| En acabar l'estrena | 4 $ | 20 $ |
| Entrada en memòria cau, durant l'estrena | 95 % de descompte | — |
La fitxa d'Argon a Artificial Analysis registra els preus amb què fa aquest compte, i són els de l'estrena: els 1,99 dòlars per tasca són el preu de l'oferta, no el de després.
Les dues tarifes les publica Google, no qui mesura. L'anunci dona la d'estrena al cos i deixa la de després a la nota al peu número u, en lletra petita: «Quan el període introductori expiri, s'aplicarà el preu de 4 dòlars per milió de tokens d'entrada i 20 dòlars per milió de sortida».
Quan expira no ho diu. I quant costaria aleshores una tasca de l'índex no es pot deduir des de fora: comptant-hi el 95 % de descompte de la memòria cau, el total no es duplica multiplicant per dos. El que sí que es pot afirmar és el que importa a l'hora de triar: la xifra barata s'aguanta en una tarifa que Google ja ha dit que apujarà.
Llegir-ne més: Artificial Analysis — Gemini 4 Argon, fitxa del model (02-10-2026) ↗
La xifra que explica per què no el ven és la de ciberseguretat
Google posa número a diverses proves seves, i les que va donar el 30 de setembre —51,3 % a AutomationBench, 77,9 % a DeepSWE v1.1, 91,7 % a LVBench— són mesures pròpies sobre el seu model, en proves diferents que no es comparen entre si. La que explica l'accés restringit és una altra: CWE-bench v1, que avalua la capacitat del model per reparar vulnerabilitats de programari. Allà, diu l'anunci, «Argon empata en el primer lloc amb una puntuació màxima del 68 %», per damunt del que ja feia 3.8 Flash Cyber en la versió anterior de la mateixa prova. És un empat al capdavant, no un primer lloc en solitari, i Google no diu amb qui empata.
Aquesta capacitat és també la raó declarada per no vendre'l. «Per a defensors de confiança i per als nostres propis equips interns a Google alliberarem Argon sense guardarails de ciberseguretat, perquè puguin aprofitar del tot la seva capacitat de defensa de nivell frontier», escriu la companyia. El que millor se li dona és justament el que no vol deixar anar.
Hi ha un exemple en marxa: Wiz —empresa de seguretat al núvol— ja fa servir Argon a la seva iniciativa Scan for Good, «un programa dedicat a protegir infraestructura pública crítica de manera gratuïta». Amb ell, explica Google, el model «va descobrir una vulnerabilitat crítica que exposava informació personal sensible en programari sanitari usat per hospitals de tot el món», un risc greu que els models frontier anteriors havien passat per alt.
Les altres dues proves de ciberseguretat de l'anunci van sense xifra: el banc de vulnerabilitats intern de Google, amb codi en 20 llenguatges de programació, i el banc de proves de penetració de caixa negra de Wiz, que mesura si analitza sistemes web en viu sense veure el codi. En tots dos, Google diu que Argon millora 3.8 Flash Cyber; en cap no publica quant.
Llegir-ne més: Google — «Gemini 4 Argon: our next era of frontier intelligence» (30-09-2026) ↗
El que Google anomena «líder» i no quantifica
Fora de la ciberseguretat, l'anunci repeteix una fórmula sense números. Argon és «el model líder» al Vals Index —Vals és una empresa que manté índexs d'avaluació de models per sectors econòmics, i aquest pondera finances, programació, treball jurídic i fiscal pel seu pes al PIB dels Estats Units—. I la companyia veu «un rendiment igualment destacat» a Vals Finance Agent v2 i al banc de proves legals de Harvey, empresa de programari jurídic amb IA que el manté.
La mateixa fórmula en seguretat: Argon «lidera en robustesa davant la injecció d'instruccions» al banc de proves d'injecció indirecta de Gray Swan, una empresa de seguretat d'IA que el manté.
En cap dels tres no hi ha xifra, i l'absència també informa. Quan Google té un número que l'afavoreix, el posa, com a CWE-bench o a AutomationBench. Quan diu «líder» i no el posa, el que publica és una valoració pròpia que ningú de fora no pot contrastar.
Conclusió
El que queda en peu de l'anunci quan el mesura algú de fora és menys èpic i més concret. Argon és a dalt, compartint graó amb models que ja hi eren. Surt barat d'usar, tot i que ja hi ha qui dona més índex per menys diner, i la tarifa que l'abarateix és la que Google ja ha dit que duplicarà, sense data per al canvi. I de les xifres que la companyia publica de si mateixa, la que explica per què encara no es pot comprar és la de ciberseguretat: un empat al primer lloc en la prova d'apedaçar vulnerabilitats, que és justament la capacitat que no vol deixar anar.
Fonts primàries
Rep el resum diari d'IA
Cada matí, l'essencial de la intel·ligència artificial al teu correu, sense fum. Al dia amb la IA.
En subscriure-t'hi acceptes rebre el butlletí d'AI Informator. Pots donar-te de baixa quan vulguis.
Comentaris