Modelos

Gemini 4 Argon: barato mientras dure la oferta

Gemini 4 Argon, el modelo frontier que Google DeepMind presentó el 30 de septiembre y todavía no vende, ya tiene nota de quien no lo fabrica: 53 puntos de Intelligence Index y 1,99 dólares por tarea, según las mediciones que Artificial Analysis tenía publicadas el 2 de octubre de 2026. Ese coste está calculado con la tarifa de estreno: Google publica en una nota al pie que, cuando el estreno acabe, el precio por token se duplica.

Recibe el resumen diario de IA

Cada mañana, lo esencial de la inteligencia artificial en tu correo, sin humo. Al día con la IA.

Frecuencia:

Viñeta: dentro de una cámara acorazada abierta, un aparato blanco con la marca Gemini descansa sobre un pedestal que lleva otra placa con la misma marca. Un único visitante con credencial colgada del cuello entra andando, y un portero trajeado con una hoja en la mano le franquea el paso por encima de un cordón de terciopelo rojo. Al otro lado del cordón, una multitud grita y agita las carteras abiertas sin poder pasar.
📷 Imagen generada con IA

En resumen

  • Según las mediciones que Artificial Analysis tenía publicadas el 2 de octubre de 2026, Gemini 4 Argon saca 53 puntos de Intelligence Index y completa una tarea del índice por 1,99 dólares.
  • En ese índice Argon empata a 53 con GPT-6 Astra y Claude Fable 5.1, por debajo de Claude Sonnet 5.5 (56) y del ajuste máximo de Claude Opus 5.5 (58).
  • De las 178 entradas del ranking que llevan índice y coste, 146 cuestan menos que Argon, y una sola le gana en las dos columnas a la vez: Claude Opus 5.5 al ajuste «high», con 54 puntos y 1,82 dólares por tarea, cobrando por token el doble que la tarifa de estreno de Argon.
  • Google avisa en nota al pie de que, al expirar el estreno, su tarifa pasa a 4 dólares de entrada y 20 de salida por millón de tokens. No dice cuándo expira.
  • De las cifras que Google publica de sí mismo, la de ciberseguridad es la que explica por qué no lo vende: en CWE-bench v1 Argon empata en el primer puesto con un 68 %.

Google lo presentó como modelo frontier y no lo puso a la venta

El 30 de septiembre de 2026, Google DeepMind —la división de inteligencia artificial de Google, que desarrolla los modelos Gemini— anunció Gemini 4 Argon. Firma el anuncio Koray Kavukcuoglu, vicepresidente sénior de Google DeepMind y Chief AI Architect de Google, con un título que no deja dudas: «Gemini 4 Argon: our next era of frontier intelligence».

Lo que no hizo Google fue ponerlo a la venta. Argon está llegando «a un conjunto de defensores de confianza en ciberseguridad» a través del programa Fairwind, y la compañía dice estar «participando activamente en el proceso voluntario del gobierno de Estados Unidos para el acceso a modelos antes de su lanzamiento». La apertura posterior empezará, según el anuncio, por «los clientes de la API de pago y los suscriptores de Google AI Ultra».

Con el modelo fuera del mercado, todas las cifras del anuncio salían de quien lo fabrica. Las del ranking de Artificial Analysis, no.

Lo que sale cuando lo mide quien no vende el modelo

Lo que mide Artificial Analysis: índice contra coste por tarea
52 54 56 58 2 $ 4 $ 6 $ 8 $ Coste por tarea Intelligence Index Claude Opus 5.5 (max) — Coste por tarea: 5,98 $ · Intelligence Index: 58 puntos Claude Opus 5.5 (max) Claude Sonnet 5.5 — Coste por tarea: 7,67 $ · Intelligence Index: 56 puntos Claude Sonnet 5.5 Claude Fable 5.1 — Coste por tarea: 7,63 $ · Intelligence Index: 53 puntos Claude Fable 5.1 GPT-6 Astra — Coste por tarea: 3,26 $ · Intelligence Index: 53 puntos GPT-6 Astra Gemini 4 Argon — Coste por tarea: 1,99 $ · Intelligence Index: 53 puntos Gemini 4 Argon GPT-6.1 Sol — Coste por tarea: 0,72 $ · Intelligence Index: 52 puntos GPT-6.1 Sol Claude Opus 5.5 (high) — Coste por tarea: 1,82 $ · Intelligence Index: 54 puntos Claude Opus 5.5 (high)
Ver los datos en tabla
Coste por tarea Intelligence Index
Claude Opus 5.5 (max) 5,98 $ 58 puntos
Claude Sonnet 5.5 7,67 $ 56 puntos
Claude Fable 5.1 7,63 $ 53 puntos
GPT-6 Astra 3,26 $ 53 puntos
Gemini 4 Argon 1,99 $ 53 puntos
GPT-6.1 Sol 0,72 $ 52 puntos
Claude Opus 5.5 (high) 1,82 $ 54 puntos
Mide Artificial Analysis, sobre sus propias pruebas, y no vende ninguno de estos modelos; datos consultados el 2 de octubre de 2026. Cada modelo va con el ajuste de esfuerzo que publica el sitio: Gemini 4 Argon en «high»; Claude Sonnet 5.5 y Claude Fable 5.1 en «max with fallback»; GPT-6 Astra y GPT-6.1 Sol en «max». De Claude Opus 5.5 van los dos ajustes que el sitio publica por separado, «max with fallback» y «high with fallback» —nombre largo, «Claude Opus 5.5 (Adaptive Reasoning, High Effort, Default Fallback)»—: el segundo es la única de las 178 entradas con índice y coste que supera a Argon en las dos columnas a la vez, y su tarifa es de 4 dólares por millón de tokens de entrada y 20 por millón de salida. El índice se publica redondeado y Argon, Astra y Fable 5.1 comparten el mismo 53. El coste por tarea de Argon está calculado con su tarifa de estreno.

En la tabla consultada el 2 de octubre, Argon aparece con 53 puntos de Intelligence Index, el mismo número que el sitio da a GPT-6 Astra y a Claude Fable 5.1.

La otra columna es el dinero, y ser barato no distingue a Argon: de las 178 entradas del ranking que llevan a la vez índice y coste, 146 completan las pruebas por menos de lo que cuesta él. Lo que estrecha la lista es pedir las dos cosas, y entonces queda una: Claude Opus 5.5 al ajuste «high» es la única entrada que saca más índice que Argon y además cuesta menos por tarea. Más nota y menos dinero, cobrando por token el doble que la tarifa de estreno de Argon: exactamente lo que Argon cobrará cuando el estreno acabe.

Un detalle que el propio sitio deja escrito: cada modelo se mide con el ajuste de esfuerzo que ofrece su proveedor, y no son el mismo. El reparto va al pie del gráfico.

Leer más: Artificial Analysis — Model leaderboard (02-10-2026) ↗

El precio con el que se mide es el de la oferta

Las dos tarifas de Gemini 4 Argon
Tarifa de Gemini 4 Argon Entrada / millón Salida / millón
De estreno 2 $ 10 $
Al acabar el estreno 4 $ 20 $
Entrada en caché, durante el estreno 95 % de descuento —
Las dos tarifas las publica Google DeepMind en el anuncio del 30 de septiembre de 2026; la segunda, en una nota al pie. Google no dice cuándo acaba el periodo de estreno. El coste por tarea que mide Artificial Analysis está calculado con la tarifa de estreno.

La ficha de Argon en Artificial Analysis registra los precios con los que hace esa cuenta, y son los del estreno: los 1,99 dólares por tarea son el precio de la oferta, no el de después.

Las dos tarifas las publica Google, no quien mide. El anuncio da la de estreno en el cuerpo y deja la de después en la nota al pie número uno, en letra pequeña: «Cuando el periodo introductorio expire, se aplicará el precio de 4 dólares por millón de tokens de entrada y 20 dólares por millón de salida».

Cuándo expira no lo dice. Y cuánto costaría entonces una tarea del índice no se puede deducir desde fuera: con el 95 % de descuento de la caché en la cuenta, el total no se duplica multiplicando por dos. Lo que sí se puede afirmar es lo que importa al elegir: la cifra barata se apoya en una tarifa que Google ya ha dicho que va a subir.

Leer más: Artificial Analysis — Gemini 4 Argon, ficha del modelo (02-10-2026) ↗

La cifra que explica por qué no lo vende es la de ciberseguridad

Google pone número en varias de sus pruebas, y las que dio el 30 de septiembre —51,3 % en AutomationBench, 77,9 % en DeepSWE v1.1, 91,7 % en LVBench— son medidas suyas sobre su propio modelo, en pruebas distintas que no se comparan entre sí. La que explica el acceso restringido es otra: CWE-bench v1, que evalúa la capacidad del modelo para reparar vulnerabilidades de software. Ahí, dice el anuncio, «Argon empata en el primer puesto con una puntuación máxima del 68 %», sobre lo que ya hacía 3.8 Flash Cyber en la versión anterior de la misma prueba. Es un empate en cabeza, no un primer puesto en solitario, y Google no dice con quién empata.

Esa capacidad es también la razón declarada para no venderlo. «Para defensores de confianza y para nuestros propios equipos internos en Google vamos a liberar Argon sin guardarraíles de ciberseguridad, para que puedan aprovechar al completo su capacidad de defensa de nivel frontier», escribe la compañía. Lo que mejor se le da es justo lo que no quiere dejar suelto.

Hay un ejemplo en marcha: Wiz —empresa de seguridad en la nube— ya usa Argon en su iniciativa Scan for Good, «un programa dedicado a proteger infraestructura pública crítica de forma gratuita». Con él, cuenta Google, el modelo «descubrió una vulnerabilidad crítica que exponía información personal sensible en software sanitario usado por hospitales de todo el mundo», un riesgo grave que los modelos frontier anteriores habían pasado por alto.

Las otras dos pruebas de ciberseguridad del anuncio van sin cifra: el banco de vulnerabilidades interno de Google, con código en 20 lenguajes de programación, y el banco de pruebas de penetración de caja negra de Wiz, que mide si analiza sistemas web en vivo sin ver el código. En los dos, Google dice que Argon mejora a 3.8 Flash Cyber; en ninguno publica cuánto.

Leer más: Google — «Gemini 4 Argon: our next era of frontier intelligence» (30-09-2026) ↗

Lo que Google llama «líder» y no cuantifica

Fuera de la ciberseguridad, el anuncio repite una fórmula sin números. Argon es «el modelo líder» en el Vals Index —Vals es una empresa que mantiene índices de evaluación de modelos por sectores económicos, y este pondera finanzas, programación, trabajo jurídico y fiscal por su peso en el PIB de Estados Unidos—. Y la compañía ve «un rendimiento igualmente destacado» en Vals Finance Agent v2 y en el banco de pruebas legales de Harvey, empresa de software jurídico con IA que lo mantiene.

La misma fórmula en seguridad: Argon «lidera en robustez frente a la inyección de instrucciones» en el banco de pruebas de inyección indirecta de Gray Swan, una empresa de seguridad de IA que lo mantiene.

En ninguno de los tres hay cifra, y la ausencia también informa. Cuando Google tiene un número que le favorece, lo pone, como en CWE-bench o en AutomationBench. Cuando dice «líder» y no lo pone, lo que publica es una valoración propia que nadie de fuera puede contrastar.

Conclusión

Lo que queda en pie del anuncio cuando lo mide alguien de fuera es menos épico y más concreto. Argon está arriba, compartiendo escalón con modelos que ya estaban ahí. Sale barato de usar, aunque ya hay quien da más índice por menos dinero, y la tarifa que lo abarata es la que Google ya ha dicho que duplicará, sin fecha para el cambio. Y de las cifras que la compañía publica de sí misma, la que explica por qué todavía no se puede comprar es la de ciberseguridad: un empate en el primer puesto en la prueba de parchear vulnerabilidades, que es justo la capacidad que no quiere dejar suelta.

Fuentes primarias

Comentarios

Sé respetuoso. Los comentarios se moderan.

    Recibe el resumen diario de IA

    Cada mañana, lo esencial de la inteligencia artificial en tu correo, sin humo. Al día con la IA.

    Frecuencia:

    ← Volver al blog