Noticias

Gemini 4 Argon es el modelo más capaz de Google hasta la fecha, y casi nadie puede usarlo

Google anunció Gemini 4 Argon el 30 de septiembre de 2026, su primer modelo bajo el nombre Gemini 4 y el primero construido específicamente para encontrar, validar y parchear vulnerabilidades de seguridad por sí solo. No está disponible para el público. Tampoco está disponible para la mayoría de los suscriptores de Google AI. Y la propia tabla de benchmarks de Google cuenta una historia notablemente más favorable que las pruebas independientes que llegaron después.

Actualizado 4 oct 20268 min de lectura
Respuesta rápida

Qué se lanzó: Gemini 4 Argon, un nuevo modelo puntero de Google DeepMind, anunciado el 30 de septiembre de 2026. Google dice que ofrece un rendimiento de nivel puntero en ingeniería de software del mundo real, trabajo de conocimiento empresarial como legal y finanzas, y especialmente defensa de ciberseguridad, incluyendo encontrar, validar y parchear vulnerabilidades de forma autónoma.

Quién puede usarlo realmente: Casi nadie, por ahora. Argon se está desplegando primero a un grupo verificado de ciberdefensores a través del Fairwind Program de Google. Google dice que llegará a desarrolladores, empresas y consumidores "lo antes posible", empezando por los clientes de pago de la API y los suscriptores de Google AI Ultra, sin fecha comprometida. Gemini Notebook y la app gratuita de Gemini no se mencionan en ningún lugar del anuncio.

Precio, donde se aplica: 2 $ por millón de tokens de entrada y 10 $ por millón de tokens de salida en el lanzamiento, que subirá más adelante a 4 $/20 $, con un descuento del 95% en la entrada cacheada. El límite de tokens de salida salta a 1.000.000, frente a los 64.000 de los modelos anteriores de la generación Gemini 3 de Google.

La brecha que la mayoría de la cobertura del día de lanzamiento se saltó: la propia tabla comparativa de Google muestra a Argon por delante de Claude Opus 5.5 y GPT-6 Astra en la mayoría de los benchmarks que eligió publicar. Las pruebas independientes de Artificial Analysis, con su propia metodología estandarizada, sitúan a Argon empatado con GPT-6 Astra y un escalón por detrás de Opus 5.5 en conjunto, aunque las brechas por benchmark son estrechas, no drásticas. Argon sigue siendo el más barato de ejecutar de los tres por tarea completada.

La entrada oficial del blog de Google 'Gemini 4 Argon: our next era of frontier intelligence', fechada el 30 de septiembre de 2026, con firma de Koray Kavukcuoglu, SVP de Google DeepMind y Chief AI Architect de Google.
blog.google, septiembre de 2026.

Qué es Argon realmente

Argon es el primer modelo que Google ha lanzado bajo el nombre Gemini 4. Todavía no existe un Gemini 4 Pro ni un Gemini 4 Flash, así que por ahora Argon es Gemini 4: un lanzamiento único en lugar de un despliegue completo de generación con varios niveles a la vez, como ocurrió con Gemini 3. El propio anuncio de Google se apoya fuertemente en tres casos de uso: ingeniería de software del mundo real, trabajo de conocimiento empresarial como el análisis legal y financiero, y defensa de ciberseguridad, donde la empresa dice que Argon puede localizar una vulnerabilidad de forma autónoma, confirmar que es real y escribir un parche que funcione sin que un humano dirija cada paso.

El cambio técnico que probablemente más importe para tareas agénticas o de larga duración es el límite de tokens de salida: Google lo elevó a 1.000.000 de tokens, frente a los 64.000 de sus modelos anteriores de la generación Gemini 3. Es un salto de 15 veces en cuánto puede contener una sola respuesta, algo que importa específicamente para tareas como la generación de parches o la redacción de documentos largos que necesitan razonar de forma continua sin tener que reiniciar una nueva llamada a mitad de camino.

El despliegue de Fairwind, y por qué los consumidores todavía no están en él

Las capacidades de Argon enfocadas en ciberseguridad se lanzan primero a través del Fairwind Program de Google, que da acceso anticipado a un grupo verificado de autoridades gubernamentales de ciberdefensa y otras organizaciones de confianza, como parte del proceso voluntario de acceso previo al lanzamiento que el gobierno de EE. UU. ha establecido para la IA puntera. Los participantes de Fairwind también obtienen una versión de Argon sin barreras de seguridad, combinada con lo que Google describe como mitigaciones de desalineación que vigilan la cadena de razonamiento del modelo en busca de señales de que está razonando para esquivar sus propias restricciones. El acceso está restringido a personal interno de ciberseguridad, respuesta a incidentes y pruebas de penetración, y las organizaciones participantes deben aplicar autenticación multifactor. Google enmarca todo el acuerdo bajo su Frontier Safety Framework: un modelo de doble uso capaz de encontrar errores explotables también es un modelo capaz de escribirlos, así que un acceso más amplio llega con un riesgo más amplio.

Para todos los demás, el propio lenguaje de Google es el único calendario público que existe: Argon llegará a "desarrolladores, empresas y consumidores, empezando por los clientes de pago de la API y los suscriptores de Google AI Ultra", sin fecha adjunta. No hay mención del nivel gratuito de la app de Gemini, ni de los suscriptores de Google AI Plus o Pro, ni de Gemini Notebook en ningún lugar del anuncio, de la página de precios ni de la cobertura que siguió. Si no eres cliente de pago de la API ni suscriptor de AI Ultra, actualmente no hay ninguna vía indicada para probar Argon en absoluto.

Precios: introductorio ahora, el doble más adelante

Donde Argon está disponible a través de la API, tiene un precio de 2 $ por millón de tokens de entrada y 10 $ por millón de tokens de salida, un precio introductorio que Google dice que subirá a 4 $/20 $ más adelante. La entrada cacheada tiene un descuento del 95%, algo que importa mucho para flujos de trabajo que reprocesan repetidamente la misma base de código o el mismo conjunto de documentos grandes, el tipo de tarea para la que Argon está específicamente pensado. Google no ha publicado una fecha de cuándo termina el precio introductorio.

Google dice que gana. Las pruebas independientes dicen que está más cerca de un empate

La entrada de lanzamiento de Google respalda a Argon con una amplia tabla de benchmarks: 77,9% en DeepSWE v1.1 (ingeniería de software de largo horizonte), 91,7% en LVBench (comprensión de vídeo largo), 68% en CWE-Bench v1 (detección de vulnerabilidades), y un primer puesto con 51,3% en AutomationBench, el benchmark de Zapier para la ejecución de tareas empresariales de principio a fin. Según el propio recuento de Google, Argon lidera en aproximadamente 12 a 13 de los 18 a 19 benchmarks de su tabla comparativa frente a Claude Opus 5.5 y GPT-6 Astra.

Artificial Analysis, que ejecuta su propia batería estandarizada de benchmarks en lugar de depender de la tabla autoseleccionada de una empresa, encontró una imagen menos favorable. Su Intelligence Index, una puntuación agregada pensada para comparar laboratorios de forma homogénea, sitúa a Argon en 53, a GPT-6 Astra en 53 (empatado con Argon), y a Claude Opus 5.5 en 58, por delante de ambos. En Terminal-Bench 4.0 en concreto, un benchmark para operar un ordenador real a través de una terminal, Artificial Analysis midió a Argon en 57%, a Astra en 59%, y a Opus 5.5 en 60%, una diferencia estrecha en lugar de una goleada. El patrón se mantiene en ambas medidas: un modelo que la propia tabla de Google muestra ganando la mayoría de las comparaciones cara a cara acaba empatado con un rival y un escalón por detrás del otro en cuanto una parte neutral ejecuta las pruebas, aunque la brecha en cualquier benchmark concreto no sea drástica.

Metric                         Argon      GPT-6 Astra   Opus 5.5
----------------------------------------------------------------------
Google-published wins          12-13 of 18-19 benchmarks (self-reported)
AA Intelligence Index            53            53            58
Terminal-Bench 4.0               57%           59%           60%
AA cost per completed task      $1.99         $3.26         $5.98

Sources: Google's launch benchmark table (self-reported, tally
not independently reproduced); Artificial Analysis independent
testing (neutral methodology). Argon wins on Google's own table
and on cost. On AA's neutral Intelligence Index and Terminal-Bench
4.0, it's tied with Astra and a step behind Opus 5.5, though the
per-benchmark gaps are narrow, not dramatic.

La ventaja real más clara de Argon en los datos independientes es el coste, no la inteligencia en bruto: Artificial Analysis midió 1,99 $ por tarea completada en su batería de evaluación, frente a 3,26 $ de GPT-6 Astra y 5,98 $ de Claude Opus 5.5. Es una ventaja genuina, pero viene con un matiz. Artificial Analysis también encontró que Argon es notablemente verboso, con un promedio de unos 62.000 tokens de salida por tarea frente a aproximadamente 27.000 de GPT-6 Astra, más del doble. Argon es barato principalmente porque su precio por token es bajo, no porque sea un modelo eficiente que razona con menos tokens que sus rivales.

También hay una disputa sin resolver que merece señalarse en lugar de ignorarse: The Hacker News informó sobre las restricciones de acceso de Fairwind, y por separado, Bloomberg informó, citando a personas con acceso directo al proyecto, que los propios ingenieros de Google descubrieron que Argon rinde peor en tareas de programación reales de lo que sugieren los benchmarks, citando específicamente un trabajo débil de diseño de interfaz (cómo se ven y se sienten las apps y los sitios web). Google rechazó esa caracterización, diciendo que sería "inexacto decir que Gemini 4 está rindiendo por debajo de lo esperado en áreas como la programación". Ninguna de las dos versiones se ha resuelto de forma independiente, y es el tipo de brecha entre el rendimiento en benchmarks y la experiencia de uso diario que merece la pena vigilar en los informes de usuarios de las próximas semanas, en lugar de dar por buena la palabra de ninguna de las dos partes.

Dónde deja esto a los usuarios de Gemini Notebook

Si usas Gemini Notebook hoy, nada cambia en tu cuaderno a causa de este lanzamiento. Argon no se menciona en el anuncio de Google como algo que llegue a la app de Gemini, Gemini Notebook, Sheets, ni a ninguna superficie de consumo, la misma brecha que encontramos cuando se lanzó Gemini 3.8 Flash tres semanas antes. La vía de despliegue de Argon (Fairwind primero, luego la API de pago y AI Ultra, con todo lo demás sin fecha) sugiere que Gemini Notebook, si llega a tener salida de la generación Gemini 4 en algún momento, es un paso posterior y no algo a corto plazo.

Si tu objetivo real es la mejor salida de modelo disponible ahora mismo en lugar de esperar a Argon, las cifras independientes de arriba apuntan hacia Claude Opus 5.5 para la calidad de tareas en bruto, ya ampliamente disponible de formas en las que Argon todavía no lo está.

La gente también pregunta

¿Qué es Gemini 4 Argon?

El primer modelo de Google DeepMind bajo el nombre Gemini 4, anunciado el 30 de septiembre de 2026. Está construido para tareas de razonamiento sostenido: ingeniería de software del mundo real, trabajo de conocimiento empresarial como el análisis legal y financiero, y defensa de ciberseguridad, incluyendo encontrar y parchear vulnerabilidades de forma autónoma.

¿Puedo usar Gemini 4 Argon ahora mismo?

Solo si formas parte del Fairwind Program de Google (ciberdefensores verificados), eres cliente de pago de la API, o suscriptor de Google AI Ultra, y aun así Google no ha dado una fecha firme de disponibilidad. No hay acceso de nivel gratuito ni desde Gemini Notebook, ni un calendario indicado de cuándo lo habrá.

¿Cuánto cuesta Gemini 4 Argon?

2 $ por millón de tokens de entrada y 10 $ por millón de tokens de salida al precio introductorio, que subirá más adelante a 4 $/20 $. La entrada cacheada tiene un descuento del 95%. Google no ha dicho cuándo termina la tarifa introductoria.

¿Es Gemini 4 Argon mejor que Claude Opus 5.5 o GPT-6 Astra?

Depende de qué cifras te fíes. La propia tabla de benchmarks de Google muestra a Argon liderando la mayoría de las comparaciones. Las pruebas independientes de Artificial Analysis sitúan a Argon aproximadamente empatado con GPT-6 Astra y por detrás de Claude Opus 5.5 en su Intelligence Index agregado, aunque Argon es el más barato de los tres por tarea completada.

¿Gemini 4 Argon impulsa Gemini Notebook?

No, y no hay indicios de que vaya a hacerlo pronto. El anuncio de Google no menciona Gemini Notebook ni la app gratuita de Gemini en ningún momento; la vía de despliegue indicada va primero por el Fairwind Program, luego por los clientes de pago de la API y los suscriptores de Google AI Ultra, con todo lo demás sin fecha.

notebooklm-to-pdf.comTodas las guías →

Exporta tu NotebookLM con un clic

Extensión de Chrome gratuita. PDF, Word y Markdown. Generado en tu equipo — nada se sube a la nube.

Seguir leyendo