Google presentó Gemini 4 Argon el 30 de septiembre de 2026. El modelo está orientado a tareas prolongadas de ingeniería de software, conocimiento empresarial y ciberseguridad defensiva. Koray Kavukcuoglu, SVP de Google DeepMind y Chief AI Architect de Google, anunció que el primer despliegue externo será para defensores cibernéticos de confianza a través del programa Fairwind.
El acceso se ampliará por fases. Google participa en el proceso voluntario del Gobierno de Estados Unidos para permitir el acceso previo a modelos. Los comentarios de los primeros evaluadores servirán para ajustar las medidas de protección antes de ofrecer Argon a desarrolladores, empresas y consumidores. El precio inicial de la API es de $2 por millón de tokens de entrada y $10 por millón de tokens de salida. Los tokens de entrada almacenados en caché tienen un descuento del 95 %. Después del periodo inicial, los precios serán de $4 por 1M tokens de entrada y $20 por 1M tokens de salida.
Miles de empleados de Google ya utilizan Argon para programación especializada, investigación y redacción. Según Google, el modelo ayudó a investigadores de computación cuántica a reducir los recursos de espacio-tiempo de subrutinas críticas, medidos como qubits × gates. Un resultado superó en un 40 % la referencia publicada en cuestión de minutos. Otros agentes analizaron datos de perfilado de toda la flota e identificaron optimizaciones que podrían liberar más de 300 TiB de memoria en los centros de datos de Google. La estimación total alcanza entre 500 TiB y 1 PiB.
Google utiliza agentes de Argon para migrar bases de código C/C++ a Rust. Los proyectos van desde decenas de miles de líneas en bibliotecas centrales como re2 y libgav1 hasta más de 800K líneas en el kernel Zircon de Fuchsia OS. Antes de llegar a producción, estos cambios pasan por auditorías automáticas y manuales, pruebas de emulación y revisiones de código.
En libgav1, los agentes partieron de un puerto existente a Rust. Sustituyeron 32K líneas de código SIMD mediante repetidos experimentos guiados por perfiles. También estudiaron la salida del compilador y generaron Rust seguro que el compilador podía vectorizar automáticamente. Google afirma que el resultado funciona 2,7 veces más rápido que el puerto Rust, mantiene una salida de vídeo idéntica y se acerca al rendimiento del C++ optimizado.
El límite de salida de Argon es de 1M tokens, frente a los 64K anteriores. Google considera que esta capacidad permite mantener el razonamiento y la generación durante flujos de trabajo largos y con varios pasos.
En DeepSWE v1.1, una prueba de ingeniería de software real con tareas de larga duración, Argon obtiene un 77,9 %. Google también informa de un resultado líder en Vals Index. Este índice mide el impacto económico en finanzas, programación, trabajo jurídico y fiscalidad, con una ponderación basada en la contribución de cada sector al PIB de Estados Unidos. Argon encabeza además Vals Finance Agent v2 y Harvey’s Legal Agent Benchmark. En AutomationBench de Zapier ocupa el primer puesto con un 51,3 %.
Argon también está diseñado para tareas de conocimiento que requieren comprensión visual. Google menciona el análisis de gráficos profesionales, la identificación de detalles en vídeos largos y la ejecución de acciones a partir de secuencias de documentos. En LVBench, que evalúa la comprensión de vídeos largos, obtiene un 91,7 %.
Google entrenó Argon para la defensa cibernética. El modelo puede localizar, validar y corregir vulnerabilidades críticas de software de forma autónoma. Los defensores de confianza y los equipos internos de Google recibirán Argon sin barreras de seguridad cibernética. Wiz lo utiliza mediante la iniciativa Scan for Good, que busca y corrige sin coste exposiciones de alto riesgo en infraestructuras públicas críticas. En una demostración inicial, Argon descubrió una vulnerabilidad crítica que exponía información personal sensible en software sanitario utilizado por hospitales de todo el mundo. Google afirma que modelos de frontera anteriores no habían detectado el problema.
Argon comparte el primer puesto en CWE-bench v1 con una puntuación del 68 %. Google relaciona este resultado con el rendimiento previo de 3.8 Flash Cyber en CWE-bench v0. Una prueba interna de vulnerabilidades de Google encontró exposiciones en bases de código complejas que cubrían 20 lenguajes de programación. En la prueba de penetración de caja negra de Wiz, Argon superó a 3.8 Flash Cyber al identificar la superficie de ataque, localizar vulnerabilidades y producir pruebas de concepto verificables.
Antes de una disponibilidad amplia, Google está reforzando las protecciones en cuatro áreas. Argon debe rechazar solicitudes dañinas relacionadas con ataques cibernéticos y amenazas químicas, biológicas, radiológicas o nucleares. También debe permitir investigaciones científicas legítimas de doble uso. Google está mejorando la supervisión de las activaciones internas, descrita en el artículo arXiv 2601.11516. Equipos rojos internos y externos probaron estas medidas con ataques manuales y automatizados.
Argon también fue entrenado contra ataques indirectos de inyección de prompts. Google lo considera su modelo más resistente hasta ahora frente a este riesgo y afirma que lidera el benchmark Indirect Prompt Injection de Gray Swan. Las medidas contra el desalineamiento supervisan la cadena de razonamiento y las acciones del modelo. Pueden detener la ejecución. Un sistema similar controló los entrenamientos y envió alertas a un equipo específico de respuesta a incidentes. Google mantuvo esos hallazgos fuera del entrenamiento para reducir el riesgo de que el modelo aprendiera a evadir la supervisión.
Google está reforzando los entornos aislados utilizados para entrenamientos y evaluaciones de alto riesgo. Se aíslan y sellan antes de comenzar esas actividades, siguiendo la hoja de ruta de control de agentes de la compañía. Tras nuevas pruebas y los comentarios de los evaluadores de confianza, el despliegue más amplio comenzará con clientes de API de pago y suscriptores de Google AI Ultra. Google también presenta Argon como una herramienta para escritura creativa, desarrolladores, profesionales y empresas.




Comentarios
Aún no hay comentarios — escribe el primero.
Inicia la conversación
Sin cuenta ni contraseña — introduce tu correo y te enviamos un enlace de acceso de un solo uso. ¿Primera vez? Todo se configura automáticamente.
Tu valoración se aplicará automáticamente al iniciar sesión.
Revisa tu bandeja de entrada
Hemos enviado un enlace de acceso a …. Ábrelo en este dispositivo — esta pestaña te conectará automáticamente.
¿No llega nada? Mira en la carpeta de spam — y marca el correo como «No es spam» para que la próxima vez llegue directo.