#google#gemini#gemini-4-argon#modelos-de-ia

    Gemini 4 Argon y 1 millón de tokens en una respuesta: precio y casos de uso

    Gemini 4 Argon escribe 1 millón de tokens en una sola respuesta. Quién lo tiene, cuánto cuesta, dónde pierde y cómo prepararte.

    Gemini 4 Argon 1 millón de tokens es el dato clave del nuevo modelo de frontera de Google DeepMind, presentado el 30 de septiembre de 2026: puede escribir hasta un millón de tokens en una sola respuesta, frente a los 64 mil de antes. Por ahora casi nadie puede usarlo: solo lo reciben defensores de confianza de ciberseguridad. Aquí van el precio, los resultados y qué preparar mientras se abre.

    Si quieres el resumen corto del lanzamiento y del acceso restringido, lee el resumen de Gemini 4 Argon y su acceso solo para defensores.

    Quién puede usar Gemini 4 Argon hoy

    Google lo describe como su modelo de frontera para programar, para trabajo de conocimiento en empresas y para ciberseguridad. No lo abrió al público: lo reciben defensores de confianza dentro de un programa llamado Fairwind. Según los reportes, son más de 650 organizaciones, entre gobiernos, operadores de infraestructura crítica y empresas de seguridad.

    La razón, según Google, es que esos defensores lo reciben con los filtros de ciberseguridad apagados para que encuentre vulnerabilidades y las repare sin negarse. Por eso la empresa dice que liberar capacidades de este nivel exige hacerlo por fases, con pruebas de equipos rojos internos y externos y con monitoreo. Wiz, una de las empresas de seguridad, ya lo usó y encontró fallas críticas en software de salud que modelos anteriores no vieron. El siguiente paso anunciado: clientes de la API de pago y suscriptores de Google Ultra, en ese orden, sin fecha.

    Persona con una laptop frente a servidores en un centro de datos, donde corren modelos como Gemini 4 Argon

    Qué significa 1 millón de tokens en una sola respuesta

    La salida máxima pasó de 64 mil tokens a un millón: dieciséis veces más. Un token equivale, más o menos, a tres cuartos de una palabra, así que un millón son unas 750 mil palabras en una respuesta. Antes había que pedir el trabajo por pedazos y vigilar que encajaran; ahora la pregunta es qué tan grande puede ser el encargo.

    Conversiones aproximadas (salen de esa regla y no de Google):

    • Una página de 500 palabras son unos 670 tokens: un millón son unas 1,500 páginas.
    • Un correo de 100 palabras son unos 130 tokens: unos 7,500 correos.
    • Un libro de 300 páginas son unos 200 mil tokens: caben cinco libros.
    • Una línea de código ronda 10 tokens: unas 100 mil líneas, una aplicación grande.

    Úsalas para dimensionar un proyecto, no para facturarlo.

    Cuánto cuesta Gemini 4 Argon

    El precio de lanzamiento es de 2 dólares por millón de tokens de entrada y 10 por millón de salida. Después sube a 4 y 20. En el anuncio revisado no hay fecha de fin del precio introductorio.

    • Una respuesta máxima de un millón de tokens: 10 dólares hoy y 20 después.
    • Leer un código de 500 mil tokens: 1 dólar de entrada hoy y 2 después.
    • Con caché, que descuenta 95 % de la entrada, volver a leerlo cuesta 5 centavos hoy y 10 después.
    • Una pasada completa: 11 dólares ahora y 22 cuando termine el periodo introductorio.

    Resultados: dónde gana y dónde pierde

    Según Google, Argon lidera la mayoría de las pruebas que publicó. En DeepSWE v1.1 saca 77.9 %, contra 74.2 de Opus 5.5 y 74.1 de Astra. En el índice Vals, 68.9 contra 67 y 63.1. En contexto largo, GraphWalks entre 256 mil y un millón de tokens: 84.2 contra 71.8 de Astra. Ventajas reales, pero no aplastantes.

    Lo que no sale en los titulares: en FrontierSWE v2 Argon saca 55.0 y Astra 65.5, es decir, pierde por 10.5 puntos. También queda atrás en tareas científicas por terminal. Y en el examen legal de Harvey saca 19.6 %: es el primer lugar, pero el mejor modelo falla la mayor parte de la prueba.

    Para quien vive de ofrecer servicios pesan más dos pruebas. AutomationBench (procesos de negocio): 51.3 %, primer lugar, o sea que casi la mitad de los procesos no los completa bien. CVE-Bench (reparación de vulnerabilidades conocidas): 68 %, empatado en primer lugar, unas dos de cada tres. La lectura útil: sirve como ayudante que adelanta trabajo, todavía no como empleado al que le dejas el proceso solo.

    ¿Cómo aplicarlo en tu empresa?

    Son propuestas de análisis propio, no ejemplos de Google, y todas terminan en un borrador que alguien debe revisar.

    1. Migración de una tienda con sistema viejo. Reúnes código y documentación (unos 500 mil tokens), pides el plan y los archivos nuevos en una respuesta, corres las pruebas y devuelves solo los errores; el caché abarata la segunda lectura. La primera pasada cuesta unos 11 dólares de modelo. Si un desarrollador cobra 50 dólares la hora, una jornada son 400 y 11 es menos de 3 %. Es un supuesto: usa tu tarifa.
    2. Investigación financiera o legal. Juntas los informes anuales de cinco empresas, pides un memorando comparativo con cita a la página y verificas cada cita contra el original. El anuncio no precisa cuánto texto acepta Argon de entrada, así que es una hipótesis, no una promesa.
    3. Video largo. En LVBench, la prueba de video largo, saca 91.7 % (cifra de Google). Una consultora podría pedir un resumen de reuniones de ocho horas con acuerdos, responsables y minuto exacto. El video también gasta tokens: mide una reunión real antes de prometer tarifa.

    Si lo tuyo es escribir correos, resumir un PDF corto o armar publicaciones, un modelo pequeño lo hace por centavos y hoy. Argon se justifica cuando el encargo es enorme. Prepárate sin gastar: elige un trabajo real y mide cuántos tokens es, anota cuánto te cuesta hoy en horas y dinero, y calcula con los dos precios (2 y 10, y 4 y 20).

    Riesgos y límites

    Los defensores lo reciben sin filtros para encontrar fallas y repararlas; Google insiste en que es solo uso defensivo. Es la tensión de toda herramienta de seguridad: los escáneres de puertos nacieron para defender y los atacantes también los usan. Es probable que la versión pública llegue con filtros y se sienta más cauta de lo que sugieren las pruebas. Y todas las cifras las publica Google; todavía no hay verificación independiente.

    Preguntas frecuentes

    ¿Qué es Gemini 4 Argon?

    Es el modelo de frontera que Google DeepMind presentó el 30 de septiembre de 2026, pensado para programar, trabajo de conocimiento en empresas y ciberseguridad.

    ¿Puedo usar Gemini 4 Argon ya?

    No, por ahora solo lo reciben defensores de confianza dentro del programa Fairwind. Después llegarán clientes de la API de pago y suscriptores de Google Ultra, sin fecha.

    ¿Cuánto cuesta?

    De lanzamiento, 2 dólares por millón de tokens de entrada y 10 por millón de salida. Después, 4 y 20.

    ¿Cuánto es un millón de tokens?

    Unas 750 mil palabras, alrededor de 1,500 páginas o unas 100 mil líneas de código.

    Conclusión

    Gemini 4 Argon y su salida de 1 millón de tokens abren la posibilidad de encargos enormes en una sola respuesta, pero hoy está cerrado, su precio de lanzamiento no va a durar y pierde justo donde casi nadie lo cuenta. La ventaja será de quien ya tenga listo qué darle de comer cuando se abra. Dime en los comentarios del video: ¿qué proyecto tuyo cabría en un millón de tokens?