Google lanza Gemini 3.6 Flash y Flash-Lite; el Pro se retrasa

Google lanza Gemini 3.6 Flash y Flash-Lite; el Pro se retrasa

Google lanza Gemini 3.6 Flash y 3.5 Flash-Lite para agentes de IA, mientras que el modelo Pro continúa retrasado.

Por Humberto Toledo el 21 de julio del 2026 a las 11:02 am PDT

✨︎ Resumen (TL;DR):

  • Google lanzó Gemini 3.6 Flash, 3.5 Flash-Lite y 3.5 Flash Cyber, enfocados en construir agentes de IA eficientes.
  • El modelo 3.6 Flash disminuye su costo de salida a 7.50 dólares por millón de tokens y ahorra hasta 17% en consumo.
  • Gemini 3.5 Pro sigue en pruebas con socios comerciales, mientras inicia el entrenamiento de Gemini 4.

Google presentó tres nuevos modelos de su familia de inteligencia artificial: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite y Gemini 3.5 Flash Cyber. Estos sistemas buscan acelerar la creación de agentes de IA eficientes y económicos a gran escala. Mientras los dos primeros ya están listos para desarrolladores, el modelo estrella Gemini 3.5 Pro sigue retrasado.

La tecnológica estadounidense enfocó este lanzamiento en la eficiencia operativa. Gemini 3.6 Flash es un modelo multimodal de inteligencia artificial que procesa texto, imagen, voz y video para ejecutar tareas complejas con menor costo. El sistema recortó sus precios de salida de 9 a 7.50 dólares por millón de tokens, mientras que el costo de entrada se mantuvo en 1.50 dólares. Además, la herramienta consume 17% menos tokens de salida en comparación con su antecesor directo.

De acuerdo con las pruebas publicadas por Google, este modelo subió al 49% de rendimiento en programación dentro del benchmark DeepSWE y alcanzó 63.9% en investigación de machine learning (MLE Bench). La firma busca competir mediante costos y velocidad, ya que análisis de firmas independientes como The New Stack ubican a este desarrollo ligeramente por detrás de rivales como Claude Sonnet 5 en algunas pruebas de código.

Moonshot frena suscripciones de Kimi K3 por exceso de demanda
Te podría interesar:
Moonshot frena suscripciones de Kimi K3 por exceso de demanda
Primer plano de una interfaz de asistente digital en una pantalla oscura, que muestra la comunicación de la tecnología IA.
Foto: Matheus Bertelli / Pexels

Velocidad y ciberseguridad a bajo costo

Por otro lado, Gemini 3.5 Flash-Lite destaca como la opción más rápida del catálogo al procesar 350 tokens de salida por segundo. Diseñado para procesar altos volúmenes de información en lugar de razonamiento profundo, este modelo ya comenzó a integrarse directamente en la Búsqueda de Google para dar respuestas ágiles a los usuarios. Su costo se fijó en 0.30 dólares por millón de tokens de entrada y 2.50 dólares de salida.

El sector empresarial ya utiliza estas capacidades para automatizar flujos complejos. Veeral Patel, responsable de IA aplicada en Ramp, detalló el impacto del nuevo modelo ligero:

“Gemini 3.5 Flash-Lite se ubicó en la frontera de Pareto en nuestro benchmark de extracción de recibos, con uno de los mejores equilibrios que hemos probado entre precisión, latencia y costo. Esa combinación es crítica en Ramp, donde necesitamos procesar recibos de forma rápida y confiable a gran escala.”

El tercer pilar del anuncio es Gemini 3.5 Flash Cyber, especializado en la detección y corrección de vulnerabilidades de software. Este opera como parte de CodeMender, un entorno donde múltiples agentes automatizados colaboran para consolidar reportes de seguridad. Google restringió el uso de este modelo exclusivamente para gobiernos y socios autorizados debido al potencial riesgo de explotación maliciosa de sus capacidades.

La directora sénior de producto, Tulsee Doshi, confirmó que el esperado Gemini 3.5 Pro continúa bajo pruebas privadas y llegará al público general cuando esté listo. En paralelo, Google ya inició el entrenamiento previo de Gemini 4, con el objetivo de liderar la próxima generación de plataformas cognitivas.

Fuentes: 1, 2, 3

+ Temas Relacionados

Más de AI

Feed