IA en Ventas

Google lanza Gemini 3.6 Flash y 3.5 Flash-Lite y abarata correr agentes de IA

Google presentó el 21 de julio de 2026 sus modelos Flash para agentes: 3.6 Flash usa 17% menos tokens y baja de precio, y 3.5 Flash-Lite corre a 350 tokens por segundo desde US$0,30.

5 min de lecturaFuente: Google
Arte de portada de Google con los nombres Gemini 3.6 Flash, 3.5 Flash-Lite y 3.5 Flash Cyber
Imagen: Google

La noticia en 30 segundos

Google lanzó el 21 de julio de 2026 Gemini 3.6 Flash y Gemini 3.5 Flash-Lite, sus modelos «workhorse» para correr agentes de IA a escala. El 3.6 Flash usa 17% menos tokens de salida que el 3.5 Flash y baja el precio a US$1,50 por millón de tokens de entrada y US$7,50 de salida. El 3.5 Flash-Lite corre a 350 tokens por segundo desde US$0,30 y US$2,50. Google suma además un modelo 3.5 Flash Cyber para hallar y parchar vulnerabilidades. El mensaje para las empresas en Chile y Latinoamérica: correr agentes de IA es cada vez más barato.

Google anunció el 21 de julio de 2026 tres modelos nuevos de su familia Gemini: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite y Gemini 3.5 Flash Cyber. La línea Flash es la de los modelos «workhorse» de Google, pensados para el punto justo entre eficiencia y calidad que hace falta para correr agentes de IA a escala. El mensaje de fondo es claro: correr agentes cuesta cada vez menos.

¿Qué anunció Google con Gemini 3.6 Flash?

Gemini 3.6 Flash es el modelo de trabajo diario. Según Google, consume 17% menos tokens de salida que el 3.5 Flash en el índice de Artificial Analysis, y en algunos benchmarks como DeepSWE la reducción llega hasta 65%. Además usa menos pasos de razonamiento y menos llamadas a herramientas para completar flujos de varios pasos. En rendimiento sube frente a su antecesor: DeepSWE 49% contra 37%, MLE Bench 63,9% contra 49,7% y uso de computador (OSWorld-Verified) 83% contra 78,4%. Su fecha de corte de conocimiento avanza de enero de 2025 a marzo de 2026.

¿Cuánto cuestan Gemini 3.6 Flash y 3.5 Flash-Lite?

El precio es la parte que más mira un líder de tecnología. Gemini 3.6 Flash cuesta US$1,50 por millón de tokens de entrada y US$7,50 por millón de tokens de salida, por debajo de los US$9 de salida del 3.5 Flash. El 3.5 Flash-Lite, el más rápido de la serie 3.5, corre a 350 tokens de salida por segundo y cuesta US$0,30 de entrada y US$2,50 de salida. Con menos tokens por tarea y precios más bajos, el costo por tarea de un agente cae de forma directa.

¿Por qué importa para quienes construyen agentes de IA?

La eficiencia de tokens no es un dato técnico aislado: es lo que decide si un agente de IA es rentable en producción. Un agente que resuelve un caso de soporte o arma una cotización hace decenas de llamadas al modelo; bajar 17% los tokens y el precio por token cambia el margen de esa operación. Google lo dice de frente al señalar que el 3.6 Flash «reduce el costo por tarea agéntica». Clientes como Figma, Harvey, Hebbia y JetBrains ya lo citan para tareas de código y análisis de documentos. Para empresas en Chile y Latinoamérica que evalúan poner agentes a atender clientes o calificar leads, el costo por interacción es justo la variable que vuelve viable un piloto.

¿Qué es Gemini 3.5 Flash Cyber?

El tercer anuncio es Gemini 3.5 Flash Cyber, un modelo afinado para encontrar y parchar vulnerabilidades de seguridad, integrado en la herramienta CodeMender de Google. Por su naturaleza de doble uso, Google lo abrirá solo a gobiernos y socios de confianza en un programa piloto de acceso limitado. En paralelo, la compañía dijo que Gemini 3.5 Pro sigue en pruebas con socios y que ya empezó el preentrenamiento de Gemini 4.

Análisis de Revenue Hub

La noticia no es «Google tiene un modelo nuevo», es «correr agentes de IA volvió a bajar de precio». Cada trimestre el costo por tarea de un agente cae, y eso mueve la frontera de qué procesos comerciales conviene automatizar. Un flujo que hace seis meses no cerraba números, con 3.6 Flash o Flash-Lite puede volverse rentable. Para un líder comercial en Chile o Latinoamérica, la lectura práctica es no anclar la decisión a un solo proveedor ni a un solo precio: el mercado se mueve rápido y hoy Google, OpenAI, Anthropic y los modelos abiertos compiten por el mismo caso de uso.

La recomendación es concreta: define primero el proceso que quieres automatizar (calificación de leads, respuestas de primer nivel, armado de cotizaciones) y recién después elige el modelo por costo por tarea, no al revés. La capa de modelo se está volviendo un commodity intercambiable; el valor sostenible está en el dato limpio, el contexto del cliente y la orquestación. Revisa cómo la IA está entrando a las operaciones de ventas y qué implica para tu equipo en nuestro blog.

Fuente y criterio editorial

Revenue Hub resume, contextualiza y analiza esta información para equipos B2B de Chile y Latinoamérica. La publicación original pertenece a Google.

Leer la fuente original

Para profundizar

Preguntas frecuentes

¿Qué es Gemini 3.6 Flash?

Es el modelo «workhorse» de Google presentado el 21 de julio de 2026 para tareas de código, trabajo de conocimiento y multimodal. Está pensado para correr agentes de IA a escala con mayor eficiencia de tokens que el 3.5 Flash.

¿Cuánto cuesta Gemini 3.6 Flash?

US$1,50 por millón de tokens de entrada y US$7,50 por millón de tokens de salida, por debajo de los US$9 de salida del 3.5 Flash.

¿Qué diferencia hay entre Gemini 3.6 Flash y 3.5 Flash-Lite?

El 3.6 Flash es el modelo de trabajo diario con mejor calidad. El 3.5 Flash-Lite es el más rápido y barato (US$0,30 de entrada y US$2,50 de salida, a 350 tokens por segundo), orientado a tareas de alto volumen y baja latencia como búsqueda agéntica y procesamiento de documentos.

¿Gemini 3.6 Flash es más barato que Gemini 3.5 Flash?

Sí. Además de bajar el precio de salida de US$9 a US$7,50 por millón de tokens, consume 17% menos tokens de salida según el índice de Artificial Analysis, lo que reduce el costo por tarea agéntica.

¿Para qué sirve Gemini 3.5 Flash Cyber?

Es un modelo afinado para encontrar y parchar vulnerabilidades de seguridad dentro de la herramienta CodeMender de Google. Estará disponible solo para gobiernos y socios de confianza en un piloto de acceso limitado.

¿Cuándo sale Gemini 3.5 Pro y Gemini 4?

Google dijo que Gemini 3.5 Pro sigue en pruebas con socios y saldrá cuando esté listo. En paralelo, ya empezó el preentrenamiento de Gemini 4, sin fecha anunciada.

¿Dónde puedo usar Gemini 3.6 Flash?

En la Gemini API vía Google AI Studio y Android Studio, en Google Antigravity, en la Gemini Enterprise Agent Platform para empresas y en la app de Gemini. El 3.5 Flash-Lite también llega a Google Search.

Comparte este análisis con tu equipo

Continúa explorando

Ver toda la categoría