Google presentó un trío de nuevos modelos Gemini el 21 de julio de 2026, duplicando la eficiencia y rentabilidad que los desarrolladores necesitan para crear agentes de IA de producción a escala. La compañía presentó Gemini 3.6 Flash, Gemini 3.5 Flash-Lite y Gemini 3.5 Flash Cyber, cada uno de los cuales apunta a un segmento diferente del cada vez más competitivo panorama de modelos de IA. Para una cobertura completa de los últimos desarrollos en noticias de última hora sobre IA, estos lanzamientos marcan el impulso más agresivo de Google hasta el momento para ganar el mercado de desarrolladores sensible a los costos.
El anuncio llega en un momento crucial para el gigante de las búsquedas. Mientras que competidores como OpenAI y Anthropic han captado la atención con sus modelos emblemáticos, la serie Flash de Google se ha hecho un hueco como opción para los desarrolladores que necesitan ejecutar agentes de IA de forma económica y fiable. Los nuevos modelos representan un avance significativo tanto en calidad como en eficiencia en los flujos de trabajo de agentes.
Gemini 3.6 Flash: el nuevo modelo de caballo de batalla
Gemini 3.6 Flash se posiciona como el modelo caballo de batalla de Google, basándose directamente en los comentarios de los desarrolladores que utilizan el anterior 3.5 Flash. Según el anuncio de Google, escrito por el Director Senior de Gestión de Productos Tulsee Doshi, el modelo ofrece codificación mejorada, trabajo de conocimiento y rendimiento multimodal al tiempo que reduce significativamente el consumo de tokens.
En el índice de análisis artificial, Gemini 3.6 Flash consume un 17% menos de tokens de salida que su predecesor. En algunos benchmarks, como DeepSWE de Datacurve, la reducción llega hasta el 65%. El modelo también requiere menos pasos de razonamiento y llamadas a herramientas para lograr flujos de trabajo de varios pasos.
El precio se ha fijado en 1,50 dólares por millón de tokens de entrada y 7,50 dólares por millón de tokens de salida, lo que socava la generación anterior. Esto hace que los agentes sean más rentables para construir y ejecutar a escala, un factor crítico para las empresas que implementan IA en miles de tareas simultáneas.
Mejoras de referencia
Google informó varias mejoras de rendimiento notables en comparación con 3.5 Flash:
- DeepSWE: 49 % frente a 37 %, lo que refleja una mayor precisión en la edición de código con menos ediciones no deseadas y bucles de ejecución reducidos.
- MLE Bench: 63,9% versus 49,7%, un salto significativo en las capacidades de investigación de aprendizaje automático
- OSWorld-Verified: 83,0 % frente a 78,4 %, lo que muestra capacidades mejoradas de uso de la computadora
- GDPval-AA v2: 1421 versus 1349, lo que refleja ganancias en tareas de trabajo de conocimiento
El uso de la computadora ahora está disponible como una herramienta integrada del lado del cliente a través de Gemini API y Gemini Enterprise, lo que elimina la necesidad de capas de orquestación de terceros.
Gemini 3.5 Flash-Lite: diseñado para velocidad y escala
Además de la actualización de Flash, Google lanzó Gemini 3.5 Flash-Lite, diseñado para tareas de baja latencia y cargas de trabajo de alto rendimiento como búsqueda agente y procesamiento de documentos. Es el modelo más rápido de la serie 3.5 y funciona a 350 tokens de salida por segundo, según lo medido por Análisis Artificial.
Con un precio agresivo de 0,30 dólares por millón de tokens de entrada y 2,50 dólares por millón de tokens de salida, Flash-Lite ofrece una atractiva relación precio-rendimiento para los desarrolladores que ejecutan tráfico de producción a escala. Google señaló que en muchas evaluaciones de agentes y codificación, el modelo incluso supera al Gemini 3 Flash más grande, incluso en SWE-Bench Pro (54,2% frente a 49,6%) y OSWorld-Verified (74,0% frente a 65,1%).
El modelo admite niveles de pensamiento configurables, lo que permite a los desarrolladores priorizar la ejecución de baja latencia para tareas de gran volumen o involucrar niveles de pensamiento más altos para cargas de trabajo complejas de subagentes de varios pasos.
Gemini 3.5 Flash Cyber: IA para la seguridad del código
La tercera versión, Gemini 3.5 Flash Cyber, es un modelo especializado optimizado para encontrar y reparar vulnerabilidades de ciberseguridad. Construido sobre Flash 3.5, está emparejado con el agente CodeMender de Google, que utiliza múltiples agentes Flash Cyber trabajando juntos para producir informes de seguridad combinados.
En el benchmark CyberGym, el modelo alcanza un rendimiento competitivo en la frontera. Sin embargo, dada la naturaleza de doble uso de la tecnología, Google está adoptando un enfoque deliberadamente cauteloso en su implementación. El modelo estará disponible exclusivamente para gobiernos y socios confiables a través de CodeMender como parte de un programa piloto de acceso limitado.
Esto les da a los defensores de primera línea una ventaja para encontrar y corregir vulnerabilidades críticas antes de que puedan ser explotadas, al tiempo que mitiga el riesgo de un uso indebido más amplio.
Gemini 3.5 Pro aún en pruebas
Google confirmó que Gemini 3.5 Pro, el modelo insignia cuyo retraso ha sido observado de cerca, se encuentra actualmente en pruebas con socios y estará disponible ampliamente tan pronto como esté listo. La compañía había pospuesto previamente el lanzamiento de Pro debido a objetivos de desempeño internos y una ola de salidas de investigadores.
Quizás lo más notable es que Google reveló que el equipo ya comenzó lo que describió como su entrenamiento previo más ambicioso hasta el momento para Gemini 4, lo que indica que la próxima generación de modelos ya está en marcha.
Medidas de seguridad mejoradas
Gemini 3.6 Flash se entrega con salvaguardias mejoradas de Frontier Safety en los dominios de amenazas químicas, biológicas, radiológicas y nucleares (QBRN) y usos indebidos de delitos cibernéticos. Google dice que estas salvaguardas hacen que el modelo sea sustancialmente más resistente a los jailbreak y al mismo tiempo minimizan los rechazos para usos beneficiosos.
El lanzamiento se produce en medio de un mayor escrutinio sobre la seguridad de los modelos de IA en Washington, donde la administración Trump ha presionado a las empresas para que compartan modelos inéditos con evaluadores gubernamentales antes de su publicación. Google DeepMind y Microsoft firmaron acuerdos con el Centro de Innovación y Estándares de IA del gobierno en mayo de 2026 para compartir sus modelos de frontera para pruebas de seguridad nacional.
Disponibilidad
Gemini 3.6 Flash y 3.5 Flash-Lite están disponibles de inmediato para los desarrolladores a través de Gemini API, Google AI Studio y Android Studio. Los clientes empresariales pueden acceder a ellos a través de la plataforma Gemini Enterprise Agent. La aplicación Gemini también es compatible con ambos modelos para uso del consumidor, y 3.5 Flash-Lite se está implementando en la Búsqueda de Google.
Manténgase por delante de la IA
¿Quieres más del mundo de la inteligencia artificial? Marque AI Buzz Wire para obtener la cobertura más reciente de la industria de la IA en la que puede confiar.
Leer más noticias sobre IA →


