O Google apresentou um trio de novos modelos Gemini em 21 de julho de 2026, duplicando a eficiência e a relação custo-benefício que os desenvolvedores precisam para construir agentes de IA de produção em escala. A empresa lançou o Gemini 3.6 Flash, o Gemini 3.5 Flash-Lite e o Gemini 3.5 Flash Cyber, cada um visando um segmento diferente do cenário cada vez mais competitivo de modelos de IA. Para uma cobertura abrangente dos mais recentes desenvolvimentos em notícias de última hora sobre IA, esses lançamentos marcam o esforço mais agressivo do Google até agora para conquistar o mercado de desenvolvedores sensíveis a custos.

O anúncio chega em um momento crucial para o gigante das buscas. Embora concorrentes como OpenAI e Anthropic tenham chamado a atenção com seus modelos principais, a série Flash do Google conquistou um nicho para desenvolvedores que precisam executar agentes de IA de maneira econômica e confiável. Os novos modelos representam um avanço significativo na qualidade e na eficiência dos fluxos de trabalho das agências.

Gemini 3.6 Flash: o novo modelo robusto

O Gemini 3.6 Flash está posicionado como o modelo robusto do Google, baseado diretamente no feedback dos desenvolvedores que usam o Flash 3.5 anterior. De acordo com o anúncio do Google, de autoria do Diretor Sênior de Gerenciamento de Produtos, Tulsee Doshi, o modelo oferece codificação aprimorada, trabalho de conhecimento e desempenho multimodal, ao mesmo tempo que reduz significativamente o consumo de tokens.

No Índice de Análise Artificial, o Gemini 3.6 Flash consome 17% menos tokens de saída do que seu antecessor. Em alguns benchmarks, como DeepSWE da Datacurve, a redução chega a 65%. O modelo também requer menos etapas de raciocínio e chamadas de ferramentas para realizar fluxos de trabalho de várias etapas.

O preço foi definido em US$ 1,50 por milhão de tokens de entrada e US$ 7,50 por milhão de tokens de saída, reduzindo o preço da geração anterior. Isso torna os agentes mais econômicos para construir e operar em escala, um fator crítico para empresas que implantam IA em milhares de tarefas simultâneas.

Melhorias de referência

O Google relatou vários ganhos notáveis de desempenho em comparação com o Flash 3,5:

  • DeepSWE: 49% versus 37%, refletindo maior precisão na edição de código com menos edições indesejadas e loops de execução reduzidos
  • MLE Bench: 63,9% versus 49,7%, um salto significativo nas capacidades de pesquisa de aprendizado de máquina
  • OSWorld-Verified: 83,0% versus 78,4%, mostrando recursos aprimorados de uso do computador
  • GDPval-AA v2: 1.421 versus 1.349, refletindo ganhos em tarefas de trabalho de conhecimento

O uso do computador agora está disponível como uma ferramenta integrada do lado do cliente por meio da API Gemini e do Gemini Enterprise, eliminando a necessidade de camadas de orquestração de terceiros.

Gemini 3.5 Flash-Lite: desenvolvido para velocidade e escala

Juntamente com a atualização do Flash, o Google lançou o Gemini 3.5 Flash-Lite, projetado para tarefas de baixa latência e cargas de trabalho de alto rendimento, como pesquisa de agentes e processamento de documentos. É o modelo mais rápido da série 3.5, rodando a 350 tokens de saída por segundo, conforme medido pela Análise Artificial.

Com um preço agressivo de US$ 0,30 por milhão de tokens de entrada e US$ 2,50 por milhão de tokens de saída, o Flash-Lite oferece uma relação preço/desempenho atraente para desenvolvedores que executam tráfego de produção em escala. O Google observou que em muitas avaliações de agente e codificação, o modelo supera até mesmo o maior Gemini 3 Flash, inclusive no SWE-Bench Pro (54,2% versus 49,6%) e no OSWorld-Verified (74,0% versus 65,1%).

O modelo oferece suporte a níveis de pensamento configuráveis, permitindo que os desenvolvedores priorizem a execução de baixa latência para tarefas de alto volume ou envolvam níveis de pensamento mais elevados para cargas de trabalho complexas de subagentes de várias etapas.

Gemini 3.5 Flash Cyber: IA para segurança de código

A terceira versão, Gemini 3.5 Flash Cyber, é um modelo especializado ajustado para encontrar e corrigir vulnerabilidades de segurança cibernética. Construído com base no Flash 3.5, ele é emparelhado com o agente CodeMender do Google, que usa vários agentes Flash Cyber ​​trabalhando juntos para produzir relatórios de segurança combinados.

No benchmark CyberGym, o modelo atinge desempenho competitivo na fronteira. No entanto, dada a natureza de dupla utilização da tecnologia, a Google está a adoptar uma abordagem deliberadamente cautelosa na implementação. O modelo estará disponível exclusivamente para governos e parceiros de confiança através do CodeMender como parte de um programa piloto de acesso limitado.

Isto dá aos defensores da linha de frente uma vantagem na descoberta e correção de vulnerabilidades críticas antes que possam ser exploradas, ao mesmo tempo que reduz o risco de uso indevido mais amplo.

Gemini 3.5 Pro ainda em testes

O Google confirmou que o Gemini 3.5 Pro, o modelo principal cujo atraso tem sido observado de perto, está atualmente em testes com parceiros e estará amplamente disponível assim que estiver pronto. A empresa já havia adiado o lançamento do Pro devido a metas de desempenho interno e a uma onda de saídas de pesquisadores.

Talvez mais notavelmente, o Google revelou que a equipe já iniciou o que descreveu como o mais ambicioso pré-treinamento para o Gemini 4, sinalizando que a próxima geração de modelos já está em andamento.

Salvaguardas de segurança aprimoradas

O Gemini 3.6 Flash é fornecido com salvaguardas aprimoradas de segurança de fronteira nos domínios de ameaças químicas, biológicas, radiológicas e nucleares (QBRN) e uso indevido de crimes cibernéticos. O Google afirma que essas salvaguardas tornam o modelo substancialmente mais resistente a jailbreaks, ao mesmo tempo que minimizam as recusas de usos benéficos.

O lançamento chega em meio a um escrutínio intensificado da segurança dos modelos de IA em Washington, onde a administração Trump pressionou as empresas a compartilhar modelos não lançados com testadores do governo antes do lançamento público. Google DeepMind e Microsoft assinaram acordos com o Centro de Padrões e Inovação de IA do governo em maio de 2026 para compartilhar seus modelos de fronteira para testes de segurança nacional.

Disponibilidade

Gemini 3.6 Flash e 3.5 Flash-Lite estão disponíveis imediatamente para desenvolvedores por meio da API Gemini, Google AI Studio e Android Studio. Os clientes corporativos podem acessá-los por meio da plataforma Gemini Enterprise Agent. O aplicativo Gemini também oferece suporte a ambos os modelos para uso do consumidor, e o 3.5 Flash-Lite está sendo lançado na Pesquisa Google.

Fique à frente da IA

Quer mais do mundo da inteligência artificial? Marque AI Buzz Wire para obter a cobertura mais recente do setor de IA em que você pode confiar.

Leia mais notícias sobre IA →