
Gemini 3.6 Flash: Google lança novos modelos
O Google anunciou nesta terça-feira (21) o Gemini 3.6 Flash, o Gemini 3.5 Flash-Lite e o Gemini 3.5 Flash Cyber, uma nova geração de modelos voltada a agentes de IA, desenvolvimento de software, tarefas multimodais e segurança cibernética. Segundo a empresa, os lançamentos reduzem latência, melhoram a eficiência de tokens e tornam fluxos de trabalho com IA mais baratos em produção.
O que muda com o Gemini 3.6 Flash
O Gemini 3.6 Flash é descrito pelo Google como o modelo “workhorse”, ou seja, a opção principal para tarefas frequentes e complexas. Ele foi desenvolvido a partir do retorno de desenvolvedores e clientes que usavam o Gemini 3.5 Flash, com avanços em programação, análise de conhecimento e desempenho multimodal.
De acordo com o Artificial Analysis Index citado pelo Google, o Gemini 3.6 Flash usa 17% menos tokens de saída que o 3.5 Flash. Em alguns testes, como o DeepSWE, da Datacurve, a redução pode chegar a 65%. A promessa é entregar respostas menos verbosas, com menos etapas de raciocínio e menos chamadas de ferramentas em tarefas de múltiplos passos.
| Modelo | Foco | Destaque |
| Gemini 3.6 Flash | Código, conhecimento e multimodal | 17% menos tokens de saída |
| Gemini 3.5 Flash-Lite | Alta escala e baixa latência | 350 tokens de saída por segundo |
| Gemini 3.5 Flash Cyber | Segurança de código | Uso limitado via CodeMender |
Preço menor e desempenho em benchmarks
Além da eficiência, o Google afirma que o Gemini 3.6 Flash chega com preço inferior ao 3.5 Flash: US$ 1,50 por 1 milhão de tokens de entrada e US$ 7,50 por 1 milhão de tokens de saída. Na prática, isso reduz o custo por tarefa agentiva, especialmente em aplicações que executam muitas chamadas de modelo.
- No DeepSWE, o Gemini 3.6 Flash marcou 49%, contra 37% do 3.5 Flash.
- No MLE Bench, voltado a pesquisa em machine learning, chegou a 63,9%, contra 49,7%.
- No OSWorld-Verified, relacionado a uso de computador, atingiu 83%, ante 78,4%.
- No GDPval-AA v2, avançou para 1421 pontos, contra 1349 do modelo anterior.


Gemini 3.5 Flash-Lite aposta em escala
O Gemini 3.5 Flash-Lite foi criado para tarefas de baixa latência e alto volume, como busca agentiva, processamento de documentos, tradução de recibos e extração de dados em grandes bases. Segundo o Artificial Analysis, o modelo alcança 350 tokens de saída por segundo.
O preço também mira escala: US$ 0,30 por 1 milhão de tokens de entrada e US$ 2,50 por 1 milhão de tokens de saída. O Google diz que desenvolvedores podem ajustar níveis de “thinking” para priorizar custo baixo, resposta rápida ou raciocínio mais profundo em subagentes.
Nos testes citados pela empresa, o 3.5 Flash-Lite superou o 3.1 Flash-Lite em tarefas de código, contexto longo e execução real. Em alguns cenários, também ficou acima do Gemini 3 Flash, incluindo SWE-Bench Pro e OSWorld-Verified.
Flash Cyber será restrito a parceiros confiáveis
O Gemini 3.5 Flash Cyber é uma versão especializada em segurança cibernética, ajustada para encontrar, validar e corrigir vulnerabilidades em código. Ele será usado dentro do CodeMender, agente de segurança de código do Google DeepMind.
Por causa do potencial de uso duplo da tecnologia, o Google adotou uma estratégia limitada: o Gemini 3.5 Flash Cyber ficará disponível apenas para governos e parceiros confiáveis em um programa piloto de acesso restrito. A ideia é ajudar defensores a corrigir falhas críticas antes que sejam exploradas.
“Nossos novos modelos Gemini entregam eficiência, latência e confiabilidade para construir agentes de IA em escala.”
Tulsee Doshi, diretora sênior de Produto do Google, em publicação oficial
Onde acessar os novos modelos Gemini
O Gemini 3.6 Flash e o Gemini 3.5 Flash-Lite já estão disponíveis para desenvolvedores pela Gemini API no Google AI Studio e no Android Studio. O Gemini 3.6 Flash também chega ao Google Antigravity, à Gemini Enterprise Agent Platform e ao aplicativo Gemini. O 3.5 Flash-Lite ainda será distribuído gradualmente na Busca do Google.
Perguntas Frequentes sobre novo modelo Gemini 3.6 Flash
O que é o Gemini 3.6 Flash?
É o novo modelo eficiente do Google para código, tarefas multimodais e agentes de IA. Ele usa menos tokens e reduz custos em produção.
Qual é a diferença entre Gemini 3.6 Flash e 3.5 Flash-Lite?
O 3.6 Flash prioriza qualidade e tarefas complexas. O 3.5 Flash-Lite foca velocidade, baixa latência e alto volume de requisições.
O Gemini 3.5 Flash Cyber será público?
Não amplamente. O modelo será oferecido via CodeMender a governos e parceiros confiáveis em piloto limitado, segundo o Google.
Como acessar o Gemini 3.6 Flash?
Desenvolvedores podem usar a Gemini API no Google AI Studio e Android Studio. Empresas têm acesso pela Gemini Enterprise Agent Platform.
Considerações finais
Com Gemini 3.6 Flash, Gemini 3.5 Flash-Lite e Gemini 3.5 Flash Cyber, o Google reforça sua estratégia de modelos mais rápidos, baratos e especializados. A atualização mira agentes de IA em produção, automação corporativa, análise multimodal e defesa cibernética. A empresa também confirmou que o Gemini 3.5 Pro está em testes com parceiros e que o pré-treinamento do Gemini 4 já começou.
