Google lança Gemini 3.8 Flash e Flash Cyber para cibersegurança
Terceiro modelo Flash do Google em seis semanas, o Gemini 3.8 Flash mantém o preço do 3.7 Flash mas raciocina mais, enquanto sua versão Cyber mira governos e infraestruturas críticas.

O Google DeepMind lançou o Gemini 3.8 Flash e uma versão especializada, o Gemini 3.8 Flash Cyber, em 2 de setembro de 2026, segundo o próprio anúncio da empresa e a cobertura do The Verge. O lançamento chega poucas semanas depois do Gemini 3.7 Flash, o que faz do 3.8 Flash o terceiro modelo da linha Flash lançado pelo Google em seis semanas — um ritmo que mostra a velocidade com que a empresa está evoluindo sua linha de modelos mais baratos e rápidos.
Mesmo preço, mas um modelo que "trabalha mais"
O Gemini 3.8 Flash mantém o preço de lançamento que o Google definiu para o 3.7 Flash: US$ 0,75 por milhão de tokens de entrada e US$ 3,75 por milhão de tokens de saída, segundo o The Verge. O próprio Google alerta que esse preço nominal não conta toda a história. A empresa diz que o novo modelo "trabalha mais" do que seu antecessor — encadeando mais etapas de raciocínio e chamando ferramentas de forma iterativa antes de responder. Como o Gemini é cobrado por token, e não por consulta, um modelo que raciocina por mais tempo e aciona ferramentas com mais frequência pode, na prática, custar mais, principalmente em níveis de esforço mais altos, mesmo que o preço por token não tenha mudado.
A empresa independente de avaliação de desempenho Artificial Analysis oferece uma leitura diferente dessa economia. Ela chamou o Gemini 3.8 Flash de "o modelo mais barato que já medimos neste nível de inteligência", estimando que ele custa cerca de 40% menos do que o Gemini 3.7 Flash para uma inteligência equivalente. Esse ganho de eficiência vem acompanhado de uma contrapartida: a empresa constatou que o modelo usa cerca de 30% mais tokens de saída por tarefa e realiza mais turnos nas avaliações agênticas, de modo que o custo por unidade de inteligência melhora mesmo com o consumo bruto de tokens aumentando.
Qualidade de código como a do Opus 5, mas por uma fração do custo e superrápido... vai ser incrível para coisas como criar vídeos com o Remotion
À frente da concorrência em benchmarks de código, finanças e direito
No benchmark de engenharia de software DeepSWE v1.1, o Gemini 3.8 Flash supera tanto seu antecessor quanto outros modelos de ponta, incluindo o Claude Fable 5 — que a própria Anthropic atualizou com um preço mais baixo nessa mesma semana, segundo o anúncio do Google DeepMind. O Google também informa que o modelo fica à frente dos concorrentes no benchmark Vals Finance Agent V2 e no Legal Agent benchmark da Harvey, duas avaliações construídas em torno de fluxos de trabalho profissionais reais em finanças e direito, em vez de perguntas e respostas genéricas.
Em relação à segurança, o Google DeepMind afirma que o Gemini 3.8 Flash traz salvaguardas integradas contra usos indevidos em contextos químicos, biológicos, radiológicos e nucleares (QBRN), bem como contra uso cibernético ofensivo, e obtém 54,9% no HLE-Verified, um benchmark de perguntas de nível especialista. A empresa também relata uma melhoria significativa na resistência do modelo a ataques de injeção de prompt, medida pela empresa independente de testes de invasão Gray Swan.
Flash Cyber e um novo programa para governos
Junto com o modelo de uso geral, o Google apresentou o Gemini 3.8 Flash Cyber, uma versão especializada criada para tarefas defensivas de cibersegurança. Ele é lançado junto com um novo Fairwind Program, restrito a governos e ao que o Google chama de "parceiros de confiança" — um grupo que, segundo a empresa, já conta com 650 membros, incluindo CrowdStrike e o Center for Internet Security. Os membros têm acesso ao Flash Cyber e também ao agente CodeMender do Google, que a empresa descreve como capaz de "encontrar e corrigir vulnerabilidades de forma autônoma, protegendo infraestruturas críticas, serviços públicos e a segurança nacional".
- CyberGym: desempenho de ponta na descoberta autônoma de vulnerabilidades, à frente do Flash Cyber 3.5 e de modelos de ponta maiores
- Benchmark interno em 20 linguagens de programação: taxa de sucesso acima de 70%
- Correção automatizada no CWE-Bench (conduzido pela Collinear): 47,2% de pass@1, contra 47,8% de um modelo de ponta líder, a um custo bem mais baixo
- Equipe de segurança do Google Chrome: 2,6 vezes mais correções corretas do que os melhores modelos comerciais
- Benchmark de testes de invasão da Wiz: entre 7,5 e 9,7 pontos percentuais a mais de recall, a um custo de 2,3 a 5,2 vezes menor
- Equipe de pesquisa de vulnerabilidades do Google Cloud: encontrou uma falha crítica e fundamental em menos de duas horas, em uma pesquisa que normalmente leva meses
O próprio Gemini 3.8 Flash já está disponível para assinantes do Google AI Pro e Ultra, para desenvolvedores por meio da API do Gemini, do Google AI Studio e do Android Studio, e para empresas por meio do Gemini Enterprise, segundo o Google DeepMind.
O que a queda no custo da IA agêntica muda fora dos EUA
Para desenvolvedores e startups brasileiras, o número que mais importa é o que a Artificial Analysis apresentou: cerca de 40% menos custo por unidade de inteligência em relação à geração anterior do Flash. Equipes que constroem agentes de codificação, pipelines de correção automatizada ou ferramentas de IA verticais, sem o volume de investimento típico do Vale do Silício, podem acessar capacidade de código e segurança próxima da fronteira tecnológica pelos mesmos canais públicos — a API do Gemini e o Google AI Studio — usados em qualquer lugar, sem precisar de um contrato empresarial dedicado para começar a experimentar. Já o acesso ao CodeMender pelo Fairwind Program continua, por ora, restrito a governos e parceiros validados.
Fontes
- Google says its new Gemini 3.8 Flash model 'works harder' but might cost moreThe Verge · 2 de setembro de 2026
- Introducing Gemini 3.8 Flash and 3.8 Flash CyberGoogle DeepMind · 2 de setembro de 2026



