Google se antecipa aos resultados do 2T: Lança Gemini 3.6 Flash e três novos modelos focados em custo-performance extrema
O Google lançou três modelos Gemini (3.6 Flash, 3.5 Flash-Lite e Flash Cyber) focando em eficiência de custos e especialização técnica antes dos resultados do segundo trimestre de 2026. O 3.6 Flash reduz drasticamente o consumo de tokens e custos operacionais, enquanto o Flash-Lite prioriza baixa latência. O Flash Cyber foca em cibersegurança via acesso restrito. Apesar da estratégia competitiva de preços agressivos frente a Anthropic e OpenAI, o mercado reagiu com cautela, registrando queda de 1% nas ações, em meio a atrasos no desenvolvimento do modelo principal, o Gemini 3.5 Pro.

TradingKey - Google ( GOOGL) lançou três novos modelos Gemini antes da divulgação de seus resultados do segundo trimestre de 2026 — o Gemini 3.6 Flash, o Gemini 3.5 Flash-Lite e o Gemini 3.5 Flash Cyber, que é projetado especificamente para segurança cibernética.
Entre eles, o 3.6 Flash e o Flash-Lite estão disponíveis a partir de hoje por meio da API do Gemini, do Google AI Studio, do Gemini Enterprise e dos aplicativos Gemini, enquanto o Flash-Lite também será integrado ao Google Search.
Em um momento em que o desenvolvimento de seu principal modelo de IA, o 3.5 Pro, está sob pressão e os concorrentes estão se aproximando, o Google aposta na relação custo-benefício.
Quais são as características dos três novos modelos Gemini?
Como uma atualização direta do 3.5 Flash, o 3.6 Flash apresenta avanços abrangentes em programação, trabalho intelectual e desempenho multimodal, ao mesmo tempo que melhora significativamente a eficiência de tokens. De acordo com o índice da Artificial Analysis, o uso de tokens de saída foi reduzido em 17% em comparação com o 3.5 Flash; em alguns benchmarks, como o DeepSWE da Datacurve, a redução chega a 65%. Ele também exige menos etapas de raciocínio e chamadas de ferramentas para concluir fluxos de trabalho de várias etapas.
Ao mesmo tempo, os preços oficiais foram reduzidos simultaneamente. A entrada custa US$ 1,50 por milhão de tokens e a saída custa US$ 7,50 por milhão de tokens, valores inferiores aos do 3.5 Flash, reduzindo o custo geral de cada tarefa de Agente.

[Fonte: Google Blog]
O 3.5 Flash-Lite é o modelo mais rápido da série 3.5, medido pela Artificial Analysis em 350 tokens de saída por segundo, com preço de apenas US$ 0,30 por milhão de tokens de entrada e US$ 2,50 por milhão de tokens de saída, voltado para cenários de baixa latência e alta vazão (throughput), como busca agêntica e processamento de documentos.
Em termos de desempenho, ele supera significativamente seu antecessor, o 3.1 Flash-Lite, em testes como o Terminal-Bench 2.1 (54% vs. 31%) e no benchmark de contexto longo GDM-MRCR v2 (72,2% vs. 60,1%). Mais notavelmente, no SWE-Bench Pro (54,2% vs. 49,6%) e no OSWorld-Verified (74,0% vs. 65,1%), ele supera até mesmo o Gemini 3 Flash, que possui um posicionamento superior. Os desenvolvedores podem configurar de forma flexível os níveis de raciocínio com base nas cargas de trabalho: direcionando tarefas de alta frequência para a camada de baixa latência e baixo custo, enquanto acionam níveis de raciocínio mais altos para tarefas de subagentes de várias etapas.

[Fonte: Google Blog]
O lançamento mais estratégico desta rodada é o Flash Cyber. Este modelo é especializado em descobrir e corrigir vulnerabilidades de software, com um preço por token inferior ao de modelos maiores. No agente de segurança de código CodeMender, múltiplos agentes Flash Cyber trabalham de forma colaborativa para agregar e gerar um único relatório, alcançando um desempenho competitivo de nível de fronteira no principal benchmark CyberGym.
Dada a natureza de uso duplo de tal tecnologia, o Google adotou uma estratégia de lançamento cautelosa: o Flash Cyber estará disponível em breve exclusivamente para governos e parceiros de confiança por meio do CodeMender como um piloto limitado, permitindo que os defensores de linha de frente corrijam vulnerabilidades antes que possam ser exploradas.

[Fonte: Google Blog]
Este movimento visa diretamente o reduto da Anthropic — esta última estabeleceu uma vantagem pioneira em defesa de código automatizada com seu modelo Mythos, e o Flash Cyber é uma jogada fundamental para o Google reduzir essa lacuna e comercializar as conquistas de pesquisa do DeepMind por meio de produtos de segurança corporativa.
Competição no Mercado de Grandes Modelos é Acirrada, Mercados de Capitais Seguem Atentos
Vale destacar que o modelo Gemini 3.5 Pro, o mais antecipado pelo mercado, não foi lançado nesta rodada, após relatos anteriores de que seu desenvolvimento está atrasado em vários meses. O posicionamento oficial do Google é de que o Gemini 3.5 Pro está atualmente em fase de testes com parceiros e será totalmente lançado assim que estiver pronto.
Os mercados de capitais adotaram uma postura de cautela em relação aos três modelos recém-lançados; até o momento da publicação, as ações do Google ainda registravam queda de cerca de 1%, negociadas a US$ 348,66.

[Fonte: TradingView]
Análises de mercado sugerem que isso pode estar relacionado à intensa concorrência externa. Por exemplo, a demanda pelo Kimi K3 da Moonshot AI é tão explosiva que a empresa limitou novas assinaturas e o acesso à API devido a restrições de capacidade, enquanto a Alibaba começou a divulgar prévias do Qwen 3.8 Max, alegando que seu desempenho geral fica atrás apenas do Fable 5 da Anthropic.
De acordo com dados da Artificial Analysis, o custo da série Gemini Flash já é inferior ao de modelos comparáveis da Anthropic, OpenAI e de fabricantes chineses — o custo de tarefa única do 3.6 Flash é, segundo relatos, menor do que o do GPT-5.6 Terra Max, Kimi K3 e Qwen 3.7 Max.
Este conteúdo foi traduzido por IA e revisado por humanos. Ele é fornecido apenas para fins informativos e de referência, não constituindo aconselhamento financeiro ou recomendação de investimento.
Artigos recomendados













Comentários (0)
Clique no botão $, digite o código do ativo e selecione para vincular uma ação, ETF ou outro ticker.