tradingkey.logo
tradingkey.logo
Pesquisar

Google lança Gemini 3.8 Flash: desempenho se aproxima do modelo topo de linha Claude Opus 5, e eficiência de custos continua sendo sua principal vantagem competitiva

TradingKey2 de set de 2026 às 17:32

Podcast IA

facebooktwitterlinkedin
Ver todos os comentários0

Em 2 de setembro, no horário do Leste dos EUA, o Google lançou o Gemini 3.8 Flash e o Gemini 3.8 Flash Cyber, focados em engenharia de software e cibersegurança, respectivamente. O Gemini 3.8 Flash destaca-se em tarefas complexas e raciocínio de longo alcance, superando vários concorrentes em benchmarks como DeepSWE v1.1, mantendo custos de API competitivos. Já o Gemini 3.8 Flash Cyber é restrito a defensores confiáveis via programa Fairwind, apresentando alta eficácia na descoberta e remediação automatizada de vulnerabilidades. Ambos compartilham o mesmo núcleo inteligente e otimizam resultados por meio de loops de agentes de longa duração.

Resumo gerado por IA

TradingKey - Google (GOOGL) lançou dois novos modelos em 2 de setembro, no horário do Leste dos EUA: Gemini 3.8 Flash e Gemini 3.8 Flash Cyber. Este é o terceiro modelo da série Flash lançado pelo Google em seis semanas, dando continuidade aos recursos de alta velocidade e baixo custo do Gemini 3.7 Flash anterior, enquanto aprimora ainda mais a geração de código, o raciocínio complexo, tarefas agênticas e capacidades de cibersegurança.

O primeiro é direcionado para engenharia de software, agentes de IA e tarefas de raciocínio em múltiplas etapas em áreas especializadas; o segundo se concentra na descoberta de vulnerabilidades e remediação automatizada, disponível apenas para defensores verificados e confiáveis.

Embora os dois modelos se destinem a diferentes casos de uso, ambos são baseados no mesmo núcleo de inteligência subjacente e avaliam e otimizam repetidamente as saídas do modelo por meio de loops de agentes de longa duração.

Gemini 3.8 Flash: Aprimora codificação de longo horizonte e tarefas de agentes

A principal atualização do Gemini 3.8 Flash foca no tratamento de tarefas complexas e contínuas que exigem chamadas de ferramentas em múltiplas etapas. A Google afirmou que, em testes selecionados, o desempenho do modelo se aproxima do de modelos de ponta de maior custo.

No benchmark de engenharia de software de longo alcance DeepSWE v1.1, o Gemini 3.8 Flash atingiu 73,7%, superando os 65,3% do Gemini 3.7 Flash, além de ultrapassar os 72,7% do GPT-5.6 Sol e os 69,6% do GPT-5.6 Terra, ficando apenas ligeiramente atrás dos 74,0% do Claude Opus 5.

8-a2b3c0c9f0044ec88039f9ca0ce895fc

Fonte: Google

Em tarefas de domínios especializados, o Gemini 3.8 Flash também demonstrou forte competitividade. Entre elas, o HLE-Verified abrange questões multidisciplinares que englobam ciência, tecnologia, ciências humanas e conhecimento profissional, nas quais o Gemini 3.8 Flash também superou os 31,0% do Claude Sonnet 5, os 51,1% do GPT-5.6 Terra, os 54,4% do Claude Opus 5 e os 54,5% do GPT-5.6 Sol.

Em termos de preços, o Gemini 3.8 Flash mantém a precificação inicial do Gemini 3.7 Flash: US$ 0,75 por milhão de tokens de entrada e US$ 3,75 por milhão de tokens de saída.

Em comparação, os preços de entrada e saída do Claude Opus 5 são de US$ 5 e US$ 25, respectivamente; do GPT-5.6 Sol, US$ 4 e US$ 20; e do GPT-5.6 Terra, US$ 2 e US$ 12.

Isso significa que o Gemini 3.8 Flash se aproxima ou até supera modelos maiores em benchmarks selecionados de programação e raciocínio, mas com um custo de chamada de API significativamente menor. Para desenvolvedores que buscam implementar agentes de código, análises automatizadas e fluxos de trabalho corporativos, sua eficiência de custo pode ser seu principal diferencial.

Gemini 3.8 Flash Cyber: Foca na Descoberta de Vulnerabilidades e Remediação Automatizada

O Gemini 3.8 Flash Cyber é outro modelo fundamental lançado nesta ocasião, voltado principalmente para cenários de defesa em cibersegurança. O Google declarou que o modelo não estará amplamente disponível, mas será fornecido a equipes de defesa credenciadas e de confiança por meio do novo programa Fairwind.

No benchmark de descoberta de vulnerabilidades CyberGym, comumente utilizado no setor de cibersegurança, o Gemini 3.8 Flash Cyber obteve a pontuação de 86,2%, superando os 77,5% do Gemini 3.5 Flash Cyber e ultrapassando também os 83,6% do GPT-5.6 Sol, os 83,8% do Mythos 5 e os 85,6% do GPT-5.5-Cyber.

Em testes internos de cenários do mundo real abrangendo 20 linguagens de programação, o Gemini 3.8 Flash Cyber atingiu uma taxa de sucesso na descoberta de vulnerabilidades de 71,0%, superior aos 58,9% do Gemini 3.7 Flash e aos 46,6% do Gemini 3.5 Flash Cyber.

Em termos de remediação automatizada, o Gemini 3.8 Flash Cyber obteve uma taxa pass@1 de 47,2% no teste CWE-Bench executado pela Collinear, valor próximo dos 47,8% dos principais modelos de ponta, embora o Google tenha ressaltado seu custo mais baixo.

Este conteúdo foi traduzido por IA e revisado por humanos. Ele é fornecido apenas para fins informativos e de referência, não constituindo aconselhamento financeiro ou recomendação de investimento.

Leia o original
Aviso legal: o conteúdo deste artigo representa apenas as opiniões pessoais do autor e não reflete a posição oficial do TradingKey. Portanto, não deve ser considerado uma recomendação de investimento. O artigo destina-se apenas a fins de referência, e os leitores não devem basear nenhuma decisão de investimento apenas em seu conteúdo. A TradingKey não se responsabiliza por quaisquer resultados de negociação decorrentes das informações contidas neste artigo. Além disso, a Tradingkey não pode garantir a precisão do conteúdo do artigo. Antes de tomar qualquer decisão de investimento, é aconselhável consultar um consultor financeiro independente para entender completamente os riscos associados.

Comentários (0)

Clique no botão $, digite o código do ativo e selecione para vincular uma ação, ETF ou outro ticker.

0/500
Diretrizes de comentários
Carregando...

Artigos recomendados

tradingkey.logo
Aviso de risco: Nosso site e aplicativo móvel fornecem apenas informações gerais sobre determinados produtos de investimento. A Finsights não oferece, e o fornecimento de tais informações não deve ser interpretado como se a Finsights estivesse oferecendo, aconselhamento financeiro ou recomendação para qualquer produto de investimento.
Os produtos de investimento estão sujeitos a riscos significativos, incluindo a possível perda do valor investido e podem não ser adequados para todos. O desempenho passado dos produtos de investimento não é indicativo de seu desempenho futuro.
A Finsights pode permitir que anunciantes ou afiliados realizem, ou forneçam anúncios em nosso site, ou aplicativo móvel, ou em qualquer parte deles e pode ser compensada por eles com base em sua interação com os anúncios.
 © Copyright: FINSIGHTS MEDIA PTE. LTD. Todos os direitos reservados.