Skip to content
research

A nova IA do Google está vencendo silenciosamente

A corrida da IA parece dominada pela OpenAI e pela Anthropic, que trocam golpes pelas primeiras posições nos benchmarks. Mas o modelo mais recente do Google supera ambas em tarefas críticas de engenharia por uma fração do custo, mudando o cálculo para desenvolvedores e empresas.

Aki Tanaka
A nova IA do Google está vencendo silenciosamente

O caminho difícil do Google para a redenção

O Google inicialmente foi pego de surpresa quando o chatGPT surgiu, forçando a empresa a largar tudo e correr para recuperar o atraso. Cerca de um ano e meio atrás, o Gemini 2.5 pro surgiu como um breve farol, aclamado como "o melhor modelo do planeta" e o primeiro a simular um Cubo Mágico completo. Essa liderança, no entanto, provou ser passageira, à medida que a OpenAI e a Anthropic rapidamente avançaram, recuperando a dianteira.

Os lançamentos subsequentes do Gemini nos últimos seis meses, apesar de apresentarem benchmarks sólidos, muitas vezes pareceram decepcionantes na aplicação prática. Os usuários relataram uma fragilidade no uso real, com os modelos frequentemente ficando aquém das expectativas e deixando muito a desejar. Esse sentimento refletiu a dificuldade do Google em traduzir consistentemente o poder computacional bruto em desempenho confiável no mundo real.

De repente

Vencendo onde mais importa

A iteração mais recente do Google, Gemini 3.8 Flash, demonstra uma proeza direcionada que o diferencia. O modelo alcançou impressionantes 73,7% no benchmark Deep SWE v1.1, uma medida crítica para tarefas de engenharia de software de longo prazo. Esse desempenho empata efetivamente com o Claude Opus 5 e supera notavelmente o GPT 5.6 Sol, posicionando o Gemini 3.8 Flash como um dos principais concorrentes em capacidades complexas de codificação.

Essa força especializada, no entanto, contrasta fortemente com seu desempenho em conhecimentos gerais. No benchmark GDP Val, que avalia o trabalho de conhecimento no mundo real, como extração de PDF e análise de dados, o Gemini 3.8 Flash pontuou 1545. Isso fica significativamente atrás dos modelos líderes, com o Claude Opus 5 atingindo 1824 e o GPT 5.6 Sol alcançando 1710, indicando que ele é "apenas razoável" para aplicações de conhecimento amplo.

Apesar de suas limitações como generalista, o Gemini 3.8 Flash solidifica seu perfil como uma potente ferramenta especializada ao dominar outras áreas de nicho. Ele garantiu o primeiro lugar no Harvey Legal Benchmark com 61,4%, tornando-se o melhor modelo do planeta para trabalho jurídico. Além disso, liderou o Terminal Bench 2.1, uma avaliação de codificação de terminal agentic, com uma pontuação de 89,4%.

A imbatível relação custo-benefício

O preço de lançamento do Gemini 3.8 Flash representa uma interrupção profunda. Os tokens de entrada custam apenas US$ 0,75 por milhão, com tokens de saída a US$ 3,75 por milhão. Isso é apenas uma fração das taxas dos concorrentes; o Claude Opus 5, por exemplo, cobra US$ 5 e US$ 25 por milhão, respectivamente, enquanto até mesmo o GPT 5.6 Terra, mais voltado para o orçamento, custa US$ 2 e US$ 12 por milhão. O Flash, em sua taxa inicial, custa de 20% a 30% do preço do Terra.

Os preços brutos dos tokens, no entanto, revelam apenas parte da história. A verdadeira medida de valor reside no custo por tarefa, que leva em consideração tanto o preço do token quanto a eficiência operacional do modelo — quantos tokens ele requer para concluir com sucesso uma determinada operação. A combinação do Gemini 3.8 Flash de custos de token agressivamente baixos e desempenho comprovado cria uma poderosa vantagem econômica, tornando as capacidades sofisticadas de IA genuinamente acessíveis para desenvolvedores e empresas.

O Google observa que estas são taxas introdutórias, com um aumento planejado para US$ 1,50 por milhão de tokens de entrada e US$ 7,50 para saída. Mesmo nessas taxas padrão, o Gemini 3.8 Flash permanece excepcionalmente econômico, posicionando-o como uma opção líder em sua classe de desempenho. Essa estratégia de preços democratiza o acesso à assistência de engenharia de software de alto desempenho, como evidenciado por suas fortes pontuações no Deep SWE. Para mais detalhes sobre as capacidades do modelo, explore Introducing Gemini 3.8 Flash and 3.8 Flash Cyber - Google Blog.

Gostando do artigo? Receba um assim na sua caixa de entrada toda manhã.

um e-mail por dia · cancele em dois cliques · sem rastreadores de terceiros

Além dos Benchmarks: É realmente bom?

As avaliações práticas iniciais do Gemini 3.8 Flash revelam um perfil de desempenho sutil, refletindo suas pontuações variadas em benchmarks. Embora demonstre uma aptidão surpreendente em tarefas generativas complexas, como a renderização de um mapa 3D intrincado do Monte Everest, sua saída pode deixar a desejar em briefings criativos mais simples, como design de sites. Isso reflete suas pontuações de alto nível no Deep SWE (73,7%), mas resultados "apenas razoáveis" no GDP Val para trabalho de conhecimento geral.

Para as empresas, isso se traduz em uma mudança crítica: a era de identificar um modelo de IA universalmente "melhor" termina. As organizações devem agora testar rigorosamente modelos como o Gemini 3.8 Flash em relação às suas cargas de trabalho internas exclusivas, desenvolvendo benchmarks personalizados para discernir o ajuste ideal. Um modelo que se destaca em engenharia de software ou tarefas jurídicas pode falhar na geração de conteúdo de marketing ou em trabalhos de conhecimento mais amplos.

O Gemini 3.8 Flash surge não como um "matador de GPT" abrangente, mas sim como uma arma poderosa e econômica para aplicações direcionadas. Seu preço introdutório agressivo, uma fração de concorrentes como Claude Opus 5 e até mesmo GPT 5.6 Terra, aliado ao desempenho de alto nível em domínios específicos, significa uma mudança estratégica inteligente para o Google. Este modelo redefine o valor, focando na excelência especializada e econômica na dinâmica corrida da IA.

Perguntas Frequentes

O que é o Gemini 3.8 Flash do Google?

O Gemini 3.8 Flash é um novo modelo de IA altamente eficiente do Google, projetado para oferecer um forte desempenho em tarefas específicas, particularmente engenharia de software e análise jurídica, a um preço muito baixo.

Como o Gemini 3.8 Flash se compara a concorrentes como o GPT-5.6 Sol?

Em benchmarks de engenharia de software como o Deep SWE, o Gemini 3.8 Flash tem um desempenho igual ou ligeiramente superior aos principais modelos como Claude Opus 5 e GPT 5.6 Sol. No entanto, ele pontua menos em tarefas de conhecimento geral e raciocínio.

Quais são os melhores casos de uso para o Gemini 3.8 Flash?

Com base em dados de benchmark, ele se destaca em engenharia de software de longo prazo, tarefas de codificação agentic (Terminal Bench) e trabalho jurídico, onde obteve o 1º lugar no Harvey Legal Benchmark. Seu baixo custo também o torna ideal para tarefas programáticas de alto volume.

Quanto custa o Gemini 3.8 Flash?

Ele tem um preço introdutório de US$ 0,75 por milhão de tokens de entrada e US$ 3,75 por milhão de tokens de saída. O preço padrão planejado é de US$ 1,50 (entrada) e US$ 7,50 (saída), o que ainda é significativamente mais barato do que modelos comparáveis de concorrentes.

Found this useful? Share it.

For builders

Want Stork to write one of these about your product?

Send us a URL. We use the product, form a view, and publish what we actually think — in 8 languages, labeled Sponsored, with no copy approval on your side. That last part is what makes it worth quoting.

See how it works$500 · AI tools & software only

Para builders

Esta página está trabalhando para a ferramenta de outra pessoa.

Agentes de IA leem. Compradores chegam nela. Ela responde em oito idiomas e via MCP. Sua ferramenta pode ter uma assim — no ar em 24 horas.