Skip to content
research

La nouvelle IA de Google gagne discrètement

La course à l'IA semble dominée par OpenAI et Anthropic, qui se disputent les meilleures places dans les benchmarks. Mais le dernier modèle de Google les surpasse sur des tâches d'ingénierie clés pour une fraction du coût, changeant ainsi la donne pour les développeurs et les entreprises.

Aki Tanaka
La nouvelle IA de Google gagne discrètement

Le chemin difficile de Google vers la rédemption

Google s'est initialement retrouvé pris au dépourvu lorsque chatGPT a fait irruption sur la scène, forçant l'entreprise à tout abandonner pour tenter de rattraper son retard. Il y a environ un an et demi, Gemini 2.5 pro est apparu comme une brève lueur d'espoir, salué comme « le meilleur modèle de la planète » et le premier à simuler un Rubik's Cube complet. Ce leadership s'est toutefois avéré éphémère, car openAI et Anthropic ont rapidement pris de l'avance, reprenant leur domination.

Les versions ultérieures de Gemini au cours des six derniers mois, malgré des scores solides aux benchmarks, ont souvent semblé décevantes en application pratique. Les utilisateurs ont signalé une fragilité dans l'utilisation réelle, les modèles ne répondant fréquemment pas aux attentes et laissant beaucoup à désirer. Ce sentiment reflétait la difficulté de Google à traduire systématiquement une puissance de calcul brute en performances fiables et concrètes.

Soudainement

Gagner là où cela compte le plus

La dernière itération de Google, Gemini 3.8 Flash, démontre une prouesse ciblée qui le distingue. Le modèle a atteint un impressionnant 73,7 % sur le benchmark Deep SWE v1.1, une mesure critique pour les tâches d'ingénierie logicielle à long terme. Cette performance égale effectivement Claude Opus 5 et surpasse notablement GPT 5.6 Sol, positionnant Gemini 3.8 Flash comme un concurrent de premier plan dans les capacités de codage complexes.

Cette force spécialisée contraste cependant fortement avec ses performances en connaissances générales. Sur le benchmark GDP Val, qui évalue le travail de connaissance réel comme l'extraction de PDF et l'analyse de données, Gemini 3.8 Flash a obtenu un score de 1545. Cela le place nettement derrière les modèles leaders, Claude Opus 5 atteignant 1824 et GPT 5.6 Sol obtenant 1710, ce qui indique qu'il est « juste correct » pour des applications de connaissances générales.

Malgré ses limites en tant que généraliste, Gemini 3.8 Flash consolide son profil d'outil spécialisé puissant en dominant d'autres domaines de niche. Il a obtenu la première place au Harvey Legal Benchmark avec 61,4 %, ce qui en fait le meilleur modèle de la planète pour le travail juridique. De plus, il a pris la tête sur Terminal Bench 2.1, une évaluation de codage de terminal agentique, avec un score de 89,4 %.

Le rapport prix-performance imbattable

Le prix de lancement de Gemini 3.8 Flash représente une perturbation profonde. Les jetons d'entrée coûtent seulement 0,75 $ par million, et les jetons de sortie 3,75 $ par million. C'est une simple fraction des tarifs des concurrents ; Claude Opus 5, par exemple, facture respectivement 5 $ et 25 $ par million, tandis que même le GPT 5.6 Terra, plus axé sur le budget, se situe à 2 $ et 12 $ par million. Flash, à son tarif initial, représente 20 à 30 % du prix de Terra.

Les prix bruts des jetons ne révèlent cependant qu'une partie de l'histoire. La véritable mesure de la valeur réside dans le coût par tâche, qui prend en compte à la fois le prix du jeton et l'efficacité opérationnelle du modèle — combien de jetons il nécessite pour terminer avec succès une opération donnée. La combinaison des coûts de jetons extrêmement bas de Gemini 3.8 Flash et de ses performances démontrées crée un avantage économique puissant, rendant les capacités d'IA sophistiquées réellement accessibles aux développeurs et aux entreprises.

Google précise qu'il s'agit de tarifs de lancement, avec une augmentation prévue à 1,50 $ par million de jetons en entrée et 7,50 $ pour la sortie. Même à ces tarifs standard, Gemini 3.8 Flash reste exceptionnellement rentable, se positionnant comme une option de premier plan dans sa catégorie de performance. Cette stratégie tarifaire démocratise l'accès à une assistance en ingénierie logicielle performante, comme en témoignent ses excellents scores Deep SWE. Pour plus de détails sur les capacités du modèle, consultez Introducing Gemini 3.8 Flash and 3.8 Flash Cyber - Google Blog.

Cet article vous plaît ? Recevez-en un comme celui-ci chaque matin.

un e-mail par jour · désinscription en deux clics · aucun traqueur tiers

Au-delà des benchmarks : est-il vraiment performant ?

Les premières évaluations pratiques de Gemini 3.8 Flash révèlent un profil de performance nuancé, reflétant ses scores variés aux benchmarks. Bien qu'il démontre une aptitude surprenante dans des tâches génératives complexes, comme le rendu d'une carte 3D complexe du mont Everest, ses résultats peuvent être insuffisants sur des briefs créatifs plus simples comme la conception de sites web. Cela reflète ses scores de premier plan sur Deep SWE (73,7 %) mais des résultats « juste corrects » sur GDP Val pour le travail de connaissances générales.

Pour les entreprises, cela se traduit par un changement critique : l'ère de l'identification d'un modèle d'IA universellement « meilleur » est révolue. Les organisations doivent désormais tester rigoureusement des modèles comme Gemini 3.8 Flash par rapport à leurs charges de travail internes uniques, en développant des benchmarks personnalisés pour discerner l'adéquation optimale. Un modèle excellant en ingénierie logicielle ou dans des tâches juridiques peut faiblir dans la génération de contenu marketing ou dans un travail de connaissances plus large.

Gemini 3.8 Flash n'apparaît pas comme un « tueur de GPT » global, mais plutôt comme une arme puissante et économique pour des applications ciblées. Sa tarification de lancement agressive, une fraction de celle de concurrents comme Claude Opus 5 et même GPT 5.6 Terra, couplée à des performances de premier ordre dans des domaines spécifiques, marque un pivot stratégique intelligent pour Google. Ce modèle redéfinit la valeur, en se concentrant sur une excellence spécialisée et rentable dans la course dynamique à l'IA.

Foire aux questions

Qu'est-ce que Gemini 3.8 Flash de Google ?

Gemini 3.8 Flash est un nouveau modèle d'IA hautement efficace de Google, conçu pour offrir de solides performances sur des tâches spécifiques, notamment l'ingénierie logicielle et l'analyse juridique, à un prix très bas.

Comment Gemini 3.8 Flash se compare-t-il à des concurrents comme GPT-5.6 Sol ?

Sur les benchmarks d'ingénierie logicielle comme Deep SWE, Gemini 3.8 Flash est à égalité ou légèrement meilleur que les meilleurs modèles comme Claude Opus 5 et GPT 5.6 Sol. Cependant, il obtient des scores inférieurs sur les tâches de connaissances générales et de raisonnement.

Quels sont les meilleurs cas d'utilisation pour Gemini 3.8 Flash ?

Sur la base des données de benchmark, il excelle dans l'ingénierie logicielle à long terme, les tâches de codage agentique (Terminal Bench) et le travail juridique, où il a obtenu la première place au Harvey Legal Benchmark. Son faible coût le rend également idéal pour les tâches programmatiques à haut volume.

Combien coûte Gemini 3.8 Flash ?

Il bénéficie d'un prix de lancement de 0,75 $ par million de jetons en entrée et 3,75 $ par million de jetons en sortie. Le prix standard devrait être de 1,50 $ (entrée) et 7,50 $ (sortie), ce qui reste nettement moins cher que les modèles comparables des concurrents.

Found this useful? Share it.

For builders

Want Stork to write one of these about your product?

Send us a URL. We use the product, form a view, and publish what we actually think — in 8 languages, labeled Sponsored, with no copy approval on your side. That last part is what makes it worth quoting.

See how it works$500 · AI tools & software only

Pour les builders

Cette page travaille pour l’outil de quelqu’un d’autre.

Les agents IA la lisent. Des acheteurs y arrivent. Elle répond en huit langues et via MCP. Votre outil peut avoir la sienne — en ligne en 24 heures.