Super Sale WeekClaude Skills — 20% OFF
News

Gemini 3.7 Flash : nouveautés, tarifs et alternatives (2026)

Powerdrill Team·
Gemini 3.7 Flash : nouveautés, tarifs et alternatives (2026)

Google a annoncé Gemini 3.7 Flash le 13 août 2026, le qualifiant de « notre modèle de travail le plus intelligent à ce jour pour le codage et les agents ». Il coûte la moitié du prix de 3.6 Flash, arrivant trois semaines après ce dernier. Le prix indiqué est un tarif de lancement et expire à la fin de l'année.

Cet article présente les changements, le prix réel et ce que mesurent les benchmarks. Il aborde également les solutions à privilégier lorsque votre livrable est un rapport ou une présentation. Les faits présentés sont à jour au 17 août 2026.

Quoi de neuf dans Gemini 3.7 Flash

Le point fort réside dans la progression des performances pour les tâches agentiques et de codage. Google cite parmi les domaines cibles l'ingénierie logicielle, le travail de gestion des connaissances, le développement web, la génération de code, le débogage, la résolution de problèmes, la compréhension de documents et l'automatisation des flux de travail en entreprise.

Deux d'entre eux importent particulièrement à quiconque travaille avec des fichiers plutôt qu'avec du code. La compréhension de documents et l'automatisation des flux de travail en entreprise sont ceux qui touchent aux feuilles de calcul, aux relevés et aux rapports.

Le rythme des sorties mérite d'être souligné en soi. Gemini 3.6 Flash est arrivé environ trois semaines plus tôt, il s'agit donc d'une itération rapide plutôt que d'un changement de génération.

Ce rythme a une conséquence pratique. Tout ce que vous construisez autour d'une version spécifique de modèle doit pouvoir tolérer les changements de version sous-jacents.

Google présente également explicitement cette gamme comme un modèle de travail plutôt que comme un modèle de pointe (frontier model). Il est conçu pour le volume et le coût, non pour résoudre votre problème unique le plus complexe.

La disponibilité varie selon le public. Les développeurs y ont accès dans Google AI Studio, Android Studio et Google Antigravity. Les entreprises en bénéficient via la Gemini Enterprise Agent Platform. Les particuliers y accèdent via Gemini Spark, pour les abonnés AI Pro et Ultra dans plus de 160 pays.

Ces trois environnements ne constituent pas le même produit. Un développeur effectuant des tests dans AI Studio et un collègue utilisant Spark travaillent avec des interfaces et des limites différentes.

Les tarifs et la date clé

Actuellement À partir du 1er janvier 2027
Entrée 0,75 $ pour 1M de tokens 1,50 $ pour 1M de tokens
Sortie 3,75 $ pour 1M de tokens 7,50 $ pour 1M de tokens

Google indique clairement que « le tarif de lancement expire le 31 décembre 2026 ». Le doublement du prix est officiel, il ne s'agit pas de spéculation.

Par rapport à 3.6 Flash, Google décrit le tarif actuel comme « la moitié du coût initial de 3.6 Flash par million de tokens ». La réduction est donc bien réelle aujourd'hui et temporaire par définition.

Si vous modélisez un budget au-delà de cette année, basez-vous sur les chiffres de janvier. Une estimation des coûts établie sur le tarif de lancement sera fausse en quelques mois.

L'inverse est également vrai. Pour un projet se terminant cette année, le tarif actuel représente de réelles économies plutôt qu'un simple argument marketing.

Un autre détail influe sur la planification. Le doublement s'applique à la fois aux entrées et aux sorties, de sorte que le ratio entre les deux reste inchangé.

Ce que les benchmarks mesurent et ne mesurent pas

Google publie cinq comparaisons par rapport à 3.6 Flash. Les gains sont importants dans chacun des cas.

Benchmark 3.7 Flash 3.6 Flash
FrontierCode 1.1 Main 43,6% 34,4%
DeepSWE v1.1 65,3% 49,0%
WebDev Arena Elo 1588 1538
GDP.pdf 34,0% 22,0%
AutomationBench 30,4% 17,0%

Trois des cinq évaluations concernent le codage. Elles ne vous apprennent pas grand-chose sur la capacité d'un modèle à lire correctement votre export trimestriel.

Celle qui se rapproche le plus de ce type de tâche est GDP.pdf, une évaluation de la compréhension de documents. Intéressez-vous à sa valeur absolue plutôt qu'à sa progression : 34,0% signifie qu'environ deux tiers des éléments ne sont toujours pas détectés.

AutomationBench se comporte de la même manière. Un bond de 17,0% à 30,4% représente un gain relatif important, mais un score absolu faible.

Cette combinaison résume fidèlement la situation. Il s'agit d'un modèle nettement plus performant pour le traitement de documents, mais ce domaine reste la colonne la plus faible du tableau.

Ce que cela change si votre livrable est un rapport ou une présentation

Une inférence plus rapide et moins coûteuse modifie l'aspect économique avant de modifier la qualité des résultats. Diviser par deux le coût des tokens permet d'envisager sereinement une étape que vous auriez ignorée auparavant.

Le candidat évident est la vérification. Demander une seconde passe pour vérifier un chiffre par rapport à sa source ne coûte pas cher lorsque les tokens sont bon marché.

Le deuxième candidat est le volume. Traiter chaque fichier d'un dossier devient abordable, au lieu de devoir se contenter d'un échantillonnage.

Le troisième est l'itération. Lorsqu'un premier essai est peu coûteux, vous pouvez poser la même question de trois manières différentes et comparer les réponses.

Ce qui ne change pas, c'est la dernière étape. Même si un modèle fournit des chiffres exacts, il vous reste à assembler le graphique, le résumé écrit et les diapositives. Notre page sur le générateur de rapports IA explique comment se déroule cette étape d'assemblage.

C'est pourquoi le coût par token est un indicateur peu fiable du coût par livrable. Les tokens représentent rarement la partie la plus onéreuse de la production d'un rapport.

Évaluez le changement en fonction de ce que vous pouvez désormais vous permettre de faire deux fois. Vérifier son propre travail est l'étape que la plupart des gens ignorent pour des raisons de coût.

Trois choses que l'annonce ne dit pas

La fenêtre de contexte. Aucun chiffre n'apparaît dans l'article. Si vos fichiers sont volumineux, cette omission est la première chose à tester.

La gestion des tableaux complexes. La compréhension de documents est présentée comme un point fort sans que l'on sache ce qu'il advient des cellules fusionnées, des en-têtes sur plusieurs lignes ou des tableaux numérisés.

Si la disponibilité sur Spark équivaut à la parité avec l'API. Gemini Spark et l'API sont présentés comme des environnements distincts, et l'article ne précise pas si leur comportement est identique.

Quelles sont les limites de taux (rate limits). Aucun quota par minute ou par jour n'apparaît dans l'annonce, ce qui importe davantage avec un prix bas qu'avec un prix élevé.

Il existe une quatrième lacune importante pour la planification. Rien n'est dit sur la durée pendant laquelle 3.7 Flash restera d'actualité, alors que 3.6 Flash n'a duré que trois semaines environ.

Là où un modèle plus rapide cesse d'être utile

Un modèle est un composant. Le travail sur lequel vous êtes évalué est un livrable fini, et l'écart entre les deux est l'étape qui prend généralement le plus de temps.

That gap has three parts. Getting the file into a usable shape, deciding which numbers matter, and producing something a colleague can read without you narrating it.

Notez que seule la partie centrale fait réellement appel à l'intelligence. La première et la dernière concernent la manipulation de fichiers et la production de formats.

Aucun de ces trois aspects n'est résolu par un token moins cher. Ils le sont par des outils qui centralisent le fichier, l'analyse et le résultat sur un seul et même espace de travail.

C'est à ce niveau qu'intervient Powerdrill Bloom. Vous importez le fichier Excel, CSV, TSV ou PDF et l'explorez sur un canevas. Ce que vous conservez se transforme en graphique, en rapport ou en diapositives en une seule étape. Sa véritable limite se situe dans l'autre sens : il ne s'agit pas d'un point de terminaison de modèle brut, vous ne contrôlez donc pas les tokens, la température ou le choix du modèle.

Des alternatives à connaître

Si vous avez besoin de Envisagez
Une inférence rapide et économique pour les tâches agentiques et de codage Gemini 3.7 Flash
Un raisonnement approfondi sur des documents longs et complexes Un modèle de pointe (frontier model) plutôt qu'une gamme de travail
Un graphique, un rapport ou une présentation finalisés à partir d'un fichier de données Un agent d'action avec importation et exportation de fichiers
Une vue interactive sur un Google Sheet Sheets canvas, présenté dans notre guide de Sheets canvas

Choisissez en fonction de l'étape manquante de votre chaîne de travail. Si l'élément manquant est le coût d'inférence, un modèle de travail est la solution.

Notez qu'il ne s'agit pas d'achats concurrents. Une gamme de modèles et un outil de livraison se situent à des niveaux différents, et la plupart des équipes finissent par payer pour les deux.

Si l'élément manquant est le livrable final, un modèle moins cher ne le produira pas. Il s'agit d'une autre catégorie d'outils, et non d'une catégorie moins performante.

Conclusion

Gemini 3.7 Flash représente une véritable avancée pour les tâches agentiques et le traitement de documents, pour la moitié du coût précédent, cette réduction étant temporaire. Ce sont les trois faits essentiels à retenir.

Le chiffre à garder à l'esprit est le score de GDP.pdf à 34,0%. Amélioration et suffisance sont deux notions différentes, et la compréhension de documents reste la colonne que vous devez vérifier vous-même.

Si votre travail aboutit à un graphique, un résumé écrit ou une présentation, essayez Powerdrill Bloom sur l'un de vos propres fichiers. Consultez également nos guides sur les plug-ins d'agents et sur ce qu'est MCP.

Foire aux questions

Qu'est-ce que Gemini 3.7 Flash ?

Il s'agit du modèle de la gamme de travail de Google annoncé le 13 août 2026, décrit comme son modèle de travail le plus intelligent à ce jour pour le codage et les agents. Google cite le codage, le travail de gestion des connaissances, la compréhension de documents et l'automatisation des flux de travail en entreprise parmi ses domaines cibles.

Combien coûte Gemini 3.7 Flash ?

Actuellement 0,75 $ par million de tokens d'entrée et 3,75 $ par million de tokens de sortie. Google précise que ce tarif de lancement expire le 31 décembre 2026, après quoi les tarifs de 1,50 $ et 7,50 $ s'appliqueront.

Est-il meilleur que Gemini 3.6 Flash ?

Google publie des gains sur les cinq benchmarks comparés, notamment FrontierCode 1.1 Main à 43,6% contre 34,4%. Il indique également que le tarif actuel correspond à la moitié du coût initial de 3.6 Flash par million de tokens.

Quelle est la taille de sa fenêtre de contexte ?

L'annonce n'indique aucun chiffre pour la fenêtre de contexte. Si les fichiers volumineux sont importants pour votre travail, testez cela vous-même plutôt que de supposer une parité avec une autre gamme.

Peut-il transformer une feuille de calcul en présentation ?

Un modèle fournit du texte et du raisonnement, pas une présentation mise en forme. Produire des diapositives à partir d'un fichier de données nécessite des outils qui gèrent le fichier et l'exportation, ce qui constitue une couche distincte du modèle.