Vuncloud Blog
← Retour aux Notes dev

Quels sont les derniers modèles Gemini ? Classement et différences de la gamme Google Gemini 2026

Gemini 3.7 Flash · 3.1 Pro · Deep Think · Nano Banana~12 min de lecture

Éditeur de code sur un portable — choix des modèles Google Gemini 2026 et agents de code

Au 19 août 2026, Google Gemini n’est plus « un modèle, deux tailles ». La ligne Flash a livré Gemini 3.7 Flash le 13 août ; la ligne Pro reste Gemini 3.1 Pro de février. La page produit DeepMind indique encore 3.5 Pro coming soon. « Dernier » tient donc en deux phrases : le dernier cheval de labour est 3.7 Flash ; le plus fort raisonnement public reste 3.1 Pro (Deep Think en option).

Ce texte suit les pages produit officielles, les tableaux de modèles Firebase / Gemini API, et le billet Google du 13 août sur 3.7 Flash. Ne choisissez pas un modèle au numéro de version. 3.7 ne bat pas automatiquement 3.1 Pro. Ce qui entre dans une table de routage est un rôle, pas un chiffre.

3.7 Flash
Dernier cheval de labour (13 août 2026) pour le code / les agents
3.1 Pro
Phare de raisonnement actuel (depuis février)
1M
Fenêtre de contexte typique (2M sur Vertex en entreprise)

Ce que « dernier » nomme vraiment

À l’été 2026, Google a éclaté Gemini sur plusieurs calendriers. La page d’accueil DeepMind épingle actuellement :

  • Gemini 3.7 Flash : travail d’agent complexe et code à l’échelle. Présenté le 13 août, environ trois semaines après 3.6 Flash (21 juillet).
  • Gemini 3.5 Flash-Lite : haut débit quand on veut encore un peu d’intelligence.
  • Gemini 3.1 Pro : tâches dures et idées transformées en livrables ; la note de bas de page reste 3.5 Pro coming soon.
  • Gemini 3.1 Deep Think : problèmes plus durs en science, recherche et ingénierie, avec raisonnement étendu.

Côté grand public, Gemini Spark (Google AI Pro / Ultra, 160+ pays) est passé à 3.7 Flash le 13 août. L’app Gemini gratuite reste souvent par défaut sur 3.6 Flash. Ne traitez pas le nom dans l’app et l’id API gemini-3.7-flash comme le même SLA.

Trois lignes avant les tableaux
  • Il n’existe pas de Gemini 3.5 Pro / 3.6 Pro / 3.7 Pro public — Pro est encore 3.1
  • 3.7 Flash est une montée du cheval de labour, pas un nouveau phare qui remplace 3.1 Pro
  • La ligne image s’appelle Gemini Image (surnom Nano Banana) ; ce n’est pas le même endpoint que le Flash texte

Un classement par métier, pas un palmarès de QI

Un seul classement de QI vous envoie au mauvais modèle. Classez par métier :

  1. Raisonnement le plus dur / longs documents / Deep Think : Gemini 3.1 Pro (Deep Think au besoin). C’est le phare public, pas 3.7.
  2. Agents de production, code, débit du travail de connaissance : Gemini 3.7 Flash. Google insiste sur les gains vs 3.6 en code, génération web, PDF et automatisation de workflows.
  3. Intelligence proche de Pro au prix Flash : Gemini 3.5 Flash (stable ; Firebase indique un arrêt pas avant 2027-05-19).
  4. Défaut de l’app gratuite / prudent : Gemini 3.6 Flash.
  5. Classification / extraction / sous-agents en masse : Gemini 3.5 Flash-Lite.
  6. Héritage : Gemini 2.5 Pro / Flash / Flash-Lite — Firebase liste un arrêt dès 2026-10-16. Ne figez pas de nouveaux projets dessus.

Chiffres officiels 3.7 vs 3.6 (dans Flash, pas contre 3.1 Pro) : FrontierCode 1.1 Main 43,6 % vs 34,4 % ; DeepSWE v1.1 65,3 % vs ~49 % ; GDP.pdf 34,0 % vs 22,0 % ; AutomationBench 30,4 % vs 17,0 % ; WebDev Arena Elo 1588 vs 1538. Cela veut dire que Flash est devenu plus fort et moins cher. Ce n’est pas une revendication que Flash bat désormais les phares Claude ou GPT.

Pourquoi Flash et Pro ne sortent plus ensemble

Fin 2025 a ouvert la génération Gemini 3 : aperçu 3 Pro, Deep Think, 3 Flash. En 2026, Flash a enchaîné 3.5 → 3.6 → 3.7 tandis que Pro restait sur 3.1. Traduction produit :

  • Flash possède la latence, le prix, le nombre de boucles d’agent et la discipline des appels d’outils.
  • Pro possède « ce problème mérite du raisonnement en plus » — long contexte, multimodal dur, Deep Think.
  • Ne routez pas tout vers latest. Trafic par défaut sur 3.7 Flash ; montée vers 3.1 Pro en cas d’échec ou de scores bas. C’est en général un ordre de grandeur moins cher que Pro partout.

Prix d’introduction de 3.7 Flash (jusqu’au 2026-12-31) : 0,75 $ / 1M en entrée et 3,75 $ / 1M en sortie, environ la moitié du tarif liste d’origine de 3.6 ; à partir du 2027-01-01, retour à 1,50 $ / 7,50 $. Contexte : ~1M en entrée, 64k en sortie. Outils : function calling, Search as a tool, Computer use. Surfaces : Gemini API / AI Studio, Android Studio, Antigravity, Gemini Enterprise Agent Platform.

Écran d’éditeur de code pour router les agents de coding Gemini 3.7 Flash et 3.1 Pro
Prenez 3.7 Flash comme boucle de code par défaut et gardez 3.1 Pro pour les cas durs. Cela colle mieux aux factures que d’épingler tout le dépôt sur « le dernier Gemini ».

Le reste de la famille : Lite, image, Deep Think, niches

Flash-Lite : volume, vitesse, coût

3.5 Flash-Lite est le cheval de labour Lite actuel : extraction de reçus, traduction, grand fan-out. Les démos DeepMind montrent une latence plus basse que 3.5 Flash ; il peut produire beaucoup de maquettes pendant que 3.6 Flash joue l’agent maître. L’ancien 3.1 Flash-Lite apparaît encore dans certaines consoles ; déplacez le nouveau trafic vers 3.5 Lite sauf jeu d’éval figé.

Nano Banana / Gemini Image

Les images ne sont pas un paramètre caché des modèles Flash texte. Palier courant :

  • Gemini 3.1 Flash Image (Nano Banana 2) : éditions conversationnelles, fusion multi-images, consistance de personnage.
  • Gemini 3 Pro Image : plus haute fidélité, texte lisible, jusqu’à ~14 images de référence.
  • Gemini 3.1 Flash-Lite Image (Nano Banana 2 Lite) : pipelines d’assets à fort volume, sensibles à la latence.

La démo de mini-jeu 3D de Google utilisait Flash pour orchestrer et Nano Banana pour peindre personnages et textures. Coupez ça en deux appels. N’attendez pas de gemini-3.7-flash qu’il porte seul la vision générative.

Deep Think, Omni, Audio, Robotics, Embedding

  • 3.1 Deep Think : raisonnement étendu sur Pro pour science / maths / agents à long horizon. Plus cher et plus lent ; pas un défaut de chat.
  • Gemini Omni : vidéo et « faire n’importe quoi à partir de n’importe quelle modalité ». Les démos 3.7 ont orchestré Omni pour des landing pages en parallaxe.
  • Gemini Audio : parole en temps réel.
  • Gemini Robotics / Robotics ER 2 : vision–langage–action. Ne pas mélanger aux API de chat ordinaires.
  • Gemini Embedding 2 : vecteurs multimodaux pour retrieval / RAG. Ne pas embedder avec un générateur.
  • 3.5 Flash Cyber : trouver et corriger des vulnérabilités. Évaluer comme produit de sécurité, pas comme codeur général.

Aide-mémoire : choisir ceci, pas cela

Modèle Rôle Utiliser pour Ne pas utiliser pour
3.1 Pro Raisonnement phare Cas durs, longs docs, Deep Think Chat à fort QPS, Pro à chaque pas
3.7 Flash Dernier cheval de labour Agents de code, workflows, l’essentiel du trafic de prod Faire comme si un 3.7 Pro existait déjà
3.6 Flash Défaut de l’app gratuite Cohérence grand public, baselines de transition Nouveau défaut de prod sauf si les évals gagnent
3.5 Flash Stable proche de Pro Contrats qui ont besoin d’une longue fenêtre de support Ignorer la clause d’arrêt 2027
3.5 Flash-Lite Bon marché et rapide Extraire, classer, sous-agents en parallèle Raisonnement ultra-dur en un coup
Famille 2.5 Héritage Tampon pour d’anciennes intégrations Nouveaux pins après octobre 2026
Image / Nano Banana Générer et éditer des pixels Assets, refs UI, verrouillage de personnage Remplacer un modèle texte pour l’architecture

IDs API, fenêtres de prix, risque d’arrêt

Mettez des IDs stables en config : gemini-3.7-flash, gemini-3.6-flash, gemini-3.5-flash, gemini-3.1-pro, gemini-2.5-pro. Les builds Flash 3.x plus récents sont marqués short-term availability (arrêt souvent TBD). 3.5 Flash pas avant 2027-05-19. 2.5 peut partir dès 2026-10-16. Les IDs preview (historiquement gemini-3-flash-preview) n’ont pas leur place dans les alias de production.

Prix : seule la fenêtre d’intro 3.6 / 3.7 Flash est soldée jusqu’à fin 2026 ; le 1er janvier 2027 la retire. Recalculez le TCO aux tarifs post-intro avant de signer un contrat.

Comment les développeurs doivent écrire la table de routage

  1. Par défaut, 3.7 Flash. Code, boucles d’outils, docs vers pages, la plupart des agents Workspace partent d’ici.
  2. Escalader les cas durs vers 3.1 Pro / Deep Think. Déclencher sur scores d’éval ou échantillonnage humain, pas sur chaque phrase utilisateur.
  3. Sidecar de volume sur 3.5 Flash-Lite. Champs, reçus, 20 brouillons en parallèle.
  4. Pixels sur les modèles Image. Les modèles texte n’écrivent que les prompts et orchestrent.
  5. Quitter 2.5 avant octobre. Garder un mois de journaux appariés. Ne pas attendre l’avis d’arrêt.
  6. Isoler la machine d’éval. Un changement de modèle fait exploser le folklore GPU/RAM local. Un Mac cloud convient mieux pour lancer le même harness en parallèle. Quand il faut une boucle de compile et d’agent dédiée, séparez les évals du portable avec Cloud Mac.
Trois questions avant de choisir
  • Est-ce une montée au sommet, ou dix mille boucles à coût maîtrisé ?
  • L’échec est-il une phrase fausse, ou un mauvais merge ? Seul le second vaut Pro
  • La sortie est-elle du code/JSON ou des pixels ? Les pixels vont à Nano Banana

FAQ

Quel est le dernier modèle Gemini en août 2026 ?

Par date de livraison, le plus récent cheval de labour public est Gemini 3.7 Flash (13 août 2026). Par plafond de raisonnement, le phare reste Gemini 3.1 Pro (Deep Think optionnel). Il n’y a pas de 3.7 Pro livré.

Y a-t-il un Gemini 3.5 Pro ?

Au moment d’écrire, DeepMind indique encore 3.5 Pro coming soon. Ne dessinez pas un 3.5 / 3.6 / 3.7 Pro sur le schéma d’architecture.

L’app Gemini gratuite est-elle en 3.7 ?

Pas forcément. L’offre gratuite montre souvent encore 3.6 Flash ; 3.7 est prioritaire pour Spark payant, l’API et les plateformes d’agents d’entreprise. Faites confiance au sélecteur dans le produit.

Nano Banana est-il le même que Gemini 3.7 ?

Non. Nano Banana est le surnom de la famille Gemini Image. Facturation et appels sont séparés du cheval de labour texte 3.7 Flash. Dans les démos 3.7, ils sont orchestrés ensemble.

Puis-je encore utiliser 2.5 ?

Oui, jusqu’à la fenêtre d’arrêt documentée. Firebase liste 2.5 Pro/Flash/Flash-Lite dès le 16 oct. 2026. Les nouveaux projets devraient utiliser 3.x.

Pour conclure

Trois phrases : le dernier cheval de labour est 3.7 Flash ; le plus fort raisonneur public reste 3.1 Pro ; Flash et Pro ne partagent plus un numéro de version, donc le numéro n’est pas un classement. Écrivez d’abord les rôles (boucle par défaut / montée des cas durs / sidecar d’extraction / images), puis les IDs. Quand 3.5 Pro arrivera vraiment, vous ne changerez que la ligne d’escalade.

Si la coopération de formation Siri–Gemini côté Apple vous intéresse, voir l’aperçu logiciel de l’événement d’automne du 18 août. C’est de la distillation AFM, pas l’app Gemini dans l’iPhone.

Ne partagez pas un Mac entre évals de modèles et travail du quotidien

3.7 Flash vs 3.1 Pro n’a de sens que sur le même harness. Mettez les boucles d’agent sur un Cloud Mac ; gardez le portable pour les diffs.

Voir les offres Cloud Mac

Notes dev · Gemini

Au changement de modèle, lancez le même harness sur un Mac dédié

3.7 Flash · 3.1 Pro · boucles d’agents · Cloud Mac

Voir les offres Cloud Mac
Offre limitée Voir les offres