Réponse courte : au 2 septembre 2026, Gemini 3.8 Flash n’est toujours pas publié publiquement. AI Studio, l’API Gemini et Vertex AI ne listent pas de gemini-3.8-flash appelable, et la card DeepMind s’arrête toujours à Gemini 3.7 Flash, passé GA le 13 août. Le même jour, plusieurs médias et comptes de fuites ont nommé mercredi comme date publique, avec le nom de code interne skimaki et l’affirmation que le déploiement en production est « terminé ». Ce sont des pistes, pas une note de lancement.
L’article du 28 août, Gemini 3.8 Flash : fenêtre de lancement et aperçu JSON de l’API, a déjà couvert la compatibilité Structured Output / Function Calling. Gemini 3.7 Flash : prix, API et JSON est le modèle Flash que vous pouvez réellement appeler. Cet article n’ajoute que trois choses : les actus autour du 2 septembre, comment lire la date de sortie, et où 3.8 a des chances d’évoluer sur le codage IA.
Déjà sorti ? État au 2026-09-02
Traitez ceci comme une checklist :
- Produit public : pas sorti. AI Studio / Gemini API / Vertex AI ne listent pas de 3.8 Flash appelable.
- ID de modèle : pas de
gemini-3.8-flashdocumenté. Mettre une chaîne issue d’une fuite en production donnera un 404. - Prix et contexte : non divulgués. Les tableaux communautaires qui affirment une fenêtre de 1M tokens ou « la moitié de 3.7 » n’ont aucune source officielle.
- Workhorse Flash actuel : toujours
gemini-3.7-flash, tarif Intro $0.75 / $3.75 par million de tokens input / output jusqu’au 2026-12-31, puis $1.50 / $7.50 à partir du 2027-01-01.
La réponse honnête à « quand est le lancement ? » est donc : Google n’a pas fixé de date publique ; aujourd’hui, c’est le mercredi rumoré, pas le mercredi du calendrier. Le reste de l’article sépare les pistes des 1–2 septembre du rythme d’août, pour que « déploiement en production terminé » ne soit pas pris pour un GA.
Actualités de septembre et force des preuves
Classez par preuves, pas par la chaleur du « ça sort demain ».
| Date | Affirmation | Solidité |
|---|---|---|
| 2026-08-13 | Gemini 3.7 Flash GA, model card officielle et tarif Intro | Confirmé |
| Résultats Q2 2026 | Sundar Pichai a dit que Flash devrait atterrir près d’un rythme mensuel | Confirmé (rythme, pas 3.8 lui-même) |
| 2026-08-27 | Business Insider : le personnel utilise « Gemini 3.8 Flash Preview » sur Jetski ; Google a refusé de commenter | Moyenne-haute : reportage nommé, toujours pas un lancement |
| 2026-08-10 | Un papier Tencent nomme « Gemini 3.8 Flash » comme un des juges LLM (trois jours avant le GA de 3.7) | Faible : faute de frappe ou nom interne anticipé |
| 2026-09-01 | Fuites : nom de code interne skimaki, déploiement en production terminé, date publique pointée sur mercredi 2 septembre | Faible à moyenne : reprises de seconde main, pas de model card, pas de changelog API |
| 2026-09-02 | Au moment où nous écrivons, les canaux officiels n’ont toujours ni card 3.8 ni endpoint appelable | Confirmé (le fait « pas sorti » lui-même) |
La vague du 1er septembre a ajouté trois mots nouveaux à l’histoire du 27 août : skimaki (nom de code interne), déploiement en production terminé et public mercredi. CryptoBriefing, 4sAPI et d’autres en ont fait « Google le dévoilera le 2 septembre ». À noter : l’avance de la communauté des fuites sur les récents mineurs Flash n’a pas été mauvaise. « Déploiement terminé » chez Google peut encore ne vouloir dire que du dogfood employés, pas un Developer Preview public.
Le retour des premiers testeurs reste une ligne subjective : « nettement mieux que 3.7 Flash », avec la réserve qu’une revue complète est trop tôt. Le nouveau détail technique est plus précis : sortie moins verbeuse (une plainte de longue date sur Flash) et des correctifs pour les modes de défaillance que 3.7 a exposés. Ce n’est pas un changement de génération — ça ressemble à un autre incrément de deux à trois semaines dans le style 3.6→3.7.
Les affirmations plus bruyantes sur X (« qualité Fable 5 au prix Flash », « des mois de tests partenaires ») n’ont toujours aucune model card DeepMind ni changelog API. Un « 3.8 » dans un papier, ou un modèle Arena anonyme, n’est pas un calendrier de sortie.
Comment lire la date de lancement
Google n’a pas publié de date pour 3.8. Les seuls intervalles dont vous disposez sont ceux de la ligne Flash elle-même, plus la rumeur du mercredi d’aujourd’hui :
- Gemini 3.6 Flash : GA vers le 21 juillet 2026.
- Gemini 3.7 Flash : GA le 2026-08-13, environ trois semaines après 3.6.
- Preview 3.8 : déjà sur Jetski dès le 27 août, seulement 14 jours après le GA de 3.7.
- Pichai lors de l’appel Q2 : Flash devrait rester proche du mensuel.
- Fuites du 1er septembre : date publique pointée sur mercredi 2 septembre. Ça tombe aussi sur la ligne « environ trois semaines après 3.7 » (2–4 septembre).
Empilez tout ça et la fenêtre publique reste début à mi-septembre 2026. Aujourd’hui (2 septembre) est le bord gauche de cette fenêtre, pas une deadline. Si mercredi passe sans model card, la meilleure lecture est « la fenêtre est encore ouverte », pas « 3.8 est mort ». Un Preview interne peut encore se fondre dans un refresh silencieux de 3.7, ou revenir sous un autre nom.
Ne faites pas de 3.8 une dépendance de jalon. Gardez la chaîne de modèle dans la config et laissez le trafic coding / agents sur 3.7. Ajoutez une ligne de fallback seulement quand AI Studio / la card DeepMind le listent.
Pourquoi le codage IA : Jetski n’est pas une fenêtre de chat
La porte interne de 3.8, c’est Jetski — la plateforme de codage de Google, pas une fenêtre de chat générique. Ça en dit plus sur l’intention produit que n’importe quel slogan « niveau Fable 5 » : la ligne Flash est censée être le moteur par défaut pour écrire du code, corriger des issues et faire tourner des agents, en dogfood sur de vrais repos internes avant qu’une date publique soit choisie.
Ça explique aussi pourquoi le rythme est compressé à deux ou trois semaines. Le flagship (le pré-entraînement de Gemini 4 a démarré le 2026-07-21, sans fenêtre de lancement) tourne sur un cycle long. Flash absorbe de petits ajustements d’algo, du post-training, des curricula d’outils et des rustines de modes de défaillance. Logan Kilpatrick a décrit 3.6→3.7 comme « clever algorithmic tweaks, not a full retrain. » 3.8 suivra probablement le même chemin.
Pour ceux qui livrent du code, ça veut dire deux choses. Premièrement, 3.8 se jouera sur les patches au premier passage, les tests verts et moins de boucles d’outils gaspillées — pas sur les scores de chat Arena. Deuxièmement, la forme d’API reste probablement en place ; ce qui change, c’est le taux de succès et le total de tokens sur les mêmes tâches de repo. L’article précédent a déjà dit que les champs Structured Output ne seront pas renommés. Celui-ci prend les tâches de coding comme étalon.
Les scores de coding que 3.7 Flash a déjà payés
Sans bench officiel 3.8, n’inventez pas de pourcentages. La baseline, ce sont les scores de coding et d’agents que 3.6 → 3.7 a déjà mis sur une model card :
| Indicateur | 3.6 Flash | 3.7 Flash (confirmé) | Ce qu’il mesure |
|---|---|---|---|
| FrontierCode 1.1 Main | 34.4% | 43.6% (+9.2pp) | Jeu principal de coding au niveau repo |
| DeepSWE v1.1 | 49.0% | 65.3% (+16.3pp) | Agents d’ingénierie logicielle |
| AutomationBench | 17.0% | 30.4% (+13.4pp) | Automatisation multi-étapes |
| WebDev Arena Elo | — | 1588 | UI navigateur / implémentation interactive |
| Positionnement | Flash généraliste, bon marché et rapide | Workhorse pour le coding et les agents | Si 3.8 reste sur cette ligne, il devrait continuer à corriger les points faibles |
Ces sauts ne sont pas du polish de chat. Ils montrent que le budget d’entraînement Flash est déjà assis sur les patches, les outils et le travail multi-étapes. Quand 3.8 apparaît, gardez la même règle : succès des patch-edits, taux de réussite des cas de test, recovery après un appel d’outil raté, suivi d’instructions multi-tours, et tokens totaux pour fermer un issue. Qu’une seule réponse « paraisse plus intelligente » ne suffit pas.
Le coût n’est pas que le prix catalogue par million. Le coding agent relit des fichiers, relance des tests et s’auto-corrige ; un issue coûte souvent plusieurs fois un tour Q&A. Flash concurrence sur « prix × latence pour fermer un issue », pas sur un score Arena anonyme. Le tarif Intro de 3.7 est déjà un ordre de grandeur sous Claude Fable 5 à $10 / $50. Même si 3.8 est un peu plus tranchant, le modèle par défaut se choisit encore au coût par tâche multiplié par les relances.
Perspectives de codage IA pour 3.8
Ce sont des hypothèses, pas des scores. Les seuls inputs sont le vecteur 3.6→3.7, le dogfood Jetski, et les deux lignes de fuite : moins de remplissage, boucher les trous de 3.7.
Plus probable
- Sortie plus courte, plus proche d’un patch : on reproche depuis longtemps à Flash de se présenter avant de changer trois lignes. Si 3.8 réduit vraiment la verbosité, les jobs de coding économisent des tokens de sortie et polluent moins de diffs. C’est le saut le moins cher, et il colle au libellé des fuites.
- Un aller-retour d’outil gaspillé en moins : les gains DeepSWE / AutomationBench de 3.7 disaient déjà que le « multi-étapes » est l’attaque principale. Si le prochain saut reste un workhorse, le gain est moins de mauvais outils, moins de champs required oubliés, moins de boucles vides sur la même commande de test — pas un nouveau titre 1M tokens.
- Une hausse modeste des patches au premier passage : après FrontierCode passé de 34.4% à 43.6%, 3.8 ressemble à quelques points de plus, pas à un saut flagship. « Nettement mieux que 3.7 » est une direction, pas une licence d’écrire « Fable 5 ».
- Même forme d’API : les agents de coding passent toujours les arguments JSON via
tools.parameters; les patches structurés utilisent toujoursresponse_mime_typeplus un Schema. Traitez d’abord un mineur Flash comme compatible ; le jour du GA, échangez la chaîne de modèle et relancez les mêmes fixtures. Les détails sont dans l’aperçu JSON de l’API. - Le prix reste dans la gamme Flash : casser « bon marché, rapide, des milliers d’appels par jour » pousserait les équipes à rester au tarif Intro de 3.7. La prévision la plus sûre : prix unitaire de gamme Flash, qualité visée sur les points faibles coding de 3.7.
Peu probable, ou sans preuves
- « Qualité Fable 5 au prix Flash » : pas de bench officiel. 3.7 lui-même n’a jamais franchi cette bande ; un essai interne n’est pas une grille tarifaire.
- Une API de coding ou un protocole repo tout neufs : de 2.5 à 3.7, la chaîne de modèle et le comportement ont changé, pas les noms de champs. 3.8 n’a aucune raison d’en inventer une d’abord.
- Gagner le coding sur une fenêtre de 1M tokens : la communauté dit que 3.8 garde une fenêtre 1M ; ce n’est pas vérifié. Même si c’est le cas, les goulets du coding sont en général dans la boucle d’outils et le feedback des tests, pas dans la pub sur la fenêtre.
- L’utiliser comme défaut de production aujourd’hui : tout changement de config « mercredi c’est GA » avant une model card est un incident.
from google import genai
from google.genai import types
# Do not point production at an undocumented 3.8 ID before GA.
# Coding-agent fixtures should pin to repo tasks, not chat scores.
MODEL = "gemini-3.7-flash"
run_tests = types.FunctionDeclaration(
name="run_tests",
description="Run tests at a path and return a failure summary",
parameters={
"type": "object",
"properties": {
"path": {"type": "string", "description": "Test target, e.g. tests/test_parser.py"},
"max_fail": {"type": "integer", "description": "Max failures to return"}
},
"required": ["path"],
},
)
client = genai.Client()
response = client.models.generate_content(
model=MODEL,
contents="parser raises KeyError on empty objects; run tests/test_parser.py, then a minimal patch.",
config=types.GenerateContentConfig(
tools=[types.Tool(function_declarations=[run_tests])],
),
)
C’est la forme sur laquelle 3.8 doit être comparé : le même issue, les mêmes outils, les mêmes tests. Ce qui compte, c’est moins d’allers-retours d’outils, moins de remplissage, et un patch qui s’applique encore. « Qui est plus intelligent » face à Claude Fable 5 est le mauvais cadre.
Comment valider un workflow de coding
Quand 3.8 arrive sur la liste officielle, sautez le communiqué et lancez votre propre repo. Coupez la fixture en quatre cases :
| Case | Ce que vous mesurez | Où 3.8 devrait battre 3.7 |
|---|---|---|
| Patch-edit | Devant un test qui échoue, peut-il émettre un diff minimal applicable | Meilleur taux au premier passage, moins de fichiers non liés touchés |
| Boucle d’outils | Lire le fichier → éditer → lancer les tests → lire l’échec | Moins de mauvais outils, moins de boucles vides, moins de champs required oubliés |
| Suivi d’instructions | « ne toucher que le parser, pas de réécriture » tient-il | Toujours sur les rails après plusieurs tours |
| Compte | Tokens input+output et temps wall-clock pour fermer un issue | Une sortie plus courte devrait baisser la facture ; si les tokens montent, un « meilleur ressenti » peut être une perte |
Les arguments d’outil restent du JSON. Si le modèle « réussit » à remplir les paramètres et que la commande de test déraille quand même, le Schema est probablement trop lâche — pas « 3.8 n’est pas assez intelligent ». Gardez deux portes : json.loads plus le même JSON Schema, puis vos invariants (chemins, timeouts, max failures). Déposez les sorties d’exemple dans la boîte à outils JSON pour un Diff local — pas d’upload. 3.7 et un futur 3.8 doivent partager les mêmes fixtures, sinon vous ne saurez pas s’il est vraiment plus stable. Voir Tool Calling et validation JSON Schema et Tool Calling → flux de données MCP.
Que faire maintenant
- Garder la production sur 3.7 Flash :
gemini-3.7-flashau tarif Intro, modèle par défaut dans la config. N’écrivez pas d’avancegemini-3.8-flashni skimaki. - Finir d’abord les fixtures de coding : 10–30 vrais issues (patches, tests, contraintes multi-tours). Quand 3.8 passera GA, relancez une fois avec une nouvelle chaîne de modèle.
- Enregistrer le total de tokens, pas seulement « ça paraît mieux » : la facture d’un agent se joue sur le nombre de boucles, pas sur le prix catalogue d’un tour.
- Mettre en cache System + tools : placez le prompt système de l’agent et la liste d’outils sur Context Caching. Les lectures cache Intro de 3.7 tournent autour de $0.075 / 1M tokens.
- Budgétiser aux tarifs standard 2027 : même si 3.8 arrive avec un nouveau tarif Intro, 3.7 lui-même double le 2027-01-01.
- Ne regarder que les canaux officiels : la card Flash DeepMind, le changelog de l’API Gemini, la liste de modèles Vertex. Les rumeurs du mercredi et les modèles Arena anonymes ne sont pas un calendrier.
FAQ
Quand Gemini 3.8 Flash sera-t-il publié ?
Google n’a pas publié de date. Les fuites ont pointé le jour public sur mercredi 2 septembre 2026, avec le nom de code interne skimaki et « déploiement en production terminé ». Compte tenu de l’écart d’environ trois semaines entre 3.6 et 3.7 et du rythme Flash quasi mensuel évoqué par le CEO, la fenêtre publique reste début à mi-septembre. Aujourd’hui est le bord gauche de cette fenêtre, pas un engagement, et ne doit pas servir de deadline de projet.
Puis-je appeler gemini-3.8-flash aujourd’hui ?
Non. Au 2 septembre 2026, il n’y a pas d’API publique, d’ID de modèle SDK ni de model card DeepMind. Utilisez gemini-3.7-flash en production.
« Déploiement en production terminé » veut-il dire que le GA est imminent ?
Non. Un déploiement interne peut ne servir que le dogfood employés sur Jetski. Business Insider a confirmé un Preview ; Google a refusé de commenter. Le dogfood peut passer GA en quelques semaines, ou être renommé ou réintégré dans 3.7.
De combien 3.8 sera-t-il meilleur que 3.7 en codage IA ?
Il n’y a pas de bench officiel. Ce que vous pouvez extrapoler, c’est le vecteur coding / agents que 3.6→3.7 a déjà payé, plus « moins de remplissage, boucher les trous de 3.7 ». Vous avez plus de chances de voir des patches plus courts et moins de boucles d’outils gaspillées qu’un Fable 5 soudain. Le jour de la sortie, fiez-vous à la model card et à vos propres fixtures de repo.
Dois-je attendre 3.8 avant de mettre en production un agent de coding ?
Non. Le Schema d’outil, les fixtures de test et le rejeu d’erreurs ne dépendent pas d’une version mineure Flash. Passez la pipeline au vert sur 3.7 ; 3.8 est un échange de chaîne de modèle.
3.8 changera-t-il l’API liée au coding ?
L’habitude 2.5→3.7 : nouvel ID de modèle, mêmes champs de requête. Les agents de coding continuent d’utiliser tools.parameters ; les patches structurés continuent d’utiliser response_schema / response_json_schema. Supposez d’abord la compatibilité, puis testez en régression le jour du GA.
À retenir
Gemini 3.8 Flash n’a pas été lancé. Au 2 septembre 2026, les faits confirmés sont : 3.7 Flash est en production, le tarif Intro tient toujours, un Preview interne tourne sur Jetski depuis une semaine, et les fuites ont nommé aujourd’hui comme date publique. Le rythme Flash des deux derniers mois pointe vers « ces jours de début septembre jusqu’à mi-mois », pas vers « attendre Gemini 4 ». Sans model card aujourd’hui, traitez « mercredi » comme le bord gauche de la fenêtre, pas comme une deadline.
Sur le codage IA, 3.8 ressemble à un patch des points faibles de 3.7 : sortie plus courte, moins de boucles vides, une hausse modeste des diffs au premier passage. Prenez les tâches de repo comme étalon, pas Arena. La forme de requête JSON / Function Calling a peu de chances de changer — c’était l’article précédent. Fixtures et validation locale aujourd’hui valent mieux qu’un calendrier de fuites. Quand 3.8 apparaîtra sur la liste officielle de modèles, relancez les mêmes issues une fois.