Gemini 3.8 Flash : date de sortie, actus août 2026, prévisions et JSON API

Au 28 août 2026, Gemini 3.8 Flash n'est pas public. Preview interne, fenêtre probable en septembre, prévisions prudentes face au 3.7, et stabilité de Structured Output / Function Calling.

Réponse courte : au 28 août 2026, Gemini 3.8 Flash n’est pas publié publiquement. Il n’y a pas de model card, pas d’API gemini-3.8-flash documentée, et la doc Flash de Google DeepMind s’arrête toujours à Gemini 3.7 Flash, passé GA le 13 août. La même semaine, Business Insider a indiqué que des employés testent déjà un « Gemini 3.8 Flash Preview » sur la plateforme interne de codage Jetski, et des posts sur X parlent d’une sortie publique « d’ici quelques semaines ». Ce sont des pistes, pas une note de lancement.

L’article précédent, Gemini 3.7 Flash : prix, API et JSON, couvre le modèle Flash que vous pouvez réellement appeler. JSON structuré avec l’API Gemini et OpenAI vs Gemini Structured Output couvrent le contrat Schema. Cet article ne répond qu’à trois questions : quand 3.8 pourrait sortir, où la qualité a des chances d’évoluer, et si la forme de requête JSON / Function Calling va changer.

Déjà sorti ? État au 2026-08-28

Traitez ceci comme une checklist :

  • Produit public : pas sorti. AI Studio / Gemini API / Vertex AI ne listent pas de 3.8 Flash appelable.
  • ID de modèle : pas de gemini-3.8-flash documenté. Mettre cette chaîne en production donnera un 404.
  • Tarifs : non divulgués. Les tableaux qui affirment « 3.8 à la moitié de 3.7 » n’ont aucune source officielle.
  • Workhorse Flash actuel : toujours gemini-3.7-flash, tarif Intro $0.75 / $3.75 par million de tokens input / output jusqu’au 2026-12-31, puis $1.50 / $7.50 à partir du 2027-01-01.

La réponse honnête à « quand est le lancement ? » est donc : Google n’a pas fixé de date publique ; d’après les deux derniers drops Flash, « des semaines, pas l’année prochaine » est le meilleur prior. Le reste de l’article sépare la rumeur du rythme, pour qu’un Preview interne ne soit pas pris pour un GA.

Actualités d’août et force des preuves

Classez par preuves, pas par chaleur des réseaux sociaux.

DateAffirmationSolidité
2026-08-13Gemini 3.7 Flash GA, model card officielle et tarif IntroConfirmé
2026-08-10Un papier Tencent nomme « Gemini 3.8 Flash » comme un des juges LLM (trois jours avant le GA de 3.7)Faible : faute de frappe ou nom interne anticipé
Résultats Q2 2026Sundar Pichai a dit que Flash devrait atterrir près d’un rythme mensuelConfirmé (rythme, pas 3.8 lui-même)
2026-08-27Business Insider : le personnel utilise « Gemini 3.8 Flash Preview » sur Jetski ; Google a refusé de commenterMoyenne-haute : reportage nommé, toujours pas un lancement
2026-08-27Posts X : déjà interne, peut-être public d’ici quelques semaines, qualité niveau Fable 5Faible : pas de model card, pas d’API
Même périodeHypothèses qu’un modèle anonyme Arena AI serait 3.8Faible : identité non vérifiée

Les détails de Business Insider comptent : le libellé interne est Gemini 3.8 Flash Preview, la surface est Jetski, et un testeur a dit que c’était déjà « nettement mieux que 3.7 Flash », tout en soulignant qu’il était trop tôt pour une revue complète. Cela colle au schéma 3.6 → 3.7 — dogfood chez Google, puis GA quelques semaines plus tard.

Les affirmations plus bruyantes sur X (« des mois de tests partenaires », « qualité Fable 5 au prix Flash ») n’ont toujours aucune model card DeepMind ni changelog API derrière elles. Le papier Tencent mentionne « 3.8 » une seule fois. Les deux explications ennuyeuses restent les meilleures : une faute de version, ou une équipe d’éval qui a touché un endpoint non publié. Un mot dans un papier n’est pas un calendrier de sortie.

Comment lire la fenêtre de lancement

Google n’a pas publié de date pour 3.8. Les seuls intervalles dont vous disposez sont ceux de la ligne Flash elle-même :

  • Gemini 3.6 Flash : GA fin juillet 2026 (même vague que 3.5 Flash-Lite).
  • Gemini 3.7 Flash : GA le 2026-08-13, environ trois semaines après 3.6.
  • Pichai lors de l’appel Q2 : Flash devrait rester proche du mensuel.
  • Un Preview 3.8 était sur une plateforme interne dès le 27 août — essai employés, pas « ça sort la semaine prochaine ».

Si le rythme de trois à quatre semaines tient, un Developer Preview ou un GA public a plus de chances de tomber début à mi-septembre 2026 que d’arriver en sidecar de Gemini 4. Le pré-entraînement de Gemini 4 a été confirmé comme démarré le 2026-07-21, sans fenêtre de lancement ; « 3.8 avant Gemini 4 » est une barre basse, parce que le flagship est plus lent par conception.

Intégrez aussi « ça ne sort jamais sous le nom 3.8 » : un Preview interne peut se fondre dans un refresh silencieux de 3.7, ou revenir sous un autre nom. Ne faites pas de 3.8 une dépendance de jalon. Gardez la chaîne de modèle dans la config et laissez le trafic sur 3.7.

3.7 Flash vs le 3.8 rumoré

ÉlémentGemini 3.7 Flash (confirmé)Gemini 3.8 Flash (non confirmé)
StatutGA 2026-08-13Preview interne rapporté ; pas d’API publique
ID de modèlegemini-3.7-flashNon documenté ; ne pas le mettre en prod
Tarif Intro$0.75 / $3.75 par million de tokens jusqu’au 2026-12-31Non divulgué
Standard 2027$1.50 / $7.50Non divulgué
Contexte~1M en entrée / ~64k en sortieNon divulgué ; Flash garde en général la fenêtre
DeepSWE v1.165,3 % (3.6 : 49,0 %)Pas de score officiel
PositionnementWorkhorse pour le codage et les agentsRumeur : plus proche du flagship, toujours au prix Flash

La colonne de droite vide est le propos : le seul Flash que vous pouvez emmener dans une revue d’architecture aujourd’hui, c’est 3.7. Son tarif Intro est déjà un ordre de grandeur sous Claude Fable 5 à $10 / $50. Même si 3.8 referme une partie de l’écart de qualité, le modèle par défaut se choisit encore au coût par tâche multiplié par les relances — pas à un score Arena anonyme.

Perspectives de performance (d’après 3.6→3.7, pas de scores inventés)

Sans bench public, n’inventez pas de pourcentages 3.8. Ce que vous pouvez extrapoler, c’est la direction que 3.6 → 3.7 a déjà payée, plus la remarque interne « nettement mieux que 3.7 » :

  • Agents / outils multi-étapes : 3.7 vs 3.6 a fait passer DeepSWE de 49,0 % à 65,3 % et AutomationBench de 17,0 % à 30,4 %. Si le prochain saut reste un workhorse, le gain est moins de relances d’outils inutiles, pas un nouveau titre sur la fenêtre de contexte.
  • Codage : FrontierCode 1.1 Main est passé de 34,4 % à 43,6 %. Placer le Preview sur Jetski (une surface de codage) signale que Flash reste le moteur par défaut pour écrire et corriger du code, pas une peau de chat.
  • Documents longs et extraction : les scores de travail de connaissance comme GDP.pdf sont passés de 22,0 % à 34,0 %. Pour l’extraction JSON, cela veut souvent dire moins de champs imbriqués, d’enums et de longueurs de tableaux qui dérivent — attendez le GA et relancez le même Schema ; ne l’écrivez pas trop tôt dans un SLA.
  • Latence et prix : la promesse produit de Flash, c’est bon marché, rapide, et appelable des milliers de fois par jour. Si 3.8 cassait ça (un Pro déguisé), les équipes resteraient au tarif Intro de 3.7. La prévision la plus sûre : prix de gamme Flash, qualité visée sur les points faibles de 3.7.

Comparer « qui est plus intelligent » à Claude Fable 5 ($10 / $50) est le mauvais cadre. Comparer « moins d’allers-retours d’outils sur le même Schema » à 3.7 est le bon. Traitez chaque prévision comme une hypothèse jusqu’à ce qu’une model card existe.

Aperçu JSON de l’API

C’est la couche qui intéresse vraiment la série. De Gemini 2.5 à 3.7, Structured Output et Function Calling ont gardé presque la même forme de requête : la chaîne de modèle et le comportement ont changé, pas les noms de champs. Si 3.8 est un incrément de 3.7, l’aperçu stable est la compatibilité, pas une nouvelle API JSON.

Structured Output : gardez le Schema, ne pariez pas sur un nouvel interrupteur

Le schéma 3.7 d’aujourd’hui s’appliquera presque certainement encore après le GA de 3.8 : response_mime_type=application/json plus response_schema (Pydantic) ou response_json_schema (un dict JSON Schema). Le décodage contraint bloque les tokens illégaux à la génération — le même chemin que le guide JSON Gemini et Du prompt au Structured Output.

from google import genai
from pydantic import BaseModel, Field

# Do not point production at an undocumented 3.8 ID before GA.
# After GA you typically change this one string; Schema and checks stay put.
MODEL = "gemini-3.7-flash"

class ExtractedTask(BaseModel):
    title: str
    priority: str = Field(description="low | medium | high")
    due_date: str | None = None

client = genai.Client()
response = client.models.generate_content(
    model=MODEL,
    contents="Extract the action item: finish the budget review by next Friday, high priority.",
    config={
        "response_mime_type": "application/json",
        "response_schema": ExtractedTask,
    },
)
print(response.parsed)

Espoirs raisonnables pour 3.8 : un meilleur taux au premier passage sur les objets imbriqués, les champs optionnels, les enums et les tableaux ; moins de chain-of-thought qui fuit quand thinking et JSON sont tous les deux actifs. N’espérez pas le JSON Schema 2020-12 complet (les limites de sous-ensemble de Gemini sur additionalProperties, prefixItems et consorts sont dans l’article de comparaison), ni que « JSON de réponse finale » et « JSON d’arguments d’outil » fusionnent en un seul bouton.

Function Calling : le Schema d’outil reste le contrat

Côté outils, c’est toujours tools plus un JSON Schema parameters, un functionCall du modèle, puis exécution côté hôte et un tour de suivi. L’argument de vente de 3.7 était des plans multi-étapes plus rigoureux ; si le dogfood 3.8 est vraiment « nettement meilleur », cherchez d’abord moins de mauvais outils, moins de champs required oubliés, moins de boucles vides sur le même outil. Le inputSchema MCP doit toujours coller à la déclaration, sinon le modèle « réussit » et le serveur refuse — indépendamment de 3.8. Voir Tool Calling → flux de données MCP.

from google import genai
from google.genai import types

lookup_order = types.FunctionDeclaration(
    name="lookup_order",
    description="Return shipment status for an order id",
    parameters={
        "type": "object",
        "properties": {
            "order_id": {"type": "string", "description": "Order id, e.g. GW-20260828"}
        },
        "required": ["order_id"],
    },
)

client = genai.Client()
response = client.models.generate_content(
    model="gemini-3.7-flash",
    contents="Has GW-20260828 shipped yet?",
    config=types.GenerateContentConfig(
        tools=[types.Tool(function_declarations=[lookup_order])],
    ),
)
Rôle JSONAujourd’hui (3.7)Aperçu 3.8
Réponse finale / extractionresponseMimeType + SchemaNoms de champs probablement inchangés ; surveillez le taux au premier passage
Arguments d’outiltools[].parametersMoins de relances et de dérives de type ; ne relâchez pas le contrat
MCPinputSchema aligné sur l’outilIndépendant du saut de modèle ; gardez la validation locale

Gardez deux portes : json.loads plus le même JSON Schema, puis vos invariants (montants, enums, fuseaux). Déposez les sorties d’exemple dans la boîte à outils JSON pour un Diff local — pas d’upload. 3.7 et un futur 3.8 doivent partager les mêmes fixtures, sinon vous ne saurez pas s’il est vraiment plus stable.

Que faire maintenant

  1. Garder la production sur 3.7 Flash : gemini-3.7-flash au tarif Intro, modèle par défaut dans la config, pas de littéraux éparpillés.
  2. Ne pas réserver un ID 3.8 fictif : un nom de Preview interne n’est pas un argument SDK. Ajoutez une ligne de fallback seulement quand AI Studio / la card DeepMind le listent.
  3. Finir d’abord les fixtures JSON : les mêmes prompts via Structured Output et Tool Calling, vérifiés localement contre le Schema. Quand 3.8 passera GA, relancez une fois avec une nouvelle chaîne de modèle.
  4. Mettre en cache System + tools : placez le prompt système de l’agent et la liste d’outils sur Context Caching. Les lectures cache Intro de 3.7 tournent autour de $0.075 / 1M tokens.
  5. Budgétiser aux tarifs standard 2027 : même si 3.8 arrive avec un nouveau tarif Intro, 3.7 lui-même double le 2027-01-01. Ne faites pas dépendre une facture Q1 d’un SKU moins cher rumoré.
  6. Ne regarder que les canaux officiels : la card Flash DeepMind, le changelog de l’API Gemini, la liste de modèles Vertex. Les fuites X et les modèles Arena anonymes ne sont pas un calendrier.

FAQ

Quand Gemini 3.8 Flash sera-t-il publié ?

Google n’a pas publié de date. Compte tenu de l’écart d’environ trois semaines entre 3.6 et 3.7 et du rythme Flash quasi mensuel évoqué par le CEO, une fenêtre publique début à mi-septembre 2026 est le meilleur prior si le Preview interne se passe bien. Ce n’est pas un engagement et ne doit pas servir de deadline de projet.

Puis-je appeler gemini-3.8-flash aujourd’hui ?

Non. Au 28 août 2026, il n’y a pas d’API publique, d’ID de modèle SDK ni de model card DeepMind. Utilisez gemini-3.7-flash en production.

Un Preview interne veut-il dire que le GA est imminent ?

Non. Business Insider a confirmé que le personnel a vu Gemini 3.8 Flash Preview sur Jetski ; Google a refusé de commenter. Le dogfood peut passer GA en quelques semaines, ou être renommé ou réintégré dans 3.7. Lisez-le comme « en cours », pas « planifié ».

3.8 sera-t-il plus fort et moins cher que 3.7 ?

Il n’y a ni bench officiel ni grille tarifaire. Les gains de 3.7 sur 3.6 étaient dans les outils multi-étapes et le codage ; un testeur interne a dit du Preview 3.8 qu’il était « nettement mieux que 3.7 », ce qui ne se généralise pas. Le tarif a plus de chances de rester dans la gamme Flash que de sauter aux prix catalogue flagship.

Structured Output / Function Calling changeront-ils d’API avec 3.8 ?

L’habitude 2.5→3.7 : nouvel ID de modèle, mêmes champs de requête — response_mime_type, response_schema / response_json_schema, tools.parameters. Traitez d’abord un incrément Flash comme compatible, puis testez en régression le même Schema le jour du GA.

Dois-je attendre 3.8 avant d’adopter Structured Output ?

Non. Le contrat JSON Schema, une seconde passe de validation et le rejeu d’erreurs ne dépendent pas d’une version mineure Flash. Passez la pipeline au vert sur 3.7 ; 3.8 est un échange de chaîne de modèle.

À retenir

Gemini 3.8 Flash n’a pas été lancé. Au 28 août 2026, les faits confirmés sont : 3.7 Flash est en production, le tarif Intro tient toujours, et un Preview interne 3.8 circule déjà. Le rythme Flash des deux derniers mois pointe vers « des semaines autour de septembre », pas vers « attendre Gemini 4 ». Performance et prix n’ont pas encore de model card ; la seule prévision honnête suit le vecteur agents et codage de 3.6→3.7.

L’histoire JSON côté API n’a pas changé : Structured Output possède la forme finale, Function Calling les arguments d’outil, les deux utilisent JSON Schema. Fixtures et validation locale aujourd’hui valent mieux qu’un calendrier de fuites. Quand 3.8 apparaîtra sur la liste officielle de modèles, relancez le même Schema une fois.