Kurze Antwort: Stand 28. August 2026 ist Gemini 3.8 Flash nicht öffentlich veröffentlicht. Es gibt keine Modellkarte, keine dokumentierte gemini-3.8-flash API, und die Flash-Docs von Google DeepMind enden weiterhin bei Gemini 3.7 Flash, das am 13. August GA ging. In derselben Woche berichtete Business Insider, dass Mitarbeiter auf der internen Coding-Plattform Jetski bereits ein „Gemini 3.8 Flash Preview“ ausprobieren, und auf X ist von einem öffentlichen Drop „in wenigen Wochen“ die Rede. Das sind Hinweise, keine Release-Notes.
Der vorherige Artikel, Gemini 3.7 Flash: Preise, API und JSON, behandelt das Flash-Modell, das Sie tatsächlich aufrufen können. Strukturiertes JSON mit der Gemini API und OpenAI vs Gemini Structured Output decken den Schema-Vertrag ab. Dieser Artikel beantwortet nur drei Fragen: wann 3.8 kommen könnte, wohin die Qualität wahrscheinlich wandert, und ob sich die Request-Form von JSON / Function Calling ändert.
Schon veröffentlicht? Stand 2026-08-28
Nehmen Sie das als Checkliste:
- Öffentliches Produkt: nicht veröffentlicht. AI Studio / Gemini API / Vertex AI listen kein aufrufbares 3.8 Flash.
- Modell-ID: kein dokumentiertes
gemini-3.8-flash. Diese Zeichenkette in Produktion zu setzen, endet mit 404. - Preise: nicht offengelegt. Tabellen, die „3.8 zum halben 3.7-Preis“ behaupten, haben keine offizielle Quelle.
- Aktuelles Flash-Workhorse: weiterhin
gemini-3.7-flash, Intro-Preis $0.75 / $3.75 pro Million Input- / Output-Token bis 2026-12-31, danach $1.50 / $7.50 ab 2027-01-01.
Die ehrliche Antwort auf „Wann kommt der Launch?“ lautet also: Google hat kein öffentliches Datum gesetzt; nach den letzten zwei Flash-Drops ist „Wochen, nicht nächstes Jahr“ die bessere Vorannahme. Der Rest dieses Artikels trennt Gerücht von Takt, damit ein internes Preview nicht mit GA verwechselt wird.
August-Nachrichten und wie stark die Belege sind
Rangfolge nach Beleglage, nicht nach Social-Media-Hitze.
| Datum | Aussage | Stärke |
|---|---|---|
| 2026-08-13 | Gemini 3.7 Flash GA, offizielle Modellkarte und Intro-Preise | Bestätigt |
| 2026-08-10 | Ein Tencent-Paper nennt „Gemini 3.8 Flash“ als einen LLM-Judge (drei Tage vor 3.7 GA) | Schwach: Tippfehler oder früher interner Name |
| Q2 2026 Earnings | Sundar Pichai sagte, Flash solle nahe an einem monatlichen Takt landen | Bestätigt (Takt, nicht 3.8 selbst) |
| 2026-08-27 | Business Insider: Mitarbeiter nutzen „Gemini 3.8 Flash Preview“ auf Jetski; Google lehnte eine Stellungnahme ab | Mittelhoch: namentliche Berichterstattung, immer noch kein Launch |
| 2026-08-27 | X-Posts: bereits intern, vielleicht in Wochen öffentlich, Qualität auf Fable-5-Niveau | Schwach: keine Modellkarte, keine API |
| Gleicher Zeitraum | Vermutungen, ein anonymes Arena AI-Modell sei 3.8 | Schwach: Identität nicht verifiziert |
Die Details von Business Insider zählen: das interne Label lautet Gemini 3.8 Flash Preview, die Oberfläche ist Jetski, und ein Tester sagte, es fühle sich bereits „spürbar besser als 3.7 Flash“ an — betonte aber, für eine volle Bewertung sei es zu früh. Das passt zum Muster 3.6 → 3.7: zuerst Dogfood bei Google, dann GA ein paar Wochen später.
Die lauteren X-Behauptungen („monatelange Partner-Tests“, „Fable-5-Qualität zum Flash-Preis“) haben nach wie vor keine DeepMind-Modellkarte und keinen API-Changelog hinter sich. Das Tencent-Paper erwähnt „3.8“ einmal. Die zwei langweiligen Erklärungen bleiben die besten: ein Versions-Tippfehler — oder ein Eval-Team, das einen unveröffentlichten Endpoint getroffen hat. Ein Wort in einem Paper ist kein Ship-Kalender.
Wie sich das Release-Fenster lesen lässt
Google hat kein 3.8-Datum veröffentlicht. Die einzigen Intervalle, die Sie nutzen können, sind die der Flash-Linie selbst:
- Gemini 3.6 Flash: Ende Juli 2026 GA (gleiche Welle wie 3.5 Flash-Lite).
- Gemini 3.7 Flash: GA am 2026-08-13, etwa drei Wochen nach 3.6.
- Pichai im Q2-Call: Flash solle nahe am Monatsrhythmus bleiben.
- Ein 3.8 Preview lag am 27. August auf einer internen Plattform — Mitarbeiter-Trial, nicht „es shippt nächste Woche“.
Wenn der Drei-bis-vier-Wochen-Rhythmus hält, ist ein öffentliches Developer Preview oder GA eher Anfang bis Mitte September 2026 zu erwarten als als Beilage zu Gemini 4. Das Pre-Training von Gemini 4 wurde für den 2026-07-21 als gestartet bestätigt, ohne Launch-Fenster; „3.8 vor Gemini 4“ ist eine niedrige Hürde, weil das Flaggschiff konstruktionsbedingt langsamer kommt.
Rechnen Sie auch „kommt nie als 3.8“ ein: ein internes Preview kann in ein stilles 3.7-Refresh einfließen oder unter anderem Namen zurückkommen. Machen Sie 3.8 nicht zur Meilenstein-Abhängigkeit. Halten Sie den Modell-String in der Config und lassen Sie den Traffic auf 3.7.
3.7 Flash vs. das gerüchtete 3.8
| Eintrag | Gemini 3.7 Flash (bestätigt) | Gemini 3.8 Flash (unbestätigt) |
|---|---|---|
| Status | GA 2026-08-13 | Internes Preview berichtet; keine öffentliche API |
| Modell-ID | gemini-3.7-flash | Undokumentiert; nicht in Produktion nehmen |
| Intro-Preis | $0.75 / $3.75 pro Million Token bis 2026-12-31 | Nicht offengelegt |
| Standard 2027 | $1.50 / $7.50 | Nicht offengelegt |
| Kontext | ~1M Input / ~64k Output | Nicht offengelegt; Flash behält das Fenster meist bei |
| DeepSWE v1.1 | 65,3 % (3.6: 49,0 %) | Kein offizieller Score |
| Positionierung | Workhorse für Coding und Agents | Gerücht: näher am Flaggschiff, weiter Flash-Preis |
Die leere rechte Spalte ist die Aussage: das einzige Flash, das Sie heute in ein Architektur-Review mitnehmen können, ist 3.7. Der Intro-Preis liegt bereits eine Größenordnung unter Claude Fable 5 mit $10 / $50. Selbst wenn 3.8 einen Teil dieser Qualitätslücke schließt, entscheidet über das Default-Modell weiter Kosten-pro-Task mal Retries — nicht ein anonymer Arena-Score.
Leistungsausblick (von 3.6→3.7, keine erfundenen Scores)
Ohne öffentlichen Bench erfinden Sie keine 3.8-Prozentsätze. Extrapolieren können Sie die Richtung, die 3.6 → 3.7 bereits eingelöst hat, plus die interne Bemerkung „spürbar besser als 3.7“:
- Agents / mehrstufige Tools: 3.7 vs. 3.6 hob DeepSWE von 49,0 % auf 65,3 % und AutomationBench von 17,0 % auf 30,4 %. Bleibt der nächste Sprung ein Workhorse, liegt der Gewinn in weniger vergeudeten Tool-Retries — nicht in einer weiteren Kontextfenster-Schlagzeile.
- Coding: FrontierCode 1.1 Main stieg von 34,4 % auf 43,6 %. Das Preview auf Jetski (eine Coding-Oberfläche) zu legen, ist ein Signal: Flash bleibt die Default-Engine zum Schreiben und Fixen von Code, keine Chat-Haut.
- Lange Dokumente und Extraktion: Wissensarbeits-Scores wie GDP.pdf stiegen von 22,0 % auf 34,0 %. Bei JSON-Extraktion heißt das meist weniger driftende verschachtelte Felder, Enums und Array-Längen — warten Sie auf GA und fahren Sie dasselbe Schema erneut; schreiben Sie es nicht früh in ein SLA.
- Latenz und Preis: Das Produktversprechen von Flash ist günstig, schnell und tausendfach am Tag aufrufbar. Würde 3.8 das brechen (ein Pro in Verkleidung), blieben Teams beim 3.7-Intro-Preis. Die sicherere Prognose: Preis im Flash-Segment, Qualität auf die Schwachstellen von 3.7 gezielt.
„Wer ist schlauer?“ gegen Claude Fable 5 ($10 / $50) ist der falsche Rahmen. „Weniger Tool-Hin-und-her beim selben Schema“ gegen 3.7 ist der richtige. Behandeln Sie jede Prognose als Hypothese, bis eine Modellkarte existiert.
API-JSON-Vorschau
Das ist die Schicht, um die es in dieser Serie wirklich geht. Von Gemini 2.5 bis 3.7 behielten Structured Output und Function Calling fast dieselbe Request-Form: Modell-String und Verhalten änderten sich, die Feldnamen nicht. Ist 3.8 ein 3.7-Inkrement, lautet die stabile Vorschau: Kompatibilität, keine neue JSON-API.
Structured Output: Schema behalten, nicht auf einen neuen Schalter wetten
Das heutige 3.7-Muster gilt nach 3.8 GA fast sicher weiter: response_mime_type=application/json plus response_schema (Pydantic) oder response_json_schema (ein JSON-Schema-Dictionary). Constrained Decoding blockiert illegale Token zur Generierungszeit — derselbe Weg wie im Gemini-JSON-Leitfaden und in Vom Prompt zu Structured Output.
from google import genai
from pydantic import BaseModel, Field
# Do not point production at an undocumented 3.8 ID before GA.
# After GA you typically change this one string; Schema and checks stay put.
MODEL = "gemini-3.7-flash"
class ExtractedTask(BaseModel):
title: str
priority: str = Field(description="low | medium | high")
due_date: str | None = None
client = genai.Client()
response = client.models.generate_content(
model=MODEL,
contents="Extract the action item: finish the budget review by next Friday, high priority.",
config={
"response_mime_type": "application/json",
"response_schema": ExtractedTask,
},
)
print(response.parsed)
Vernünftige Hoffnungen für 3.8: eine höhere Erstpass-Quote bei verschachtelten Objekten, optionalen Feldern, Enums und Arrays; weniger durchgesickerte Chain-of-Thought, wenn Thinking und JSON gleichzeitig an sind. Nicht hoffen auf vollständiges JSON Schema 2020-12 (die Teilmengen-Grenzen von Gemini bei additionalProperties, prefixItems und Verwandten stehen im Vergleichsartikel) — und nicht darauf, dass „finales Antwort-JSON“ und „Tool-Argument-JSON“ in einem Regler zusammenfallen.
Function Calling: das Tool-Schema bleibt der Vertrag
Auf der Tool-Seite gilt weiter tools plus ein parameters JSON Schema, ein functionCall vom Modell, dann Host-Ausführung und ein Folgeturn. Das Verkaufsargument von 3.7 war sorgfältigere mehrstufige Pläne; ist das 3.8-Dogfood wirklich „spürbar besser“, schauen Sie zuerst nach weniger falschen Tools, weniger fallengelassenen required-Feldern, weniger leeren Schleifen auf demselben Tool. MCP-inputSchema muss weiter zur Deklaration passen, sonst „schlägt“ das Modell zu und der Server lehnt ab — unabhängig von 3.8. Siehe Tool Calling → MCP-Datenfluss.
from google import genai
from google.genai import types
lookup_order = types.FunctionDeclaration(
name="lookup_order",
description="Return shipment status for an order id",
parameters={
"type": "object",
"properties": {
"order_id": {"type": "string", "description": "Order id, e.g. GW-20260828"}
},
"required": ["order_id"],
},
)
client = genai.Client()
response = client.models.generate_content(
model="gemini-3.7-flash",
contents="Has GW-20260828 shipped yet?",
config=types.GenerateContentConfig(
tools=[types.Tool(function_declarations=[lookup_order])],
),
)
| JSON-Aufgabe | Heute (3.7) | 3.8-Vorschau |
|---|---|---|
| Finale Antwort / Extraktion | responseMimeType + Schema | Feldnamen wahrscheinlich unverändert; Erstpass-Quote beobachten |
| Tool-Argumente | tools[].parameters | Weniger Retries und Typ-Drift; den Vertrag nicht lockern |
| MCP | inputSchema am Tool ausgerichtet | Unabhängig vom Modell-Bump; lokale Validierung behalten |
Zwei Schleusen behalten: json.loads plus dasselbe JSON Schema, dann Ihre eigenen Invarianten (Geld, Enums, Zeitzonen). Legen Sie Beispielausgaben in die JSON-Toolbox für einen lokalen Diff — kein Upload. 3.7 und ein künftiges 3.8 sollten dieselben Fixtures teilen, sonst können Sie nicht sagen, ob es wirklich stabiler geworden ist.
Was Sie jetzt tun sollten
- Produktion auf 3.7 Flash lassen:
gemini-3.7-flashzum Intro-Preis, Default-Modell in der Config, keine verstreuten Literale. - Keine fiktive 3.8-ID vorhalten: ein interner Preview-Name ist kein SDK-Argument. Eine Fallback-Zeile erst, wenn AI Studio / die DeepMind-Karte es listen.
- Zuerst die JSON-Fixtures fertigmachen: dieselben Prompts durch Structured Output und Tool Calling, lokal gegen Schema geprüft. Wenn 3.8 GA geht, einmal mit neuem Modell-String neu fahren.
- System + tools cachen: Agent-System-Prompt und Tool-Liste auf Context Caching legen. 3.7-Intro-Cache-Lesen liegt bei etwa $0.075 / 1M Token.
- Budget nach Standardtarifen 2027 kalkulieren: selbst wenn 3.8 mit einem neuen Intro-Preis kommt, verdoppelt sich 3.7 selbst am 2027-01-01. Lassen Sie eine Q1-Rechnung nicht von einer gerüchteten günstigeren SKU abhängen.
- Nur offizielle Kanäle beobachten: die DeepMind-Flash-Karte, der Gemini-API-Changelog, die Vertex-Modellliste. X-Leaks und anonyme Arena-Modelle sind kein Zeitplan.
FAQ
Wann wird Gemini 3.8 Flash veröffentlicht?
Google hat kein Datum veröffentlicht. Angesichts der rund drei Wochen zwischen 3.6 und 3.7 und dem vom CEO genannten, nahezu monatlichen Flash-Takt ist ein öffentliches Fenster Anfang bis Mitte September 2026 die bessere Vorannahme, wenn das interne Preview gut läuft. Das ist keine Zusage und darf kein Projekt-Deadline sein.
Kann ich gemini-3.8-flash heute aufrufen?
Nein. Stand 28. August 2026 gibt es keine öffentliche API, keine SDK-Modell-ID und keine DeepMind-Modellkarte. Nutzen Sie gemini-3.7-flash in Produktion.
Heißt ein internes Preview, dass GA unmittelbar bevorsteht?
Nein. Business Insider bestätigte, dass Mitarbeiter Gemini 3.8 Flash Preview auf Jetski gesehen haben; Google lehnte eine Stellungnahme ab. Dogfood kann in Wochen GA gehen — oder umbenannt oder wieder in 3.7 zurückgeführt werden. Lesen Sie es als „in Arbeit“, nicht als „terminiert“.
Wird 3.8 stärker und günstiger als 3.7?
Es gibt keinen offiziellen Bench und keine Preisliste. Die Gewinne von 3.7 gegenüber 3.6 lagen bei mehrstufigen Tools und Coding; ein interner Tester nannte das 3.8 Preview „spürbar besser als 3.7“ — das lässt sich nicht verallgemeinern. Der Preis bleibt eher im Flash-Segment, als auf Flaggschiff-Listenpreise zu springen.
Ändert 3.8 die API von Structured Output / Function Calling?
Die Gewohnheit von 2.5 bis 3.7: neue Modell-ID, dieselben Request-Felder — response_mime_type, response_schema / response_json_schema, tools.parameters. Behandeln Sie ein Flash-Inkrement zuerst als kompatibel, und regressionstesten Sie dasselbe Schema am GA-Tag.
Soll ich mit Structured Output auf 3.8 warten?
Nein. Der JSON-Schema-Vertrag, ein zweiter Validierungslauf und Error-Replay hängen nicht von einer Flash-Minor-Version ab. Machen Sie die Pipeline auf 3.7 grün; 3.8 ist ein Tausch des Modell-Strings.
Fazit
Gemini 3.8 Flash ist nicht gestartet. Am 28. August 2026 steht fest: 3.7 Flash läuft in Produktion, der Intro-Preis gilt weiter, und ein internes 3.8 Preview kursiert bereits. Der Flash-Takt der letzten zwei Monate zeigt auf „Wochen um den September“, nicht auf „auf Gemini 4 warten“. Leistung und Preis haben noch keine Modellkarte; die einzige ehrliche Prognose folgt dem Agent- und Coding-Vektor von 3.6→3.7.
Die JSON-Geschichte auf der API ist unverändert: Structured Output besitzt die finale Form, Function Calling die Tool-Argumente, beide nutzen JSON Schema. Fixtures und lokale Validierung heute schlagen einen Leak-Kalender. Sobald 3.8 auf der offiziellen Modellliste erscheint, dasselbe Schema einmal neu fahren.