Wann kommt Gemini 3.8 Flash? Aktuelle Nachrichten, Release-Termin und KI-Coding-Prognose

Stand 2. September 2026 ist Gemini 3.8 Flash nicht öffentlich. Mittwochs-Gerüchte, Leak-Codename skimaki, das September-Fenster und eine Coding-Prognose gegenüber Gemini 3.7 Flash.

Kurze Antwort: Stand 2. September 2026 ist Gemini 3.8 Flash weiterhin nicht öffentlich veröffentlicht. AI Studio, die Gemini API und Vertex AI listen kein aufrufbares gemini-3.8-flash, und die DeepMind-Karte endet weiter bei Gemini 3.7 Flash, das am 13. August GA ging. Am selben Tag nannten mehrere Medien und Leak-Accounts Mittwoch als öffentlichen Termin, mit dem internen Codenamen skimaki und der Behauptung, das Production-Deployment sei „fertig“. Das sind Hinweise, keine Release-Notes.

Der Beitrag vom 28. August, Gemini 3.8 Flash: Release-Fenster und API-JSON-Vorschau, hat die Kompatibilität von Structured Output / Function Calling bereits behandelt. Gemini 3.7 Flash: Preise, API und JSON ist das Flash-Modell, das Sie tatsächlich aufrufen können. Dieser Artikel ergänzt nur drei Dinge: die Nachrichten um den 2. September, wie sich das Release-Datum lesen lässt, und wohin 3.8 beim AI Coding wahrscheinlich wandert.

Schon veröffentlicht? Stand 2026-09-02

Nehmen Sie das als Checkliste:

  • Öffentliches Produkt: nicht veröffentlicht. AI Studio / Gemini API / Vertex AI listen kein aufrufbares 3.8 Flash.
  • Modell-ID: kein dokumentiertes gemini-3.8-flash. Eine geleakte Zeichenkette in Produktion zu setzen, endet mit 404.
  • Preis und Kontext: nicht offengelegt. Community-Tabellen, die ein 1M-Token-Fenster oder „die Hälfte von 3.7“ behaupten, haben keine offizielle Quelle.
  • Aktuelles Flash-Workhorse: weiterhin gemini-3.7-flash, Intro-Preis $0.75 / $3.75 pro Million Input- / Output-Token bis 2026-12-31, danach $1.50 / $7.50 ab 2027-01-01.

Die ehrliche Antwort auf „Wann kommt der Launch?“ lautet also: Google hat kein öffentliches Datum gesetzt; heute ist der gerüchtete Mittwoch, nicht der Mittwoch im Kalender. Der Rest dieses Artikels trennt die Hinweise vom 1.–2. September vom August-Takt, damit „Production-Deployment abgeschlossen“ nicht mit GA verwechselt wird.

September-Nachrichten und wie stark die Belege sind

Rangfolge nach Beleglage, nicht nach „es shippt morgen“-Hitze.

DatumAussageStärke
2026-08-13Gemini 3.7 Flash GA, offizielle Modellkarte und Intro-PreiseBestätigt
Q2 2026 EarningsSundar Pichai sagte, Flash solle nahe an einem monatlichen Takt landenBestätigt (Takt, nicht 3.8 selbst)
2026-08-27Business Insider: Mitarbeiter nutzen „Gemini 3.8 Flash Preview“ auf Jetski; Google lehnte eine Stellungnahme abMittelhoch: namentliche Berichterstattung, immer noch kein Launch
2026-08-10Ein Tencent-Paper nennt „Gemini 3.8 Flash“ als einen LLM-Judge (drei Tage vor 3.7 GA)Schwach: Tippfehler oder früher interner Name
2026-09-01Leaks: interner Codename skimaki, Production-Deployment abgeschlossen, öffentlicher Termin auf Mittwoch, den 2. SeptemberSchwach bis mittel: Zweitquellen, keine Modellkarte, kein API-Changelog
2026-09-02Zum Zeitpunkt dieses Artikels haben offizielle Kanäle weiter keine 3.8-Karte und keinen aufrufbaren EndpointBestätigt (die Tatsache „nicht veröffentlicht“ selbst)

Die Welle vom 1. September hat der Story vom 27. August drei neue Wörter hinzugefügt: skimaki (interner Codename), Production-Deployment abgeschlossen und öffentlich am Mittwoch. CryptoBriefing, 4sAPI und andere haben daraus „Google stellt es am 2. September vor“ gemacht. Bemerkenswert: Der Vorlauf der Leak-Community bei den letzten Flash-Minors war nicht schlecht. „Deployment abgeschlossen“ kann intern bei Google weiter nur Employee-Dogfood heißen, kein öffentliches Developer Preview.

Frühes Tester-Feedback ist weiter ein subjektiver Satz: „spürbar besser als 3.7 Flash“, mit dem Vorbehalt, für eine volle Bewertung sei es zu früh. Die neuen technischen Hinweise sind konkreter: weniger wortreiche Ausgabe (eine alte Flash-Beschwerde) und Fixes für Fehlermodi, die 3.7 offengelegt hat. Das ist kein Generationswechsel — es sieht aus wie ein weiteres Zwei-bis-drei-Wochen-Inkrement im Stil 3.6→3.7.

Die lauteren X-Behauptungen („Fable-5-Qualität zum Flash-Preis“, „monatelange Partner-Tests“) haben nach wie vor keine DeepMind-Modellkarte und keinen API-Changelog. Ein „3.8“ in einem Paper oder ein anonymes Arena-Modell ist kein Ship-Kalender.

Wie sich das Release-Datum lesen lässt

Google hat kein 3.8-Datum veröffentlicht. Die einzigen Intervalle, die Sie nutzen können, sind die der Flash-Linie selbst, plus das heutige Mittwoch-Gerücht:

  • Gemini 3.6 Flash: GA um den 21. Juli 2026.
  • Gemini 3.7 Flash: GA am 2026-08-13, etwa drei Wochen nach 3.6.
  • 3.8 Preview: am 27. August bereits auf Jetski, nur 14 Tage nach 3.7 GA.
  • Pichai im Q2-Call: Flash solle nahe am Monatsrhythmus bleiben.
  • Leaks vom 1. September: öffentlicher Termin auf Mittwoch, den 2. September. Das liegt auch auf der Linie „etwa drei Wochen nach 3.7“ (2.–4. September).

Das übereinandergelegt, bleibt das öffentliche Fenster Anfang bis Mitte September 2026. Heute (2. September) ist der linke Rand dieses Fensters, keine Deadline. Geht der Mittwoch ohne Modellkarte vorbei, lautet die bessere Lesart „das Fenster ist noch offen“, nicht „3.8 ist tot“. Ein internes Preview kann weiter in ein stilles 3.7-Refresh einfließen oder unter anderem Namen zurückkommen.

Machen Sie 3.8 nicht zur Meilenstein-Abhängigkeit. Halten Sie den Modell-String in der Config und lassen Sie Coding- / Agent-Traffic auf 3.7. Eine Fallback-Zeile erst, wenn AI Studio / die DeepMind-Karte es listen.

Warum AI Coding: Jetski ist kein Chatfenster

Die interne Tür für 3.8 ist Jetski — Googles eigene Coding-Plattform, kein generisches Chatfenster. Das sagt mehr über die Produktabsicht als jedes „Fable-5-Niveau“-Motto: Die Flash-Linie soll die Default-Engine zum Schreiben von Code, Fixen von Issues und Betreiben von Agents sein, als Dogfood auf echten internen Repos, bevor ein öffentliches Datum feststeht.

Das erklärt auch, warum der Takt auf zwei oder drei Wochen gestaucht ist. Das Flaggschiff (Pre-Training von Gemini 4 startete am 2026-07-21, ohne Launch-Fenster) läuft in einem langen Zyklus. Flash nimmt kleine Algorithmus-Tweaks, Post-Training, Tool-Curricula und Failure-Mode-Patches auf. Logan Kilpatrick beschrieb 3.6→3.7 als „clever algorithmic tweaks, not a full retrain.“ 3.8 geht wahrscheinlich denselben Weg.

Für Leute, die Code ausliefern, heißt das zwei Dinge. Erstens: 3.8 entscheidet sich an Erstpass-Patches, grünen Tests und weniger vergeudeten Tool-Schleifen — nicht an Arena-Chat-Scores. Zweitens bleibt die API-Form wahrscheinlich stehen; was sich ändert, ist Erfolgsquote und Gesamt-Token auf denselben Repo-Aufgaben. Der vorherige Artikel hat bereits gesagt, dass Structured-Output-Felder nicht umbenannt werden. Dieser legt den Maßstab auf Coding-Aufgaben.

Coding-Scores, die 3.7 Flash bereits eingelöst hat

Ohne offiziellen 3.8-Bench erfinden Sie keine Prozentsätze. Die Baseline sind die Coding- und Agent-Scores, die 3.6 → 3.7 bereits auf eine Modellkarte geschrieben hat:

Kennzahl3.6 Flash3.7 Flash (bestätigt)Was sie misst
FrontierCode 1.1 Main34.4%43.6% (+9.2pp)Repo-Coding-Hauptsatz
DeepSWE v1.149.0%65.3% (+16.3pp)Software-Engineering-Agents
AutomationBench17.0%30.4% (+13.4pp)Mehrstufige Automatisierung
WebDev Arena Elo—1588Browser-UI / interaktive Implementierung
PositionierungGünstiges, schnelles Allzweck-FlashWorkhorse für Coding und AgentsBleibt 3.8 auf dieser Linie, sollte es weiter Schwachstellen flicken

Diese Sprünge sind keine Chat-Politur. Sie zeigen, dass das Flash-Trainingsbudget bereits auf Patches, Tools und Mehrschritt-Arbeit sitzt. Wenn 3.8 erscheint, denselben Maßstab behalten: Patch-Edit-Erfolg, Testfall-Bestehensquote, Recovery nach einem fehlgeschlagenen Tool-Call, Instruction Following über mehrere Turns, und Gesamt-Token bis ein Issue geschlossen ist. Ob eine einzelne Antwort sich „schlauer anfühlt“, reicht nicht.

Kosten sind nicht nur der Listenpreis pro Million. Agent-Coding liest Dateien erneut, fährt Tests erneut und korrigiert sich selbst; ein Issue kostet oft ein Vielfaches eines einzelnen Q&A-Turns. Flash konkurriert über „Preis × Latenz bis ein Issue geschlossen ist“, nicht über einen anonymen Arena-Score. Der Intro-Preis von 3.7 liegt bereits eine Größenordnung unter Claude Fable 5 mit $10 / $50. Selbst wenn 3.8 etwas schärfer ist, entscheidet über das Default-Modell weiter Kosten-pro-Task mal Retries.

AI-Coding-Ausblick für 3.8

Das sind Hypothesen, keine Scores. Die einzigen Inputs sind der Vektor 3.6→3.7, Jetski-Dogfood und die zwei Leak-Zeilen: weniger Fülltext, die Löcher von 3.7 stopfen.

Eher wahrscheinlich

  • Kürzere Ausgabe, eher ein Patch: Flash wird lange beschuldigt, sich vorzustellen, bevor es drei Zeilen ändert. Drückt 3.8 die Verbosity wirklich, sparen Coding-Jobs Output-Token und verschmutzen weniger Diffs. Das ist der günstigste Sprung, und er passt zur Leak-Formulierung.
  • Eine vergeudete Tool-Runde weniger: Die DeepSWE- / AutomationBench-Gewinne von 3.7 haben bereits gesagt, „mehrstufig“ ist der Hauptangriff. Bleibt der nächste Sprung ein Workhorse, liegt der Gewinn in weniger falschen Tools, weniger fallengelassenen required-Feldern, weniger leeren Schleifen auf demselben Testbefehl — nicht in einer weiteren 1M-Token-Schlagzeile.
  • Ein leichter Anstieg bei Erstpass-Patches: nachdem FrontierCode von 34.4% auf 43.6% ging, sieht 3.8 nach ein paar Punkten mehr aus, nicht nach einem Flaggschiff-Sprung. „Spürbar besser als 3.7“ ist eine Richtung, keine Lizenz, „Fable 5“ zu schreiben.
  • Dieselbe API-Form: Coding-Agents übergeben JSON-Argumente weiter über tools.parameters; strukturierte Patches nutzen weiter response_mime_type plus ein Schema. Behandeln Sie ein Flash-Minor zuerst als kompatibel; am GA-Tag den Modell-String tauschen und dieselben Fixtures neu fahren. Details stehen in der API-JSON-Vorschau.
  • Preis bleibt im Flash-Segment: „günstig, schnell, tausendfach am Tag“ zu brechen, würde Teams zurück auf den 3.7-Intro-Preis drücken. Die sicherere Prognose: Stückpreis im Flash-Segment, Qualität auf die Coding-Schwachstellen von 3.7 gezielt.

Unwahrscheinlich oder unbelegt

  • „Fable-5-Qualität zum Flash-Preis“: kein offizieller Bench. 3.7 selbst hat dieses Band nie überschritten; ein interner Trial ist keine Preisliste.
  • Eine brandneue Coding-API oder ein Repo-Protokoll: von 2.5 bis 3.7 änderten sich Modell-String und Verhalten, die Feldnamen nicht. 3.8 hat keinen Grund, zuerst eines zu erfinden.
  • Coding über ein 1M-Token-Fenster gewinnen: die Community sagt, 3.8 behält ein 1M-Fenster; das ist unbestätigt. Selbst wenn, sitzen Coding-Engpässe meist in der Tool-Schleife und im Test-Feedback, nicht in der Fenster-Anzeige.
  • Heute als Produktions-Default nutzen: jede Config-Änderung „Mittwoch ist GA“ vor einer Modellkarte ist ein Incident.
from google import genai
from google.genai import types

# Do not point production at an undocumented 3.8 ID before GA.
# Coding-agent fixtures should pin to repo tasks, not chat scores.
MODEL = "gemini-3.7-flash"

run_tests = types.FunctionDeclaration(
    name="run_tests",
    description="Run tests at a path and return a failure summary",
    parameters={
        "type": "object",
        "properties": {
            "path": {"type": "string", "description": "Test target, e.g. tests/test_parser.py"},
            "max_fail": {"type": "integer", "description": "Max failures to return"}
        },
        "required": ["path"],
    },
)

client = genai.Client()
response = client.models.generate_content(
    model=MODEL,
    contents="parser raises KeyError on empty objects; run tests/test_parser.py, then a minimal patch.",
    config=types.GenerateContentConfig(
        tools=[types.Tool(function_declarations=[run_tests])],
    ),
)

Das ist die Form, auf der 3.8 verglichen werden sollte: dasselbe Issue, dieselben Tools, dieselben Tests. Was zählt, ist weniger Tool-Hin-und-her, weniger Fülltext und ein Patch, der sich noch anwenden lässt. „Wer ist schlauer“ gegen Claude Fable 5 ist der falsche Rahmen.

Wie Sie einen Coding-Workflow abnehmen

Sobald 3.8 auf der offiziellen Liste steht, die Pressemitteilung überspringen und das eigene Repo fahren. Die Fixture in vier Zellen teilen:

ZelleWas Sie messenWo 3.8 3.7 schlagen sollte
Patch-EditGegeben ein fehlschlagender Test: kann es einen minimalen, anwendbaren Diff liefernHöhere Erstpass-Quote, weniger unbeteiligte Dateien angefasst
Tool-SchleifeDatei lesen → editieren → Tests fahren → Failure lesenWeniger falsche Tools, weniger leere Schleifen, weniger fallengelassene required-Felder
Instruction FollowingÜberlebt „nur den Parser anfassen, kein Rewrite“Nach mehreren Turns weiter auf der Schiene
AbrechnungInput+Output-Token und Wall-Clock-Zeit bis ein Issue geschlossen istKürzere Ausgabe sollte die Rechnung senken; steigen die Token, kann sich ein „besserer Eindruck“ als Verlust entpuppen

Tool-Argumente sind weiter JSON. „Gelingt“ dem Modell das Füllen der Parameter und der Testbefehl gerät trotzdem aus der Spur, ist das Schema wahrscheinlich zu locker — nicht „3.8 ist nicht schlau genug“. Zwei Schleusen behalten: json.loads plus dasselbe JSON Schema, dann Ihre eigenen Invarianten (Pfade, Timeouts, maximale Failures). Legen Sie Beispielausgaben in die JSON-Toolbox für einen lokalen Diff — kein Upload. 3.7 und ein künftiges 3.8 sollten dieselben Fixtures teilen, sonst können Sie nicht sagen, ob es wirklich stabiler geworden ist. Siehe Tool Calling und JSON-Schema-Validierung und Tool Calling → MCP-Datenfluss.

Was Sie jetzt tun sollten

  1. Produktion auf 3.7 Flash lassen: gemini-3.7-flash zum Intro-Preis, Default-Modell in der Config. Kein Vorab-gemini-3.8-flash oder skimaki.
  2. Zuerst die Coding-Fixtures fertigmachen: 10–30 echte Issues (Patches, Tests, Multi-Turn-Constraints). Wenn 3.8 GA geht, einmal mit neuem Modell-String neu fahren.
  3. Gesamt-Token loggen, nicht nur „fühlt sich besser an“: Die Agent-Rechnung steckt in der Loop-Zahl, nicht im Einzelturn-Listenpreis.
  4. System + tools cachen: Agent-System-Prompt und Tool-Liste auf Context Caching legen. 3.7-Intro-Cache-Lesen liegt bei etwa $0.075 / 1M Token.
  5. Budget nach Standardtarifen 2027 kalkulieren: selbst wenn 3.8 mit einem neuen Intro-Preis kommt, verdoppelt sich 3.7 selbst am 2027-01-01.
  6. Nur offizielle Kanäle beobachten: die DeepMind-Flash-Karte, der Gemini-API-Changelog, die Vertex-Modellliste. Mittwoch-Gerüchte und anonyme Arena-Modelle sind kein Zeitplan.

FAQ

Wann wird Gemini 3.8 Flash veröffentlicht?

Google hat kein Datum veröffentlicht. Leaks haben den öffentlichen Tag auf Mittwoch, den 2. September 2026 gelegt, mit internem Codenamen skimaki und „Production-Deployment abgeschlossen“. Angesichts der rund drei Wochen zwischen 3.6 und 3.7 und dem vom CEO genannten, nahezu monatlichen Flash-Takt bleibt das öffentliche Fenster Anfang bis Mitte September. Heute ist der linke Rand dieses Fensters, keine Zusage, und darf keine Projekt-Deadline sein.

Kann ich gemini-3.8-flash heute aufrufen?

Nein. Stand 2. September 2026 gibt es keine öffentliche API, keine SDK-Modell-ID und keine DeepMind-Modellkarte. Nutzen Sie gemini-3.7-flash in Produktion.

Heißt „Production-Deployment abgeschlossen“, dass GA unmittelbar bevorsteht?

Nein. Internes Deploy kann nur Jetski-Employee-Dogfood bedienen. Business Insider bestätigte ein Preview; Google lehnte eine Stellungnahme ab. Dogfood kann in Wochen GA gehen — oder umbenannt oder wieder in 3.7 zurückgeführt werden.

Wie viel besser wird 3.8 beim AI Coding als 3.7?

Es gibt keinen offiziellen Bench. Extrapolieren können Sie den Coding- / Agent-Vektor, den 3.6→3.7 bereits eingelöst hat, plus „weniger Fülltext, die Löcher von 3.7 stopfen“. Wahrscheinlicher sind kürzere Patches und weniger vergeudete Tool-Schleifen als ein plötzliches Fable 5. Am Ship-Tag gelten die Modellkarte und Ihre eigenen Repo-Fixtures.

Soll ich mit einem Coding-Agent auf 3.8 warten?

Nein. Tool-Schema, Test-Fixtures und Error-Replay hängen nicht von einer Flash-Minor-Version ab. Machen Sie die Pipeline auf 3.7 grün; 3.8 ist ein Tausch des Modell-Strings.

Ändert 3.8 die coding-bezogene API?

Die Gewohnheit von 2.5 bis 3.7: neue Modell-ID, dieselben Request-Felder. Coding-Agents nutzen weiter tools.parameters; strukturierte Patches weiter response_schema / response_json_schema. Zuerst Kompatibilität annehmen, am GA-Tag regressionstesten.

Fazit

Gemini 3.8 Flash ist nicht gestartet. Am 2. September 2026 steht fest: 3.7 Flash läuft in Produktion, der Intro-Preis gilt weiter, ein internes Preview liegt seit einer Woche auf Jetski, und Leaks haben heute als öffentlichen Termin genannt. Der Flash-Takt der letzten zwei Monate zeigt auf „diese Tage Anfang September bis Mitte des Monats“, nicht auf „auf Gemini 4 warten“. Ohne Modellkarte heute den „Mittwoch“ als linken Rand des Fensters lesen, nicht als Deadline.

Beim AI Coding sieht 3.8 nach einem Schwachstellen-Patch von 3.7 aus: kürzere Ausgabe, weniger leere Schleifen, ein leichter Anstieg bei Erstpass-Diffs. Repo-Aufgaben als Maßstab, nicht Arena. Die Request-Form von JSON / Function Calling bleibt wahrscheinlich unverändert — das war der vorherige Artikel. Fixtures und lokale Validierung heute schlagen einen Leak-Kalender. Sobald 3.8 auf der offiziellen Modellliste erscheint, dieselben Issues einmal neu fahren.