先給結論:截至 2026 年 8 月 28 日,Gemini 3.8 Flash 還沒有官方釋出。沒有公開的模型卡、沒有 gemini-3.8-flash API、Google DeepMind 檔案仍停在 8 月 13 日上線的 Gemini 3.7 Flash。同一周裡,Business Insider 報導員工已在內部編碼平臺 Jetski 試用「Gemini 3.8 Flash Preview」,X 上也有「數週內公開」的傳聞——這些都是線索,不是發版說明。
上一篇《Gemini 3.7 Flash 價格、API 與 JSON 介紹》把當前可呼叫的 Flash 講清楚了;《Gemini API 結構化 JSON 教程》和《OpenAI vs Gemini Structured Output》則是 Schema 契約。這篇只回答三件事:3.8 什麼時候可能來、效能大概往哪走、API 層的 JSON / Function Calling 會不會改。
釋出了沒有:2026-08-28 現狀
可以當作核對清單:
- 公開產品:未釋出。AI Studio / Gemini API / Vertex AI 模型列表裡沒有可呼叫的 3.8 Flash。
- 模型 ID:不存在已檔案化的
gemini-3.8-flash。把字串寫進生產設定會直接 404。 - 價格:未披露。任何「3.8 只要 3.7 一半價錢」的表格都沒有官方出處。
- 當前主力 Flash:仍是
gemini-3.7-flash,Intro 價 $0.75 / $3.75(每百萬 input / output token)至 2026-12-31,2027-01-01 起標準價 $1.50 / $7.50。
所以「什麼時候釋出」的誠實答案是:Google 還沒定公開日;按 Flash 近兩個月的節奏,更像「數週內」而不是「明年」。下面把線索和節奏拆開,避免把內部 Preview 當成 GA。
8 月最新訊息與證據強度
按可信度從高到低排,而不是按社交媒體熱度。
| 時間 | 訊息 | 強度 |
|---|---|---|
| 2026-08-13 | Gemini 3.7 Flash 正式 GA,官方模型卡與 Intro 價上線 | 已確認 |
| 2026-08-10 | 有騰訊論文把「Gemini 3.8 Flash」寫成評測裁判之一(3.7 釋出前三天) | 弱:可能筆誤,也可能提前拿到內部名 |
| 2026 Q2 財報 | Sundar Pichai 稱 Flash 線目標接近「每月一更」 | 已確認(節奏,不是 3.8 本身) |
| 2026-08-27 | Business Insider:員工在內部平臺 Jetski 使用「Gemini 3.8 Flash Preview」;Google 拒絕置評 | 中高:有圖、有具名報導,仍非正式發版 |
| 2026-08-27 | X 賬號稱 3.8 已內部部署、可能數週內公開,並對比 Claude Fable 5 | 弱:無模型卡、無 API |
| 同期 | Arena AI 出現疑似 3.8 匿名模型的猜測 | 弱:無法核驗身份 |
Business Insider 的細節值得單獨記下:內部名稱是 Gemini 3.8 Flash Preview,入口是 Google 內部編碼平臺 Jetski;一名試用員工說「已經明顯好於 3.7 Flash」,同時強調「現在做完整評測還太早」。這和 3.6 → 3.7 的對外節奏一致——先內部 dogfood,再隔兩三週 GA。
X 上更激進的說法(「已完成數月合作伙伴測試」「Fable 5 級質量、Flash 級價格」)目前沒有 DeepMind 模型卡或 API changelog 支撐。騰訊論文裡只出現一次「3.8」,更合理的解釋仍是兩種:研究員寫錯版本號,或評測組用過尚未公開的內部端點。一篇論文裡的一個詞,不能當釋出日曆。
釋出視窗怎麼推
Google 沒有公佈 3.8 的日期。能推的只有 Flash 線自己的間隔:
- Gemini 3.6 Flash:2026 年 7 月下旬 GA(與 3.5 Flash-Lite 等同一波)。
- Gemini 3.7 Flash:2026-08-13 GA,距 3.6 大約三週。
- Pichai 在 Q2 電話會的表述:Flash 儘量做到接近月更。
- 3.8 Preview 已在 8 月 27 日出現在內部平臺——說明至少進入員工試用,不等於「下週一定對外」。
若繼續「三到四周三更一版」,對外 Developer Preview / GA 更可能落在 2026 年 9 月上旬到中旬,而不是拖到 Gemini 4。Gemini 4 的預訓練官方只確認 2026-07-21 已啟動,沒有釋出視窗;「3.8 會早於 Gemini 4」幾乎是一句空話——旗艦本來就更慢。
也要把「不釋出」算進機率:內部 Preview 可能合回 3.7 的靜默更新,或改名再出。規劃專案時,不要把 3.8 寫成里程碑依賴;把 model 字串做成設定,3.7 繼續承擔流量。
3.7 Flash vs 傳聞中的 3.8
| 項 | Gemini 3.7 Flash(已確認) | Gemini 3.8 Flash(未確認) |
|---|---|---|
| 狀態 | 2026-08-13 GA | 內部 Preview 報導;無公開 API |
| 模型 ID | gemini-3.7-flash | 未檔案化;勿寫入生產 |
| Intro 價 | $0.75 / $3.75 每百萬 token,至 2026-12-31 | 未披露 |
| 2027 標準價 | $1.50 / $7.50 | 未披露 |
| 上下文 | 約 100 萬 token 輸入 / 約 64k 輸出 | 未披露;Flash 檔通常沿用同窗 |
| DeepSWE v1.1 | 65.3%(3.6 為 49.0%) | 無官方分 |
| 定位 | 編碼與 Agent 的 workhorse | 傳聞稱「更接近旗艦、仍走 Flash 價」 |
對照表裡右邊一列全是空,這本身就是資訊:現在能寫進架構評審的只有 3.7。左邊的 Intro 價已經比 Claude Fable 5 的 $10 / $50 低一個數量級;即便 3.8 真能吃掉部分旗艦質量,決定預設模型的仍是「單次任務成本 × 重試次數」,不是 Arena 匿名分。
效能預測(基於 3.6→3.7,不是跑分)
沒有公開 bench,就不能編造 3.8 的百分比。能外推的是 3.6 → 3.7 已經兌現的方向,以及內部員工那句「明顯好於 3.7」:
- Agent / 多步工具:3.7 相對 3.6,DeepSWE 從 49.0% 到 65.3%,AutomationBench 從 17.0% 到 30.4%。下一跳若仍瞄準 workhorse,優先項會是更少的無效 tool 重試,而不是再堆上下文長度。
- 編碼:FrontierCode 1.1 Main 從 34.4% 到 43.6%。內部 Preview 放在 Jetski(編碼平臺)上,說明 Google 仍把 Flash 當「寫程式碼、修 Issue」的預設引擎,而不是聊天模型。
- 長檔案與抽取:GDP.pdf 一類知識工作從 22.0% 到 34.0%。對 JSON 抽取來說,這通常表現為巢狀欄位、enum、陣列長度更少跑偏——要等 GA 後用同一套 Schema 迴歸,不能提前寫進 SLA。
- 延遲與價:Flash 的產品承諾是「便宜、快、可日呼叫幾千次」。3.8 若破壞這個承諾(變成偽 Pro),反而會逼團隊留在 3.7 Intro 價上。更合理的預測是:單價仍落在 Flash 檔,質量往 3.7 的短板補。
和 Claude Fable 5($10 / $50)比「誰更聰明」沒有意義;和 3.7 比「同樣 Schema 下少幾次 tool 來回」才有意義。預測請當成假設,釋出當天以模型卡為準。
API JSON 能力前瞻
這是本系列真正要盯的層。Gemini 從 2.5 到 3.7,Structured Output 與 Function Calling 的請求形狀幾乎沒變:換的是模型字串和行為,不是欄位名。3.8 若作為 3.7 的迭代,最穩的前瞻是——相容,而不是新造一套 JSON API。
Structured Output:繼續用 Schema,不要賭新開關
今天 3.7 的寫法,3.8 GA 後大機率仍適用:response_mime_type=application/json,再配 response_schema(Pydantic)或 response_json_schema(JSON Schema 字典)。約束解碼在生成階段擋住非法 token,這和《Gemini JSON 教程》《從 Prompt 到 Structured Output》裡講的是同一條路。
from google import genai
from pydantic import BaseModel, Field
# 3.8 未 GA 前不要把生產模型改成未檔案化的 ID。
# GA 後通常只改這一處字串,Schema 與校驗流水線不動。
MODEL = "gemini-3.7-flash"
class ExtractedTask(BaseModel):
title: str
priority: str = Field(description="low | medium | high")
due_date: str | None = None
client = genai.Client()
response = client.models.generate_content(
model=MODEL,
contents="從紀要擷取待辦:下週五前完成預算評審,高優先順序。",
config={
"response_mime_type": "application/json",
"response_schema": ExtractedTask,
},
)
print(response.parsed)
對 3.8 的合理期待:複雜巢狀、可選欄位、enum 與陣列的一次透過率再高一點,thinking 與 JSON 同開時少把推理文字漏進物件。對 3.8 的不要期待:突然支援完整 JSON Schema 2020-12(Gemini 對 additionalProperties、prefixItems 等子集限制見對比文)、或取消「最終答覆 JSON」和「工具引數 JSON」的分工。
Function Calling:工具 Schema 繼續當合同
工具側仍是 tools + parameters JSON Schema,模型回 functionCall,宿主執行後再回灌。3.7 的賣點是多步規劃更「較真」;若 3.8 內部狗糧確實「明顯更好」,最先應表現在少選錯工具、少漏 required、少對同一工具空轉。MCP 的 inputSchema 仍要和宣告對齊,否則模型填參透過、Server 拒收——這與 3.8 是否釋出無關,見《Tool Calling → MCP 資料流》。
from google import genai
from google.genai import types
lookup_order = types.FunctionDeclaration(
name="lookup_order",
description="按訂單號返回物流狀態",
parameters={
"type": "object",
"properties": {
"order_id": {"type": "string", "description": "訂單號,如 GW-20260828"}
},
"required": ["order_id"],
},
)
client = genai.Client()
response = client.models.generate_content(
model="gemini-3.7-flash",
contents="查一下 GW-20260828 發貨了沒有",
config=types.GenerateContentConfig(
tools=[types.Tool(function_declarations=[lookup_order])],
),
)
| JSON 用途 | 今天(3.7) | 3.8 前瞻 |
|---|---|---|
| 最終答覆 / 抽取 | responseMimeType + Schema | 欄位名大機率不變;盯一次透過率 |
| 工具引數 | tools[].parameters | 少重試、少型別漂移;合同不要改松 |
| MCP | inputSchema 與工具宣告對齊 | 與模型代際無關,繼續本機校驗 |
落地仍建議兩道閘:json.loads + 同一份 JSON Schema 再校驗;金額、列舉、時區等業務不變數自己寫。樣例輸出丟進 JSON 工具箱做本機 Diff,不上傳——3.7 和未來的 3.8 用同一套夾具,才比較得了「是不是真的更穩」。
開發者現在該做什麼
- 生產繼續釘在 3.7 Flash:
gemini-3.7-flash吃 Intro 價,把 default model 做成設定而不是散落硬編碼。 - 不要預留不存在的 3.8 ID:內部 Preview 名稱不能當 SDK 引數。等 AI Studio / DeepMind 模型卡出現再加一行 fallback。
- 先把 JSON 迴歸夾具寫完:同一批 Prompt,分別跑 Structured Output 與 Tool Calling,用本機校驗器對照 Schema。3.8 一旦 GA,只換模型再跑一遍。
- 快取 System + tools:Agent 系統提示和工具列表走 Context Caching,3.7 Intro 期快取讀取約 $0.075 / 1M token。
- 預算按 2027 標準價算:即便 3.8 帶著新 Intro 價,3.7 自己也會在 2027-01-01 翻倍。不要讓 Q1 賬單依賴「傳聞中的更便宜」。
- 只看官方渠道:DeepMind Flash 模型卡、Gemini API changelog、Vertex 模型列表。X 洩漏和 Arena 匿名模型不當作排期。
常見問題 FAQ
Gemini 3.8 Flash 什麼時候釋出?
Google 尚未公佈日期。按 3.6 到 3.7 約三週、以及 CEO 所述的接近月更節奏,若內部 Preview 順利,對外視窗更可能在 2026 年 9 月上旬到中旬。這不是官方承諾,不能當專案截止日期。
現在能呼叫 gemini-3.8-flash 嗎?
不能。截至 2026 年 8 月 28 日沒有公開 API、SDK 模型 ID 或 DeepMind 模型卡。生產請使用 gemini-3.7-flash。
內部 Preview 是不是等於即將 GA?
不等於。Business Insider 證實員工在 Jetski 上看到 Gemini 3.8 Flash Preview,Google 拒絕置評。內部 dogfood 可能數週後 GA,也可能改名或合回 3.7。把它當成「正在做」,而不是「已排期」。
3.8 會比 3.7 更強、更便宜嗎?
沒有官方 bench 和價目。3.7 相對 3.6 的提升集中在 Agent 多步工具與編碼;內部員工稱 3.8 Preview「明顯好於 3.7」,但樣本不可外推。價格更可能留在 Flash 檔,而不是突然對標旗艦標價。
3.8 的 Structured Output / Function Calling 會換 API 嗎?
從 2.5 到 3.7 的慣例是模型 ID 變、請求欄位不變:response_mime_type、response_schema / response_json_schema、tools.parameters 繼續用。3.8 作為 Flash 小版本,應先假設相容,GA 當天再對同一套 Schema 做迴歸。
該不該等 3.8 再上 Structured Output?
不該等。JSON Schema 契約、二次校驗和錯誤回灌與具體 Flash 小版本無關。先在 3.7 上把流水線跑通,3.8 來了只換模型字串。
總結
Gemini 3.8 Flash 還沒釋出。2026 年 8 月 28 日能確認的是:3.7 Flash 在服役、Intro 價還在、內部已經出現 3.8 Preview。按近兩個月的 Flash 節奏,公開日更像「九月前後的數週」,而不是等 Gemini 4。效能與價格都還沒有模型卡,預測只能沿著 3.6→3.7 的 Agent / 編碼方向外推。
API 層的 JSON 故事沒有變:Structured Output 管最終形狀,Function Calling 管工具引數,兩邊都用 JSON Schema。今天把夾具和本機校驗準備好,比追洩漏日曆更有用。3.8 一旦出現在官方模型列表,用同一套 Schema 再跑一遍即可。