先给结论:截至 2026 年 8 月 28 日,Gemini 3.8 Flash 还没有官方发布。没有公开的模型卡、没有 gemini-3.8-flash API、Google DeepMind 文档仍停在 8 月 13 日上线的 Gemini 3.7 Flash。同一周里,Business Insider 报道员工已在内部编码平台 Jetski 试用「Gemini 3.8 Flash Preview」,X 上也有「数周内公开」的传闻——这些都是线索,不是发版说明。
上一篇《Gemini 3.7 Flash 价格、API 与 JSON 介绍》把当前可调用的 Flash 讲清楚了;《Gemini API 结构化 JSON 教程》和《OpenAI vs Gemini Structured Output》则是 Schema 契约。这篇只回答三件事:3.8 什么时候可能来、性能大概往哪走、API 层的 JSON / Function Calling 会不会改。
发布了没有:2026-08-28 现状
可以当作核对清单:
- 公开产品:未发布。AI Studio / Gemini API / Vertex AI 模型列表里没有可调用的 3.8 Flash。
- 模型 ID:不存在已文档化的
gemini-3.8-flash。把字符串写进生产配置会直接 404。 - 价格:未披露。任何「3.8 只要 3.7 一半价钱」的表格都没有官方出处。
- 当前主力 Flash:仍是
gemini-3.7-flash,Intro 价 $0.75 / $3.75(每百万 input / output token)至 2026-12-31,2027-01-01 起标准价 $1.50 / $7.50。
所以「什么时候发布」的诚实答案是:Google 还没定公开日;按 Flash 近两个月的节奏,更像「数周内」而不是「明年」。下面把线索和节奏拆开,避免把内部 Preview 当成 GA。
8 月最新消息与证据强度
按可信度从高到低排,而不是按社交媒体热度。
| 时间 | 消息 | 强度 |
|---|---|---|
| 2026-08-13 | Gemini 3.7 Flash 正式 GA,官方模型卡与 Intro 价上线 | 已确认 |
| 2026-08-10 | 有腾讯论文把「Gemini 3.8 Flash」写成评测裁判之一(3.7 发布前三天) | 弱:可能笔误,也可能提前拿到内部名 |
| 2026 Q2 财报 | Sundar Pichai 称 Flash 线目标接近「每月一更」 | 已确认(节奏,不是 3.8 本身) |
| 2026-08-27 | Business Insider:员工在内部平台 Jetski 使用「Gemini 3.8 Flash Preview」;Google 拒绝置评 | 中高:有图、有具名报道,仍非正式发版 |
| 2026-08-27 | X 账号称 3.8 已内部部署、可能数周内公开,并对比 Claude Fable 5 | 弱:无模型卡、无 API |
| 同期 | Arena AI 出现疑似 3.8 匿名模型的猜测 | 弱:无法核验身份 |
Business Insider 的细节值得单独记下:内部名称是 Gemini 3.8 Flash Preview,入口是 Google 内部编码平台 Jetski;一名试用员工说「已经明显好于 3.7 Flash」,同时强调「现在做完整评测还太早」。这和 3.6 → 3.7 的对外节奏一致——先内部 dogfood,再隔两三周 GA。
X 上更激进的说法(「已完成数月合作伙伴测试」「Fable 5 级质量、Flash 级价格」)目前没有 DeepMind 模型卡或 API changelog 支撑。腾讯论文里只出现一次「3.8」,更合理的解释仍是两种:研究员写错版本号,或评测组用过尚未公开的内部端点。一篇论文里的一个词,不能当发布日历。
发布窗口怎么推
Google 没有公布 3.8 的日期。能推的只有 Flash 线自己的间隔:
- Gemini 3.6 Flash:2026 年 7 月下旬 GA(与 3.5 Flash-Lite 等同一波)。
- Gemini 3.7 Flash:2026-08-13 GA,距 3.6 大约三周。
- Pichai 在 Q2 电话会的表述:Flash 尽量做到接近月更。
- 3.8 Preview 已在 8 月 27 日出现在内部平台——说明至少进入员工试用,不等于「下周一定对外」。
若继续「三到四周三更一版」,对外 Developer Preview / GA 更可能落在 2026 年 9 月上旬到中旬,而不是拖到 Gemini 4。Gemini 4 的预训练官方只确认 2026-07-21 已启动,没有发布窗口;「3.8 会早于 Gemini 4」几乎是一句空话——旗舰本来就更慢。
也要把「不发布」算进概率:内部 Preview 可能合回 3.7 的静默更新,或改名再出。规划项目时,不要把 3.8 写成里程碑依赖;把 model 字符串做成配置,3.7 继续承担流量。
3.7 Flash vs 传闻中的 3.8
| 项 | Gemini 3.7 Flash(已确认) | Gemini 3.8 Flash(未确认) |
|---|---|---|
| 状态 | 2026-08-13 GA | 内部 Preview 报道;无公开 API |
| 模型 ID | gemini-3.7-flash | 未文档化;勿写入生产 |
| Intro 价 | $0.75 / $3.75 每百万 token,至 2026-12-31 | 未披露 |
| 2027 标准价 | $1.50 / $7.50 | 未披露 |
| 上下文 | 约 100 万 token 输入 / 约 64k 输出 | 未披露;Flash 档通常沿用同窗 |
| DeepSWE v1.1 | 65.3%(3.6 为 49.0%) | 无官方分 |
| 定位 | 编码与 Agent 的 workhorse | 传闻称「更接近旗舰、仍走 Flash 价」 |
对照表里右边一列全是空,这本身就是信息:现在能写进架构评审的只有 3.7。左边的 Intro 价已经比 Claude Fable 5 的 $10 / $50 低一个数量级;即便 3.8 真能吃掉部分旗舰质量,决定默认模型的仍是「单次任务成本 × 重试次数」,不是 Arena 匿名分。
性能预测(基于 3.6→3.7,不是跑分)
没有公开 bench,就不能编造 3.8 的百分比。能外推的是 3.6 → 3.7 已经兑现的方向,以及内部员工那句「明显好于 3.7」:
- Agent / 多步工具:3.7 相对 3.6,DeepSWE 从 49.0% 到 65.3%,AutomationBench 从 17.0% 到 30.4%。下一跳若仍瞄准 workhorse,优先项会是更少的无效 tool 重试,而不是再堆上下文长度。
- 编码:FrontierCode 1.1 Main 从 34.4% 到 43.6%。内部 Preview 放在 Jetski(编码平台)上,说明 Google 仍把 Flash 当「写代码、修 Issue」的默认引擎,而不是聊天模型。
- 长文档与抽取:GDP.pdf 一类知识工作从 22.0% 到 34.0%。对 JSON 抽取来说,这通常表现为嵌套字段、enum、数组长度更少跑偏——要等 GA 后用同一套 Schema 回归,不能提前写进 SLA。
- 延迟与价:Flash 的产品承诺是「便宜、快、可日调用几千次」。3.8 若破坏这个承诺(变成伪 Pro),反而会逼团队留在 3.7 Intro 价上。更合理的预测是:单价仍落在 Flash 档,质量往 3.7 的短板补。
和 Claude Fable 5($10 / $50)比「谁更聪明」没有意义;和 3.7 比「同样 Schema 下少几次 tool 来回」才有意义。预测请当成假设,发布当天以模型卡为准。
API JSON 能力前瞻
这是本系列真正要盯的层。Gemini 从 2.5 到 3.7,Structured Output 与 Function Calling 的请求形状几乎没变:换的是模型字符串和行为,不是字段名。3.8 若作为 3.7 的迭代,最稳的前瞻是——兼容,而不是新造一套 JSON API。
Structured Output:继续用 Schema,不要赌新开关
今天 3.7 的写法,3.8 GA 后大概率仍适用:response_mime_type=application/json,再配 response_schema(Pydantic)或 response_json_schema(JSON Schema 字典)。约束解码在生成阶段挡住非法 token,这和《Gemini JSON 教程》《从 Prompt 到 Structured Output》里讲的是同一条路。
from google import genai
from pydantic import BaseModel, Field
# 3.8 未 GA 前不要把生产模型改成未文档化的 ID。
# GA 后通常只改这一处字符串,Schema 与校验流水线不动。
MODEL = "gemini-3.7-flash"
class ExtractedTask(BaseModel):
title: str
priority: str = Field(description="low | medium | high")
due_date: str | None = None
client = genai.Client()
response = client.models.generate_content(
model=MODEL,
contents="从纪要提取待办:下周五前完成预算评审,高优先级。",
config={
"response_mime_type": "application/json",
"response_schema": ExtractedTask,
},
)
print(response.parsed)
对 3.8 的合理期待:复杂嵌套、可选字段、enum 与数组的一次通过率再高一点,thinking 与 JSON 同开时少把推理文本漏进对象。对 3.8 的不要期待:突然支持完整 JSON Schema 2020-12(Gemini 对 additionalProperties、prefixItems 等子集限制见对比文)、或取消「最终答复 JSON」和「工具参数 JSON」的分工。
Function Calling:工具 Schema 继续当合同
工具侧仍是 tools + parameters JSON Schema,模型回 functionCall,宿主执行后再回灌。3.7 的卖点是多步规划更「较真」;若 3.8 内部狗粮确实「明显更好」,最先应表现在少选错工具、少漏 required、少对同一工具空转。MCP 的 inputSchema 仍要和声明对齐,否则模型填参通过、Server 拒收——这与 3.8 是否发布无关,见《Tool Calling → MCP 数据流》。
from google import genai
from google.genai import types
lookup_order = types.FunctionDeclaration(
name="lookup_order",
description="按订单号返回物流状态",
parameters={
"type": "object",
"properties": {
"order_id": {"type": "string", "description": "订单号,如 GW-20260828"}
},
"required": ["order_id"],
},
)
client = genai.Client()
response = client.models.generate_content(
model="gemini-3.7-flash",
contents="查一下 GW-20260828 发货了没有",
config=types.GenerateContentConfig(
tools=[types.Tool(function_declarations=[lookup_order])],
),
)
| JSON 用途 | 今天(3.7) | 3.8 前瞻 |
|---|---|---|
| 最终答复 / 抽取 | responseMimeType + Schema | 字段名大概率不变;盯一次通过率 |
| 工具参数 | tools[].parameters | 少重试、少类型漂移;合同不要改松 |
| MCP | inputSchema 与工具声明对齐 | 与模型代际无关,继续本地校验 |
落地仍建议两道闸:json.loads + 同一份 JSON Schema 再校验;金额、枚举、时区等业务不变量自己写。样例输出丢进 JSON 工具箱做本地 Diff,不上传——3.7 和未来的 3.8 用同一套夹具,才比较得了「是不是真的更稳」。
开发者现在该做什么
- 生产继续钉在 3.7 Flash:
gemini-3.7-flash吃 Intro 价,把 default model 做成配置而不是散落硬编码。 - 不要预留不存在的 3.8 ID:内部 Preview 名称不能当 SDK 参数。等 AI Studio / DeepMind 模型卡出现再加一行 fallback。
- 先把 JSON 回归夹具写完:同一批 Prompt,分别跑 Structured Output 与 Tool Calling,用本地校验器对照 Schema。3.8 一旦 GA,只换模型再跑一遍。
- 缓存 System + tools:Agent 系统提示和工具列表走 Context Caching,3.7 Intro 期缓存读取约 $0.075 / 1M token。
- 预算按 2027 标准价算:即便 3.8 带着新 Intro 价,3.7 自己也会在 2027-01-01 翻倍。不要让 Q1 账单依赖「传闻中的更便宜」。
- 只看官方渠道:DeepMind Flash 模型卡、Gemini API changelog、Vertex 模型列表。X 泄漏和 Arena 匿名模型不当作排期。
常见问题 FAQ
Gemini 3.8 Flash 什么时候发布?
Google 尚未公布日期。按 3.6 到 3.7 约三周、以及 CEO 所述的接近月更节奏,若内部 Preview 顺利,对外窗口更可能在 2026 年 9 月上旬到中旬。这不是官方承诺,不能当项目截止日期。
现在能调用 gemini-3.8-flash 吗?
不能。截至 2026 年 8 月 28 日没有公开 API、SDK 模型 ID 或 DeepMind 模型卡。生产请使用 gemini-3.7-flash。
内部 Preview 是不是等于即将 GA?
不等于。Business Insider 证实员工在 Jetski 上看到 Gemini 3.8 Flash Preview,Google 拒绝置评。内部 dogfood 可能数周后 GA,也可能改名或合回 3.7。把它当成「正在做」,而不是「已排期」。
3.8 会比 3.7 更强、更便宜吗?
没有官方 bench 和价目。3.7 相对 3.6 的提升集中在 Agent 多步工具与编码;内部员工称 3.8 Preview「明显好于 3.7」,但样本不可外推。价格更可能留在 Flash 档,而不是突然对标旗舰标价。
3.8 的 Structured Output / Function Calling 会换 API 吗?
从 2.5 到 3.7 的惯例是模型 ID 变、请求字段不变:response_mime_type、response_schema / response_json_schema、tools.parameters 继续用。3.8 作为 Flash 小版本,应先假设兼容,GA 当天再对同一套 Schema 做回归。
该不该等 3.8 再上 Structured Output?
不该等。JSON Schema 契约、二次校验和错误回灌与具体 Flash 小版本无关。先在 3.7 上把流水线跑通,3.8 来了只换模型字符串。
总结
Gemini 3.8 Flash 还没发布。2026 年 8 月 28 日能确认的是:3.7 Flash 在服役、Intro 价还在、内部已经出现 3.8 Preview。按近两个月的 Flash 节奏,公开日更像「九月前后的数周」,而不是等 Gemini 4。性能与价格都还没有模型卡,预测只能沿着 3.6→3.7 的 Agent / 编码方向外推。
API 层的 JSON 故事没有变:Structured Output 管最终形状,Function Calling 管工具参数,两边都用 JSON Schema。今天把夹具和本地校验准备好,比追泄漏日历更有用。3.8 一旦出现在官方模型列表,用同一套 Schema 再跑一遍即可。