Gemini 3.8 Flash 什么时候发布?2026 最新消息、性能预测与 API JSON 能力前瞻

截至 2026 年 8 月 28 日,Gemini 3.8 Flash 尚未官方发布。梳理内部 Preview、泄漏线索、发布窗口、相对 3.7 Flash 的性能预测,以及 Structured Output / Function Calling 的 API JSON 前瞻。

先给结论:截至 2026 年 8 月 28 日,Gemini 3.8 Flash 还没有官方发布。没有公开的模型卡、没有 gemini-3.8-flash API、Google DeepMind 文档仍停在 8 月 13 日上线的 Gemini 3.7 Flash。同一周里,Business Insider 报道员工已在内部编码平台 Jetski 试用「Gemini 3.8 Flash Preview」,X 上也有「数周内公开」的传闻——这些都是线索,不是发版说明。

上一篇《Gemini 3.7 Flash 价格、API 与 JSON 介绍》把当前可调用的 Flash 讲清楚了;《Gemini API 结构化 JSON 教程》和《OpenAI vs Gemini Structured Output》则是 Schema 契约。这篇只回答三件事:3.8 什么时候可能来、性能大概往哪走、API 层的 JSON / Function Calling 会不会改。

发布了没有:2026-08-28 现状

可以当作核对清单:

  • 公开产品:未发布。AI Studio / Gemini API / Vertex AI 模型列表里没有可调用的 3.8 Flash。
  • 模型 ID:不存在已文档化的 gemini-3.8-flash。把字符串写进生产配置会直接 404。
  • 价格:未披露。任何「3.8 只要 3.7 一半价钱」的表格都没有官方出处。
  • 当前主力 Flash:仍是 gemini-3.7-flash,Intro 价 $0.75 / $3.75(每百万 input / output token)至 2026-12-31,2027-01-01 起标准价 $1.50 / $7.50。

所以「什么时候发布」的诚实答案是:Google 还没定公开日;按 Flash 近两个月的节奏,更像「数周内」而不是「明年」。下面把线索和节奏拆开,避免把内部 Preview 当成 GA。

8 月最新消息与证据强度

按可信度从高到低排,而不是按社交媒体热度。

时间消息强度
2026-08-13Gemini 3.7 Flash 正式 GA,官方模型卡与 Intro 价上线已确认
2026-08-10有腾讯论文把「Gemini 3.8 Flash」写成评测裁判之一(3.7 发布前三天)弱:可能笔误,也可能提前拿到内部名
2026 Q2 财报Sundar Pichai 称 Flash 线目标接近「每月一更」已确认(节奏,不是 3.8 本身)
2026-08-27Business Insider:员工在内部平台 Jetski 使用「Gemini 3.8 Flash Preview」;Google 拒绝置评中高:有图、有具名报道,仍非正式发版
2026-08-27X 账号称 3.8 已内部部署、可能数周内公开,并对比 Claude Fable 5弱:无模型卡、无 API
同期Arena AI 出现疑似 3.8 匿名模型的猜测弱:无法核验身份

Business Insider 的细节值得单独记下:内部名称是 Gemini 3.8 Flash Preview,入口是 Google 内部编码平台 Jetski;一名试用员工说「已经明显好于 3.7 Flash」,同时强调「现在做完整评测还太早」。这和 3.6 → 3.7 的对外节奏一致——先内部 dogfood,再隔两三周 GA。

X 上更激进的说法(「已完成数月合作伙伴测试」「Fable 5 级质量、Flash 级价格」)目前没有 DeepMind 模型卡或 API changelog 支撑。腾讯论文里只出现一次「3.8」,更合理的解释仍是两种:研究员写错版本号,或评测组用过尚未公开的内部端点。一篇论文里的一个词,不能当发布日历。

发布窗口怎么推

Google 没有公布 3.8 的日期。能推的只有 Flash 线自己的间隔:

  • Gemini 3.6 Flash:2026 年 7 月下旬 GA(与 3.5 Flash-Lite 等同一波)。
  • Gemini 3.7 Flash:2026-08-13 GA,距 3.6 大约三周。
  • Pichai 在 Q2 电话会的表述:Flash 尽量做到接近月更。
  • 3.8 Preview 已在 8 月 27 日出现在内部平台——说明至少进入员工试用,不等于「下周一定对外」。

若继续「三到四周三更一版」,对外 Developer Preview / GA 更可能落在 2026 年 9 月上旬到中旬,而不是拖到 Gemini 4。Gemini 4 的预训练官方只确认 2026-07-21 已启动,没有发布窗口;「3.8 会早于 Gemini 4」几乎是一句空话——旗舰本来就更慢。

也要把「不发布」算进概率:内部 Preview 可能合回 3.7 的静默更新,或改名再出。规划项目时,不要把 3.8 写成里程碑依赖;把 model 字符串做成配置,3.7 继续承担流量。

3.7 Flash vs 传闻中的 3.8

项Gemini 3.7 Flash(已确认)Gemini 3.8 Flash(未确认)
状态2026-08-13 GA内部 Preview 报道;无公开 API
模型 IDgemini-3.7-flash未文档化;勿写入生产
Intro 价$0.75 / $3.75 每百万 token,至 2026-12-31未披露
2027 标准价$1.50 / $7.50未披露
上下文约 100 万 token 输入 / 约 64k 输出未披露;Flash 档通常沿用同窗
DeepSWE v1.165.3%(3.6 为 49.0%)无官方分
定位编码与 Agent 的 workhorse传闻称「更接近旗舰、仍走 Flash 价」

对照表里右边一列全是空,这本身就是信息:现在能写进架构评审的只有 3.7。左边的 Intro 价已经比 Claude Fable 5 的 $10 / $50 低一个数量级;即便 3.8 真能吃掉部分旗舰质量,决定默认模型的仍是「单次任务成本 × 重试次数」,不是 Arena 匿名分。

性能预测(基于 3.6→3.7,不是跑分)

没有公开 bench,就不能编造 3.8 的百分比。能外推的是 3.6 → 3.7 已经兑现的方向,以及内部员工那句「明显好于 3.7」:

  • Agent / 多步工具:3.7 相对 3.6,DeepSWE 从 49.0% 到 65.3%,AutomationBench 从 17.0% 到 30.4%。下一跳若仍瞄准 workhorse,优先项会是更少的无效 tool 重试,而不是再堆上下文长度。
  • 编码:FrontierCode 1.1 Main 从 34.4% 到 43.6%。内部 Preview 放在 Jetski(编码平台)上,说明 Google 仍把 Flash 当「写代码、修 Issue」的默认引擎,而不是聊天模型。
  • 长文档与抽取:GDP.pdf 一类知识工作从 22.0% 到 34.0%。对 JSON 抽取来说,这通常表现为嵌套字段、enum、数组长度更少跑偏——要等 GA 后用同一套 Schema 回归,不能提前写进 SLA。
  • 延迟与价:Flash 的产品承诺是「便宜、快、可日调用几千次」。3.8 若破坏这个承诺(变成伪 Pro),反而会逼团队留在 3.7 Intro 价上。更合理的预测是:单价仍落在 Flash 档,质量往 3.7 的短板补。

和 Claude Fable 5($10 / $50)比「谁更聪明」没有意义;和 3.7 比「同样 Schema 下少几次 tool 来回」才有意义。预测请当成假设,发布当天以模型卡为准。

API JSON 能力前瞻

这是本系列真正要盯的层。Gemini 从 2.5 到 3.7,Structured Output 与 Function Calling 的请求形状几乎没变:换的是模型字符串和行为,不是字段名。3.8 若作为 3.7 的迭代,最稳的前瞻是——兼容,而不是新造一套 JSON API。

Structured Output:继续用 Schema,不要赌新开关

今天 3.7 的写法,3.8 GA 后大概率仍适用:response_mime_type=application/json,再配 response_schema(Pydantic)或 response_json_schema(JSON Schema 字典)。约束解码在生成阶段挡住非法 token,这和《Gemini JSON 教程》《从 Prompt 到 Structured Output》里讲的是同一条路。

from google import genai
from pydantic import BaseModel, Field

# 3.8 未 GA 前不要把生产模型改成未文档化的 ID。
# GA 后通常只改这一处字符串,Schema 与校验流水线不动。
MODEL = "gemini-3.7-flash"

class ExtractedTask(BaseModel):
    title: str
    priority: str = Field(description="low | medium | high")
    due_date: str | None = None

client = genai.Client()
response = client.models.generate_content(
    model=MODEL,
    contents="从纪要提取待办:下周五前完成预算评审,高优先级。",
    config={
        "response_mime_type": "application/json",
        "response_schema": ExtractedTask,
    },
)
print(response.parsed)

对 3.8 的合理期待:复杂嵌套、可选字段、enum 与数组的一次通过率再高一点,thinking 与 JSON 同开时少把推理文本漏进对象。对 3.8 的不要期待:突然支持完整 JSON Schema 2020-12(Gemini 对 additionalProperties、prefixItems 等子集限制见对比文)、或取消「最终答复 JSON」和「工具参数 JSON」的分工。

Function Calling:工具 Schema 继续当合同

工具侧仍是 tools + parameters JSON Schema,模型回 functionCall,宿主执行后再回灌。3.7 的卖点是多步规划更「较真」;若 3.8 内部狗粮确实「明显更好」,最先应表现在少选错工具、少漏 required、少对同一工具空转。MCP 的 inputSchema 仍要和声明对齐,否则模型填参通过、Server 拒收——这与 3.8 是否发布无关,见《Tool Calling → MCP 数据流》。

from google import genai
from google.genai import types

lookup_order = types.FunctionDeclaration(
    name="lookup_order",
    description="按订单号返回物流状态",
    parameters={
        "type": "object",
        "properties": {
            "order_id": {"type": "string", "description": "订单号,如 GW-20260828"}
        },
        "required": ["order_id"],
    },
)

client = genai.Client()
response = client.models.generate_content(
    model="gemini-3.7-flash",
    contents="查一下 GW-20260828 发货了没有",
    config=types.GenerateContentConfig(
        tools=[types.Tool(function_declarations=[lookup_order])],
    ),
)
JSON 用途今天(3.7)3.8 前瞻
最终答复 / 抽取responseMimeType + Schema字段名大概率不变;盯一次通过率
工具参数tools[].parameters少重试、少类型漂移;合同不要改松
MCPinputSchema 与工具声明对齐与模型代际无关,继续本地校验

落地仍建议两道闸:json.loads + 同一份 JSON Schema 再校验;金额、枚举、时区等业务不变量自己写。样例输出丢进 JSON 工具箱做本地 Diff,不上传——3.7 和未来的 3.8 用同一套夹具,才比较得了「是不是真的更稳」。

开发者现在该做什么

  1. 生产继续钉在 3.7 Flash:gemini-3.7-flash 吃 Intro 价,把 default model 做成配置而不是散落硬编码。
  2. 不要预留不存在的 3.8 ID:内部 Preview 名称不能当 SDK 参数。等 AI Studio / DeepMind 模型卡出现再加一行 fallback。
  3. 先把 JSON 回归夹具写完:同一批 Prompt,分别跑 Structured Output 与 Tool Calling,用本地校验器对照 Schema。3.8 一旦 GA,只换模型再跑一遍。
  4. 缓存 System + tools:Agent 系统提示和工具列表走 Context Caching,3.7 Intro 期缓存读取约 $0.075 / 1M token。
  5. 预算按 2027 标准价算:即便 3.8 带着新 Intro 价,3.7 自己也会在 2027-01-01 翻倍。不要让 Q1 账单依赖「传闻中的更便宜」。
  6. 只看官方渠道:DeepMind Flash 模型卡、Gemini API changelog、Vertex 模型列表。X 泄漏和 Arena 匿名模型不当作排期。

常见问题 FAQ

Gemini 3.8 Flash 什么时候发布?

Google 尚未公布日期。按 3.6 到 3.7 约三周、以及 CEO 所述的接近月更节奏,若内部 Preview 顺利,对外窗口更可能在 2026 年 9 月上旬到中旬。这不是官方承诺,不能当项目截止日期。

现在能调用 gemini-3.8-flash 吗?

不能。截至 2026 年 8 月 28 日没有公开 API、SDK 模型 ID 或 DeepMind 模型卡。生产请使用 gemini-3.7-flash。

内部 Preview 是不是等于即将 GA?

不等于。Business Insider 证实员工在 Jetski 上看到 Gemini 3.8 Flash Preview,Google 拒绝置评。内部 dogfood 可能数周后 GA,也可能改名或合回 3.7。把它当成「正在做」,而不是「已排期」。

3.8 会比 3.7 更强、更便宜吗?

没有官方 bench 和价目。3.7 相对 3.6 的提升集中在 Agent 多步工具与编码;内部员工称 3.8 Preview「明显好于 3.7」,但样本不可外推。价格更可能留在 Flash 档,而不是突然对标旗舰标价。

3.8 的 Structured Output / Function Calling 会换 API 吗?

从 2.5 到 3.7 的惯例是模型 ID 变、请求字段不变:response_mime_type、response_schema / response_json_schema、tools.parameters 继续用。3.8 作为 Flash 小版本,应先假设兼容,GA 当天再对同一套 Schema 做回归。

该不该等 3.8 再上 Structured Output?

不该等。JSON Schema 契约、二次校验和错误回灌与具体 Flash 小版本无关。先在 3.7 上把流水线跑通,3.8 来了只换模型字符串。

总结

Gemini 3.8 Flash 还没发布。2026 年 8 月 28 日能确认的是:3.7 Flash 在服役、Intro 价还在、内部已经出现 3.8 Preview。按近两个月的 Flash 节奏,公开日更像「九月前后的数周」,而不是等 Gemini 4。性能与价格都还没有模型卡,预测只能沿着 3.6→3.7 的 Agent / 编码方向外推。

API 层的 JSON 故事没有变:Structured Output 管最终形状,Function Calling 管工具参数,两边都用 JSON Schema。今天把夹具和本地校验准备好,比追泄漏日历更有用。3.8 一旦出现在官方模型列表,用同一套 Schema 再跑一遍即可。