Resposta curta: em 28 de agosto de 2026, o Gemini 3.8 Flash não está publicado publicamente. Não há model card, não há API documentada gemini-3.8-flash, e a documentação Flash do Google DeepMind ainda para no Gemini 3.7 Flash, que entrou em GA em 13 de agosto. Na mesma semana, a Business Insider relatou que funcionários já testam um «Gemini 3.8 Flash Preview» na plataforma interna de codificação Jetski, e posts no X falam de um lançamento público «em algumas semanas». São pistas, não uma nota de lançamento.
O artigo anterior, Gemini 3.7 Flash: preços, API e JSON, cobre o modelo Flash que você realmente pode chamar. JSON estruturado com a API Gemini e OpenAI vs Gemini Structured Output cobrem o contrato Schema. Este artigo responde só três perguntas: quando o 3.8 pode chegar, para onde a qualidade deve se mover e se a forma da requisição JSON / Function Calling vai mudar.
Já foi lançado? Status em 2026-08-28
Trate isto como uma lista de verificação:
- Produto público: não lançado. AI Studio / Gemini API / Vertex AI não listam um 3.8 Flash invocável.
- Model ID: não há
gemini-3.8-flashdocumentado. Colocar essa string em produção vai retornar 404. - Preços: não divulgados. Tabelas que afirmam «3.8 pela metade do 3.7» não têm fonte oficial.
- Workhorse Flash atual: ainda é
gemini-3.7-flash, preço intro de $0,75 / $3,75 por milhão de tokens de entrada / saída até 2026-12-31, depois $1,50 / $7,50 a partir de 2027-01-01.
Então a resposta honesta a «quando lança?» é: o Google não definiu uma data pública; dados os dois últimos lançamentos Flash, «semanas, não o ano que vem» é o prior mais razoável. O restante deste texto separa rumor e cadência para que um Preview interno não seja confundido com GA.
Notícias de agosto e força das evidências
Ordene por evidência, não pelo calor das redes sociais.
| Data | Afirmação | Força |
|---|---|---|
| 2026-08-13 | Gemini 3.7 Flash GA, model card oficial e preços intro | Confirmado |
| 2026-08-10 | Um paper da Tencent nomeia «Gemini 3.8 Flash» como um dos juízes LLM (três dias antes do GA do 3.7) | Fraco: typo ou nome interno antecipado |
| Resultados Q2 2026 | Sundar Pichai disse que o Flash deveria chegar perto de uma cadência mensal | Confirmado (cadência, não o 3.8 em si) |
| 2026-08-27 | Business Insider: equipe usando «Gemini 3.8 Flash Preview» no Jetski; o Google se recusou a comentar | Média-alta: reportagem nomeada, ainda não é lançamento |
| 2026-08-27 | Posts no X: já interno, talvez público em semanas, qualidade nível Fable 5 | Fraco: sem model card, sem API |
| Mesmo período | Palpites de que um modelo anônimo da Arena AI é o 3.8 | Fraco: identidade não verificada |
Os detalhes da Business Insider importam: o rótulo interno é Gemini 3.8 Flash Preview, a superfície é o Jetski, e um tester disse que já parecia «notavelmente melhor que o 3.7 Flash» ao ressaltar que era cedo demais para uma review completa. Isso combina com o padrão 3.6 → 3.7 — dogfood dentro do Google, depois GA algumas semanas depois.
As afirmações mais barulhentas no X («meses de testes com partners», «qualidade Fable 5 a preço Flash») ainda têm nenhum model card da DeepMind nem changelog de API por trás. O paper da Tencent menciona «3.8» uma vez. As duas explicações chatas continuam as melhores: um typo de versão, ou um time de eval batendo num endpoint não publicado. Uma palavra num paper não é calendário de lançamento.
Como ler a janela de lançamento
O Google não publicou uma data para o 3.8. Os únicos intervalos que você pode usar são os da própria linha Flash:
- Gemini 3.6 Flash: GA no fim de julho de 2026 (mesma onda do 3.5 Flash-Lite).
- Gemini 3.7 Flash: GA em 2026-08-13, cerca de três semanas depois do 3.6.
- Pichai na call do Q2: o Flash deve ficar perto do mensal.
- Um 3.8 Preview estava numa plataforma interna em 27 de agosto — trial de funcionários, não «lança na semana que vem».
Se o ritmo de três a quatro semanas se mantiver, um Developer Preview ou GA público é mais provável no início ou meados de setembro de 2026 do que como apêndice do Gemini 4. O pré-treinamento do Gemini 4 foi confirmado como iniciado em 2026-07-21 sem janela de lançamento; «3.8 antes do Gemini 4» é um listão baixo porque o flagship é mais lento por desenho.
Inclua também no cálculo o «nunca lança como 3.8»: um Preview interno pode ser absorvido numa atualização silenciosa do 3.7 ou voltar com outro nome. Não faça do 3.8 uma dependência de marco. Deixe a string do modelo na configuração e o tráfego no 3.7.
3.7 Flash vs o 3.8 rumorado
| Item | Gemini 3.7 Flash (confirmado) | Gemini 3.8 Flash (não confirmado) |
|---|---|---|
| Status | GA 2026-08-13 | Preview interno relatado; sem API pública |
| Model ID | gemini-3.7-flash | Não documentado; não coloque em produção |
| Preço intro | $0.75 / $3.75 por milhão de tokens até 2026-12-31 | Não divulgado |
| Padrão 2027 | $1.50 / $7.50 | Não divulgado |
| Contexto | ~1M entrada / ~64k saída | Não divulgado; Flash costuma manter a janela |
| DeepSWE v1.1 | 65,3% (3.6: 49,0%) | Sem score oficial |
| Posicionamento | Workhorse para codificação e agentes | Rumor: mais perto do flagship, ainda com preço Flash |
A coluna direita vazia é o ponto: o único Flash que você pode levar hoje a uma revisão de arquitetura é o 3.7. O preço intro já está uma ordem de magnitude abaixo do Claude Fable 5 a $10 / $50. Mesmo que o 3.8 feche parte dessa lacuna de qualidade, o modelo padrão ainda é escolhido por custo por tarefa × retentativas — não por um score anônimo da Arena.
Perspectiva de desempenho (de 3.6→3.7, sem scores inventados)
Sem bench público, não invente porcentagens do 3.8. O que você pode extrapolar é a direção que 3.6 → 3.7 já pagou, mais o comentário interno «notavelmente melhor que o 3.7»:
- Agentes / ferramentas multi-etapas: 3.7 vs 3.6 moveu DeepSWE de 49,0% para 65,3% e AutomationBench de 17,0% para 30,4%. Se o próximo salto continuar workhorse, o prêmio é menos retentativas de ferramenta desperdiçadas, não mais um headline de janela de contexto.
- Codificação: FrontierCode 1.1 Main passou de 34,4% para 43,6%. Colocar o Preview no Jetski (uma superfície de codificação) é um sinal de que o Flash continua o motor padrão para escrever e corrigir código, não uma pele de chat.
- Documentos longos e extração: scores de trabalho de conhecimento como GDP.pdf passaram de 22,0% para 34,0%. Para extração JSON isso costuma significar menos deriva em campos aninhados, enums e comprimentos de array — espere o GA e rode de novo o mesmo Schema; não escreva isso num SLA cedo demais.
- Latência e preço: a promessa de produto do Flash é barato, rápido e invocável milhares de vezes por dia. Se o 3.8 quebrasse isso (um Pro disfarçado), os times ficariam no preço intro do 3.7. A previsão mais segura é preço de faixa Flash, qualidade apontada para os pontos fracos do 3.7.
Comparar «quem é mais inteligente» com o Claude Fable 5 ($10 / $50) é o recorte errado. Comparar «menos idas e voltas de ferramenta no mesmo Schema» com o 3.7 é o certo. Trate cada previsão como hipótese até existir um model card.
Prévia JSON da API
Esta é a camada com que a série realmente se importa. Do Gemini 2.5 ao 3.7, Structured Output e Function Calling mantiveram quase a mesma forma de requisição: a string do modelo e o comportamento mudaram, os nomes de campo não. Se o 3.8 for um incremento do 3.7, a prévia estável é compatibilidade, não uma nova API JSON.
Structured Output: fique com o Schema, não aposte num interruptor novo
O padrão de hoje do 3.7 quase certamente ainda vale depois do GA do 3.8: response_mime_type=application/json mais response_schema (Pydantic) ou response_json_schema (um dicionário JSON Schema). A decodificação restrita bloqueia tokens ilegais na geração — o mesmo caminho de o guia JSON da Gemini e Do prompt ao Structured Output.
from google import genai
from pydantic import BaseModel, Field
# Do not point production at an undocumented 3.8 ID before GA.
# After GA you typically change this one string; Schema and checks stay put.
MODEL = "gemini-3.7-flash"
class ExtractedTask(BaseModel):
title: str
priority: str = Field(description="low | medium | high")
due_date: str | None = None
client = genai.Client()
response = client.models.generate_content(
model=MODEL,
contents="Extract the action item: finish the budget review by next Friday, high priority.",
config={
"response_mime_type": "application/json",
"response_schema": ExtractedTask,
},
)
print(response.parsed)
Esperanças razoáveis para o 3.8: taxa de acerto na primeira passagem mais alta em objetos aninhados, campos opcionais, enums e arrays; menos vazamento de chain-of-thought quando thinking e JSON estão os dois ligados. Não espere JSON Schema 2020-12 completo (os limites de subconjunto da Gemini em additionalProperties, prefixItems e afins estão no artigo de comparação), nem que «JSON de resposta final» e «JSON de argumentos de ferramenta» virem um único controle.
Function Calling: o Schema da ferramenta continua o contrato
O lado de ferramentas ainda é tools mais um JSON Schema de parameters, um functionCall do modelo, depois execução no host e um turno de follow-up. O argumento de venda do 3.7 foi planos multi-etapas mais rigorosos; se o dogfood do 3.8 for mesmo «notavelmente melhor», procure primeiro menos ferramentas erradas, menos campos required omitidos, menos loops vazios na mesma ferramenta. O inputSchema do MCP ainda precisa bater com a declaração, ou o modelo «passa» e o servidor rejeita — isso é independente do 3.8. Veja Tool Calling → fluxo de dados MCP.
from google import genai
from google.genai import types
lookup_order = types.FunctionDeclaration(
name="lookup_order",
description="Return shipment status for an order id",
parameters={
"type": "object",
"properties": {
"order_id": {"type": "string", "description": "Order id, e.g. GW-20260828"}
},
"required": ["order_id"],
},
)
client = genai.Client()
response = client.models.generate_content(
model="gemini-3.7-flash",
contents="Has GW-20260828 shipped yet?",
config=types.GenerateContentConfig(
tools=[types.Tool(function_declarations=[lookup_order])],
),
)
| Papel do JSON | Hoje (3.7) | Prévia 3.8 |
|---|---|---|
| Resposta final / extração | responseMimeType + Schema | Nomes de campo provavelmente iguais; vigie a taxa na primeira passagem |
| Argumentos de ferramenta | tools[].parameters | Menos retentativas e deriva de tipo; não afrouxe o contrato |
| MCP | inputSchema alinhado com a ferramenta | Independente do bump de modelo; mantenha validação local |
Mantenha duas portas: json.loads mais o mesmo JSON Schema, depois as suas invariantes (dinheiro, enums, fusos). Jogue saídas de amostra na caixa de ferramentas JSON para um Diff local — sem upload. 3.7 e um futuro 3.8 devem compartilhar os mesmos fixtures, ou você não consegue dizer se de fato ficou mais estável.
O que fazer agora
- Mantenha produção no 3.7 Flash:
gemini-3.7-flashno preço intro, modelo padrão na configuração, não literais espalhados. - Não reserve um ID 3.8 fictício: nome de Preview interno não é argumento de SDK. Adicione uma linha de fallback só depois que o AI Studio / o card da DeepMind listarem.
- Termine primeiro os fixtures JSON: os mesmos prompts por Structured Output e Tool Calling, checados localmente contra Schema. Quando o 3.8 entrar em GA, rode de novo uma vez com a nova string de modelo.
- Cacheie System + tools: coloque o prompt de sistema do agente e a lista de ferramentas no Context Caching. Leituras de cache intro do 3.7 saem por cerca de $0,075 / 1M tokens.
- Orce nas tarifas padrão de 2027: mesmo que o 3.8 saia com um preço intro novo, o 3.7 em si dobra em 2027-01-01. Não deixe uma fatura de Q1 depender de um SKU rumorado mais barato.
- Olhe só canais oficiais: o card Flash da DeepMind, o changelog da Gemini API, a lista de modelos do Vertex. Vazamentos no X e modelos anônimos da Arena não são cronograma.
FAQ
Quando o Gemini 3.8 Flash será lançado?
O Google não publicou uma data. Dado o intervalo de cerca de três semanas entre 3.6 e 3.7 e a cadência Flash quase mensal do CEO, uma janela pública no início ou meados de setembro de 2026 é o prior melhor se o Preview interno correr bem. Isso não é um compromisso e não pode ser prazo de projeto.
Posso chamar gemini-3.8-flash hoje?
Não. Em 28 de agosto de 2026 não há API pública, model ID de SDK nem model card da DeepMind. Use gemini-3.7-flash em produção.
Um Preview interno significa que o GA é iminente?
Não. A Business Insider confirmou que a equipe viu Gemini 3.8 Flash Preview no Jetski; o Google se recusou a comentar. Dogfood pode ir a GA em semanas, ou ser renomeado ou reabsorvido no 3.7. Leia como «em andamento», não «agendado».
O 3.8 será mais forte e mais barato que o 3.7?
Não há bench oficial nem lista de preços. Os ganhos do 3.7 sobre o 3.6 ficaram em ferramentas multi-etapas e codificação; um tester interno chamou o 3.8 Preview de «notavelmente melhor que o 3.7», o que não se generaliza. É mais provável o preço ficar na faixa Flash do que saltar para tarifas de flagship.
Structured Output / Function Calling mudam de API no 3.8?
O hábito de 2.5→3.7 é: novo model ID, mesmos campos de requisição — response_mime_type, response_schema / response_json_schema, tools.parameters. Trate um incremento Flash como compatível primeiro e depois faça regressão do mesmo Schema no dia do GA.
Devo esperar o 3.8 antes de adotar Structured Output?
Não. O contrato JSON Schema, um segundo passe de validação e o replay de erros não dependem de uma versão menor do Flash. Deixe o pipeline verde no 3.7; 3.8 é troca de string de modelo.
Conclusões
O Gemini 3.8 Flash não foi lançado. Em 28 de agosto de 2026 os fatos confirmados são: o 3.7 Flash está em produção, o preço intro ainda vale, e um 3.8 Preview interno já circula. A cadência Flash dos últimos dois meses aponta para «semanas em torno de setembro», não «esperar o Gemini 4». Desempenho e preço ainda não têm model card; a única previsão honesta segue o vetor de agentes e codificação de 3.6→3.7.
A história JSON na API não mudou: Structured Output dono da forma final, Function Calling dono dos argumentos de ferramenta, os dois usam JSON Schema. Fixtures e validação local hoje valem mais que um calendário de vazamentos. Quando o 3.8 aparecer na lista oficial de modelos, rode o mesmo Schema uma vez.