Quando o Gemini 3.8 Flash será lançado? Notícias de agosto de 2026, desempenho e JSON da API

Em 28 de agosto de 2026 o Gemini 3.8 Flash não é público. Preview interno, janela provável em setembro, previsão cautelosa frente ao 3.7 e se Structured Output / Function Calling muda.

Resposta curta: em 28 de agosto de 2026, o Gemini 3.8 Flash não está publicado publicamente. Não há model card, não há API documentada gemini-3.8-flash, e a documentação Flash do Google DeepMind ainda para no Gemini 3.7 Flash, que entrou em GA em 13 de agosto. Na mesma semana, a Business Insider relatou que funcionários já testam um «Gemini 3.8 Flash Preview» na plataforma interna de codificação Jetski, e posts no X falam de um lançamento público «em algumas semanas». São pistas, não uma nota de lançamento.

O artigo anterior, Gemini 3.7 Flash: preços, API e JSON, cobre o modelo Flash que você realmente pode chamar. JSON estruturado com a API Gemini e OpenAI vs Gemini Structured Output cobrem o contrato Schema. Este artigo responde só três perguntas: quando o 3.8 pode chegar, para onde a qualidade deve se mover e se a forma da requisição JSON / Function Calling vai mudar.

Já foi lançado? Status em 2026-08-28

Trate isto como uma lista de verificação:

  • Produto público: não lançado. AI Studio / Gemini API / Vertex AI não listam um 3.8 Flash invocável.
  • Model ID: não há gemini-3.8-flash documentado. Colocar essa string em produção vai retornar 404.
  • Preços: não divulgados. Tabelas que afirmam «3.8 pela metade do 3.7» não têm fonte oficial.
  • Workhorse Flash atual: ainda é gemini-3.7-flash, preço intro de $0,75 / $3,75 por milhão de tokens de entrada / saída até 2026-12-31, depois $1,50 / $7,50 a partir de 2027-01-01.

Então a resposta honesta a «quando lança?» é: o Google não definiu uma data pública; dados os dois últimos lançamentos Flash, «semanas, não o ano que vem» é o prior mais razoável. O restante deste texto separa rumor e cadência para que um Preview interno não seja confundido com GA.

Notícias de agosto e força das evidências

Ordene por evidência, não pelo calor das redes sociais.

DataAfirmaçãoForça
2026-08-13Gemini 3.7 Flash GA, model card oficial e preços introConfirmado
2026-08-10Um paper da Tencent nomeia «Gemini 3.8 Flash» como um dos juízes LLM (três dias antes do GA do 3.7)Fraco: typo ou nome interno antecipado
Resultados Q2 2026Sundar Pichai disse que o Flash deveria chegar perto de uma cadência mensalConfirmado (cadência, não o 3.8 em si)
2026-08-27Business Insider: equipe usando «Gemini 3.8 Flash Preview» no Jetski; o Google se recusou a comentarMédia-alta: reportagem nomeada, ainda não é lançamento
2026-08-27Posts no X: já interno, talvez público em semanas, qualidade nível Fable 5Fraco: sem model card, sem API
Mesmo períodoPalpites de que um modelo anônimo da Arena AI é o 3.8Fraco: identidade não verificada

Os detalhes da Business Insider importam: o rótulo interno é Gemini 3.8 Flash Preview, a superfície é o Jetski, e um tester disse que já parecia «notavelmente melhor que o 3.7 Flash» ao ressaltar que era cedo demais para uma review completa. Isso combina com o padrão 3.6 → 3.7 — dogfood dentro do Google, depois GA algumas semanas depois.

As afirmações mais barulhentas no X («meses de testes com partners», «qualidade Fable 5 a preço Flash») ainda têm nenhum model card da DeepMind nem changelog de API por trás. O paper da Tencent menciona «3.8» uma vez. As duas explicações chatas continuam as melhores: um typo de versão, ou um time de eval batendo num endpoint não publicado. Uma palavra num paper não é calendário de lançamento.

Como ler a janela de lançamento

O Google não publicou uma data para o 3.8. Os únicos intervalos que você pode usar são os da própria linha Flash:

  • Gemini 3.6 Flash: GA no fim de julho de 2026 (mesma onda do 3.5 Flash-Lite).
  • Gemini 3.7 Flash: GA em 2026-08-13, cerca de três semanas depois do 3.6.
  • Pichai na call do Q2: o Flash deve ficar perto do mensal.
  • Um 3.8 Preview estava numa plataforma interna em 27 de agosto — trial de funcionários, não «lança na semana que vem».

Se o ritmo de três a quatro semanas se mantiver, um Developer Preview ou GA público é mais provável no início ou meados de setembro de 2026 do que como apêndice do Gemini 4. O pré-treinamento do Gemini 4 foi confirmado como iniciado em 2026-07-21 sem janela de lançamento; «3.8 antes do Gemini 4» é um listão baixo porque o flagship é mais lento por desenho.

Inclua também no cálculo o «nunca lança como 3.8»: um Preview interno pode ser absorvido numa atualização silenciosa do 3.7 ou voltar com outro nome. Não faça do 3.8 uma dependência de marco. Deixe a string do modelo na configuração e o tráfego no 3.7.

3.7 Flash vs o 3.8 rumorado

ItemGemini 3.7 Flash (confirmado)Gemini 3.8 Flash (não confirmado)
StatusGA 2026-08-13Preview interno relatado; sem API pública
Model IDgemini-3.7-flashNão documentado; não coloque em produção
Preço intro$0.75 / $3.75 por milhão de tokens até 2026-12-31Não divulgado
Padrão 2027$1.50 / $7.50Não divulgado
Contexto~1M entrada / ~64k saídaNão divulgado; Flash costuma manter a janela
DeepSWE v1.165,3% (3.6: 49,0%)Sem score oficial
PosicionamentoWorkhorse para codificação e agentesRumor: mais perto do flagship, ainda com preço Flash

A coluna direita vazia é o ponto: o único Flash que você pode levar hoje a uma revisão de arquitetura é o 3.7. O preço intro já está uma ordem de magnitude abaixo do Claude Fable 5 a $10 / $50. Mesmo que o 3.8 feche parte dessa lacuna de qualidade, o modelo padrão ainda é escolhido por custo por tarefa × retentativas — não por um score anônimo da Arena.

Perspectiva de desempenho (de 3.6→3.7, sem scores inventados)

Sem bench público, não invente porcentagens do 3.8. O que você pode extrapolar é a direção que 3.6 → 3.7 já pagou, mais o comentário interno «notavelmente melhor que o 3.7»:

  • Agentes / ferramentas multi-etapas: 3.7 vs 3.6 moveu DeepSWE de 49,0% para 65,3% e AutomationBench de 17,0% para 30,4%. Se o próximo salto continuar workhorse, o prêmio é menos retentativas de ferramenta desperdiçadas, não mais um headline de janela de contexto.
  • Codificação: FrontierCode 1.1 Main passou de 34,4% para 43,6%. Colocar o Preview no Jetski (uma superfície de codificação) é um sinal de que o Flash continua o motor padrão para escrever e corrigir código, não uma pele de chat.
  • Documentos longos e extração: scores de trabalho de conhecimento como GDP.pdf passaram de 22,0% para 34,0%. Para extração JSON isso costuma significar menos deriva em campos aninhados, enums e comprimentos de array — espere o GA e rode de novo o mesmo Schema; não escreva isso num SLA cedo demais.
  • Latência e preço: a promessa de produto do Flash é barato, rápido e invocável milhares de vezes por dia. Se o 3.8 quebrasse isso (um Pro disfarçado), os times ficariam no preço intro do 3.7. A previsão mais segura é preço de faixa Flash, qualidade apontada para os pontos fracos do 3.7.

Comparar «quem é mais inteligente» com o Claude Fable 5 ($10 / $50) é o recorte errado. Comparar «menos idas e voltas de ferramenta no mesmo Schema» com o 3.7 é o certo. Trate cada previsão como hipótese até existir um model card.

Prévia JSON da API

Esta é a camada com que a série realmente se importa. Do Gemini 2.5 ao 3.7, Structured Output e Function Calling mantiveram quase a mesma forma de requisição: a string do modelo e o comportamento mudaram, os nomes de campo não. Se o 3.8 for um incremento do 3.7, a prévia estável é compatibilidade, não uma nova API JSON.

Structured Output: fique com o Schema, não aposte num interruptor novo

O padrão de hoje do 3.7 quase certamente ainda vale depois do GA do 3.8: response_mime_type=application/json mais response_schema (Pydantic) ou response_json_schema (um dicionário JSON Schema). A decodificação restrita bloqueia tokens ilegais na geração — o mesmo caminho de o guia JSON da Gemini e Do prompt ao Structured Output.

from google import genai
from pydantic import BaseModel, Field

# Do not point production at an undocumented 3.8 ID before GA.
# After GA you typically change this one string; Schema and checks stay put.
MODEL = "gemini-3.7-flash"

class ExtractedTask(BaseModel):
    title: str
    priority: str = Field(description="low | medium | high")
    due_date: str | None = None

client = genai.Client()
response = client.models.generate_content(
    model=MODEL,
    contents="Extract the action item: finish the budget review by next Friday, high priority.",
    config={
        "response_mime_type": "application/json",
        "response_schema": ExtractedTask,
    },
)
print(response.parsed)

Esperanças razoáveis para o 3.8: taxa de acerto na primeira passagem mais alta em objetos aninhados, campos opcionais, enums e arrays; menos vazamento de chain-of-thought quando thinking e JSON estão os dois ligados. Não espere JSON Schema 2020-12 completo (os limites de subconjunto da Gemini em additionalProperties, prefixItems e afins estão no artigo de comparação), nem que «JSON de resposta final» e «JSON de argumentos de ferramenta» virem um único controle.

Function Calling: o Schema da ferramenta continua o contrato

O lado de ferramentas ainda é tools mais um JSON Schema de parameters, um functionCall do modelo, depois execução no host e um turno de follow-up. O argumento de venda do 3.7 foi planos multi-etapas mais rigorosos; se o dogfood do 3.8 for mesmo «notavelmente melhor», procure primeiro menos ferramentas erradas, menos campos required omitidos, menos loops vazios na mesma ferramenta. O inputSchema do MCP ainda precisa bater com a declaração, ou o modelo «passa» e o servidor rejeita — isso é independente do 3.8. Veja Tool Calling → fluxo de dados MCP.

from google import genai
from google.genai import types

lookup_order = types.FunctionDeclaration(
    name="lookup_order",
    description="Return shipment status for an order id",
    parameters={
        "type": "object",
        "properties": {
            "order_id": {"type": "string", "description": "Order id, e.g. GW-20260828"}
        },
        "required": ["order_id"],
    },
)

client = genai.Client()
response = client.models.generate_content(
    model="gemini-3.7-flash",
    contents="Has GW-20260828 shipped yet?",
    config=types.GenerateContentConfig(
        tools=[types.Tool(function_declarations=[lookup_order])],
    ),
)
Papel do JSONHoje (3.7)Prévia 3.8
Resposta final / extraçãoresponseMimeType + SchemaNomes de campo provavelmente iguais; vigie a taxa na primeira passagem
Argumentos de ferramentatools[].parametersMenos retentativas e deriva de tipo; não afrouxe o contrato
MCPinputSchema alinhado com a ferramentaIndependente do bump de modelo; mantenha validação local

Mantenha duas portas: json.loads mais o mesmo JSON Schema, depois as suas invariantes (dinheiro, enums, fusos). Jogue saídas de amostra na caixa de ferramentas JSON para um Diff local — sem upload. 3.7 e um futuro 3.8 devem compartilhar os mesmos fixtures, ou você não consegue dizer se de fato ficou mais estável.

O que fazer agora

  1. Mantenha produção no 3.7 Flash: gemini-3.7-flash no preço intro, modelo padrão na configuração, não literais espalhados.
  2. Não reserve um ID 3.8 fictício: nome de Preview interno não é argumento de SDK. Adicione uma linha de fallback só depois que o AI Studio / o card da DeepMind listarem.
  3. Termine primeiro os fixtures JSON: os mesmos prompts por Structured Output e Tool Calling, checados localmente contra Schema. Quando o 3.8 entrar em GA, rode de novo uma vez com a nova string de modelo.
  4. Cacheie System + tools: coloque o prompt de sistema do agente e a lista de ferramentas no Context Caching. Leituras de cache intro do 3.7 saem por cerca de $0,075 / 1M tokens.
  5. Orce nas tarifas padrão de 2027: mesmo que o 3.8 saia com um preço intro novo, o 3.7 em si dobra em 2027-01-01. Não deixe uma fatura de Q1 depender de um SKU rumorado mais barato.
  6. Olhe só canais oficiais: o card Flash da DeepMind, o changelog da Gemini API, a lista de modelos do Vertex. Vazamentos no X e modelos anônimos da Arena não são cronograma.

FAQ

Quando o Gemini 3.8 Flash será lançado?

O Google não publicou uma data. Dado o intervalo de cerca de três semanas entre 3.6 e 3.7 e a cadência Flash quase mensal do CEO, uma janela pública no início ou meados de setembro de 2026 é o prior melhor se o Preview interno correr bem. Isso não é um compromisso e não pode ser prazo de projeto.

Posso chamar gemini-3.8-flash hoje?

Não. Em 28 de agosto de 2026 não há API pública, model ID de SDK nem model card da DeepMind. Use gemini-3.7-flash em produção.

Um Preview interno significa que o GA é iminente?

Não. A Business Insider confirmou que a equipe viu Gemini 3.8 Flash Preview no Jetski; o Google se recusou a comentar. Dogfood pode ir a GA em semanas, ou ser renomeado ou reabsorvido no 3.7. Leia como «em andamento», não «agendado».

O 3.8 será mais forte e mais barato que o 3.7?

Não há bench oficial nem lista de preços. Os ganhos do 3.7 sobre o 3.6 ficaram em ferramentas multi-etapas e codificação; um tester interno chamou o 3.8 Preview de «notavelmente melhor que o 3.7», o que não se generaliza. É mais provável o preço ficar na faixa Flash do que saltar para tarifas de flagship.

Structured Output / Function Calling mudam de API no 3.8?

O hábito de 2.5→3.7 é: novo model ID, mesmos campos de requisição — response_mime_type, response_schema / response_json_schema, tools.parameters. Trate um incremento Flash como compatível primeiro e depois faça regressão do mesmo Schema no dia do GA.

Devo esperar o 3.8 antes de adotar Structured Output?

Não. O contrato JSON Schema, um segundo passe de validação e o replay de erros não dependem de uma versão menor do Flash. Deixe o pipeline verde no 3.7; 3.8 é troca de string de modelo.

Conclusões

O Gemini 3.8 Flash não foi lançado. Em 28 de agosto de 2026 os fatos confirmados são: o 3.7 Flash está em produção, o preço intro ainda vale, e um 3.8 Preview interno já circula. A cadência Flash dos últimos dois meses aponta para «semanas em torno de setembro», não «esperar o Gemini 4». Desempenho e preço ainda não têm model card; a única previsão honesta segue o vetor de agentes e codificação de 3.6→3.7.

A história JSON na API não mudou: Structured Output dono da forma final, Function Calling dono dos argumentos de ferramenta, os dois usam JSON Schema. Fixtures e validação local hoje valem mais que um calendário de vazamentos. Quando o 3.8 aparecer na lista oficial de modelos, rode o mesmo Schema uma vez.