Resposta curta: em 2 de setembro de 2026, o Gemini 3.8 Flash ainda não está publicado publicamente. O AI Studio, a Gemini API e o Vertex AI não listam um gemini-3.8-flash invocável, e o card da DeepMind ainda para no Gemini 3.7 Flash, que entrou em GA em 13 de agosto. No mesmo dia, vários veículos e contas de vazamento apontaram a quarta-feira como data pública, com o codinome interno skimaki e a afirmação de que o deploy em produção está «feito». São pistas, não uma nota de lançamento.
O texto de 28 de agosto, janela de lançamento do Gemini 3.8 Flash e prévia JSON da API, já cobriu a compatibilidade de Structured Output / Function Calling. Gemini 3.7 Flash: preços, API e JSON é o Flash que você realmente pode chamar. Este artigo acrescenta só três coisas: as notícias em torno de 2 de setembro, como ler a data de saída e para onde o 3.8 deve se mover em AI coding.
Já foi lançado? Status em 2026-09-02
Trate isto como uma lista de verificação:
- Produto público: não lançado. AI Studio / Gemini API / Vertex AI não listam um 3.8 Flash invocável.
- Model ID: não há
gemini-3.8-flashdocumentado. Colocar uma string vazada em produção vai retornar 404. - Preço e contexto: não divulgados. Tabelas da comunidade que afirmam uma janela de 1M-token ou «metade do 3.7» não têm fonte oficial.
- Workhorse Flash atual: ainda é
gemini-3.7-flash, preço intro de $0.75 / $3.75 por milhão de tokens de entrada / saída até 2026-12-31, depois $1.50 / $7.50 a partir de 2027-01-01.
Então a resposta honesta a «quando lança?» é: o Google não definiu uma data pública; hoje é a quarta-feira do rumor, não a quarta-feira do calendário. O restante deste texto separa as pistas de 1–2 de setembro da cadência de agosto para que «production deployment complete» não seja confundido com GA.
Notícias de setembro e força das evidências
Ordene por evidência, não pelo calor de «lança amanhã».
| Data | Afirmação | Força |
|---|---|---|
| 2026-08-13 | Gemini 3.7 Flash GA, model card oficial e preços intro | Confirmado |
| Q2 2026 earnings | Sundar Pichai disse que o Flash deveria chegar perto de uma cadência mensal | Confirmado (cadência, não o 3.8 em si) |
| 2026-08-27 | Business Insider: equipe usando «Gemini 3.8 Flash Preview» no Jetski; o Google se recusou a comentar | Média-alta: reportagem nomeada, ainda não é lançamento |
| 2026-08-10 | Um paper da Tencent nomeia «Gemini 3.8 Flash» como um dos juízes LLM (três dias antes do GA do 3.7) | Fraco: typo ou nome interno antecipado |
| 2026-09-01 | Vazamentos: codinome interno skimaki, production deployment feito, data pública apontada para quarta-feira 2 de setembro | Fraco a médio: textos de segunda mão, sem model card, sem changelog de API |
| 2026-09-02 | Na hora desta escrita, os canais oficiais ainda não têm card 3.8 nem endpoint invocável | Confirmado (o próprio fato de «não lançado») |
A onda de 1º de setembro acrescentou três palavras novas à história de 27 de agosto: skimaki (codinome interno), production deployment complete e quarta-feira pública. CryptoBriefing, 4sAPI e outros transformaram isso em «o Google vai revelar em 2 de setembro». Vale notar: a antecedência da comunidade de vazamentos nos últimos menores Flash não tem sido ruim. «Deployment complete» dentro do Google ainda pode significar só dogfood de funcionários, não um Developer Preview público.
O feedback inicial de testers ainda é uma linha subjetiva: «notavelmente melhor que o 3.7 Flash», com a ressalva de que uma review completa é cedo demais. A cor técnica nova é mais específica: saída menos verbosa (uma reclamação antiga da linha Flash) e correções para modos de falha que o 3.7 expôs. Isso não é um reset geracional — parece outro incremento de duas a três semanas no estilo 3.6→3.7.
As afirmações mais barulhentas no X («qualidade Fable 5 a preço Flash», «meses de testes com partners») ainda têm nenhum model card da DeepMind nem changelog de API. Um «3.8» num paper, ou um modelo anônimo da Arena, não é calendário de lançamento.
Como ler a data de lançamento
O Google não publicou uma data para o 3.8. Os únicos intervalos que você pode usar são os da própria linha Flash, mais o rumor de quarta-feira de hoje:
- Gemini 3.6 Flash: GA por volta de 21 de julho de 2026.
- Gemini 3.7 Flash: GA em 2026-08-13, cerca de três semanas depois do 3.6.
- 3.8 Preview: já no Jetski em 27 de agosto, só 14 dias depois do GA do 3.7.
- Pichai na call do Q2: o Flash deve ficar perto do mensal.
- Vazamentos de 1º de setembro: data pública apontada para quarta-feira 2 de setembro. Isso também cai na linha de «cerca de três semanas depois do 3.7» (2–4 de setembro).
Empilhe isso e a janela pública continua início a meados de setembro de 2026. Hoje (2 de setembro) é a borda esquerda dessa janela, não um prazo. Se a quarta-feira passar sem model card, a leitura melhor é «a janela ainda está aberta», não «o 3.8 morreu». Um Preview interno ainda pode ser absorvido numa atualização silenciosa do 3.7 ou voltar com outro nome.
Não faça do 3.8 uma dependência de marco. Deixe a string do modelo na configuração e o tráfego de código / agentes no 3.7. Adicione uma linha de fallback só depois que o AI Studio / o card da DeepMind listarem.
Por que AI coding: Jetski não é uma caixa de chat
A porta interna do 3.8 é o Jetski — a plataforma de codificação do próprio Google, não uma caixa de chat genérica. Isso diz mais sobre a intenção de produto do que qualquer slogan «nível Fable 5»: a linha Flash quer ser o motor padrão para escrever código, corrigir issues e rodar agentes, com dogfood em repos internos reais antes de escolher uma data pública.
Também explica por que a cadência está comprimida em duas ou três semanas. O flagship (o pré-treinamento do Gemini 4 começou em 2026-07-21, sem janela de lançamento) corre um ciclo longo. O Flash absorve ajustes pequenos de algoritmo, pós-treino, currículos de ferramentas e patches de modos de falha. Logan Kilpatrick descreveu 3.6→3.7 como «ajustes algorítmicos inteligentes, não um retreino completo». O 3.8 provavelmente segue o mesmo caminho.
Para quem entrega código, isso significa duas coisas. Primeiro: o 3.8 se ganha ou se perde em patches na primeira passagem, testes verdes e menos loops de ferramenta desperdiçados — não em scores de chat da Arena. Segundo: a forma da API provavelmente fica no lugar; o que muda é a taxa de acerto e o total de tokens nas mesmas tarefas de repo. O artigo anterior já disse que os campos de Structured Output não serão renomeados. Este troca a régua por tarefas de código.
Scores de código que o 3.7 Flash já pagou
Sem bench oficial do 3.8, não invente porcentagens. A linha de base são os scores de código e agentes que 3.6 → 3.7 já colocou numa model card:
| Métrica | 3.6 Flash | 3.7 Flash (confirmado) | O que mede |
|---|---|---|---|
| FrontierCode 1.1 Main | 34.4% | 43.6% (+9.2pp) | Conjunto principal de código em nível de repo |
| DeepSWE v1.1 | 49.0% | 65.3% (+16.3pp) | Agentes de engenharia de software |
| AutomationBench | 17.0% | 30.4% (+13.4pp) | Automação multi-etapas |
| WebDev Arena Elo | — | 1588 | UI de navegador / implementação interativa |
| Posicionamento | Flash geral barato e rápido | Workhorse para código e agentes | Se o 3.8 ficar nesta linha, deve continuar tapando pontos fracos |
Esses saltos não são polimento de chat. Mostram que o orçamento de treino do Flash já está sentado em patches, ferramentas e trabalho multi-etapas. Quando o 3.8 aparecer, use a mesma régua: sucesso de edição de patch, taxa de testes que passam, recuperação depois de uma tool call falha, seguir instruções em vários turnos e tokens totais para fechar um issue. Uma resposta única «parecer mais inteligente» não basta.
Custo não é só o preço de lista por milhão. Codificação com agente relê arquivos, roda testes de novo e se autocorrije; um issue costuma custar várias vezes um único turno de pergunta e resposta. O Flash compete em «preço × latência para fechar um issue», não num score anônimo da Arena. O preço intro do 3.7 já está uma ordem de magnitude abaixo do Claude Fable 5 a $10 / $50. Mesmo que o 3.8 fique um pouco mais afiado, o modelo padrão ainda é escolhido por custo por tarefa × retentativas.
Perspectiva de AI coding para o 3.8
São hipóteses, não scores. Os únicos insumos são o vetor 3.6→3.7, o dogfood do Jetski e as duas linhas de vazamento: menos enrolação, tapar os buracos do 3.7.
Mais provável
- Saída mais curta, mais parecida com um patch: o Flash há tempos é acusado de se apresentar antes de mudar três linhas. Se o 3.8 de fato cortar a verbosidade, jobs de código economizam tokens de saída e sujam menos diffs. É o salto mais barato, e combina com o wording dos vazamentos.
- Uma ida e volta de ferramenta desperdiçada a menos: os ganhos do 3.7 em DeepSWE / AutomationBench já disseram que «multi-etapas» é o ataque principal. Se o próximo salto continuar workhorse, o prêmio é menos ferramentas erradas, menos campos required omitidos, menos loops vazios no mesmo comando de teste — não mais um headline de 1M-token.
- Um ganho modesto em patches na primeira passagem: depois que o FrontierCode foi de 34.4% → 43.6%, o 3.8 parece mais alguns pontos, não um salto de flagship. «Notavelmente melhor que o 3.7» é uma direção, não licença para escrever «Fable 5».
- Mesma forma de API: agentes de código ainda entregam argumentos JSON por
tools.parameters; patches estruturados ainda usamresponse_mime_typemais um Schema. Trate um menor Flash como compatível primeiro; no dia do GA, troque a string do modelo e rode de novo os mesmos fixtures. Os detalhes estão na prévia JSON da API. - O preço fica na faixa Flash: quebrar «barato, rápido, milhares de chamadas por dia» empurraria os times de volta ao preço intro do 3.7. A previsão mais segura é preço unitário de faixa Flash, qualidade apontada para os pontos fracos de código do 3.7.
Pouco provável, ou sem evidência
- «Qualidade Fable 5 a preço Flash»: sem bench oficial. O 3.7 em si nunca cruzou essa faixa; um trial interno não é lista de preços.
- Uma API de código ou um protocolo de repo novinhos: de 2.5 a 3.7, a string do modelo e o comportamento mudaram, os nomes de campo não. O 3.8 não tem motivo para inventar um primeiro.
- Ganhar em código com uma janela de 1M-token: a comunidade diz que o 3.8 mantém uma janela de 1M; isso não está verificado. Mesmo que mantenha, o gargalo de código costuma ficar no loop de ferramentas e no feedback de testes, não no anúncio da janela.
- Usá-lo hoje como modelo padrão de produção: qualquer mudança de config de «quarta-feira é GA» antes de uma model card é um incidente.
from google import genai
from google.genai import types
# Do not point production at an undocumented 3.8 ID before GA.
# Coding-agent fixtures should pin to repo tasks, not chat scores.
MODEL = "gemini-3.7-flash"
run_tests = types.FunctionDeclaration(
name="run_tests",
description="Run tests at a path and return a failure summary",
parameters={
"type": "object",
"properties": {
"path": {"type": "string", "description": "Test target, e.g. tests/test_parser.py"},
"max_fail": {"type": "integer", "description": "Max failures to return"}
},
"required": ["path"],
},
)
client = genai.Client()
response = client.models.generate_content(
model=MODEL,
contents="parser raises KeyError on empty objects; run tests/test_parser.py, then a minimal patch.",
config=types.GenerateContentConfig(
tools=[types.Tool(function_declarations=[run_tests])],
),
)
Essa é a forma na qual o 3.8 deve ser comparado: o mesmo issue, as mesmas ferramentas, os mesmos testes. O que importa é menos idas e voltas de ferramenta, menos enrolação e um patch que ainda dá apply. «Quem é mais inteligente» contra o Claude Fable 5 é o recorte errado.
Como aceitar um fluxo de codificação
Quando o 3.8 entrar na lista oficial, pule a nota de imprensa e rode o seu próprio repo. Divida o fixture em quatro células:
| Célula | O que você mede | Onde o 3.8 deveria superar o 3.7 |
|---|---|---|
| Edição de patch | Dado um teste falhando, ele emite um diff mínimo aplicável | Taxa maior na primeira passagem, menos arquivos alheios tocados |
| Loop de ferramentas | Ler arquivo → editar → rodar testes → ler a falha | Menos ferramentas erradas, menos loops vazios, menos campos required omitidos |
| Seguir instruções | «Só mexa no parser, sem reescrever» sobrevive | Continua nos trilhos depois de vários turnos |
| Livro-razão | Tokens de entrada+saída e tempo de parede para fechar um issue | Saída mais curta deveria cortar a conta; se os tokens subirem, um «parece melhor» pode ser prejuízo |
Argumentos de ferramenta ainda são JSON. Se o modelo «passa» no preenchimento de parâmetros e o comando de teste ainda sai dos trilhos, o Schema provavelmente está frouxo demais — não «o 3.8 não é inteligente o suficiente». Mantenha duas portas: json.loads mais o mesmo JSON Schema, depois as suas invariantes (caminhos, timeouts, máximo de falhas). Jogue saídas de amostra na caixa de ferramentas JSON para um Diff local — sem upload. 3.7 e um futuro 3.8 devem compartilhar os mesmos fixtures, ou você não consegue dizer se de fato ficou mais estável. Veja Tool Calling e validação com JSON Schema e Tool Calling → fluxo de dados MCP.
O que fazer agora
- Mantenha produção no 3.7 Flash:
gemini-3.7-flashno preço intro, modelo padrão na configuração. Não pré-escrevagemini-3.8-flashnem skimaki. - Termine primeiro os fixtures de código: 10–30 issues reais (patches, testes, restrições multi-turno). Quando o 3.8 entrar em GA, rode de novo uma vez com a nova string de modelo.
- Registre tokens totais, não só «parece melhor»: a fatura do agente mora na contagem de loops, não no preço de lista de um único turno.
- Cacheie System + tools: coloque o prompt de sistema do agente e a lista de ferramentas no Context Caching. Leituras de cache intro do 3.7 saem por cerca de $0.075 / 1M tokens.
- Orce nas tarifas padrão de 2027: mesmo que o 3.8 saia com um preço intro novo, o 3.7 em si dobra em 2027-01-01.
- Olhe só canais oficiais: o card Flash da DeepMind, o changelog da Gemini API, a lista de modelos do Vertex. Rumores de quarta-feira e modelos anônimos da Arena não são cronograma.
FAQ
Quando o Gemini 3.8 Flash será lançado?
O Google não publicou uma data. Vazamentos apontaram o dia público para quarta-feira 2 de setembro de 2026, com codinome interno skimaki e «production deployment complete». Dado o intervalo de cerca de três semanas entre 3.6 e 3.7 e a cadência Flash quase mensal do CEO, a janela pública continua início a meados de setembro. Hoje é a borda esquerda dessa janela, não um compromisso, e não pode ser prazo de projeto.
Posso chamar gemini-3.8-flash hoje?
Não. Em 2 de setembro de 2026 não há API pública, model ID de SDK nem model card da DeepMind. Use gemini-3.7-flash em produção.
«Production deployment complete» significa que o GA é iminente?
Não. Deploy interno pode servir só dogfood de funcionários no Jetski. A Business Insider confirmou um Preview; o Google se recusou a comentar. Dogfood pode ir a GA em semanas, ou ser renomeado ou reabsorvido no 3.7.
O 3.8 será quanto melhor em AI coding que o 3.7?
Não há bench oficial. O que você pode extrapolar é o vetor de código / agentes que 3.6→3.7 já pagou, mais «menos enrolação, tapar os buracos do 3.7». É mais provável ver patches mais curtos e menos loops de ferramenta desperdiçados do que um Fable 5 de repente. No dia do lançamento, confie no model card e nos seus próprios fixtures de repo.
Devo esperar o 3.8 antes de lançar um agente de código?
Não. O Schema de ferramentas, os fixtures de teste e o replay de erros não dependem de uma versão menor do Flash. Deixe o pipeline verde no 3.7; 3.8 é troca de string de modelo.
O 3.8 muda a API relacionada a código?
O hábito de 2.5→3.7 é: novo model ID, mesmos campos de requisição. Agentes de código continuam com tools.parameters; patches estruturados continuam com response_schema / response_json_schema. Assuma compatibilidade primeiro e faça regressão no dia do GA.
Conclusões
O Gemini 3.8 Flash não foi lançado. Em 2 de setembro de 2026 os fatos confirmados são: o 3.7 Flash está em produção, o preço intro ainda vale, um Preview interno está no Jetski há uma semana, e vazamentos nomearam hoje como data pública. A cadência Flash dos últimos dois meses aponta para «esses dias de início de setembro até meados do mês», não «esperar o Gemini 4». Sem model card hoje, trate «quarta-feira» como a borda esquerda da janela, não como prazo.
Em AI coding, o 3.8 parece um patch nos pontos fracos do 3.7: saída mais curta, menos loops vazios, um ganho modesto em diffs na primeira passagem. Use tarefas de repo como régua, não Arena. A forma de requisição JSON / Function Calling provavelmente não muda — isso foi o artigo anterior. Fixtures e validação local hoje valem mais que um calendário de vazamentos. Quando o 3.8 aparecer na lista oficial de modelos, rode os mesmos issues uma vez.