¿Cuándo se lanza Gemini 3.8 Flash? Noticias de agosto 2026, rendimiento y JSON de la API

A 28 de agosto de 2026 Gemini 3.8 Flash no es público. Preview interna, ventana probable en septiembre, previsión prudente frente a 3.7 y si Structured Output / Function Calling cambiará.

Respuesta breve: a 28 de agosto de 2026, Gemini 3.8 Flash no está publicado de forma pública. No hay model card, no hay API documentada gemini-3.8-flash y la documentación Flash de Google DeepMind sigue deteniéndose en Gemini 3.7 Flash, que pasó a GA el 13 de agosto. Esa misma semana, Business Insider informó que los empleados ya prueban un «Gemini 3.8 Flash Preview» en la plataforma interna de codificación Jetski, y en X se habla de un lanzamiento público «en unas semanas». Son pistas, no una nota de lanzamiento.

El artículo anterior, Gemini 3.7 Flash: precios, API y JSON, cubre el modelo Flash que sí puedes llamar. JSON estructurado con la API Gemini y OpenAI vs Gemini Structured Output cubren el contrato Schema. Este artículo responde solo tres preguntas: cuándo podría llegar 3.8, hacia dónde se mueve la calidad y si cambia la forma de la petición JSON / Function Calling.

¿Ya se lanzó? Estado al 2026-08-28

Trátalo como una lista de comprobación:

  • Producto público: no publicado. AI Studio / Gemini API / Vertex AI no listan un 3.8 Flash invocable.
  • Model ID: no hay un gemini-3.8-flash documentado. Poner esa cadena en producción devolverá 404.
  • Precios: no divulgados. Las tablas que afirman «3.8 a la mitad de 3.7» no tienen fuente oficial.
  • Workhorse Flash actual: sigue siendo gemini-3.7-flash, precio intro de $0,75 / $3,75 por millón de tokens de entrada / salida hasta 2026-12-31, luego $1,50 / $7,50 desde 2027-01-01.

Así que la respuesta honesta a «¿cuándo se lanza?» es: Google no ha fijado una fecha pública; dados los dos últimos lanzamientos Flash, «semanas, no el año que viene» es la hipótesis previa más razonable. El resto de este artículo separa rumor y cadencia para que un Preview interno no se confunda con GA.

Noticias de agosto y fuerza de la evidencia

Ordena por evidencia, no por calor en redes sociales.

FechaAfirmaciónFuerza
2026-08-13Gemini 3.7 Flash GA, model card oficial y precios introConfirmado
2026-08-10Un paper de Tencent nombra «Gemini 3.8 Flash» como uno de los jueces LLM (tres días antes del GA de 3.7)Débil: errata o nombre interno temprano
Resultados Q2 2026Sundar Pichai dijo que Flash debería acercarse a una cadencia mensualConfirmado (cadencia, no 3.8 en sí)
2026-08-27Business Insider: el personal usa «Gemini 3.8 Flash Preview» en Jetski; Google declinó comentarMedia-alta: reportaje con nombre, aún no es un lanzamiento
2026-08-27Posts en X: ya interno, quizá público en semanas, calidad nivel Fable 5Débil: sin model card, sin API
Mismo periodoConjeturas de que un modelo anónimo de Arena AI es 3.8Débil: identidad no verificada

Los detalles de Business Insider importan: la etiqueta interna es Gemini 3.8 Flash Preview, la superficie es Jetski, y un tester dijo que ya se sentía «notablemente mejor que 3.7 Flash» al subrayar que era demasiado pronto para una revisión completa. Eso encaja con el patrón 3.6 → 3.7 — dogfood dentro de Google, luego GA unas semanas después.

Las afirmaciones más ruidosas en X («meses de pruebas con partners», «calidad Fable 5 a precio Flash») siguen sin model card de DeepMind ni changelog de API detrás. El paper de Tencent menciona «3.8» una sola vez. Las dos explicaciones aburridas siguen siendo las mejores: un typo de versión, o un equipo de eval golpeando un endpoint no publicado. Una palabra en un paper no es un calendario de lanzamiento.

Cómo leer la ventana de lanzamiento

Google no ha publicado una fecha para 3.8. Los únicos intervalos que puedes usar son los de la propia línea Flash:

  • Gemini 3.6 Flash: GA a finales de julio de 2026 (misma oleada que 3.5 Flash-Lite).
  • Gemini 3.7 Flash: GA el 2026-08-13, unas tres semanas después de 3.6.
  • Pichai en la llamada del Q2: Flash debería mantenerse cerca de lo mensual.
  • Un 3.8 Preview estaba en una plataforma interna el 27 de agosto — prueba de empleados, no «se lanza la semana que viene».

Si se mantiene el ritmo de tres a cuatro semanas, un Developer Preview o GA público es más probable a principios o mediados de septiembre de 2026 que como añadido de Gemini 4. El pre-entrenamiento de Gemini 4 se confirmó iniciado el 2026-07-21 sin ventana de lanzamiento; «3.8 antes de Gemini 4» es un listón bajo porque el flagship es más lento por diseño.

También incluye en el cálculo «nunca se lanza como 3.8»: un Preview interno puede plegarse en una actualización silenciosa de 3.7 o volver con otro nombre. No conviertas 3.8 en una dependencia de hito. Deja la cadena del modelo en la configuración y el tráfico en 3.7.

3.7 Flash vs el 3.8 rumorado

ElementoGemini 3.7 Flash (confirmado)Gemini 3.8 Flash (sin confirmar)
EstadoGA 2026-08-13Preview interno reportado; sin API pública
Model IDgemini-3.7-flashSin documentar; no lo pongas en producción
Precio intro$0.75 / $3.75 por millón de tokens hasta 2026-12-31No divulgado
Estándar 2027$1.50 / $7.50No divulgado
Contexto~1M entrada / ~64k salidaNo divulgado; Flash suele conservar la ventana
DeepSWE v1.165,3 % (3.6: 49,0 %)Sin puntuación oficial
PosicionamientoWorkhorse para codificación y agentesRumor: más cerca del flagship, aún a precio Flash

La columna derecha vacía es el punto: el único Flash que puedes llevar hoy a una revisión de arquitectura es 3.7. Su precio intro ya está un orden de magnitud por debajo de Claude Fable 5 a $10 / $50. Aunque 3.8 cierre parte de esa brecha de calidad, el modelo por defecto se elige por coste por tarea × reintentos — no por una puntuación anónima de Arena.

Perspectiva de rendimiento (de 3.6→3.7, no puntuaciones inventadas)

Sin bench público, no inventes porcentajes de 3.8. Lo que puedes extrapolar es la dirección que 3.6 → 3.7 ya pagó, más el comentario interno «notablemente mejor que 3.7»:

  • Agentes / herramientas multi-paso: 3.7 vs 3.6 movió DeepSWE de 49,0 % a 65,3 % y AutomationBench de 17,0 % a 30,4 %. Si el siguiente salto sigue siendo un workhorse, el premio son menos reintentos de herramientas desperdiciados, no otro titular de ventana de contexto.
  • Codificación: FrontierCode 1.1 Main pasó de 34,4 % a 43,6 %. Poner el Preview en Jetski (una superficie de codificación) señala que Flash sigue siendo el motor por defecto para escribir y corregir código, no una interfaz de chat.
  • Documentos largos y extracción: puntuaciones de trabajo de conocimiento como GDP.pdf pasaron de 22,0 % a 34,0 %. Para extracción JSON eso suele significar menos deriva en campos anidados, enums y longitudes de array — espera al GA y vuelve a ejecutar el mismo Schema; no lo escribas en un SLA antes de tiempo.
  • Latencia y precio: la promesa de producto de Flash es barato, rápido y invocable miles de veces al día. Si 3.8 rompiera eso (un Pro disfrazado), los equipos se quedarían en el precio intro de 3.7. El pronóstico más seguro es precio de nivel Flash, calidad apuntando a los puntos débiles de 3.7.

Comparar «quién es más inteligente» contra Claude Fable 5 ($10 / $50) es el marco equivocado. Comparar «menos idas y vueltas de herramientas con el mismo Schema» contra 3.7 es el correcto. Trata cada pronóstico como hipótesis hasta que exista un model card.

Avance JSON de la API

Esta es la capa que de verdad le importa a la serie. Desde Gemini 2.5 hasta 3.7, Structured Output y Function Calling mantuvieron casi la misma forma de petición: cambiaron la cadena del modelo y el comportamiento, no los nombres de campo. Si 3.8 es un incremento de 3.7, el avance estable es compatibilidad, no una nueva API JSON.

Structured Output: quédate con el Schema, no apuestes a un interruptor nuevo

El patrón actual de 3.7 casi seguro seguirá aplicando tras el GA de 3.8: response_mime_type=application/json más response_schema (Pydantic) o response_json_schema (un diccionario JSON Schema). El decodificado restringido bloquea tokens ilegales en el momento de la generación — el mismo camino que la guía JSON de Gemini y Del prompt al Structured Output.

from google import genai
from pydantic import BaseModel, Field

# Do not point production at an undocumented 3.8 ID before GA.
# After GA you typically change this one string; Schema and checks stay put.
MODEL = "gemini-3.7-flash"

class ExtractedTask(BaseModel):
    title: str
    priority: str = Field(description="low | medium | high")
    due_date: str | None = None

client = genai.Client()
response = client.models.generate_content(
    model=MODEL,
    contents="Extract the action item: finish the budget review by next Friday, high priority.",
    config={
        "response_mime_type": "application/json",
        "response_schema": ExtractedTask,
    },
)
print(response.parsed)

Esperanzas razonables para 3.8: mayor tasa de acierto al primer paso en objetos anidados, campos opcionales, enums y arrays; menos filtrado de chain-of-thought cuando thinking y JSON están ambos activos. No esperes JSON Schema 2020-12 completo (los límites de subconjunto de Gemini en additionalProperties, prefixItems y compañía están en el artículo de comparación), ni que se fusionen «JSON de respuesta final» y «JSON de argumentos de herramienta» en un solo control.

Function Calling: el Schema de herramienta sigue siendo el contrato

El lado de herramientas sigue siendo tools más un JSON Schema de parameters, un functionCall del modelo, luego ejecución en el host y un turno de seguimiento. El argumento de venta de 3.7 fue planes multi-paso más rigurosos; si el dogfood de 3.8 es de verdad «notablemente mejor», busca primero menos herramientas equivocadas, menos campos required omitidos, menos bucles vacíos sobre la misma herramienta. El inputSchema de MCP sigue teniendo que coincidir con la declaración, o el modelo «tiene éxito» y el servidor rechaza — eso es independiente de 3.8. Ver Tool Calling → flujo de datos MCP.

from google import genai
from google.genai import types

lookup_order = types.FunctionDeclaration(
    name="lookup_order",
    description="Return shipment status for an order id",
    parameters={
        "type": "object",
        "properties": {
            "order_id": {"type": "string", "description": "Order id, e.g. GW-20260828"}
        },
        "required": ["order_id"],
    },
)

client = genai.Client()
response = client.models.generate_content(
    model="gemini-3.7-flash",
    contents="Has GW-20260828 shipped yet?",
    config=types.GenerateContentConfig(
        tools=[types.Tool(function_declarations=[lookup_order])],
    ),
)
Uso del JSONHoy (3.7)Avance 3.8
Respuesta final / extracciónresponseMimeType + SchemaLos nombres de campo probablemente no cambian; vigila la tasa al primer paso
Argumentos de herramientatools[].parametersMenos reintentos y deriva de tipos; no aflojes el contrato
MCPinputSchema alineado con la herramientaIndependiente del salto de modelo; mantén validación local

Mantén dos puertas: json.loads más el mismo JSON Schema, luego tus propias invariantes (dinero, enums, zonas horarias). Deja las salidas de muestra en la caja de herramientas JSON para un Diff local — sin subir nada. 3.7 y un futuro 3.8 deberían compartir los mismos fixtures, o no podrás saber si de verdad se volvió más estable.

Qué hacer ahora

  1. Mantén producción en 3.7 Flash: gemini-3.7-flash a precio intro, modelo por defecto en la configuración, no literales dispersos.
  2. No reserves un ID 3.8 ficticio: un nombre de Preview interno no es un argumento del SDK. Añade una fila de fallback solo cuando AI Studio / la ficha de DeepMind lo listen.
  3. Termina primero los fixtures JSON: los mismos prompts por Structured Output y Tool Calling, comprobados en local contra Schema. Cuando 3.8 pase a GA, vuelve a ejecutar una vez con la nueva cadena de modelo.
  4. Cachea System + tools: pon el prompt de sistema del agente y la lista de herramientas en Context Caching. Las lecturas de caché intro de 3.7 rondan $0,075 / 1M tokens.
  5. Presupuesta a tarifas estándar 2027: aunque 3.8 salga con un precio intro nuevo, 3.7 mismo se duplica el 2027-01-01. No dejes que una factura de Q1 dependa de un SKU rumorado más barato.
  6. Mira solo canales oficiales: la ficha Flash de DeepMind, el changelog de Gemini API, la lista de modelos de Vertex. Las filtraciones de X y los modelos anónimos de Arena no son un calendario.

FAQ

¿Cuándo se lanzará Gemini 3.8 Flash?

Google no ha publicado una fecha. Dado el intervalo de unas tres semanas entre 3.6 y 3.7 y la cadencia Flash casi mensual del CEO, una ventana pública a principios o mediados de septiembre de 2026 es la hipótesis previa más razonable si el Preview interno va bien. Eso no es un compromiso y no debe ser una fecha límite de proyecto.

¿Puedo llamar a gemini-3.8-flash hoy?

No. A 28 de agosto de 2026 no hay API pública, model ID de SDK ni model card de DeepMind. Usa gemini-3.7-flash en producción.

¿Un Preview interno significa que el GA es inminente?

No. Business Insider confirmó que el personal vio Gemini 3.8 Flash Preview en Jetski; Google declinó comentar. El dogfood puede pasar a GA en semanas, o renombrarse o reintegrarse en 3.7. Léelo como «en curso», no como «programado».

¿Será 3.8 más fuerte y más barato que 3.7?

No hay bench oficial ni lista de precios. Las ganancias de 3.7 sobre 3.6 estuvieron en herramientas multi-paso y codificación; un tester interno llamó al 3.8 Preview «notablemente mejor que 3.7», lo cual no se generaliza. Es más probable que el precio se quede en el nivel Flash a que salte a tarifas de flagship.

¿Structured Output / Function Calling cambiarán de API en 3.8?

El hábito de 2.5→3.7 es: nuevo model ID, mismos campos de petición — response_mime_type, response_schema / response_json_schema, tools.parameters. Trata un incremento Flash como compatible primero y luego haz regresión del mismo Schema el día del GA.

¿Debería esperar a 3.8 antes de adoptar Structured Output?

No. El contrato JSON Schema, un segundo pase de validación y la reinyección de errores no dependen de una versión menor de Flash. Deja el pipeline en verde sobre 3.7; 3.8 es un cambio de cadena de modelo.

Conclusiones

Gemini 3.8 Flash no se ha lanzado. El 28 de agosto de 2026 los hechos confirmados son: 3.7 Flash está en producción, el precio intro sigue vigente y un 3.8 Preview interno ya circula. La cadencia Flash de los últimos dos meses apunta a «semanas alrededor de septiembre», no a «esperar a Gemini 4». Rendimiento y precio aún no tienen model card; el único pronóstico honesto sigue el vector de agentes y codificación de 3.6→3.7.

La historia JSON en la API no ha cambiado: Structured Output posee la forma final, Function Calling posee los argumentos de herramienta, ambos usan JSON Schema. Fixtures y validación local hoy valen más que un calendario de filtraciones. Cuando 3.8 aparezca en la lista oficial de modelos, vuelve a ejecutar el mismo Schema una vez.