¿Cuándo se lanza Gemini 3.8 Flash? Últimas noticias, fecha y previsión de AI Coding

A 2 de septiembre de 2026 Gemini 3.8 Flash no es público. Rumores del miércoles, nombre interno skimaki, ventana de septiembre y previsión de coding frente a Gemini 3.7 Flash.

Respuesta breve: a 2 de septiembre de 2026, Gemini 3.8 Flash sigue sin publicarse de forma pública. AI Studio, la Gemini API y Vertex AI no listan un gemini-3.8-flash invocable, y la ficha de DeepMind sigue deteniéndose en Gemini 3.7 Flash, que pasó a GA el 13 de agosto. El mismo día, varios medios y cuentas de filtraciones señalaron el miércoles como fecha pública, con el nombre interno skimaki y la afirmación de que el despliegue en producción está «hecho». Son pistas, no una nota de lanzamiento.

El artículo del 28 de agosto, ventana de lanzamiento de Gemini 3.8 Flash y avance JSON de la API, ya cubrió la compatibilidad de Structured Output / Function Calling. Gemini 3.7 Flash: precios, API y JSON es el Flash que sí puedes llamar. Este artículo añade solo tres cosas: las noticias en torno al 2 de septiembre, cómo leer la fecha de salida y hacia dónde es probable que se mueva 3.8 en AI coding.

¿Ya se lanzó? Estado al 2026-09-02

Trátalo como una lista de comprobación:

  • Producto público: no publicado. AI Studio / Gemini API / Vertex AI no listan un 3.8 Flash invocable.
  • Model ID: no hay un gemini-3.8-flash documentado. Poner una cadena filtrada en producción devolverá 404.
  • Precio y contexto: no divulgados. Las tablas de la comunidad que afirman una ventana de 1M-token o «la mitad de 3.7» no tienen fuente oficial.
  • Workhorse Flash actual: sigue siendo gemini-3.7-flash, precio intro de $0.75 / $3.75 por millón de tokens de entrada / salida hasta 2026-12-31, luego $1.50 / $7.50 desde 2027-01-01.

Así que la respuesta honesta a «¿cuándo se lanza?» es: Google no ha fijado una fecha pública; hoy es el miércoles del rumor, no el miércoles del calendario. El resto de este artículo separa las pistas del 1–2 de septiembre de la cadencia de agosto para que «production deployment complete» no se confunda con GA.

Noticias de septiembre y fuerza de la evidencia

Ordena por evidencia, no por el calor de «se lanza mañana».

FechaAfirmaciónFuerza
2026-08-13Gemini 3.7 Flash GA, model card oficial y precios introConfirmado
Q2 2026 earningsSundar Pichai dijo que Flash debería acercarse a una cadencia mensualConfirmado (cadencia, no 3.8 en sí)
2026-08-27Business Insider: el personal usa «Gemini 3.8 Flash Preview» en Jetski; Google declinó comentarMedia-alta: reportaje con nombre, aún no es un lanzamiento
2026-08-10Un paper de Tencent nombra «Gemini 3.8 Flash» como uno de los jueces LLM (tres días antes del GA de 3.7)Débil: errata o nombre interno temprano
2026-09-01Filtraciones: nombre interno skimaki, production deployment hecho, fecha pública apuntada al miércoles 2 de septiembreDébil a media: recuentos de segunda mano, sin model card, sin changelog de API
2026-09-02A la hora de escribir, los canales oficiales siguen sin ficha 3.8 ni endpoint invocableConfirmado (el hecho mismo de «no publicado»)

La oleada del 1 de septiembre añadió tres palabras nuevas a la historia del 27 de agosto: skimaki (nombre interno), production deployment complete y miércoles público. CryptoBriefing, 4sAPI y otros lo convirtieron en «Google lo desvelará el 2 de septiembre». Conviene apuntar: el margen de anticipación de la comunidad de filtraciones en los últimos menores Flash no ha sido malo. «Deployment complete» dentro de Google puede seguir significando solo dogfood de empleados, no un Developer Preview público.

El feedback temprano de testers sigue siendo una línea subjetiva: «notablemente mejor que 3.7 Flash», con la salvedad de que una revisión completa es demasiado pronto. El color técnico nuevo es más concreto: salida menos verbosa (una queja antigua de la línea Flash) y parches a modos de fallo que 3.7 dejó al descubierto. Eso no es un reset generacional — parece otro incremento de dos a tres semanas al estilo 3.6→3.7.

Las afirmaciones más ruidosas en X («calidad Fable 5 a precio Flash», «meses de pruebas con partners») siguen sin model card de DeepMind ni changelog de API. Un «3.8» en un paper, o un modelo anónimo de Arena, no es un calendario de lanzamiento.

Cómo leer la fecha de lanzamiento

Google no ha publicado una fecha para 3.8. Los únicos intervalos que puedes usar son los de la propia línea Flash, más el rumor de miércoles de hoy:

  • Gemini 3.6 Flash: GA hacia el 21 de julio de 2026.
  • Gemini 3.7 Flash: GA el 2026-08-13, unas tres semanas después de 3.6.
  • 3.8 Preview: ya en Jetski el 27 de agosto, solo 14 días después del GA de 3.7.
  • Pichai en la llamada del Q2: Flash debería mantenerse cerca de lo mensual.
  • Filtraciones del 1 de septiembre: fecha pública apuntada al miércoles 2 de septiembre. Eso también cae en la línea de «unas tres semanas después de 3.7» (2–4 de septiembre).

Apílalos y la ventana pública sigue siendo principios a mediados de septiembre de 2026. Hoy (2 de septiembre) es el borde izquierdo de esa ventana, no una fecha límite. Si el miércoles pasa sin model card, la lectura mejor es «la ventana sigue abierta», no «3.8 está muerto». Un Preview interno aún puede plegarse en una actualización silenciosa de 3.7 o volver con otro nombre.

No conviertas 3.8 en una dependencia de hito. Deja la cadena del modelo en la configuración y el tráfico de código / agentes en 3.7. Añade una fila de fallback solo cuando AI Studio / la ficha de DeepMind lo listen.

Por qué AI coding: Jetski no es un chat

La puerta interna de 3.8 es Jetski — la plataforma de codificación de Google, no un chat genérico. Eso dice más de la intención de producto que cualquier eslogan «nivel Fable 5»: la línea Flash quiere ser el motor por defecto para escribir código, corregir issues y correr agentes, con dogfood sobre repos internos reales antes de elegir una fecha pública.

También explica por qué la cadencia se comprime a dos o tres semanas. El flagship (el pre-entrenamiento de Gemini 4 empezó el 2026-07-21, sin ventana de lanzamiento) corre un ciclo largo. Flash absorbe ajustes pequeños de algoritmo, post-entrenamiento, currículos de herramientas y parches de modos de fallo. Logan Kilpatrick describió 3.6→3.7 como «ajustes algorítmicos inteligentes, no un reentrenamiento completo». 3.8 probablemente sigue el mismo camino.

Para quien entrega código, eso significa dos cosas. Primera: 3.8 se gana o se pierde en parches al primer paso, tests en verde y menos bucles de herramientas desperdiciados — no en puntuaciones de chat de Arena. Segunda: la forma de la API probablemente no se mueve; lo que cambia es la tasa de acierto y el total de tokens en las mismas tareas de repo. El artículo anterior ya dijo que los campos de Structured Output no se van a renombrar. Este cambia la regla por tareas de código.

Puntuaciones de código que 3.7 Flash ya pagó

Sin un bench oficial de 3.8, no inventes porcentajes. La línea base son las puntuaciones de código y agentes que 3.6 → 3.7 ya puso en una model card:

Métrica3.6 Flash3.7 Flash (confirmado)Qué mide
FrontierCode 1.1 Main34.4%43.6% (+9.2pp)Conjunto principal de código a nivel de repo
DeepSWE v1.149.0%65.3% (+16.3pp)Agentes de ingeniería de software
AutomationBench17.0%30.4% (+13.4pp)Automatización multi-paso
WebDev Arena Elo—1588UI de navegador / implementación interactiva
PosicionamientoFlash general barato y rápidoWorkhorse para código y agentesSi 3.8 sigue esta línea, debería seguir parcheando puntos débiles

Esos saltos no son pulido de chat. Muestran que el presupuesto de entrenamiento de Flash ya está sentado en parches, herramientas y trabajo multi-paso. Cuando aparezca 3.8, usa la misma regla: éxito de edición de parche, tasa de tests que pasan, recuperación tras una llamada de herramienta fallida, seguimiento de instrucciones en varios turnos y tokens totales para cerrar un issue. Que una sola respuesta «se sienta más lista» no basta.

El coste no es solo el precio de lista por millón. La codificación con agentes relee archivos, relanza tests y se autocorrije; un issue suele costar varias veces un solo turno de pregunta y respuesta. Flash compite en «precio × latencia para cerrar un issue», no en una puntuación anónima de Arena. El precio intro de 3.7 ya está un orden de magnitud por debajo de Claude Fable 5 a $10 / $50. Aunque 3.8 sea un poco más afilado, el modelo por defecto se sigue eligiendo por coste por tarea × reintentos.

Perspectiva de AI coding para 3.8

Son hipótesis, no puntuaciones. Los únicos insumos son el vector 3.6→3.7, el dogfood de Jetski y las dos líneas de filtración: menos paja, tapar los agujeros de 3.7.

Más probable

  • Salida más corta, más parecida a un parche: a Flash se le acusa desde hace tiempo de presentarse antes de cambiar tres líneas. Si 3.8 de verdad recorta la verbosidad, los trabajos de código ahorran tokens de salida y ensucian menos diffs. Es el salto más barato, y encaja con el wording de las filtraciones.
  • Un viaje de herramienta desperdiciado menos: las ganancias de 3.7 en DeepSWE / AutomationBench ya dijeron que «multi-paso» es el ataque principal. Si el siguiente salto sigue siendo un workhorse, el premio es menos herramientas equivocadas, menos campos required omitidos, menos bucles vacíos sobre el mismo comando de test — no otro titular de 1M-token.
  • Un alza modesta en parches al primer paso: después de que FrontierCode pasara de 34.4% → 43.6%, 3.8 parece unos puntos más, no un salto a flagship. «Notablemente mejor que 3.7» es una dirección, no una licencia para escribir «Fable 5».
  • Misma forma de API: los agentes de código siguen entregando argumentos JSON por tools.parameters; los parches estructurados siguen usando response_mime_type más un Schema. Trata un menor Flash como compatible primero; el día del GA, cambia la cadena del modelo y vuelve a ejecutar los mismos fixtures. Los detalles están en el avance JSON de la API.
  • El precio se queda en el nivel Flash: romper «barato, rápido, miles de llamadas al día» empujaría a los equipos de vuelta al precio intro de 3.7. El pronóstico más seguro es precio unitario de nivel Flash, calidad apuntando a los puntos débiles de código de 3.7.

Poco probable, o sin evidencia

  • «Calidad Fable 5 a precio Flash»: no hay bench oficial. 3.7 mismo nunca cruzó esa banda; un trial interno no es una lista de precios.
  • Una API de código o un protocolo de repo flamante: de 2.5 a 3.7 cambiaron la cadena del modelo y el comportamiento, no los nombres de campo. 3.8 no tiene motivo para inventar uno primero.
  • Ganar en código gracias a una ventana de 1M-token: la comunidad dice que 3.8 conserva una ventana de 1M; no está verificado. Aunque la conserve, los cuellos de botella de código suelen estar en el bucle de herramientas y el feedback de tests, no en el anuncio de la ventana.
  • Usarlo hoy como modelo por defecto en producción: cualquier cambio de config de «el miércoles es GA» antes de una model card es un incidente.
from google import genai
from google.genai import types

# Do not point production at an undocumented 3.8 ID before GA.
# Coding-agent fixtures should pin to repo tasks, not chat scores.
MODEL = "gemini-3.7-flash"

run_tests = types.FunctionDeclaration(
    name="run_tests",
    description="Run tests at a path and return a failure summary",
    parameters={
        "type": "object",
        "properties": {
            "path": {"type": "string", "description": "Test target, e.g. tests/test_parser.py"},
            "max_fail": {"type": "integer", "description": "Max failures to return"}
        },
        "required": ["path"],
    },
)

client = genai.Client()
response = client.models.generate_content(
    model=MODEL,
    contents="parser raises KeyError on empty objects; run tests/test_parser.py, then a minimal patch.",
    config=types.GenerateContentConfig(
        tools=[types.Tool(function_declarations=[run_tests])],
    ),
)

Esa es la forma contra la que hay que comparar 3.8: el mismo issue, las mismas herramientas, los mismos tests. Lo que importa es menos idas y vueltas de herramientas, menos paja y un parche que aún se pueda aplicar. «Quién es más inteligente» frente a Claude Fable 5 es el marco equivocado.

Cómo aceptar un flujo de codificación

Cuando 3.8 aparezca en la lista oficial, sáltate la nota de prensa y corre tu propio repo. Parte el fixture en cuatro celdas:

CeldaQué midesDónde 3.8 debería superar a 3.7
Edición de parcheDado un test que falla, ¿emite un diff mínimo aplicable?Mayor tasa al primer paso, menos archivos ajenos tocados
Bucle de herramientasLeer archivo → editar → correr tests → leer el falloMenos herramientas equivocadas, menos bucles vacíos, menos campos required omitidos
Seguimiento de instrucciones¿Sobrevive «solo toca el parser, sin reescribir»?Sigue en raíles tras varios turnos
Libro mayorTokens de entrada+salida y tiempo de pared para cerrar un issueUna salida más corta debería bajar la factura; si suben los tokens, un «se siente mejor» puede ser una pérdida

Los argumentos de herramienta siguen siendo JSON. Si el modelo «tiene éxito» rellenando parámetros y el comando de test se sale de raíles, el Schema probablemente está demasiado suelto — no «3.8 no es lo bastante listo». Mantén dos puertas: json.loads más el mismo JSON Schema, luego tus propias invariantes (rutas, timeouts, máximo de fallos). Deja las salidas de muestra en la caja de herramientas JSON para un Diff local — sin subir nada. 3.7 y un futuro 3.8 deberían compartir los mismos fixtures, o no podrás saber si de verdad se volvió más estable. Ver Tool Calling y validación con JSON Schema y Tool Calling → flujo de datos MCP.

Qué hacer ahora

  1. Mantén producción en 3.7 Flash: gemini-3.7-flash a precio intro, modelo por defecto en la configuración. No preescribas gemini-3.8-flash ni skimaki.
  2. Termina primero los fixtures de código: 10–30 issues reales (parches, tests, restricciones multi-turno). Cuando 3.8 pase a GA, vuelve a ejecutar una vez con la nueva cadena de modelo.
  3. Registra tokens totales, no solo «se siente mejor»: la factura del agente vive en el recuento de bucles, no en el precio de lista de un solo turno.
  4. Cachea System + tools: pon el prompt de sistema del agente y la lista de herramientas en Context Caching. Las lecturas de caché intro de 3.7 rondan $0.075 / 1M tokens.
  5. Presupuesta a tarifas estándar 2027: aunque 3.8 salga con un precio intro nuevo, 3.7 mismo se duplica el 2027-01-01.
  6. Mira solo canales oficiales: la ficha Flash de DeepMind, el changelog de Gemini API, la lista de modelos de Vertex. Los rumores del miércoles y los modelos anónimos de Arena no son un calendario.

FAQ

¿Cuándo se lanzará Gemini 3.8 Flash?

Google no ha publicado una fecha. Las filtraciones apuntaron el día público al miércoles 2 de septiembre de 2026, con nombre interno skimaki y «production deployment complete». Dado el intervalo de unas tres semanas entre 3.6 y 3.7 y la cadencia Flash casi mensual del CEO, la ventana pública sigue siendo principios a mediados de septiembre. Hoy es el borde izquierdo de esa ventana, no un compromiso, y no debe ser una fecha límite de proyecto.

¿Puedo llamar a gemini-3.8-flash hoy?

No. A 2 de septiembre de 2026 no hay API pública, model ID de SDK ni model card de DeepMind. Usa gemini-3.7-flash en producción.

¿«Production deployment complete» significa que el GA es inminente?

No. Un deploy interno puede servir solo dogfood de empleados en Jetski. Business Insider confirmó un Preview; Google declinó comentar. El dogfood puede pasar a GA en semanas, o renombrarse o reintegrarse en 3.7.

¿Cuánto mejor será 3.8 en AI coding que 3.7?

No hay bench oficial. Lo que puedes extrapolar es el vector de código / agentes que 3.6→3.7 ya pagó, más «menos paja, tapar los agujeros de 3.7». Es más probable ver parches más cortos y menos bucles de herramientas desperdiciados que un Fable 5 de golpe. El día del lanzamiento, fíate de la model card y de tus propios fixtures de repo.

¿Debería esperar a 3.8 antes de lanzar un agente de código?

No. El Schema de herramientas, los fixtures de test y la reinyección de errores no dependen de una versión menor de Flash. Deja el pipeline en verde sobre 3.7; 3.8 es un cambio de cadena de modelo.

¿3.8 cambiará la API relacionada con código?

El hábito de 2.5→3.7 es: nuevo model ID, mismos campos de petición. Los agentes de código siguen usando tools.parameters; los parches estructurados siguen usando response_schema / response_json_schema. Asume compatibilidad primero y haz regresión el día del GA.

Conclusiones

Gemini 3.8 Flash no se ha lanzado. El 2 de septiembre de 2026 los hechos confirmados son: 3.7 Flash está en producción, el precio intro sigue vigente, un Preview interno lleva una semana en Jetski y las filtraciones nombraron hoy como fecha pública. La cadencia Flash de los últimos dos meses apunta a «estos días de principios de septiembre hasta mediados de mes», no a «esperar a Gemini 4». Sin model card hoy, trata «miércoles» como el borde izquierdo de la ventana, no como una fecha límite.

En AI coding, 3.8 parece un parche a los puntos débiles de 3.7: salida más corta, menos bucles vacíos, un alza modesta en diffs al primer paso. Usa tareas de repo como regla, no Arena. La forma de petición JSON / Function Calling probablemente no cambia — eso fue el artículo anterior. Fixtures y validación local hoy valen más que un calendario de filtraciones. Cuando 3.8 aparezca en la lista oficial de modelos, vuelve a ejecutar los mismos issues una vez.