Когда выйдет Gemini 3.8 Flash? Свежие новости, дата релиза и прогноз AI Coding

На 2 сентября 2026 Gemini 3.8 Flash не опубликован. Слухи о среде, кодовое имя skimaki, сентябрьское окно и прогноз по кодингу относительно Gemini 3.7 Flash.

Короткий ответ: по состоянию на 2 сентября 2026 года Gemini 3.8 Flash по-прежнему не выпущен публично. AI Studio, Gemini API и Vertex AI не содержат вызываемого gemini-3.8-flash, а card DeepMind по-прежнему останавливается на Gemini 3.7 Flash, который стал GA 13 августа. В тот же день несколько изданий и аккаунтов-утечек назвали средой публичную дату, с внутренним кодовым именем skimaki и утверждениями, что production-деплой «завершён». Это зацепки, а не релиз-ноут.

Материал от 28 августа, окно запуска Gemini 3.8 Flash и превью JSON API, уже закрыл совместимость Structured Output / Function Calling. Gemini 3.7 Flash: цены, API и JSON — это Flash, который можно реально вызвать. Эта статья добавляет только три вещи: новости около 2 сентября, как читать дату релиза и куда 3.8, скорее всего, сдвинется в AI coding.

Уже вышел? Статус на 2026-09-02

Считайте это чек-листом:

  • Публичный продукт: не выпущен. AI Studio / Gemini API / Vertex AI не содержат вызываемого 3.8 Flash.
  • Model ID: нет задокументированного gemini-3.8-flash. Просочившаяся строка в продакшене даст 404.
  • Цена и контекст: не раскрыты. Таблицы сообщества про окно 1M-token или «вдвое дешевле 3.7» не имеют официального источника.
  • Текущий workhorse Flash: по-прежнему gemini-3.7-flash, intro-цена $0.75 / $3.75 за миллион input / output токенов до 2026-12-31, затем $1.50 / $7.50 с 2027-01-01.

Честный ответ на «когда релиз?» такой: Google не назначил публичную дату; сегодня — среда из слухов, а не среда календаря. Дальше текст отделяет зацепки 1–2 сентября от августовской каденции, чтобы «production deployment complete» не приняли за GA.

Сентябрьские новости и сила доказательств

Ранжируйте по доказательствам, а не по жару «выйдет завтра».

ДатаУтверждениеСила
2026-08-13Gemini 3.7 Flash GA, официальная model card и intro-ценыПодтверждено
Q2 2026 earningsSundar Pichai сказал, что линейка Flash должна держаться близко к ежемесячному ритмуПодтверждено (каденция, не сам 3.8)
2026-08-27Business Insider: сотрудники используют «Gemini 3.8 Flash Preview» на Jetski; Google отказался комментироватьСредне-высокая: именной репортаж, всё ещё не релиз
2026-08-10Статья Tencent называет «Gemini 3.8 Flash» одним из LLM-судей (за три дня до GA 3.7)Слабо: опечатка или раннее внутреннее имя
2026-09-01Утечки: внутреннее имя skimaki, production deployment завершён, публичная дата указывает на среду 2 сентябряСлабо-средне: пересказы из вторых рук, нет model card, нет changelog API
2026-09-02На момент текста официальные каналы по-прежнему без card 3.8 и вызываемого endpointПодтверждено (сам факт «не выпущен»)

Волна 1 сентября добавила к истории 27 августа три новых слова: skimaki (внутреннее кодовое имя), production deployment complete и публичная среда. CryptoBriefing, 4sAPI и другие превратили это в «Google представит 2 сентября». Стоит отметить: задел сообщества утечек по недавним минорам Flash был неплох. «Deployment complete» внутри Google всё ещё может значить только employee dogfood, а не публичный Developer Preview.

Ранний фидбек тестеров по-прежнему одна субъективная строка: «заметно лучше 3.7 Flash», с оговоркой, что для полного обзора рано. Новый технический цвет конкретнее: менее многословный вывод (давняя жалоба линейки Flash) и патчи failure mode, которые вскрыл 3.7. Это не поколенческий сброс — похоже на очередной инкремент в две–три недели в стиле 3.6→3.7.

Более громкие заявления в X («качество Fable 5 по цене Flash», «месяцы партнёрских тестов») по-прежнему не подкреплены model card DeepMind или changelog API. Одно «3.8» в одной статье или одна анонимная модель Arena — не календарь релиза.

Как читать дату запуска

Google не публиковал дату 3.8. Единственные интервалы, которыми можно пользоваться, — собственные интервалы линейки Flash плюс сегодняшний слух про среду:

  • Gemini 3.6 Flash: GA около 21 июля 2026.
  • Gemini 3.7 Flash: GA 2026-08-13, примерно через три недели после 3.6.
  • 3.8 Preview: уже на Jetski к 27 августа, всего 14 дней после GA 3.7.
  • Pichai на звонке Q2: Flash должен оставаться близко к ежемесячному ритму.
  • Утечки 1 сентября: публичная дата указывает на среду 2 сентября. Это же ложится на линию «примерно три недели после 3.7» (2–4 сентября).

Сложите это вместе — и публичное окно по-прежнему начало–середина сентября 2026. Сегодня (2 сентября) — левый край этого окна, не дедлайн. Если среда пройдёт без model card, лучше читать «окно ещё открыто», а не «3.8 мёртв». Внутренний Preview всё ещё могут влить в тихий апдейт 3.7 или вернуть под другим именем.

Не делайте 3.8 зависимостью вехи. Держите строку модели в конфиге и оставляйте трафик кода / агентов на 3.7. Добавьте строку fallback только после появления в AI Studio / card DeepMind.

Почему AI coding: Jetski — не чат

Внутренняя дверь для 3.8 — Jetski: собственная платформа кодирования Google, а не обычный чат. Это говорит о продуктовом намерении больше любого слогана «уровня Fable 5»: линейка Flash должна стать движком по умолчанию для написания кода, правок issue и запуска агентов, с dogfood на реальных внутренних репозиториях до выбора публичной даты.

Отсюда же сжатая каденция в две–три недели. Флагман (предобучение Gemini 4 стартовало 2026-07-21, без окна запуска) идёт длинным циклом. Flash вбирает мелкие алгоритмические правки, пост-тренинг, учебные курсы по инструментам и патчи failure mode. Logan Kilpatrick описал 3.6→3.7 как «умные алгоритмические твики, не полную перетренировку». 3.8, скорее всего, тот же путь.

Для тех, кто выкатывает код, это значит две вещи. Первое: 3.8 выиграет или проиграет на патчах с первого прохода, зелёных тестах и меньшем числе пустых циклов инструментов — не на чат-баллах Arena. Второе: форма API, скорее всего, останется; меняются success rate и суммарные токены на тех же repo-задачах. Предыдущая статья уже сказала, что поля Structured Output не переименуют. Эта меняет линейку на задачи кодирования.

Баллы по коду, которые 3.7 Flash уже оплатил

Без официального bench 3.8 не выдумывайте проценты. База — баллы по коду и агентам, которые 3.6 → 3.7 уже положил на model card:

Метрика3.6 Flash3.7 Flash (подтверждено)Что измеряет
FrontierCode 1.1 Main34.4%43.6% (+9.2pp)Основной набор кодирования на уровне репозитория
DeepSWE v1.149.0%65.3% (+16.3pp)Агенты программной инженерии
AutomationBench17.0%30.4% (+13.4pp)Многошаговая автоматизация
WebDev Arena Elo—1588Browser UI / интерактивная реализация
ПозиционированиеДешёвый быстрый общий FlashWorkhorse для кода и агентовЕсли 3.8 останется на этой линии, должен дальше латать слабые места

Эти скачки — не полировка чата. Они показывают, что бюджет обучения Flash уже сидит на патчах, инструментах и многошаговой работе. Когда появится 3.8, держите ту же линейку: успех правки патча, доля прошедших тестов, восстановление после неудачного tool call, следование инструкциям на нескольких ходах и суммарные токены на один issue. «Умнее ли один ответ» — недостаточно.

Стоимость — не только прайс за миллион. Агентное кодирование перечитывает файлы, перезапускает тесты и самоисправляется; один issue часто стоит в несколько раз дороже одного хода вопрос–ответ. Flash конкурирует по «цене × задержке закрытия issue», не по анонимному баллу Arena. Intro-цена 3.7 уже на порядок ниже Claude Fable 5 по $10 / $50. Даже если 3.8 чуть острее, модель по умолчанию всё равно выбирают по стоимости задачи × числу повторов.

Прогноз AI coding для 3.8

Это гипотезы, не баллы. Единственные входы — вектор 3.6→3.7, dogfood Jetski и две строки утечек: меньше воды, закрыть дыры 3.7.

Более вероятно

  • Короче вывод, больше похож на патч: линейку Flash давно упрекают, что она представляется, прежде чем поменять три строки. Если 3.8 правда срежет verbosity, coding-задачи сэкономят output-токены и меньше засорят diff. Это самый дешёвый шаг, и он совпадает с формулировками утечек.
  • На один бесполезный кругооборот инструмента меньше: прирост 3.7 по DeepSWE / AutomationBench уже сказал, что «многошаговость» — главный удар. Если следующий шаг останется workhorse, приз — меньше неверных инструментов, меньше пропущенных required, меньше пустых циклов на той же тестовой команде — не очередной заголовок про 1M-token.
  • Скромный рост патчей с первого прохода: после того как FrontierCode сдвинулся 34.4% → 43.6%, 3.8 выглядит как ещё несколько пунктов, не прыжок к флагману. «Заметно лучше 3.7» — направление, не лицензия писать «Fable 5».
  • Та же форма API: coding-агенты по-прежнему передают JSON-аргументы через tools.parameters; структурированные патчи по-прежнему используют response_mime_type плюс Schema. Сначала считайте минор Flash совместимым; в день GA смените строку модели и прогоните те же fixtures. Подробности — в превью JSON API.
  • Цена остаётся в тарифе Flash: сломать «дёшево, быстро, тысячи вызовов в день» заставило бы команды вернуться на intro-цену 3.7. Более безопасный прогноз: цена уровня Flash, качество — в слабые места 3.7 по коду.

Маловероятно или без доказательств

  • «Качество Fable 5 по цене Flash»: нет официального bench. Сам 3.7 эту полосу не перешёл; один внутренний trial — не прайс-лист.
  • Совершенно новый coding API или repo-протокол: с 2.5 по 3.7 менялись строка модели и поведение, не имена полей. 3.8 незачем изобретать это первым.
  • Выигрыш в коде за счёт окна 1M-token: сообщество говорит, что 3.8 сохраняет окно 1M; это не проверено. Даже если сохранит, узкие места кодирования обычно в цикле инструментов и фидбеке тестов, не в рекламе окна.
  • Ставить его продакшен-дефолтом сегодня: любая смена конфига «среда — это GA» до model card — инцидент.
from google import genai
from google.genai import types

# Do not point production at an undocumented 3.8 ID before GA.
# Coding-agent fixtures should pin to repo tasks, not chat scores.
MODEL = "gemini-3.7-flash"

run_tests = types.FunctionDeclaration(
    name="run_tests",
    description="Run tests at a path and return a failure summary",
    parameters={
        "type": "object",
        "properties": {
            "path": {"type": "string", "description": "Test target, e.g. tests/test_parser.py"},
            "max_fail": {"type": "integer", "description": "Max failures to return"}
        },
        "required": ["path"],
    },
)

client = genai.Client()
response = client.models.generate_content(
    model=MODEL,
    contents="parser raises KeyError on empty objects; run tests/test_parser.py, then a minimal patch.",
    config=types.GenerateContentConfig(
        tools=[types.Tool(function_declarations=[run_tests])],
    ),
)

Вот форма, на которой 3.8 надо сравнивать: тот же issue, те же инструменты, те же тесты. Важно меньше кругов инструментов, меньше воды и патч, который всё ещё apply-ится. «Кто умнее» против Claude Fable 5 — неверный кадр.

Как принимать coding-workflow

Когда 3.8 появится в официальном списке, пропустите пресс-релиз и прогоните свой репозиторий. Разбейте fixture на четыре ячейки:

ЯчейкаЧто измеряетеГде 3.8 должен обойти 3.7
Правка патчаПо падающему тесту выдаёт ли минимальный применимый diffВыше first-pass, меньше чужих файлов задето
Цикл инструментовПрочитать файл → править → гонять тесты → читать падениеМеньше неверных инструментов, меньше пустых циклов, меньше пропущенных required
Следование инструкциямВыживает ли «трогать только parser, без переписывания»После нескольких ходов всё ещё на рельсах
Книга учётаInput+output токены и wall time на закрытие одного issueКороче вывод должен снизить счёт; если токены растут, «лучше ощущается» может быть убытком

Аргументы инструментов по-прежнему JSON. Если модель «успешна» в заполнении параметров, а тестовая команда всё равно сходит с рельсов, Schema, скорее всего, слишком свободная — не «3.8 недостаточно умён». Держите два шлюза: json.loads плюс та же JSON Schema, затем свои инварианты (пути, таймауты, максимум падений). Складывайте образцы вывода в JSON toolbox для локального Diff — без загрузки. 3.7 и будущий 3.8 должны делить одни и те же fixtures, иначе не понять, стал ли он реально стабильнее. См. Tool Calling и валидация JSON Schema и Tool Calling → поток данных MCP.

Что делать сейчас

  1. Оставьте продакшен на 3.7 Flash: gemini-3.7-flash по intro-цене, модель по умолчанию в конфиге. Не прописывайте заранее gemini-3.8-flash или skimaki.
  2. Сначала допишите coding-fixtures: 10–30 реальных issue (патчи, тесты, многоходовые ограничения). Когда 3.8 станет GA, прогоните ещё раз с новой строкой модели.
  3. Логируйте суммарные токены, не только «кажется лучше»: счета агента живут в числе циклов, не в прайсе одного хода.
  4. Кэшируйте System + tools: системный промпт агента и список инструментов — в Context Caching. Intro-чтение кэша 3.7 около $0.075 / 1M токенов.
  5. Бюджет по стандартным тарифам 2027: даже если 3.8 выйдет с новой intro-ценой, сам 3.7 удвоится 2027-01-01.
  6. Смотрите только официальные каналы: Flash card DeepMind, changelog Gemini API, список моделей Vertex. Средовые слухи и анонимные модели Arena — не расписание.

FAQ

Когда выйдет Gemini 3.8 Flash?

Google не публиковал дату. Утечки указали публичный день на среду 2 сентября 2026, с внутренним именем skimaki и «production deployment complete». При промежутке около трёх недель между 3.6 и 3.7 и почти ежемесячной каденции Flash, о которой говорил CEO, публичное окно по-прежнему начало–середина сентября. Сегодня — левый край этого окна, не обязательство и не дедлайн проекта.

Можно ли вызвать gemini-3.8-flash сегодня?

Нет. На 2 сентября 2026 нет публичного API, SDK model ID или model card DeepMind. В продакшене используйте gemini-3.7-flash.

Значит ли «production deployment complete», что GA близко?

Нет. Внутренний деплой может обслуживать только employee dogfood на Jetski. Business Insider подтвердил Preview; Google отказался комментировать. Dogfood может стать GA через недели, а может быть переименован или влит обратно в 3.7.

Насколько 3.8 будет лучше 3.7 в AI coding?

Официального bench нет. Экстраполировать можно вектор кода / агентов, который 3.6→3.7 уже оплатил, плюс «меньше воды, закрыть дыры 3.7». Скорее увидите более короткие патчи и меньше пустых циклов инструментов, чем внезапный Fable 5. В день релиза доверяйте model card и своим repo-fixtures.

Стоит ли ждать 3.8, прежде чем выкатывать coding-агента?

Нет. Schema инструментов, тестовые fixtures и повтор ошибок не зависят от минорной версии Flash. Доведите пайплайн до зелёного на 3.7; 3.8 — замена строки модели.

Изменит ли 3.8 API, связанный с кодом?

Привычка 2.5→3.7: новый model ID, те же поля запроса. Coding-агенты продолжают использовать tools.parameters; структурированные патчи — response_schema / response_json_schema. Сначала считайте совместимым, затем в день GA прогоните регрессию.

Итоги

Gemini 3.8 Flash не вышел. На 2 сентября 2026 подтверждено: 3.7 Flash в продакшене, intro-цена ещё действует, внутренний Preview неделю крутится на Jetski, а утечки назвали сегодня публичной датой. Каденция Flash за последние два месяца указывает на «эти дни начала сентября до середины месяца», а не «ждать Gemini 4». Без model card сегодня читайте «среду» как левый край окна, не как дедлайн.

В AI coding 3.8 похож на патч слабых мест 3.7: короче вывод, меньше пустых циклов, скромный рост first-pass diff. Линейка — repo-задачи, не Arena. Форма запроса JSON / Function Calling, скорее всего, без изменений — это была предыдущая статья. Fixtures и локальная валидация сегодня полезнее календаря утечек. Когда 3.8 появится в официальном списке моделей, прогоните те же issue ещё раз.