Gemini 3.8 Flash는 언제 출시되나? 최신 소식, 출시 시점, AI Coding 전망

2026년 9월 2일 기준 Gemini 3.8 Flash는 미공개입니다. 수요일 출시 소문, 내부 코드명 skimaki, 9월 공개 창, 3.7 대비 AI Coding 전망.

짧게 말하면: 2026년 9월 2일 기준으로 Gemini 3.8 Flash는 아직 공개되지 않았습니다. AI Studio, Gemini API, Vertex AI 모델 목록에 호출 가능한 gemini-3.8-flash가 없고, DeepMind 모델 카드는 8월 13일 GA한 Gemini 3.7 Flash에서 멈춰 있습니다. 같은 날 여러 매체와 유출 계정이 “수요일”을 공개일로 적었고, 내부 코드네임 skimaki, 프로덕션 배포가 “완료”됐다는 말도 돌고 있습니다——단서일 뿐, 출시 공지는 아닙니다.

8월 28일 글 《Gemini 3.8 Flash 출시 윈도우와 API JSON 전망》은 Structured Output / Function Calling 호환성을 이미 다뤘습니다. 《Gemini 3.7 Flash 가격, API, JSON》이 지금 실제로 호출할 수 있는 Flash입니다. 이 글이 더하는 것은 세 가지뿐입니다: 9월 2일 전후의 소식, 출시일을 어떻게 읽을지, 그리고 3.8이 AI Coding에서 어디로 갈지.

출시됐나? 2026-09-02 현황

체크리스트로 보세요:

  • 공개 제품: 미출시. AI Studio / Gemini API / Vertex AI에 호출 가능한 3.8 Flash가 없습니다.
  • 모델 ID: 문서화된 gemini-3.8-flash가 없습니다. 유출 문자열을 프로덕션에 넣으면 404입니다.
  • 요금과 컨텍스트: 미공개. “100만 token 컨텍스트”, “3.7의 절반”이라고 적힌 커뮤니티 표에 공식 출처가 없습니다.
  • 현재 Flash workhorse: 여전히 gemini-3.7-flash. Intro 요금은 백만 input / output token당 $0.75 / $3.75(2026-12-31까지), 2027-01-01부터 $1.50 / $7.50.

그래서 “언제 출시되나”에 대한 정직한 답은: Google은 공개일을 정하지 않았습니다. 오늘은 소문의 수요일이지, 공식 캘린더의 수요일이 아닙니다. 아래에서는 9월 1–2일의 새 단서와 8월에 확인된 리듬을 나눠, “프로덕션 배포 완료”를 GA로 착각하지 않게 합니다.

9월 소식과 증거 강도

“내일 나온다” 열기가 아니라 증거 강도로 나열합니다.

날짜주장강도
2026-08-13Gemini 3.7 Flash GA, 공식 모델 카드와 Intro 요금 공개확인됨
2026 Q2 실적Sundar Pichai가 Flash는 월간에 가까운 리듬을 목표로 한다고 발언확인됨 (리듬이지 3.8 자체는 아님)
2026-08-27Business Insider: 직원이 Jetski에서 “Gemini 3.8 Flash Preview” 사용; Google은 논평 거부중~높음: 실명 보도, 그래도 출시는 아님
2026-08-10Tencent 논문이 “Gemini 3.8 Flash”를 LLM 판정 모델 중 하나로 기재 (3.7 GA 3일 전)약함: 오타이거나 조기 내부명
2026-09-01유출: 내부 코드네임 skimaki, 프로덕션 배포 완료, 공개일은 9월 2일 수요일을 가리킴약함~중간: 이차 전재, 모델 카드 없음, API changelog 없음
2026-09-02이 글을 쓰는 시점에도 공식 채널에 3.8 모델 카드나 호출 가능한 엔드포인트가 없음확인됨 (“미출시”라는 사실 자체)

9월 1일 물결은 8월 27일 이야기에 새 단어 세 개를 더했습니다: skimaki(내부 코드네임), 프로덕션 배포 완료, 수요일 공개. CryptoBriefing, 4sAPI 등은 이를 “Google이 9월 2일에 공개한다”로 바꿨습니다. 남겨둘 점은, 최근 두 번의 Flash 마이너에서 유출 커뮤니티의 선행 폭이 나쁘지 않았다는 것입니다. 다만 Google 내부의 “배포 완료”는 직원 dogfood로 트래픽을 옮긴 것뿐일 수 있고, 대외 Developer Preview는 아닙니다.

초기 테스터 피드백은 여전히 주관적인 한 줄입니다: “이미 3.7 Flash보다 분명히 낫다.” 다만 “전체 평가하기엔 너무 이르다”는 단서가 붙습니다. 새로운 기술적 단서는 더 구체적입니다: 장황한 출력을 줄인다(Flash 라인의 오랜 불만)와, 3.7이 드러낸 실패 모드를 고친다는 것. 세대 교체가 아닙니다——3.6→3.7과 같은 2~3주 증분으로 보입니다.

X의 더 큰 주장(“Fable 5 품질을 Flash 가격에”, “몇 달간의 파트너 테스트”) 뒤에는 아직 DeepMind 모델 카드도 API changelog도 없습니다. 논문의 “3.8” 한 번, Arena 익명 모델 하나는 출시 캘린더가 아닙니다.

출시일을 어떻게 읽을지

Google은 3.8 날짜를 공개하지 않았습니다. 쓸 수 있는 간격은 Flash 라인 자신의 것과, 오늘의 “수요일” 소문뿐입니다:

  • Gemini 3.6 Flash: 2026년 7월 21일 전후 GA.
  • Gemini 3.7 Flash: 2026-08-13 GA, 3.6에서 약 3주 후.
  • 3.8 Preview: 8월 27일까지 이미 Jetski에 올라가 있었다——3.7 GA에서 불과 14일.
  • 2분기 콜에서 Pichai: Flash는 월간에 가깝게 유지하고 싶다.
  • 9월 1일 유출: 공개일은 9월 2일(수요일)을 가리킴. 3.7 간격에 맞추면 9월 2–4일도 “약 3주” 선에 올라갑니다.

겹치면 대외 윈도우는 여전히 2026년 9월 초~중순입니다. 오늘(9월 2일)은 그 윈도우의 왼쪽 끝이지, 마감이 아닙니다. 수요일이 모델 카드 없이 지나도, 더 타당한 읽기는 “윈도우가 아직 열려 있다”이지 “3.8은 죽었다”가 아닙니다. 사내 Preview는 조용한 3.7 갱신으로 흡수되거나, 다른 이름으로 돌아올 수 있습니다.

3.8을 마일스톤 의존으로 두지 마세요. 모델 문자열은 설정에 두고, 코딩 / Agent 트래픽은 3.7에 남겨 두세요. AI Studio / DeepMind 모델 카드에 오른 뒤에 fallback 행을 추가하세요.

왜 AI Coding인가: Jetski는 채팅창이 아니다

3.8의 사내 진입점은 Jetski——Google 자신의 코딩 플랫폼이지, 일반 채팅창이 아닙니다. “Fable 5급” 슬로건보다 제품 의도를 더 잘 보여 줍니다: Flash 라인은 코드를 쓰고, 이슈를 고치고, Agent를 돌리는 기본 엔진이 되려 하며, 사내 실제 저장소에서 dogfood한 뒤에 대외 날짜를 고른다는 뜻입니다.

리듬이 2~3주로 압축된 이유이기도 합니다. 플래그십(Gemini 4 사전학습은 2026-07-21에 시작, 출시 윈도우 없음)은 긴 주기입니다. Flash가 흡수하는 것은 작은 알고리즘 조정, 사후학습, 도구 커리큘럼, 실패 모드 패치입니다. Logan Kilpatrick은 3.6→3.7을 “영리한 알고리즘 조정이지, 전체 재학습이 아니다”라고 말했습니다. 3.8도 같은 길일 가능성이 큽니다.

코드를 출시하는 사람에게는 두 가지입니다. 첫째, 3.8의 승패는 Arena 잡담 점수가 아니라 패치 1차 통과, 테스트 한 번에 녹색, 헛된 tool 왕복의 감소에서 갈립니다. 둘째, API 형태는 거의 그대로이고, 바뀌는 것은 같은 저장소 과제에서의 성공률과 총 token입니다. 이전 글은 Structured Output 필드가 바뀌지 않는다고 이미 썼습니다. 이 글은 척도를 코딩 과제로 바꿉니다.

3.7 Flash가 이미 낸 코딩 점수

3.8 공식 벤치가 없으면 퍼센티지를 지어내지 마세요. 기준으로 쓸 수 있는 것은 3.6 → 3.7이 이미 모델 카드에 올린 코딩과 Agent 점수입니다:

지표3.6 Flash3.7 Flash (확인됨)무엇을 재나
FrontierCode 1.1 Main34.4%43.6% (+9.2pp)저장소 단위 코딩 메인 세트
DeepSWE v1.149.0%65.3% (+16.3pp)소프트웨어 공학 Agent
AutomationBench17.0%30.4% (+13.4pp)다단계 자동화
WebDev Arena Elo—1588브라우저 UI / 대화형 구현
포지셔닝싸고 빠른 범용 Flash코딩과 Agent용 workhorse3.8이 이 선이면 약점을 계속 메워야 함

이 점프는 잡담 다듬기가 아닙니다. Flash 학습 예산이 이미 패치, 도구, 다단계 작업에 올라가 있음을 보여 줍니다. 3.8이 나오면 같은 척도를 쓰세요: 패치 편집 성공률, 테스트 케이스 통과율, 도구 실패 후 회복, 멀티턴 지시 추종, 이슈 하나를 닫는 총 token. 한 번의 답변이 “더 똑똑하게 느껴지는지”로는 부족합니다.

비용은 백만 token 리스트 가격만이 아닙니다. Agent 코딩은 파일을 다시 읽고, 테스트를 다시 돌리고, 스스로 고칩니다. 이슈 하나의 총 소비는 단발 Q&A의 몇 배가 되기 쉽습니다. Flash가 겨루는 것은 “이슈를 닫는 총액 × 지연”이지, Arena 익명 점수가 아닙니다. 3.7 Intro 요금은 Claude Fable 5의 $10 / $50보다 이미 한 자릿수 낮습니다. 3.8이 조금 더 날카로워도, 기본 모델을 정하는 것은 “작업당 비용 × 재시도 횟수”입니다.

3.8의 AI Coding 전망

아래는 가설이지 점수가 아닙니다. 재료는 세 가지뿐입니다: 3.6→3.7 방향, Jetski dogfood, 그리고 “군더더기를 줄이고 3.7의 구멍을 막는다”는 유출 두 줄.

더 가능성 높은 쪽

  • 출력이 짧아지고, 패치처럼 보인다: Flash 라인은 오래 “자기소개한 뒤 세 줄을 고친다”는 불만을 들어 왔습니다. 3.8이 정말 verbosity를 낮추면 코딩은 output token을 아끼고, diff 오염도 줄어듭니다. 가장 싼 도약이고, 유출 문구와도 맞습니다.
  • 헛된 tool 왕복이 한 번 줄어든다: 3.7의 DeepSWE / AutomationBench 상승은 이미 “다단계”가 핵심 공략임을 말했습니다. 다음 도약도 workhorse라면 노릴 것은 잘못된 도구, required 누락, 같은 테스트 명령에서의 공회전을 줄이는 일——100만 token 컨텍스트 헤드라인이 아닙니다.
  • 패치 1차 통과율이 조금 오른다: FrontierCode가 34.4%에서 43.6%로 온 뒤, 3.8은 몇 포인트 더 오르는 형이지, 갑자기 플래그십에 붙는 형이 아닙니다. 사내의 “3.7보다 분명히 낫다”는 방향이지 “Fable 5”를 쓸 면허는 아닙니다.
  • API 형태는 같다: 코딩 Agent는 여전히 tools.parameters로 JSON 인자를 넘기고, 구조화 패치가 필요하면 response_mime_type + Schema를 씁니다. Flash 마이너는 일단 호환으로 보고, GA 당일 모델 문자열만 바꿔 같은 픽스처로 회귀하세요. 세부 사항은 《API JSON 전망》에 있습니다.
  • 요금은 Flash 대역에 남는다: “싸고, 빠르고, 하루에 수천 번 호출 가능하다”를 깨면 팀은 3.7 Intro 요금으로 돌아갑니다. 더 안전한 전망은 Flash 대역 단가, 품질은 3.7의 코딩 약점을 메우는 방향입니다.

가능성 낮음, 또는 증거 부족

  • “Fable 5 품질을 Flash 가격에”: 공식 벤치가 없습니다. 3.7 자체도 그 대역을 넘지 못했습니다. 사내 체험 한 번은 요금표가 아닙니다.
  • 새로운 코딩 API나 저장소 단위 프로토콜: 2.5부터 3.7까지 바뀐 것은 모델 문자열과 동작이지, 필드 이름이 아닙니다. 3.8이 먼저 발명할 이유는 없습니다.
  • 100만 token 컨텍스트로 코딩에서 이긴다: 커뮤니티는 3.8이 1M 창을 유지한다고 하지만 미확인입니다. 유지해도 코딩 병목은 보통 도구 루프와 테스트 피드백에 있지, 창 광고에 있지 않습니다.
  • 오늘 프로덕션 기본 모델로 쓴다: 모델 카드가 나오기 전의 “수요일이 GA” 설정 변경은 사고입니다.
from google import genai
from google.genai import types

# Do not point production at an undocumented 3.8 ID before GA.
# Coding-agent fixtures should pin to repo tasks, not chat scores.
MODEL = "gemini-3.7-flash"

run_tests = types.FunctionDeclaration(
    name="run_tests",
    description="Run tests at a path and return a failure summary",
    parameters={
        "type": "object",
        "properties": {
            "path": {"type": "string", "description": "Test target, e.g. tests/test_parser.py"},
            "max_fail": {"type": "integer", "description": "Max failures to return"}
        },
        "required": ["path"],
    },
)

client = genai.Client()
response = client.models.generate_content(
    model=MODEL,
    contents="parser raises KeyError on empty objects; run tests/test_parser.py, then a minimal patch.",
    config=types.GenerateContentConfig(
        tools=[types.Tool(function_declarations=[run_tests])],
    ),
)

3.8을 비교해야 하는 형태는 이것입니다: 같은 이슈, 같은 도구, 같은 테스트. 볼 것은 tool 왕복이 줄었는지, 군더더기가 줄었는지, 패치가 여전히 apply되는지입니다. Claude Fable 5와 “누가 더 똑똑한가”는 틀린 프레임입니다.

코딩 워크플로를 어떻게 검수할지

3.8이 공식 목록에 오르면 보도자료를 건너뛰고 자기 저장소를 돌리세요. 픽스처는 네 칸으로 나눕니다:

칸무엇을 재나3.8이 3.7보다 나아야 할 점
패치 편집실패 테스트를 주고, apply 가능한 최소 diff를 내는지1차 통과율이 오르고, 무관한 파일을 덜 건드림
도구 루프파일 읽기 → 코드 수정 → 테스트 실행 → 실패 읽기잘못된 도구, 공회전, required 누락이 줄어듦
지시 추종“parser만 고치고, 리팩터링하지 말 것”이 지켜지는지몇 턴 뒤에도 레일에서 벗어나지 않음
총비용이슈 하나를 닫는 input+output token과 월클록 시간짧은 출력은 총액을 내려야 함; token이 늘면 “더 나은 느낌”은 손실일 수 있음

도구 인자는 여전히 JSON입니다. 모델이 매개변수 채우기에 “성공”했는데 테스트 명령이 탈선하면, 십중팔구 Schema가 너무 느슨한 것입니다——“3.8이 충분히 똑똑하지 않다”가 아닙니다. 게이트는 두 개: json.loads + 같은 JSON Schema, 그다음 경로·타임아웃·최대 실패 건수는 직접 고정합니다. 샘플 출력은 JSON 툴박스에서 로컬 Diff——업로드 없음. 3.7과 미래의 3.8이 같은 픽스처를 쓰지 않으면 “정말 더 안정적인지”를 비교할 수 없습니다. 관련 파이프라인은 《Tool Calling과 JSON Schema 검증》《Tool Calling → MCP 데이터 흐름》을 보세요.

지금 할 일

  1. 프로덕션은 3.7 Flash에 고정: gemini-3.7-flash로 Intro 요금을 쓰고, 기본 모델은 설정에 둡니다. gemini-3.8-flash나 skimaki를 미리 쓰지 마세요.
  2. 코딩 회귀 픽스처를 먼저 끝내기: 실제 이슈 10–30개(패치, 테스트, 멀티턴 제약). 3.8이 GA하면 모델만 바꿔 한 번 더 돌립니다.
  3. 총 token을 기록하고, “더 나은 느낌”만 믿지 말 것: Agent 청구서는 루프 횟수에 있지, 단발 리스트 가격에 있지 않습니다.
  4. System + tools 캐시: Agent system prompt와 도구 목록은 Context Caching. 3.7 Intro 기간 캐시 읽기는 약 $0.075 / 1M token.
  5. 예산은 2027 표준가로: 3.8이 새 Intro 요금을 들고 와도, 3.7 자체는 2027-01-01에 두 배가 됩니다.
  6. 공식 채널만 보기: DeepMind Flash 모델 카드, Gemini API changelog, Vertex 모델 목록. 수요일 소문과 Arena 익명 모델은 일정이 아닙니다.

FAQ

Gemini 3.8 Flash는 언제 출시되나요?

Google은 날짜를 공개하지 않았습니다. 유출은 공개일을 2026년 9월 2일 수요일로 가리켰고, 내부 코드네임은 skimaki, 프로덕션 배포는 “완료”라고 합니다. 3.6에서 3.7까지 약 3주, CEO가 말한 월간에 가까운 Flash 리듬을 보면 대외 윈도우는 여전히 9월 초~중순입니다. 오늘은 그 윈도우의 왼쪽 끝이지 약속이 아니며, 프로젝트 마감으로 쓰면 안 됩니다.

지금 gemini-3.8-flash를 호출할 수 있나요?

없습니다. 2026년 9월 2일 기준으로 공개 API, SDK 모델 ID, DeepMind 모델 카드가 없습니다. 프로덕션에서는 gemini-3.7-flash를 쓰세요.

“프로덕션 배포 완료”는 곧 GA라는 뜻인가요?

아닙니다. 사내 배포는 Jetski 직원 dogfood만 맡을 수 있습니다. Business Insider가 확인한 것은 Preview이고, Google은 논평을 거부했습니다. dogfood는 몇 주 뒤 GA할 수도, 이름이 바뀌거나 3.7로 흡수될 수도 있습니다.

3.8의 AI Coding은 3.7보다 얼마나 나아지나요?

공식 벤치가 없습니다. 외삽할 수 있는 것은 3.6→3.7이 이미 낸 코딩 / Agent 방향과, “군더더기를 줄이고 3.7의 구멍을 막는다”입니다. 갑자기 Fable 5가 되기보다, 더 짧은 패치와 헛된 tool 왕복 감소를 볼 가능성이 큽니다. 출시 당일에는 모델 카드와 자기 저장소 픽스처를 믿으세요.

코딩 Agent는 3.8을 기다렸다가 내야 하나요?

기다릴 필요 없습니다. 도구 Schema, 테스트 픽스처, 오류 재주입은 Flash 마이너 버전에 의존하지 않습니다. 먼저 3.7에서 파이프라인을 통과시키세요. 3.8이 오면 바꿀 것은 모델 문자열뿐입니다.

3.8에서 코딩 관련 API가 바뀌나요?

2.5에서 3.7까지의 습관은 모델 ID가 바뀌고 요청 필드는 같다는 점입니다. 코딩 Agent는 tools.parameters를 계속 쓰고, 구조화 패치는 response_schema / response_json_schema를 계속 씁니다. 일단 호환으로 보고, GA 당일 회귀하세요.

요약

Gemini 3.8 Flash는 아직 출시되지 않았습니다. 2026년 9월 2일에 확인할 수 있는 것은: 3.7 Flash가 프로덕션에 있고, Intro 요금은 유효하며, 사내 Preview가 Jetski에서 일주일째 돌고 있고, 유출이 오늘을 공개일로 적었다는 점입니다. 최근 두 달의 Flash 리듬은 “Gemini 4를 기다리라”가 아니라 “9월 초의 이 며칠부터 중순”을 가리킵니다. 오늘 모델 카드가 없으면 “수요일”은 윈도우의 왼쪽 끝이지, 마감이 아닙니다.

AI Coding에서 3.8은 3.7의 약점 패치로 보입니다: 더 짧은 출력, 공회전 감소, 패치 1차 통과율의 소폭 상승. 척도는 저장소 과제이지 Arena가 아닙니다. JSON / Function Calling 요청 형태는 거의 그대로입니다——그건 이전 글입니다. 오늘 픽스처와 로컬 검증을 준비하는 편이 유출 캘린더를 쫓는 것보다 낫습니다. 3.8이 공식 모델 목록에 오르면 같은 이슈를 한 번 더 돌리면 됩니다.