한눈에 결론
- Google DeepMind는 2026년 9월 2일 Gemini 3.8 Flash와 Gemini 3.8 Flash Cyber를 공개했습니다. 6주 사이 세 번째 Flash입니다.
- 도입 단가는 3.7 Flash와 같습니다. 입력 100만 토큰당 0.75달러, 출력 100만 토큰당 3.75달러이며 2026년 12월 31일까지입니다. 2027년 1월 1일부터는 1.50달러 / 7.50달러입니다.
- 단가가 같아도 작업당 청구는 늘 수 있습니다. 공식문 자체가 높은 노력 단계에서 토큰을 더 쓸 수 있다고 적었고, 3.7은 효율 우선 작업용으로 계속 지원됩니다.
- 일반 이용자는 Google AI Pro·Ultra의 Gemini 앱, 검색 AI 모드, 스프레드시트 Gemini에서 3.8 Flash를 씁니다. 개발자는 모델 ID
gemini-3.8-flash입니다. - Gemini 3.8 Flash Cyber는 Fairwind Program 대상입니다. 정부·핵심 인프라·소프트웨어 유지보수 조직용이며, 한국 개인이 모델 목록에서 고를 대상이 아닙니다.
Fact Check
| 항목 | 현재 판정 | 근거 |
|---|---|---|
| 3.8 Flash·3.8 Flash Cyber가 2026-09-02 공개됐다 | 사실 | Google 공식 블로그 Introducing Gemini 3.8 Flash and 3.8 Flash Cyber |
| 6주 만에 세 번째 Flash다 | 사실 | 공식문: 3.7 이후 3주, 6주간 세 번째 Flash |
| 입력·출력 단가가 3.7보다 내려갔다 | 거짓 | 도입가 $0.75 / $3.75로 동일 |
| 도입가는 2026년 말까지다 | 사실 | 공식 각주. 2027-01-01부터 $1.50 / $7.50 |
| 단가가 같으면 청구액도 같다 | 일부 사실 | 단가는 동일. 높은 노력 단계에서 토큰이 늘면 작업당 비용은 증가 가능 |
| 무료 요금제에서도 3.8 Flash가 기본이다 | 공식 미확인 | 공식문은 Pro·Ultra 구독자와 기업·개발자 경로만 명시 |
| Flash Cyber를 누구나 API에서 고를 수 있다 | 거짓 | Fairwind Program 제한 공개 |
| Gemini 3.5 Pro가 이번 발표로 나왔다 | 거짓 | 이번 공식문은 Flash와 Cyber만 다룸 |
9월 2일 공식문이 말한 것과 말하지 않은 것
1차 출처는 Google 블로그 글 「Introducing Gemini 3.8 Flash and 3.8 Flash Cyber」(2026년 9월 2일)입니다. 작성자는 제품 총괄 툴시 도시(Tulsee Doshi)와 DeepMind 보안 책임 랄루카 아다 포파(Raluca Ada Popa)입니다. 모델 카드 공개일도 같은 날입니다.
회사 표현은 분명합니다. 3.8 Flash를 “지금까지 가장 똑똑한 작업용(workhorse) 모델”로 적었고, 3.7과 같은 속도와 낮은 비용이라고 했습니다. 초점은 소프트웨어 엔지니어링, 에이전트 작업, 여러 단계를 거치는 전문 영역 추론입니다. 입력은 텍스트·이미지·오디오·비디오·PDF, 출력은 텍스트입니다. 컨텍스트는 104만 8,576토큰, 최대 출력은 6만 5,536토큰입니다.
말하지 않은 것도 있습니다. 이번 글은 Gemini 3.5 Pro 출시일이 아닙니다. Pro 라인 일정은 이번 공식문에 없습니다. Flash Cyber 단가표도 공개 가격 페이지처럼 숫자로 적히지 않았습니다. “더 큰 프론티어 모델보다 싸다”는 비교만 있습니다.

3.7 Flash와 비교하면 어디가 올랐나
개발자 문서의 자체 비교표가 가장 구체적입니다. Google Cloud 「Developer’s guide to Gemini 3.8 Flash」는 3.8과 3.7을 같은 표에 넣었습니다.
| 평가 | 3.8 Flash | 3.7 Flash |
|---|---|---|
| Terminal-bench 2.1 | 90.8% | 81.6% |
| SWE-Bench Pro | 61.6% | 60.4% |
| SWE-Atlas | 51.9% | 48.0% |
| τ³-bench Banking | 38.1% | 30.9% |
| CharXiv (멀티모달) | 86.2% | 84.5% |
| GDP.pdf | 35.0% | 34.0% |
| Humanity’s Last Exam | 45.4% | 45.7% |
코딩·에이전트·도구 사용 쪽 상승이 큽니다. 터미널 벤치 2.1은 9.2%포인트 올랐습니다. 은행 에이전트 벤치도 7.2%포인트 올랐습니다. 반대로 Humanity’s Last Exam은 45.7%에서 45.4%로 소폭 내려갔습니다. “모든 시험이 올랐다”고 말하면 공식 표와 어긋납니다.
제품 페이지는 DeepSWE v1.1에서 더 큰 프론티어 모델 다수를 앞선다고 했고, HLE-Verified는 54.9%라고 적었습니다. HLE와 HLE-Verified는 다른 집계입니다. 숫자를 하나로 합치면 안 됩니다. Vals Finance Agent V2와 Harvey Legal Agent Benchmark에서도 3.7과 다른 프론티어 모델을 앞섰다고 했지만, 그 두 항목의 원점수 표는 블로그 본문에 없습니다.
사고 단계는 low, medium, high이며 기본값은 medium입니다. Gemini API 문서는 관리형 에이전트와 Antigravity 에이전트·SDK의 기본 모델이 3.8 Flash로 바뀌었다고 적었습니다. 이미 Antigravity를 쓰는 팀은 모델 ID를 안 바꿔도 경로가 바뀌었을 수 있습니다. 기본값이 바뀐 뒤에는 로그에서 실제 모델 ID를 확인하는 편이 안전합니다.
토큰 단가가 같아도 청구액이 늘어날 수 있는 이유

가격은 공식 각주가 기준입니다.
| 항목 | 2026-12-31까지 도입가 | 2027-01-01부터 정가 |
|---|---|---|
| 입력 100만 토큰 | 0.75달러 | 1.50달러 |
| 출력 100만 토큰 | 3.75달러 | 7.50달러 |
사고(thinking) 토큰은 출력으로 청구됩니다. 공식문과 Cloud 문서는 같은 경고를 반복합니다. 복잡한 작업, 특히 높은 노력 단계에서 성능을 위해 토큰을 더 쓸 수 있다. 계산 효율이 최우선이면 노력 단계를 낮추거나 3.7 Flash를 그대로 쓰라고 했습니다. 3.7은 효율 우선 작업용으로 계속 지원됩니다.
독립 측정과 공식 경고는 방향이 같습니다. Artificial Analysis는 토큰 단가가 그대로여도 작업당 비용이 전작보다 약 40% 높게 나왔다고 적었습니다. 원인으로 작업당 평균 출력 토큰이 약 30% 늘고, 에이전트 평가에서 턴 수가 늘어난 점을 들었습니다. 이 수치는 Google 공식 가격표가 아닙니다. “모든 실제 업무가 40% 비싸다”는 뜻이 아니라, 단가 = 청구액이 아니라는 신호로 보는 것이 맞습니다.
이용자가 확인할 항목은 네 가지입니다. 같은 프롬프트로 3.7과 3.8의 사용 토큰을 비교할 것. 사고 단계를 high로 고정하지 말고 작업별로 조절할 것. 캐시가 켜져 있는 반복 컨텍스트인지 확인할 것. 2027년 1월 1일 정가 전환일을 캘린더에 표시할 것.
비교 방법은 단순합니다. 실제 업무 프롬프트 10개를 고릅니다. 파일 첨부나 도구 호출이 있는 것과 없는 것을 섞습니다. 두 모델에 같은 사고 단계를 넣고 출력 품질, 출력 토큰, 왕복 횟수를 표로 남깁니다. 품질이 비슷하고 토큰만 늘면 3.8이 이득이 아닙니다. 한 번에 끝나는 수정이 늘어 사람 시간이 줄면, 토큰이 조금 늘어도 3.8이 맞습니다. 이 판단은 벤치마크가 대신 해주지 않습니다.
도입가는 연말까지입니다. 그 전에 새 Flash가 또 나오면 가격 체계가 다시 바뀔 수는 있지만, 현재 문서에 적힌 날짜는 2026년 12월 31일과 2027년 1월 1일입니다. “도입가가 영원히 유지된다”는 문장은 공식문에 없습니다.
지금 바로 쓸 수 있는 사람과 못 쓰는 사람

공식문이 명시한 경로는 세 갈래입니다.
소비자. Google AI Pro와 Ultra 구독자가 Gemini 앱, 검색 AI 모드, Google Sheets의 Gemini에서 3.8 Flash를 씁니다. 무료 요금제 기본 모델이라는 문장은 이 발표문에 없습니다. Plus 요금제 언급도 이번 글에는 없습니다. 앱에서 모델 이름이 바로 안 보이면 구독 등급과 앱 업데이트부터 확인해야 합니다.
개발자. 모델 ID는 gemini-3.8-flash입니다. Google AI Studio와 Gemini API, Gemini Enterprise Agent Platform에서 일반 제공(GA)입니다. 도구로는 함수 호출, 검색, 코드 실행, 컴퓨터 사용(미리보기)이 문서에 있습니다. Gemini Live API는 이 모델에서 지원되지 않습니다. 미세조정(tuning)도 지원되지 않습니다.
API를 3.x에서 옮길 때 문서가 명시한 주의가 있습니다. temperature, top_p, top_k 같은 옛 샘플링 파라미터는 제거합니다. thinking_budget은 thinking_level 문자열로 바꿉니다. minimal 단계는 없습니다. 이미 동작 중인 에이전트 파이프라인은 파라미터부터 점검하지 않으면 요청이 거절될 수 있습니다.
기업. Gemini Enterprise에서 3.8 Flash에 접근합니다. 클라우드 콘솔의 Agent Platform 경로가 공식 링크입니다.
누구에게 필요한가 / 굳이 필요 없는가
- 필요: 여러 파일을 넘나드는 코딩, 도구를 반복 호출하는 에이전트, 금융·법률처럼 단계가 긴 업무 초안.
- 필요: Antigravity를 기본값으로 쓰는 팀. 기본 모델이 이미 3.8로 바뀌었습니다.
- 급하지 않음: 짧은 요약, 번역, 단순 Q&A처럼 토큰을 아끼는 대량 처리. 3.7 또는
low가 맞을 수 있습니다. - 해당 없음: Flash Cyber가 필요하다고 해서 개인 API 키로 여는 경우. 창구가 다릅니다.
Gemini 3.8 Flash Cyber는 일반 이용자 모델이 아니다
같은 날 나온 두 번째 모델이 Cyber입니다. 제품 페이지 표현은 “취약점을 찾고 고치는 데 쓰는 가장 성능 높은 사이버보안 모델”입니다. 대상은 Fairwind Program입니다. 같은 날 Google이 연 제한 접근 프로그램으로, 신뢰할 수 있는 정부 기관, 핵심 인프라 운영자, 소프트웨어 유지보수 조직에 우선 제공합니다.
공식 블로그가 적은 수치는 다음입니다. 내부 벤치마크에서 20개 프로그래밍 언어 코드베이스의 취약점 발견 성공률이 70%를 넘었다. CWE-Bench pass@1은 47.2%로, 비교 대상 프론티어 모델 47.8%에 근접하면서 비용은 더 낮다고 했습니다. Chrome 보안팀은 더 큰 상용 모델보다 올바른 패치를 2.6배 많이 만들었다고 했습니다. Wiz는 자체 침투 테스트 벤치마크에서 재현율이 7.5~9.7%포인트 높고 비용은 2.3~5.2분의 1이라고 했습니다. 클라우드 취약점 연구팀은 보통 몇 달이 걸리는 기초 취약점을 2시간 안에 찾았다고 적었습니다.
이 숫자의 성격은 대부분 회사·파트너 평가입니다. 공개 재현 데이터가 없는 항목은 “독립 검증 완료”로 쓰지 않습니다. Fairwind 쪽 모델은 사이버 방어를 위해 완화 장치가 더 느슨하다고 공식문이 명시했습니다. 그래서 일반 공개 API에 올리지 않습니다. The Verge 보도는 프로그램 규모를 약 650곳, 구성에 CrowdStrike와 Center for Internet Security를 포함한다고 전했습니다. 회원 명단과 한국 기업 포함 여부는 Google 공식문에 없습니다.
일반 Google Cloud 고객이 할 수 있는 일은 따로 적혀 있습니다. 공개 모델을 쓰는 CodeMender와 AI Threat Defense 조합입니다. Cyber 가중치 자체를 콘솔에서 고르는 경로와는 다릅니다.
3.8로 바꿀지, 3.7을 남길지

전환 기준은 벤치마크 1등보다 업무 유형입니다.
3.8을 기본으로 두는 경우입니다. 여러 파일 리팩터, 터미널·도구를 오래 돌리는 코딩 에이전트, 금융·법률처럼 단계가 긴 초안. Antigravity 기본 경로를 이미 쓰는 팀. 2026년 말까지 도입가로 품질을 올리는 쪽이 맞을 때. 이 경우에는 모델 ID를 명시해 두는 편이 좋습니다. 기본값이 다시 바뀌면 재현이 어려워집니다.
3.7을 남기거나 사고 단계를 낮추는 경우입니다. 대량 요약, 분류, 짧은 변환처럼 작업당 토큰이 곧 원가인 파이프라인. Cloud 문서가 효율 우선 작업에 3.7을 남겨 둔 이유입니다. 야간 배치, 로그 정리, 번역 초안처럼 실패 비용이 낮은 작업은 low로 먼저 돌려 보는 것이 맞습니다.
기존과 달라진 실사용 지점은 세 곳입니다. 첫째, Antigravity 기본 모델이 바뀌어 설정하지 않은 프로젝트도 경로가 달라질 수 있습니다. 둘째, 높은 사고 단계에서 왕복이 늘면 같은 단가라도 월 사용량이 먼저 보입니다. 셋째, Cyber는 같은 발표에 묶여 나왔지만 제품 접근 권한이 다릅니다. 보안 팀에 “3.8이면 취약점 자동 패치가 된다”고 전달하면 사실이 아닙니다. 그 기능의 전면은 Fairwind와 CodeMender 조합입니다.
흔한 실수는 네 가지입니다. 단가가 같으니 월 청구도 같다고 가정하는 것. Cyber를 AI Studio 모델 목록에서 찾는 것. Antigravity 기본값 변경을 모르고 이전 모델이 돌고 있다고 생각하는 것. HLE와 HLE-Verified 점수를 같은 숫자로 인용하는 것입니다.
업데이트·대기를 가르는 기준은 이렇습니다. 지금 코딩 에이전트의 실패율이 높고 사람 재작업이 많으면 3.8을 시험할 이유가 있습니다. 토큰 예산이 빠듯하고 품질 차이가 작으면 연말 도입가 기간에 서두를 필요는 없습니다. 3.7은 지원 종료가 이번 발표문에 적혀 있지 않습니다.
확인일 기준 공식 링크는 Google 블로그 발표문, DeepMind 3.8 Flash 제품 페이지와 모델 카드, Gemini API 「What’s new in Gemini 3.8 Flash」, Cloud 개발자 가이드, Fairwind 프로그램 소개입니다. 가격·지원 범위는 이 페이지가 바뀌면 숫자가 바뀝니다. 이 글의 확인 시점은 2026년 9월 3일입니다.
자주 묻는 질문
Gemini 앱에서 모델 이름이 3.8로 보이나요?
공식문은 Pro·Ultra 구독자의 Gemini 앱, 검색 AI 모드, Sheets Gemini에 3.8 Flash를 넣었다고 했습니다. 앱 화면의 표기 방식까지는 적지 않았습니다. 구독 등급과 앱 버전을 먼저 확인하는 것이 맞습니다.
사고 단계를 무조건 high로 두면 되나요?
품질이 필요한 긴 작업에는 high가 맞을 수 있습니다. 다만 사고 토큰은 출력 요금입니다. 공식 경고대로 높은 단계에서 토큰이 늘 수 있으니, 같은 작업을 medium·low와 비교한 뒤에 고정하는 편이 안전합니다.
한국에서 Flash Cyber를 신청할 수 있나요?
신청 창구는 DeepMind Fairwind 페이지입니다. 대상 설명은 정부, 핵심 인프라, 소프트웨어 유지보수 조직입니다. 한국 개인·일반 스타트업이 통과된다는 공식 안내는 없습니다.
출처: Introducing Gemini 3.8 Flash and 3.8 Flash Cyber · Gemini 3.8 Flash 제품 페이지 · 모델 카드 · Gemini API 최신 모델 문서 · Cloud 개발자 가이드 · Fairwind Program · Gemini 3.8 Flash Cyber · 사실 확인일 2026-09-03