2026년 9월 8일 기준 — 도입가 종료일과 배포 상황은 변동될 수 있어 변경 확인 시 이 글을 업데이트합니다.
빠른 답
- 가격은? API 도입가 100만 토큰당 입력 $0.75·출력 $3.75 — 단, 2026년 12월 31일까지만 유효하고 2027년 1월 1일부터 $1.50/$7.50으로 2배 오른다(공식 가격 문서 기준).
- 어디서 쓸 수 있나? 소비자는 Google AI Pro·Ultra 구독자만 Gemini 앱·검색 AI Mode·시트에서 사용 가능. 개발자는 Gemini API(AI Studio 등)로 바로 쓸 수 있고 무료 티어도 있다.
- 3.7 Flash보다 나은가? 구글은 “장기 소프트웨어 엔지니어링·에이전트 과제에서 대형 프런티어 모델 대부분을 능가한다"고 밝혔다. 도입가는 3.7 Flash와 같아 비용 부담 없이 갈아탈 수 있다.
Gemini 3.8 Flash란 — 6주 만에 세 번째 Flash
구글은 2026년 9월 2일 Gemini 3.8 Flash와 보안 전용 모델 Gemini 3.8 Flash Cyber를 공개했다. 6주간 세 번째 Flash 출시이며, 3.7 Flash 나온 지 약 3주 만이다. 포지션은 “가장 지능적인 Flash 모델” — 장기간 이어지는 소프트웨어 엔지니어링, 자율 에이전트, 복잡한 기업 워크플로용 경량 모델이다. 성능 조절형 ’effort level’(토큰 소모와 성능을 맞바꾸는 설정)도 지원한다.
어디서 쓸 수 있나 — 배포 현황
| 사용자 | 이용 방법 |
|---|---|
| 일반 (Gemini 앱) | Google AI Pro·Ultra 구독자 — Gemini 앱, 검색 AI Mode, 시트의 Gemini |
| 개발자 | Gemini API — Google AI Studio, Android Studio, Stitch, Google Antigravity |
| 기업 | Gemini Enterprise |
| 무료 티어 | API의 Standard·Priority 티어는 무료 (Batch·Flex는 제외) |
무료 Gemini 앱 사용자에 대한 배포는 이번 발표에 언급이 없었다. 반면 API 무료 티어에서 Standard·Priority가 무료로 표기돼 있어 개발자는 무료로 시험해볼 수 있다.
API 가격 — 도입가가 12월 31일에 끝난다
공식 가격 문서 기준 100만 토큰당 가격:
| 티어 | 입력 | 출력 | 2027년 1월 1일부터 |
|---|---|---|---|
| Standard | $0.75 | $3.75 | $1.50 / $7.50 |
| Batch·Flex | $0.375 | $1.875 | $0.75 / $3.75 |
| Priority | $1.35 | $6.75 | $2.70 / $13.50 |
| 컨텍스트 캐싱 | $0.075 | — | $0.15 (저장 $0.50→$1.00/시간) |
주의할 점 두 가지:
- 도입가(introductory pricing) 기간이 명시돼 있다 — 2026년 12월 31일까지이며, 2027년부터 정가는 정확히 2배다. 장기 서비스를 설계한다면 정가 기준으로 예산을 잡는 게 안전하다.
- 인상 후에도 Batch·Flex 티어가 절반이다($0.75/$3.75). 실시간 응답이 필요 없는 대량 처리라면 배치로 돌리는 것이 인상 이후의 기본 절약 전략이다.
참고로 그라운딩(검색 연동)은 무료 티어에서는 쓸 수 없고, 유료는 월 5,000건 무료(Gemini 3.x 전체 공유) 이후 1,000건당 $14다.
Gemini 앱에서 쓰려면 — 구독 플랜
구글 공식 요금제 페이지 기준 한국 가격:
| 플랜 | 월 요금 | 3.8 Flash |
|---|---|---|
| 무료 | ₩0 | 이번 발표에서 언급 없음 |
| Google AI Plus | ₩7,500 (400GB 스토리지) | 언급 없음 |
| Google AI Pro | ₩29,000 (5TB 스토리지) | 사용 가능 |
| Google AI Ultra | 최상위 플랜 (공식 페이지 참조) | 사용 가능 |
앱이 아니라 API 목적이라면 구독 없이 AI Studio 무료 티어로 시작할 수 있다.
성능은 얼마나 좋아졌나
구글이 공식 수치를 공개한 것은 HLE-Verified 하나고, 나머지는 상대 평가다:
| 벤치마크 | 결과 (공식 발표 기준) |
|---|---|
| HLE-Verified | 54.9% |
| DeepSWE v1.1 (장기 SWE) | 대형 프런티어 모델 대부분 능가 |
| Vals Finance Agent V2 (금융) | 3.7 Flash·프런티어 모델 능가 |
| Harvey’s Legal Agent (법무) | 3.7 Flash·프런티어 모델 능가 |
요컨대 경량·속도형 라인인 Flash가 코딩·에이전트 영역에서 프런티어급에 근접한 게 매력 포인트다 — 구글 표현으로 “더 비싼 프런티어 모델에 근접하는 성능”. 참고로 입력 기준 GPT-6 Astra($10)의 약 13분의 1 가격이다. Astra 쪽 전체 내용은 GPT-6 아스트라 가격·사용법 총정리에서, 출시 발표는 GPT-6 Astra 공개 — 발표 상세 정리에서 볼 수 있다.
플래시 사이버(Flash Cyber)는 일반 사용자 접근 불가
보안 전용 변형 모델이다:
- 기능: 자율 취약점 탐지 + 자동 패치. 공격 능력보다 방어에 초점을 맞췄다
- 성능: CWE-Bench(패치) Pass@1 47.2% — 최상위 프런티어 모델(47.8%)에 근접한 데 비용은 훨씬 낮다. 내부 취약점 발견 벤치(20개 프로그래밍 언어)에서는 성공률 70%를 넘겼다
- 실제 사례: 크로 보안팀은 더 큰 상용 모델보다 2.6배 많은 정답 패치를 얻었고, 보안사 Wiz는 리콜 7.5
9.7%포인트 높이면서 비용은 2.35.2배 낮췄다 - 접근: 공개 API·Vertex가 아닌 Fairwind 프로그램 신청제 — 정부기관·핵심인프라 운영자·SW 유지보수자 대상
자주 묻는 질문
Q. 무료로 쓸 수 있나요? 개발자는 가능하다 — Gemini API 무료 티어에서 Standard·Priority가 무료다. 일반 Gemini 앱 무료 플랜은 이번 발표에 언급이 없었다.
Q. 2027년에 가격이 오른다는 게 사실인가요? 공식 가격 문서에 명시돼 있다. Standard 기준 입력 $0.75→$1.50, 출력 $3.75→$7.50 (1월 1일부터). 인상 전 테스트·도입 예산을 잡는 편이 낫다.
Q. 3.7 Flash 쓰던 서비스인데 갈아타야 하나요? 도입가가 같고(공식 발표 기준) 성능은 코딩·장기 과제 중심으로 향상됐다. 비용상 불리는 없으니 API 모델명만 바꿔 시험해볼 만하다.
Q. 한국어를 쓸 수 있나요? 이번 발표에서 언어 제약 언급은 없었다. Gemini 앱의 한국어 UI와 API의 한국어 프롬프트 사용에는 영향을 주는 변경이 없다.
Q. Flash Cyber는 어떻게 쓸 수 있나요? 일반 공개는 돼 있지 않다. 정부기관·핵심인프라·SW 유지보수 조직이라면 Fairwind 프로그램에 신청해야 한다.