본문으로 건너뛰기
TEN Brief 하루 열 건, 확인된 것만 2026.09.03 EN

This article is also available in English →

테크 · 2분 · 검색 의도

제미나이 3.8 플래시 공개 — 넉 달에 네 번째, 100만 토큰 0.75달러

Google DeepMind released Gemini 3.8 Flash on September 2, 2026, its fourth Flash-tier model in under four months and only three weeks after Gemini 3.7 Flash. Priced at 0.75 dollars per million input tokens and 3.75 dollars per million output tokens as an introductory rate through the end of 2026 — half the standard 1.50 and 7.50 dollars — it scores 59 on the Artificial Analysis Intelligence Index at high reasoning, three points above its predecessor and level with GPT-5.6 Sol at extra-high reasoning and Grok 4.6 at medium. The context window stays at one million tokens, output runs at roughly 300 tokens per second, and a typical high-reasoning task costs about 0.58 dollars and takes about 2.5 minutes. Google also shipped a separate Gemini 3.8 Flash Cyber variant: one core model behind two different access envelopes

구글 딥마인드가 2026년 9월 2일 제미나이 3.8 플래시(Gemini 3.8 Flash)를 공개했다. 넉 달이 채 안 되는 기간에 나온 네 번째 플래시 모델이고, 직전 3.7 플래시로부터는 3주 만이다. 가격은 100만 토큰당 입력 0.75달러·출력 3.75달러로, 정가(입력 1.50달러·출력 7.50달러)의 절반인 도입가를 2026년 말까지 적용한다. 아티피셜 애널리시스(Artificial Analysis) 지능 지수에서 높은 추론 설정 기준 59점을 받아 전작(56점)보다 3점 올랐고, GPT-5.6 Sol의 최상위 추론 설정(59점), 그록 4.6의 중간 설정(59점)과 같은 자리에 섰다. 컨텍스트 창은 100만 토큰으로 그대로이며 출력 속도는 초당 약 300토큰, 높은 추론 설정에서 작업 하나당 비용은 약 0.58달러·소요 시간은 약 2.5분이다. 구글은 같은 날 사이버보안 용도의 별도 변종 '제미나이 3.8 플래시 사이버'도 함께 내놨다

아침 햇빛이 드는 개방형 작업 공간의 긴 나무 테이블과 펼쳐진 노트북들, 창밖의 초록 나무

3줄 요약

  • 속도 — 넉 달에 네 번째 플래시 모델, 전작으로부터는 3주 만이다
  • 가격 — 100만 토큰 입력 0.75달러·출력 3.75달러, 연말까지 도입가(정가의 절반)
  • 성능 — 지능 지수 59점으로 전작 대비 +3, 상위 모델들과 같은 점수대에 올라섰다

핵심 질문

제미나이 3.8 플래시 가격 얼마야
**100만 토큰 기준 입력 0.75달러, 출력 3.75달러다.** 이것은 **2026년 말까지 적용되는 도입가**이고, 정가는 입력 1.50달러·출력 7.50달러다. 즉 2027년부터는 같은 사용량에 두 배를 내게 된다. 출력이 입력보다 5배 비싼 구조는 이 업계의 공통 관행이다(「AI 토큰 가격이란 — 출력이 입력보다 5배 비싼 이유」). 실제 비용 감각으로 바꾸면 이렇다 — 아티피셜 애널리시스 측정 기준 높은 추론 설정에서 **작업 하나당 약 0.58달러**, 소요 시간은 약 **2.5분**이다. 낮은 추론 설정에서는 0.8분으로 줄어든다. 같은 모델이라도 추론 강도를 어디에 두느냐에 따라 시간과 비용이 3배 안팎으로 달라진다는 뜻이다.
성능은 얼마나 올랐어
**아티피셜 애널리시스 지능 지수에서 59점, 전작보다 3점 올랐다.** 설정별로는 높은 추론 59점, 중간 57점, 낮은 52점이다. 이 59점이 의미를 갖는 이유는 **비교 대상** 때문이다 — GPT-5.6 Sol의 최상위 추론 설정, 그록 4.6의 중간 설정이 같은 59점이다. 값싼 경량 모델이 상위 모델의 점수대에 올라온 것이다. 컨텍스트 창은 **100만 토큰**으로 전작과 같고, 입력은 텍스트·이미지·영상·음성을 받으며 출력 속도는 초당 약 **300토큰**이다. 구글은 특히 **에이전트 작업**(도구 사용, 여러 단계에 걸친 실제 업무)에서의 개선을 강조했다. 다만 벤치마크 점수는 측정 기관과 설정에 따라 크게 달라진다는 점은 늘 함께 봐야 한다(「코딩 벤치마크란 — 같은 모델이 28%와 84%를 동시에 받는 이유」).
왜 이렇게 자주 내놓는 거야
**경량 모델 구간이 지금 가장 치열한 전장이기 때문이다.** 넉 달 안에 플래시 계열만 네 번, 전작으로부터는 3주 만이다. 프론티어급 최상위 모델은 개발에 오래 걸리고 가격도 높아 쓰는 사람이 제한되지만, 값싼 경량 모델은 **실제 서비스에 대량으로 꽂히는 자리**다. 챗봇 한 번의 답변, 문서 요약, 코드 자동완성처럼 하루에 수억 번 호출되는 작업은 성능보다 **단가**가 채택을 결정한다. 그래서 이 구간에서는 3주 간격의 갱신이 합리적인 전략이 된다. 작년의 최고 성능이 올해의 보급형 가격으로 내려오는 구조는 「프론티어 모델이란 — 작년 최고가 올해 보급형이 되는 이유」에서 다뤘다.

구글 딥마인드가 제미나이 3.8 플래시를 공개했다. 직전 모델이 나온 지 3주 만이다.

1. 사양과 가격

항목
공개일2026년 9월 2일
입력 가격100만 토큰당 0.75달러 (정가 1.50달러)
출력 가격100만 토큰당 3.75달러 (정가 7.50달러)
도입가 적용2026년 12월 31일까지
컨텍스트 창100만 토큰 (전작과 동일)
입력 형식텍스트 · 이미지 · 영상 · 음성
출력 속도초당 약 300토큰

지금 값의 절반은 도입가다. 2027년부터는 같은 사용량에 두 배가 청구된다. 서비스 원가를 지금 가격으로 잡아 두면 연말에 구조가 흔들린다.

출력이 입력보다 5배 비싼 이유는 「AI 토큰 가격이란」에서 다뤘다.

2. 점수 — 59점이 놓인 자리

모델 (설정)지능 지수
제미나이 3.8 플래시 (high)59
제미나이 3.7 플래시 (high)56
GPT-5.6 Sol (xhigh)59
그록 4.6 (medium)59
제미나이 3.8 플래시 (medium)57
제미나이 3.8 플래시 (low)52

숫자 자체보다 자리가 뉴스다. 값싼 플래시 계열이 상위 모델의 최상위 추론 설정과 같은 점수를 받았다.

작업 단위 비용·시간은 이렇다.

설정작업당 비용작업당 시간
high0.58달러2.5분
low0.8분

같은 모델이라도 추론 강도를 어디에 두느냐에 따라 시간이 3배 차이 난다. 실제 서비스 설계에서는 이 선택이 성능 선택보다 비용에 더 크게 작용한다.

단, 벤치마크는 하나의 측정치다. 같은 모델이 기관과 설정에 따라 전혀 다른 점수를 받는 구조는 「코딩 벤치마크란」에서 정리했다.

3. 넉 달에 네 번 — 왜 이 구간만 빠른가

구간갱신 주기채택을 정하는 요소
프론티어 최상위수개월~1년성능
경량·저가 (플래시급)수주단가

경량 모델은 하루에 수억 번 호출되는 자리에 들어간다 — 검색 요약, 문서 정리, 코드 자동완성, 고객 응대. 이 자리에서는 점수 1점보다 토큰당 0.1달러가 채택을 정한다. 그래서 3주 간격 갱신이 성립한다.

작년의 최고 성능이 올해의 보급형 가격으로 내려오는 흐름은 「프론티어 모델이란」에서 다뤘다.

4. 같은 날 나온 '사이버 변종'

구글은 제미나이 3.8 플래시 사이버를 별도로 함께 냈다. 핵심은 하나의 모델을 두 개의 접근 등급으로 나눈다는 것이다.

이 방식이 이번 주에 세 회사에서 동시에 나타났다.

회사일반제한 접근
구글제미나이 3.8 플래시3.8 플래시 사이버
앤스로픽 (9월 1일)페이블 5.1미토스 5.1 (검증된 기관 전용)
오픈AI (9월 1~2일)아스트라 사이버 기능, Daybreak Blue 한정

사흘 사이 같은 모양의 결정이 세 번 나왔다. 배경에는 사이버 능력이 규제·안전 문제의 최전선이 됐다는 사정이 있다(「오픈AI 아스트라, 사이버 '크리티컬' 등급」).

5. 남은 것과 확인하지 못한 것

  • 사이버 변종의 조건 — 누가 어떤 심사를 거쳐 접근하는지 확인하지 못했다.
  • 점수의 출처 — 지능 지수는 아티피셜 애널리시스 한 기관의 측정치다.
  • 도입가 이후 — 정가 전환 시점의 기존 계약 처리 방식은 공개되지 않았다.
  • 모델 자체 — 크기·아키텍처·학습 데이터는 공개되지 않았다. 이는 이 업계의 일반적 관행이다.

출처

  1. Artificial Analysis — Google has released Gemini 3.8 Flash, its fourth Flash model in under four months
  2. 9to5Google — Gemini 3.8 Flash rolling out three weeks after last release
  3. Android Authority — Google's Gemini 3.8 Flash is built to "work harder"
  4. MarkTechPost — Google DeepMind Releases Gemini 3.8 Flash and Gemini 3.8 Flash Cyber: One Core Model, Two Access Envelopes
  5. Android Headlines — Google Debuts Gemini 3.8 Flash and Cyber Variants with Massive Performance Leap

검증

발행
최종 수정
교차 확인
서로 다른 출처 5건을 대조했다.
미검증
  • 제미나이 3.8 플래시 사이버 변종의 접근 조건·심사 기준은 확인하지 못했다
  • 지능 지수 점수는 아티피셜 애널리시스 한 기관의 측정치이며 다른 벤치마크와 다를 수 있다
  • 도입가 종료 후 실제 정가 적용 시점과 기존 계약의 처리 방식은 공개되지 않았다
  • 학습 데이터·모델 크기·아키텍처는 공개되지 않았다
작성
발행 전 사람이 검수했다. 수집·교차확인·재작성 절차는 편집 원칙.

하루 열 건, 아침에 한 번

3줄 요약만 보내고 전문은 사이트에서 읽습니다. 하단에서 한 번의 클릭으로 언제든 해지할 수 있습니다.

관련