Google Gemini 모델 패밀리 리서치 원본 — 2026-07-25
불변 캡처. 절대 편집하지 마라. 가공본은 위키 페이지에. 주의: Gemini 는 non-Anthropic 프로바이더. 규격 §0-2 에 따라 기본 신뢰도는 [MED]/[aggregator]. 단, ai.google.dev 와 cloud.google.com 은 Google 1차 출처이므로 그 값들은 [HIGH] 로 표기함.
조사 방법
검색어
- "Gemini API pricing Pro Flash Flash-Lite 2.5 model ID context window ai.google.dev"
- "Gemini 3 Pro model release 2026 pricing context window"
- "Gemini Deep Think API access Vertex AI subscription Ultra 2026"
- "gemini-2.5-pro context window 1,048,576 input token limit output 65536 knowledge cutoff modalities site:ai.google.dev"
- "Google AI Pro Ultra subscription price 2026 Gemini app Deep Think official one.google.com"
열어본 URL (WebFetch)
- https://ai.google.dev/gemini-api/docs/pricing — [HIGH] Google 1차, Gemini Developer API 가격
- https://ai.google.dev/gemini-api/docs/models — [HIGH] Google 1차, 모델 목록 (스펙 표 없음)
- https://ai.google.dev/gemini-api/docs/models.md.txt — [HIGH] Google 1차 (스펙 표 없음, 설명만)
- https://cloud.google.com/vertex-ai/generative-ai/pricing — [HIGH] Google 1차, Vertex AI 가격
- https://ai.google.dev/gemini-api/docs/models/gemini-2.5-pro — [HIGH] 2.5 Pro 스펙
- https://ai.google.dev/gemini-api/docs/models/gemini-2.5-flash — [HIGH] 2.5 Flash 스펙
- https://ai.google.dev/gemini-api/docs/models/gemini-2.5-flash-lite — [HIGH] 2.5 Flash-Lite 스펙
- https://ai.google.dev/gemini-api/docs/models/gemini-3.1-pro-preview — [HIGH] 3.1 Pro Preview 스펙
- https://ai.google.dev/gemini-api/docs/models/gemini-3.5-flash — [HIGH] 3.5 Flash 스펙
- https://ai.google.dev/gemini-api/docs/models/gemini-3.6-flash — [HIGH] 3.6 Flash 스펙
- https://blog.google/products/gemini/gemini-3-deep-think/ — [HIGH] Deep Think (앱 접근)
- (검색결과) x.com/GoogleDeepMind, x.com/sundarpichai — [MED] Deep Think API/Vertex 조기접근
확인된 사실 [신뢰도]
라인업 현황 (2026-07 기준, ai.google.dev/models) [HIGH]
공식 모델 페이지가 stable 로 표시하는 모델:
- gemini-3.6-flash (stable) — "최신, 속도+지능 균형, agentic·멀티모달"
- gemini-3.5-flash (stable) — "sustained frontier performance 위한 최고 지능"
- gemini-3.5-flash-lite (stable) — "가장 빠르고 비용효율적"
- gemini-3.1-flash-lite (stable) — "frontier-class performance"
- gemini-2.5-pro (stable) — "복잡한 작업용 가장 진보된 모델"
- gemini-2.5-flash (stable) — "best price-performance"
- gemini-2.5-flash-lite (stable) — "가장 빠르고 예산친화적"
Preview 로 표시:
- gemini-3.1-pro-preview
- gemini-3-flash-preview
- gemini-3.5-live-translate-preview
- gemini-3.1-flash-live-preview
- gemini-3.1-flash-tts-preview
★ 핵심 관찰 [HIGH]: Flash 계열은 3.6 까지 GA 됐지만 Pro 계열은 GA 최신이 2.5 Pro 뿐이고 그 위는 gemini-3.1-pro-preview (preview) 가 최신. 공식 페이지에 "Gemini 3.5 Pro" 또는 "Gemini 3 Pro (GA)" 는 없음. (일부 애그리게이터가 3.5 Pro/3 Pro 를 언급하나 공식 미확인 — 아래 미확인 섹션)
- "Interactions API is now generally available" — 최신 기능·모델 접근에 권장한다고 models 페이지에 명시.
컨텍스트 윈도우 · 스펙 (개별 모델 페이지, ai.google.dev) [HIGH]
| 모델 ID | 입력 토큰(컨텍스트) | 출력 토큰 | knowledge cutoff | 입력 모달리티 |
|---|---|---|---|---|
gemini-2.5-pro |
1,048,576 | 65,536 | (페이지 미표기, 아래 참고) | text, image, video, audio, PDF |
gemini-2.5-flash |
1,048,576 | 65,536 | January 2025 | text, images, video, audio |
gemini-2.5-flash-lite |
1,048,576 | 65,536 | January 2025 | text, images, video, audio, PDF (출력은 text만) |
gemini-3.1-pro-preview |
1,048,576 | 65,536 | (페이지 미표기) | text, image, video, audio, PDF |
gemini-3.5-flash |
1,048,576 | 65,536 | (페이지 미표기) | text, image, video, audio, PDF |
gemini-3.6-flash |
1,048,576 | 65,536 | (페이지 미표기) | text, image, video, audio, PDF |
- 2.5 Pro 설명(개별 페이지): "코드·수학·STEM 복잡 추론, 대용량 데이터셋·코드베이스·문서 롱컨텍스트 분석." 입력 1,048,576 / 출력 65,536 확인.
- 3.1 Pro Preview: "better thinking", "소프트웨어 엔지니어링 행동에 최적화", "정밀 tool usage 필요한 agentic workflow" 라고 개별 페이지가 명시.
- 전 모델 컨텍스트가 1,048,576 (=1M) 입력 / 65,536 (=64K) 출력 으로 동일하게 관측됨. (2M 컨텍스트 GA 모델은 공식 페이지에서 확인 못 함 — 미확인 섹션 참조)
Gemini Developer API 가격 (ai.google.dev/pricing) [HIGH] (verified 2026-07)
표준(Standard) 티어, per 1M tokens. 롱컨텍스트 구간(≤200K vs >200K)이 있는 모델은 구간별.
| 모델 | 입력 (표준) | 출력 (표준) | 비고 |
|---|---|---|---|
gemini-3.6-flash |
$1.50 | $7.50 | 캐싱 $0.15/1M + 저장 $1.00/hr |
gemini-3.5-flash |
$1.50 | $9.00 | |
gemini-3.5-flash-lite |
$0.30 | $2.50 | |
gemini-3.1-flash-lite |
$0.25 (text/img/video), $0.50 (audio) | $1.50 | |
gemini-3.1-pro-preview |
$2.00 (≤200K) / $4.00 (>200K) | $12.00 (≤200K) / $18.00 (>200K) | 캐싱 $0.20/$0.40 + 저장 $4.50/hr |
gemini-2.5-pro |
$1.25 (≤200K) / $2.50 (>200K) | $10.00 (≤200K) / $15.00 (>200K) | |
gemini-2.5-flash |
$0.30 | $2.50 | |
gemini-2.5-flash-lite |
$0.10 | $0.40 | 가장 저렴 |
티어 배수 (Developer API 및 Vertex 공통 관측): - Batch / Flex = 표준 -50% - Priority = 표준 +80% (예: 3.5 Flash Priority 입력 $2.70) - 예: 2.5 Pro Batch/Flex ≤200K = 입력 $0.625 / 출력 $5.00; >200K = $1.25 / $7.50. - 예: 2.5 Pro Priority ≤200K = 입력 $2.25 / 출력 $18.00; >200K = $4.50 / $27.00.
★ 롱컨텍스트 구간별 요율 (핵심) [HIGH]:
- Pro 계열만 200K 경계에서 요율이 2배 가까이 뛴다. gemini-2.5-pro: 입력 $1.25→$2.50, 출력 $10→$15. gemini-3.1-pro-preview: 입력 $2→$4, 출력 $12→$18.
- Flash / Flash-Lite 는 구간 구분 없이 단일 요율 (관측 범위 내).
특화 모델 가격 (ai.google.dev/pricing) [HIGH]
gemini-3.1-flash-lite-image: 입력 $0.25/1M, 출력 $30.00/1M (≈$0.0336/이미지)gemini-2.5-flash-image: 입력 $0.30/1M, 출력 $0.039/이미지Gemini Embedding 2: text $0.20/1M, image $0.45/1M, audio $6.50/1M, video $12.00/1Mgemini-embedding-001: 표준 $0.15/1M, batch $0.075/1M- Veo 3.1 (영상 생성): Standard $0.40/sec(720p-1080p), $0.60/sec(4K); Fast/Lite 더 저렴
Vertex AI 가격 차이 (cloud.google.com/vertex-ai) [HIGH] (verified 2026-07)
- 숫자 자체는 Developer API 와 대체로 동일. 단 Global vs Non-global 엔드포인트 구분 존재:
- Non-global 은 대략 +10% (예: 3.5 Flash 입력 Global $1.50 → Non-global $1.65).
- "Non-global 엔드포인트는 2026-07-01 부터 non-global 가격 적용" (그 전엔 Global 가격).
- Vertex 는 audio 입력을 별도 요율로 명시 (예: 2.5 Flash audio 입력 $1.00/1M vs text/img/video $0.30/1M). Developer API 요약에는 audio 별도표기가 덜 노출됨.
- Vertex 캐시 입력: "regular 대비 90% 할인" 명시. (2.5 Pro cached $0.13/$0.25).
- Vertex 에 남아있는 구세대:
gemini-2.0-flash($0.15 in / $0.60 out, audio $1.00),gemini-2.0-flash-lite($0.075 / $0.30). gemini-3-flash-preview(Vertex): 입력 $0.5(text/img/video)/$1(audio), 출력 $3, 캐시 $0.05/$0.1.- Deep Research Agent (Vertex): $2/1M 입력, $12/1M 출력 (캐시 없음).
- 오류(4xx/5xx) 응답은 과금 안 함.
그라운딩 / 툴 가격 [HIGH]
- Google Search Grounding: Gemini 3 모델 = 월 5,000 무료, 이후 $14/1,000 쿼리. Gemini 2.x = 일 1,500 무료, 이후 $35/1,000. 그라운딩 입력 토큰은 과금 안 함.
- Google Maps Grounding: Gemini 3 = 월 5,000 무료, 이후 $14/1,000. Gemini 2.x = 일 1,500(Flash/Lite)/10,000(Pro) 무료, 이후 $25/1,000.
- Grounding with Your Data: $2.50/1,000 prompts.
- File Search: $0.15/1M 임베딩 토큰 + 표준 모델 토큰 요율.
- Computer Use Tool (Vertex): 베이스 모델 토큰 요율로 과금.
Deep Think — API 과금인가 구독인가? [핵심 질문]
- [HIGH] blog.google (Gemini 3 Deep Think 페이지): "고급 병렬 추론으로 여러 가설 동시 탐색." Google AI Ultra 구독자에게 Gemini 앱에서 독점 제공. 앱에서 프롬프트바 'Deep Think' 선택 + 모델 드롭다운 'Gemini 3 Pro' 선택. → 일반 API 과금 모델이 아님.
- [MED] GoogleDeepMind / Sundar Pichai X 게시물: 과학 연구자·개발자 대상으로 Vertex AI Early Access Program 으로 Deep Think API 를 처음 개방. "select researchers & enterprises through an early access program."
- 결론: Deep Think = 소비자 구독(Ultra, 앱) 기능이며, API 는 Vertex AI 조기접근(EAP) 로만, 일반 종량 과금 아님. (2026-07 기준)
소비자 구독 티어 (2026-07, I/O 2026 이후) [MED, 애그리게이터/뉴스]
- 브랜드: "Google AI" — AI Plus ($4.99), AI Pro ($19.99/월), AI Ultra ($99.99 / $199.99).
- AI Ultra: I/O 2026 (2026-05-19) 에 재편. 이전 $249.99/월 → 하위 Ultra $99.99 (Pro 한도 5x), 상위 $199.99 (Pro 한도 20x).
- Ultra 포함: Gemini 3.1 Pro, Gemini 2.5 Deep Think, Veo 3.1, 월 25,000 AI 크레딧, 20TB 저장.
- (주의: 이 소비자 가격은 뉴스/애그리게이터 기반. one.google.com 1차 미확인.)
멀티모달 강점 [HIGH/MED]
- [HIGH] 전 현행 모델이 네이티브 멀티모달 입력 (text + image + video + audio + PDF) 을 단일 모델에서 수용. 2.5/3.x Flash·Pro 모두 동일 입력 셋.
- [HIGH] 오디오·비디오 입력이 토큰으로 직접 과금되고 (audio 는 종종 별도 상위 요율), 임베딩도 video/audio 별도 요율 존재 → 진짜 멀티모달 파이프라인.
- [HIGH] 1M 토큰 컨텍스트 → 긴 영상/대용량 코드베이스/다문서 롱컨텍스트 분석이 핵심 마케팅 포인트 (2.5 Pro 설명).
- [HIGH] Live 계열 preview 모델(
gemini-3.1-flash-live-preview,gemini-3.5-live-translate-preview, TTS) → 실시간 음성·번역·음성합성 스트리밍. - 출력은 모두 text (이미지·영상 생성은 별도 모델 gemini-*-image / Veo).
엇갈리거나 미확인
- "Gemini 3.5 Pro" / "Gemini 3 Pro (GA)": 애그리게이터(codersera, eesel, metacto, pricepertoken)가 "Gemini 3 Pro Preview 2025-11-18 출시", "Gemini 3.5 Pro I/O 2026-05-19 발표, GA 6월 예상, 2M 컨텍스트" 등을 주장. 그러나 ai.google.dev 공식 pricing/models 페이지에는 최신 Pro 가
gemini-3.1-pro-preview(preview) 이고 GA Pro 는 2.5 Pro 뿐. GA 날짜·3.5 Pro 존재 여부 공식 미확인 → uncertain. - 2M 토큰 컨텍스트 모델: 애그리게이터가 3.5 Pro 2M 컨텍스트를 주장하나 공식 개별 모델 페이지에서는 전부 1,048,576 (1M) 만 확인됨. 2M GA 미확인.
- 3.x Flash/Pro knowledge cutoff: 2.5 계열은 "January 2025" 로 명시됐지만 3.1/3.5/3.6 개별 페이지에서 cutoff 를 확인 못 함.
- gemini-2.5-pro cutoff: 개별 페이지에서 명시 확인 못 함 (2.5 Flash/Flash-Lite 는 Jan 2025).
- 소비자 구독 가격 ($4.99/$19.99/$99.99/$199.99): 뉴스(Engadget)·애그리게이터 기반 [MED]. one.google.com 공식 가격표 직접 미확인.
- Deep Think Vertex EAP 세부(가격·정원·현재 상태): X 게시물 [MED] 만 확인. 공식 Vertex 문서 페이지 직접 미확인.
- Non-global 가격 전환일 (2026-07-01): Vertex 페이지 요약에 나왔으나 현재(2026-07-25)가 그 이후이므로 non-global 가격이 실제 적용 중일 것 — 세부 재확인 필요.
원문 발췌
ai.google.dev/gemini-api/docs/pricing (요약 발췌) [HIGH]
Gemini 3.6 Flash: Standard $1.50 in / $7.50 out; Batch $0.75/$3.75; caching $0.15/1M + $1.00/hr
Gemini 3.5 Flash: Standard $1.50 in / $9.00 out; Priority $2.70/$16.20
Gemini 3.5 Flash-Lite: Standard $0.30 / $2.50
Gemini 3.1 Flash-Lite: $0.25 (text/img/video), $0.50 (audio) in / $1.50 out
Gemini 3.1 Pro Preview: ≤200k $2.00/$12.00, >200k $4.00/$18.00; caching $0.20/$0.40 + $4.50/hr
Gemini 2.5 Pro: ≤200k $1.25/$10.00, >200k $2.50/$15.00
Gemini 2.5 Flash: $0.30 / $2.50
Gemini 2.5 Flash-Lite: $0.10 / $0.40
Google Search Grounding: 5,000 free/mo (Gemini 3), then $14/1,000
cloud.google.com/vertex-ai/generative-ai/pricing (발췌) [HIGH]
Gemini 2.5 Pro: Input $1.25 (≤200K) / $2.50 (>200K); Output $10 / $15; Cached $0.13 / $0.25
Gemini 3.5 Flash: Input $1.50 (Global) / $1.65 (Non-global); Output $9.00 / $9.90
Priority tier = Standard +80%; Flex/Batch = Standard -50%
Non-global endpoints: Global pricing until July 1, 2026; non-global thereafter
Context caching: 90% discount on cached input vs regular input
Deep Research Agent: $2/1M input, $12/1M output (no cached pricing)
blog.google Gemini 3 Deep Think [HIGH]
"uses advanced parallel reasoning to explore multiple hypotheses simultaneously"
Available exclusively to "Google AI Ultra subscribers in the Gemini app."
Activate: select 'Deep Think' in prompt bar + Gemini 3 Pro in model dropdown.
(article does not mention API/Vertex pricing)
X posts (DeepMind / Pichai) [MED]
"The upgraded Deep Think mode is rolling out now in the Gemini App for Google AI Ultra subscribers.
For scientific researchers and developers, we're opening a Vertex AI Early Access Program for the API."
개별 모델 페이지 스펙 [HIGH]
gemini-2.5-pro: input 1,048,576 / output 65,536 / text,image,video,audio,PDF
gemini-2.5-flash: input 1,048,576 / output 65,536 / cutoff Jan 2025 / text,images,video,audio / Thinking 지원
gemini-2.5-flash-lite: 1,048,576 / 65,536 / cutoff Jan 2025 / text,images,video,audio,PDF (out: text)
gemini-3.1-pro-preview: 1,048,576 / 65,536 / text,image,video,audio,PDF / "better thinking", SWE·agentic 최적화
gemini-3.5-flash: 1,048,576 / 65,536 / text,image,video,audio,PDF
gemini-3.6-flash: 1,048,576 / 65,536 / text,image,video,audio,PDF