원본 캡처

Google Gemini 모델 패밀리 리서치 원본 — 2026-07-25

불변 캡처. 절대 편집하지 마라. 가공본은 위키 페이지에. 주의: Gemini 는 non-Anthropic 프로바이더. 규격 §0-2 에 따라 기본 신뢰도는 [MED]/[aggregator]. 단, ai.google.dev 와 cloud.google.com 은 Google 1차 출처이므로 그 값들은 [HIGH] 로 표기함.

조사 방법

검색어

  • "Gemini API pricing Pro Flash Flash-Lite 2.5 model ID context window ai.google.dev"
  • "Gemini 3 Pro model release 2026 pricing context window"
  • "Gemini Deep Think API access Vertex AI subscription Ultra 2026"
  • "gemini-2.5-pro context window 1,048,576 input token limit output 65536 knowledge cutoff modalities site:ai.google.dev"
  • "Google AI Pro Ultra subscription price 2026 Gemini app Deep Think official one.google.com"

열어본 URL (WebFetch)

  1. https://ai.google.dev/gemini-api/docs/pricing — [HIGH] Google 1차, Gemini Developer API 가격
  2. https://ai.google.dev/gemini-api/docs/models — [HIGH] Google 1차, 모델 목록 (스펙 표 없음)
  3. https://ai.google.dev/gemini-api/docs/models.md.txt — [HIGH] Google 1차 (스펙 표 없음, 설명만)
  4. https://cloud.google.com/vertex-ai/generative-ai/pricing — [HIGH] Google 1차, Vertex AI 가격
  5. https://ai.google.dev/gemini-api/docs/models/gemini-2.5-pro — [HIGH] 2.5 Pro 스펙
  6. https://ai.google.dev/gemini-api/docs/models/gemini-2.5-flash — [HIGH] 2.5 Flash 스펙
  7. https://ai.google.dev/gemini-api/docs/models/gemini-2.5-flash-lite — [HIGH] 2.5 Flash-Lite 스펙
  8. https://ai.google.dev/gemini-api/docs/models/gemini-3.1-pro-preview — [HIGH] 3.1 Pro Preview 스펙
  9. https://ai.google.dev/gemini-api/docs/models/gemini-3.5-flash — [HIGH] 3.5 Flash 스펙
  10. https://ai.google.dev/gemini-api/docs/models/gemini-3.6-flash — [HIGH] 3.6 Flash 스펙
  11. https://blog.google/products/gemini/gemini-3-deep-think/ — [HIGH] Deep Think (앱 접근)
  12. (검색결과) x.com/GoogleDeepMind, x.com/sundarpichai — [MED] Deep Think API/Vertex 조기접근

확인된 사실 [신뢰도]

라인업 현황 (2026-07 기준, ai.google.dev/models) [HIGH]

공식 모델 페이지가 stable 로 표시하는 모델: - gemini-3.6-flash (stable) — "최신, 속도+지능 균형, agentic·멀티모달" - gemini-3.5-flash (stable) — "sustained frontier performance 위한 최고 지능" - gemini-3.5-flash-lite (stable) — "가장 빠르고 비용효율적" - gemini-3.1-flash-lite (stable) — "frontier-class performance" - gemini-2.5-pro (stable) — "복잡한 작업용 가장 진보된 모델" - gemini-2.5-flash (stable) — "best price-performance" - gemini-2.5-flash-lite (stable) — "가장 빠르고 예산친화적"

Preview 로 표시: - gemini-3.1-pro-preview - gemini-3-flash-preview - gemini-3.5-live-translate-preview - gemini-3.1-flash-live-preview - gemini-3.1-flash-tts-preview

★ 핵심 관찰 [HIGH]: Flash 계열은 3.6 까지 GA 됐지만 Pro 계열은 GA 최신이 2.5 Pro 뿐이고 그 위는 gemini-3.1-pro-preview (preview) 가 최신. 공식 페이지에 "Gemini 3.5 Pro" 또는 "Gemini 3 Pro (GA)" 는 없음. (일부 애그리게이터가 3.5 Pro/3 Pro 를 언급하나 공식 미확인 — 아래 미확인 섹션) - "Interactions API is now generally available" — 최신 기능·모델 접근에 권장한다고 models 페이지에 명시.

컨텍스트 윈도우 · 스펙 (개별 모델 페이지, ai.google.dev) [HIGH]

모델 ID 입력 토큰(컨텍스트) 출력 토큰 knowledge cutoff 입력 모달리티
gemini-2.5-pro 1,048,576 65,536 (페이지 미표기, 아래 참고) text, image, video, audio, PDF
gemini-2.5-flash 1,048,576 65,536 January 2025 text, images, video, audio
gemini-2.5-flash-lite 1,048,576 65,536 January 2025 text, images, video, audio, PDF (출력은 text만)
gemini-3.1-pro-preview 1,048,576 65,536 (페이지 미표기) text, image, video, audio, PDF
gemini-3.5-flash 1,048,576 65,536 (페이지 미표기) text, image, video, audio, PDF
gemini-3.6-flash 1,048,576 65,536 (페이지 미표기) text, image, video, audio, PDF
  • 2.5 Pro 설명(개별 페이지): "코드·수학·STEM 복잡 추론, 대용량 데이터셋·코드베이스·문서 롱컨텍스트 분석." 입력 1,048,576 / 출력 65,536 확인.
  • 3.1 Pro Preview: "better thinking", "소프트웨어 엔지니어링 행동에 최적화", "정밀 tool usage 필요한 agentic workflow" 라고 개별 페이지가 명시.
  • 전 모델 컨텍스트가 1,048,576 (=1M) 입력 / 65,536 (=64K) 출력 으로 동일하게 관측됨. (2M 컨텍스트 GA 모델은 공식 페이지에서 확인 못 함 — 미확인 섹션 참조)

Gemini Developer API 가격 (ai.google.dev/pricing) [HIGH] (verified 2026-07)

표준(Standard) 티어, per 1M tokens. 롱컨텍스트 구간(≤200K vs >200K)이 있는 모델은 구간별.

모델 입력 (표준) 출력 (표준) 비고
gemini-3.6-flash $1.50 $7.50 캐싱 $0.15/1M + 저장 $1.00/hr
gemini-3.5-flash $1.50 $9.00
gemini-3.5-flash-lite $0.30 $2.50
gemini-3.1-flash-lite $0.25 (text/img/video), $0.50 (audio) $1.50
gemini-3.1-pro-preview $2.00 (≤200K) / $4.00 (>200K) $12.00 (≤200K) / $18.00 (>200K) 캐싱 $0.20/$0.40 + 저장 $4.50/hr
gemini-2.5-pro $1.25 (≤200K) / $2.50 (>200K) $10.00 (≤200K) / $15.00 (>200K)
gemini-2.5-flash $0.30 $2.50
gemini-2.5-flash-lite $0.10 $0.40 가장 저렴

티어 배수 (Developer API 및 Vertex 공통 관측): - Batch / Flex = 표준 -50% - Priority = 표준 +80% (예: 3.5 Flash Priority 입력 $2.70) - 예: 2.5 Pro Batch/Flex ≤200K = 입력 $0.625 / 출력 $5.00; >200K = $1.25 / $7.50. - 예: 2.5 Pro Priority ≤200K = 입력 $2.25 / 출력 $18.00; >200K = $4.50 / $27.00.

★ 롱컨텍스트 구간별 요율 (핵심) [HIGH]: - Pro 계열만 200K 경계에서 요율이 2배 가까이 뛴다. gemini-2.5-pro: 입력 $1.25→$2.50, 출력 $10→$15. gemini-3.1-pro-preview: 입력 $2→$4, 출력 $12→$18. - Flash / Flash-Lite 는 구간 구분 없이 단일 요율 (관측 범위 내).

특화 모델 가격 (ai.google.dev/pricing) [HIGH]

  • gemini-3.1-flash-lite-image: 입력 $0.25/1M, 출력 $30.00/1M (≈$0.0336/이미지)
  • gemini-2.5-flash-image: 입력 $0.30/1M, 출력 $0.039/이미지
  • Gemini Embedding 2: text $0.20/1M, image $0.45/1M, audio $6.50/1M, video $12.00/1M
  • gemini-embedding-001: 표준 $0.15/1M, batch $0.075/1M
  • Veo 3.1 (영상 생성): Standard $0.40/sec(720p-1080p), $0.60/sec(4K); Fast/Lite 더 저렴

Vertex AI 가격 차이 (cloud.google.com/vertex-ai) [HIGH] (verified 2026-07)

  • 숫자 자체는 Developer API 와 대체로 동일. 단 Global vs Non-global 엔드포인트 구분 존재:
  • Non-global 은 대략 +10% (예: 3.5 Flash 입력 Global $1.50 → Non-global $1.65).
  • "Non-global 엔드포인트는 2026-07-01 부터 non-global 가격 적용" (그 전엔 Global 가격).
  • Vertex 는 audio 입력을 별도 요율로 명시 (예: 2.5 Flash audio 입력 $1.00/1M vs text/img/video $0.30/1M). Developer API 요약에는 audio 별도표기가 덜 노출됨.
  • Vertex 캐시 입력: "regular 대비 90% 할인" 명시. (2.5 Pro cached $0.13/$0.25).
  • Vertex 에 남아있는 구세대: gemini-2.0-flash ($0.15 in / $0.60 out, audio $1.00), gemini-2.0-flash-lite ($0.075 / $0.30).
  • gemini-3-flash-preview (Vertex): 입력 $0.5(text/img/video)/$1(audio), 출력 $3, 캐시 $0.05/$0.1.
  • Deep Research Agent (Vertex): $2/1M 입력, $12/1M 출력 (캐시 없음).
  • 오류(4xx/5xx) 응답은 과금 안 함.

그라운딩 / 툴 가격 [HIGH]

  • Google Search Grounding: Gemini 3 모델 = 월 5,000 무료, 이후 $14/1,000 쿼리. Gemini 2.x = 일 1,500 무료, 이후 $35/1,000. 그라운딩 입력 토큰은 과금 안 함.
  • Google Maps Grounding: Gemini 3 = 월 5,000 무료, 이후 $14/1,000. Gemini 2.x = 일 1,500(Flash/Lite)/10,000(Pro) 무료, 이후 $25/1,000.
  • Grounding with Your Data: $2.50/1,000 prompts.
  • File Search: $0.15/1M 임베딩 토큰 + 표준 모델 토큰 요율.
  • Computer Use Tool (Vertex): 베이스 모델 토큰 요율로 과금.

Deep Think — API 과금인가 구독인가? [핵심 질문]

  • [HIGH] blog.google (Gemini 3 Deep Think 페이지): "고급 병렬 추론으로 여러 가설 동시 탐색." Google AI Ultra 구독자에게 Gemini 앱에서 독점 제공. 앱에서 프롬프트바 'Deep Think' 선택 + 모델 드롭다운 'Gemini 3 Pro' 선택. → 일반 API 과금 모델이 아님.
  • [MED] GoogleDeepMind / Sundar Pichai X 게시물: 과학 연구자·개발자 대상으로 Vertex AI Early Access Program 으로 Deep Think API 를 처음 개방. "select researchers & enterprises through an early access program."
  • 결론: Deep Think = 소비자 구독(Ultra, 앱) 기능이며, API 는 Vertex AI 조기접근(EAP) 로만, 일반 종량 과금 아님. (2026-07 기준)

소비자 구독 티어 (2026-07, I/O 2026 이후) [MED, 애그리게이터/뉴스]

  • 브랜드: "Google AI" — AI Plus ($4.99), AI Pro ($19.99/월), AI Ultra ($99.99 / $199.99).
  • AI Ultra: I/O 2026 (2026-05-19) 에 재편. 이전 $249.99/월 → 하위 Ultra $99.99 (Pro 한도 5x), 상위 $199.99 (Pro 한도 20x).
  • Ultra 포함: Gemini 3.1 Pro, Gemini 2.5 Deep Think, Veo 3.1, 월 25,000 AI 크레딧, 20TB 저장.
  • (주의: 이 소비자 가격은 뉴스/애그리게이터 기반. one.google.com 1차 미확인.)

멀티모달 강점 [HIGH/MED]

  • [HIGH] 전 현행 모델이 네이티브 멀티모달 입력 (text + image + video + audio + PDF) 을 단일 모델에서 수용. 2.5/3.x Flash·Pro 모두 동일 입력 셋.
  • [HIGH] 오디오·비디오 입력이 토큰으로 직접 과금되고 (audio 는 종종 별도 상위 요율), 임베딩도 video/audio 별도 요율 존재 → 진짜 멀티모달 파이프라인.
  • [HIGH] 1M 토큰 컨텍스트 → 긴 영상/대용량 코드베이스/다문서 롱컨텍스트 분석이 핵심 마케팅 포인트 (2.5 Pro 설명).
  • [HIGH] Live 계열 preview 모델(gemini-3.1-flash-live-preview, gemini-3.5-live-translate-preview, TTS) → 실시간 음성·번역·음성합성 스트리밍.
  • 출력은 모두 text (이미지·영상 생성은 별도 모델 gemini-*-image / Veo).

엇갈리거나 미확인

  • "Gemini 3.5 Pro" / "Gemini 3 Pro (GA)": 애그리게이터(codersera, eesel, metacto, pricepertoken)가 "Gemini 3 Pro Preview 2025-11-18 출시", "Gemini 3.5 Pro I/O 2026-05-19 발표, GA 6월 예상, 2M 컨텍스트" 등을 주장. 그러나 ai.google.dev 공식 pricing/models 페이지에는 최신 Pro 가 gemini-3.1-pro-preview (preview) 이고 GA Pro 는 2.5 Pro 뿐. GA 날짜·3.5 Pro 존재 여부 공식 미확인 → uncertain.
  • 2M 토큰 컨텍스트 모델: 애그리게이터가 3.5 Pro 2M 컨텍스트를 주장하나 공식 개별 모델 페이지에서는 전부 1,048,576 (1M) 만 확인됨. 2M GA 미확인.
  • 3.x Flash/Pro knowledge cutoff: 2.5 계열은 "January 2025" 로 명시됐지만 3.1/3.5/3.6 개별 페이지에서 cutoff 를 확인 못 함.
  • gemini-2.5-pro cutoff: 개별 페이지에서 명시 확인 못 함 (2.5 Flash/Flash-Lite 는 Jan 2025).
  • 소비자 구독 가격 ($4.99/$19.99/$99.99/$199.99): 뉴스(Engadget)·애그리게이터 기반 [MED]. one.google.com 공식 가격표 직접 미확인.
  • Deep Think Vertex EAP 세부(가격·정원·현재 상태): X 게시물 [MED] 만 확인. 공식 Vertex 문서 페이지 직접 미확인.
  • Non-global 가격 전환일 (2026-07-01): Vertex 페이지 요약에 나왔으나 현재(2026-07-25)가 그 이후이므로 non-global 가격이 실제 적용 중일 것 — 세부 재확인 필요.

원문 발췌

ai.google.dev/gemini-api/docs/pricing (요약 발췌) [HIGH]

Gemini 3.6 Flash: Standard $1.50 in / $7.50 out; Batch $0.75/$3.75; caching $0.15/1M + $1.00/hr
Gemini 3.5 Flash: Standard $1.50 in / $9.00 out; Priority $2.70/$16.20
Gemini 3.5 Flash-Lite: Standard $0.30 / $2.50
Gemini 3.1 Flash-Lite: $0.25 (text/img/video), $0.50 (audio) in / $1.50 out
Gemini 3.1 Pro Preview: ≤200k $2.00/$12.00, >200k $4.00/$18.00; caching $0.20/$0.40 + $4.50/hr
Gemini 2.5 Pro: ≤200k $1.25/$10.00, >200k $2.50/$15.00
Gemini 2.5 Flash: $0.30 / $2.50
Gemini 2.5 Flash-Lite: $0.10 / $0.40
Google Search Grounding: 5,000 free/mo (Gemini 3), then $14/1,000

cloud.google.com/vertex-ai/generative-ai/pricing (발췌) [HIGH]

Gemini 2.5 Pro: Input $1.25 (≤200K) / $2.50 (>200K); Output $10 / $15; Cached $0.13 / $0.25
Gemini 3.5 Flash: Input $1.50 (Global) / $1.65 (Non-global); Output $9.00 / $9.90
Priority tier = Standard +80%; Flex/Batch = Standard -50%
Non-global endpoints: Global pricing until July 1, 2026; non-global thereafter
Context caching: 90% discount on cached input vs regular input
Deep Research Agent: $2/1M input, $12/1M output (no cached pricing)

blog.google Gemini 3 Deep Think [HIGH]

"uses advanced parallel reasoning to explore multiple hypotheses simultaneously"
Available exclusively to "Google AI Ultra subscribers in the Gemini app."
Activate: select 'Deep Think' in prompt bar + Gemini 3 Pro in model dropdown.
(article does not mention API/Vertex pricing)

X posts (DeepMind / Pichai) [MED]

"The upgraded Deep Think mode is rolling out now in the Gemini App for Google AI Ultra subscribers.
For scientific researchers and developers, we're opening a Vertex AI Early Access Program for the API."

개별 모델 페이지 스펙 [HIGH]

gemini-2.5-pro:  input 1,048,576 / output 65,536 / text,image,video,audio,PDF
gemini-2.5-flash: input 1,048,576 / output 65,536 / cutoff Jan 2025 / text,images,video,audio / Thinking 지원
gemini-2.5-flash-lite: 1,048,576 / 65,536 / cutoff Jan 2025 / text,images,video,audio,PDF (out: text)
gemini-3.1-pro-preview: 1,048,576 / 65,536 / text,image,video,audio,PDF / "better thinking", SWE·agentic 최적화
gemini-3.5-flash: 1,048,576 / 65,536 / text,image,video,audio,PDF
gemini-3.6-flash: 1,048,576 / 65,536 / text,image,video,audio,PDF