모델
verified · type: reference · verified: 2026-07 · review: 30d · updated: 2026-07-25 · [model, comparison]

2026 LLM 지형도 — 모델 한눈에

⚠️ 신선도: 이 페이지는 30일마다 재검증 대상. Anthropic 데이터는 first-party 출처 [HIGH]. 나머지 프로바이더는 2026-07 재검증에서 가격을 각 사 공식 페이지로 재확인해 대부분 [official] 로 승격했다 (컨텍스트 크기·GPT-5.6 롱컨텍스트 서차지 등 일부 값은 여전히 [aggregator] [MED]). 이 판은 매달 바뀐다. 모든 버전·가격을 부패하는 값으로 취급하라.

어떻게 고를지는 → model-choice-decision-guide


빠른 비교표

프로바이더 대표 모델 (mid-2026) 모델 ID 컨텍스트 가격 $/1M (in-out) 강점
Anthropic [HIGH] Claude Opus 5 (기본값) claude-opus-5 1M $5 / $25 에이전트 코딩·장기 자율, thinking 기본 ON
Anthropic [HIGH] Claude Opus 4.8 (이전 세대) claude-opus-4-8 1M $5 / $25 에이전트 코딩, 장기 자율
Anthropic [HIGH] Claude Fable 5 (최상위) claude-fable-5 1M $10 / $50 최난도 추론
Anthropic [HIGH] Claude Sonnet 5 (균형) claude-sonnet-5 1M $3 / $15 ⚠️인트로 $2/$10 → 2026-08-31 만료 Opus 근접 품질, Sonnet 가격
Anthropic [HIGH] Claude Haiku 4.5 (저가) claude-haiku-4-5 200K $1 / $5 속도 중요 단순 작업
OpenAI [official] GPT-5.6 Sol gpt-5.6-sol ~1.05M $5 / $30 프론티어 추론, computer-use
OpenAI [official] GPT-5.6 Terra (균형) gpt-5.6-terra ~1.05M $2.50 / $15 프로덕션 마이그레이션 타깃
OpenAI [official] GPT-5.6 Luna (저가) gpt-5.6-luna ~1.05M $1 / $6 대량 요약·분류
Google [official] Gemini 3.1 Pro (현행 Pro 플래그십 · 3.5 Pro 는 미존재) gemini-3.1-pro 1M $2 / $12 (>200K → $4/$18) 최상위 멀티모달 추론, 에이전트
Google [official] Gemini 3.5 Flash gemini-3.5-flash 1M $1.50 / $9 빠르고 저렴
Google [official] Gemini 3.6 Flash gemini-3.6-flash 1M $1.50 / $7.50 최신 Flash, 출력 더 저렴
DeepSeek (open) [official] DeepSeek V4 Pro deepseek-ai/DeepSeek-V4-Pro 1M $0.44 / $0.87 오픈웨이트 가성비 프론티어 (MIT)
DeepSeek (open) [official] DeepSeek V4 Flash DeepSeek-V4-Flash 1M $0.14 / $0.28 초저가 오픈 워크호스
Alibaba Qwen [official] Qwen 3.7 Max qwen3.7-max 1M $2.50 / $7.50 (⚠️현재 50%할인 $1.25/$3.75, 2026-07-31 만료) 에이전트 코딩 · 런칭시 closed-weights
Mistral (open) [official] Mistral Large 3 mistral-large-2512 256K $2 / $6 (API) · 셀프호스트 Apache 2.0, 다국어
Meta (open) Llama 5 ⛔ 아래 박스 스펙 미확인 — 인용 금지

가격은 $입력 / $출력 (per 1M tokens).


프로바이더별

Anthropic — Claude [HIGH: first-party]

  • Fable 5 (claude-fable-5) — 가장 강력한 널리 배포된 모델. 1M ctx, 128K 출력. $10/$50 (verified 2026-07). thinking 항상 켜짐, 30일 데이터 보존 필요. 울트라 프리미엄.
  • Opus 5 (claude-opus-5) — 대부분 기본값으로 삼을 플래그십. 1M ctx, 128K 출력. $5/$25 (verified 2026-07). SOTA 장기 에이전트 + 코딩. thinking 이 기본 ON(thinking 생략 = adaptive)이고 low/medium effort 가 유난히 강해 비용·지연 절감 1순위 레버.
  • Opus 4.8 (claude-opus-4-8) — 이전 세대 플래그십. 1M ctx, 128K 출력. $5/$25 (verified 2026-07). Opus 5 와 동가·동컨텍스트지만 thinking 생략 시 OFF.
  • Opus 4.7 / 4.6 (claude-opus-4-7, claude-opus-4-6) — 이전 세대, 여전히 활성.
  • Sonnet 5 (claude-sonnet-5) — 속도/지능 균형 최고, 코딩·에이전트에서 Opus 근접. 1M ctx. $3/$15 — 인트로 $2/$10 은 2026-08-31 만료 (verified 2026-07). 이 날짜 이후엔 죽은 가격이니 인용 주의.
  • Haiku 4.5 (claude-haiku-4-5) — 가장 빠르고 저렴. 200K ctx, 64K 출력. $1/$5 (verified 2026-07).

OpenAI — GPT-5.6 [official 가격: developers.openai.com · ctx aggregator]

  • 두 날짜 주의: 제한 프리뷰 2026-06-26 (미국 정부 검증 ~20개 조직), 일반 공개(GA) 2026-07-09. gpt-5.6gpt-5.6-sol 의 별칭.
  • 세 티어(천체 이름): Sol $5/$30 · Terra $2.50/$15 · Luna $1/$6 (verified 2026-07, developers.openai.com 공식). ~1.05M ctx (aggregator). 배치 API 는 50% 할인.
  • ⚠️ 롱컨텍스트 서차지: 입력이 272K 토큰을 넘으면 요청 전체가 더 높은 요율($10/$45, Sol 기준)로 과금된다 — 초과분만이 아니라 전부. 예산 짤 때 주의. (공식 가격표엔 short/long 컬럼만 있고 임계값·요율 미공개 — aggregator, 재확인 필요)
  • 구세대 gpt-5.4 ($2.50/$15 [confirmed]), gpt-5.1 (가격 [unverified]) 도 아직 판매 중.

Google — Gemini [official: ai.google.dev]

  • Gemini 3.5 Pro 는 존재하지 않는다. 2026-07 Google 공식 가격 페이지(ai.google.dev)에 3.5 Pro 항목이 없다 — "2M 컨텍스트 + Deep Think GA" 는 mid-2026 소문/미확인 정보였고 공식 확인 실패로 삭제한다. Deep Think 자체는 Google AI Ultra 구독(~$250/월) 기능이지 별도 API 과금 모델이 아니다.
  • Gemini 3.1 Pro (gemini-3.1-pro, 2026-02-19 출시) — 현행 Pro 플래그십. 1M ctx. $2/$12, >200K 프롬프트는 입력 $2→$4 / 출력 $12→$18 로 대략 2배 (verified 2026-07, 공식).
  • Flash 라인: Gemini 3.5 Flash $1.50/$9, Gemini 3.6 Flash $1.50/$7.50(출력 더 저렴), Flash-Lite 도 있음 (verified 2026-07, 공식). → "부패한다, 매달 재확인" 프레임은 유효.

DeepSeek — V4 (오픈웨이트) [official: api-docs.deepseek.com]

  • 2026-04-24 출시. 2티어, MIT 라이선스 가중치 (Hugging Face).
  • V4 Pro — 1.6T total / ~49B active MoE, 1M ctx. $0.44/$0.87, 캐시히트 입력 $0.003625 (verified 2026-07, 공식). 오픈웨이트 가성비 최강.
  • V4 Flash — 284B / ~13B active, 1M ctx. $0.14/$0.28, 캐시히트 입력 $0.0028 (verified 2026-07, 공식). 초저가.
  • R2 (추론 모델) — 계속 소문만, 미출시. V4 가 진짜 2026 플래그십.

Alibaba — Qwen [official: alibabacloud.com]

  • Qwen 3.7 Max — 에이전트 우선 플래그십, 2026-05-20 발표. 1M ctx, 네이티브 확장 사고. 리스트 $2.50/$7.50, 현재 50% 할인 $1.25/$3.75 (2026-07-31 23:59 베이징 만료), 캐시 입력 $0.25 (verified 2026-07, Alibaba 공식 캠페인). 런칭 시 closed-weights (Model Studio/OpenRouter 만) — 통상 작은 변종을 몇 주~달 뒤 오픈. Qwen 3.8 도 일부 출처에 언급.

Mistral (오픈웨이트) [official: mistral.ai]

  • Mistral Large 3 (mistral-large-2512, 2025-12-02) — 675B/41B MoE, 256K ctx, 텍스트+이미지. Apache 2.0, 셀프호스트 가능 + API $2/$6 (verified 2026-07, mistral.ai 공식), 강한 다국어 + 함수호출.

Meta — Llama 5 ⛔ DO-NOT-CITE

인용 금지 박스. Llama 5 스펙(600B 파라미터 / 5M 토큰 컨텍스트 / 재귀적 자기개선 / Apache 2.0 / 2026-04-08 출시)은 조작 의심이다. 신뢰 못할 블로그 단일 출처에서만 나왔고, 1년 묵은 Gemini 2.0 과 비교하는 등 tell 이 보인다. Meta 공식 발표로 확인되기 전까지 이 위키에서 Llama 5 는 "열린 미확인 질문"이지 사실이 아니다. 어떤 스펙도 인용하지 마라. (2026-07 재확인: 상태 그대로. 예측시장 Manifold·Kalshi 는 여전히 "Meta 가 Llama 5 를 낼까"를 미결로 열어두고 있고, 그 스펙은 오직 ragyfied.com 단일 블로그에서만 나온다. Meta 공식 발표 없음 — 인용 금지 유지.)


참고

출처 신뢰도: Anthropic 은 first-party skill 참조 [HIGH]. 나머지 프로바이더는 2026-07 재검증에서 OpenAI(developers.openai.com)·Google(ai.google.dev)·DeepSeek(api-docs.deepseek.com)·Mistral(mistral.ai)·Qwen(alibabacloud.com) 가격을 각 사 공식 페이지로 재확인해 [official] 로 승격했다. 컨텍스트 크기·GPT-5.6 롱컨텍스트 서차지 등 일부 값은 여전히 aggregator [MED]. 원본 → 2026-07-23-models-landscape-research.