2026 LLM 지형도 — 모델 한눈에
⚠️ 신선도: 이 페이지는 30일마다 재검증 대상. Anthropic 데이터는 first-party 출처 [HIGH]. 나머지 프로바이더는 2026-07 재검증에서 가격을 각 사 공식 페이지로 재확인해 대부분
[official]로 승격했다 (컨텍스트 크기·GPT-5.6 롱컨텍스트 서차지 등 일부 값은 여전히[aggregator][MED]). 이 판은 매달 바뀐다. 모든 버전·가격을 부패하는 값으로 취급하라.
어떻게 고를지는 → model-choice-decision-guide
빠른 비교표
| 프로바이더 | 대표 모델 (mid-2026) | 모델 ID | 컨텍스트 | 가격 $/1M (in-out) | 강점 |
|---|---|---|---|---|---|
| Anthropic [HIGH] | Claude Opus 5 (기본값) | claude-opus-5 |
1M | $5 / $25 | 에이전트 코딩·장기 자율, thinking 기본 ON |
| Anthropic [HIGH] | Claude Opus 4.8 (이전 세대) | claude-opus-4-8 |
1M | $5 / $25 | 에이전트 코딩, 장기 자율 |
| Anthropic [HIGH] | Claude Fable 5 (최상위) | claude-fable-5 |
1M | $10 / $50 | 최난도 추론 |
| Anthropic [HIGH] | Claude Sonnet 5 (균형) | claude-sonnet-5 |
1M | $3 / $15 ⚠️인트로 $2/$10 → 2026-08-31 만료 | Opus 근접 품질, Sonnet 가격 |
| Anthropic [HIGH] | Claude Haiku 4.5 (저가) | claude-haiku-4-5 |
200K | $1 / $5 | 속도 중요 단순 작업 |
| OpenAI [official] | GPT-5.6 Sol | gpt-5.6-sol |
~1.05M | $5 / $30 | 프론티어 추론, computer-use |
| OpenAI [official] | GPT-5.6 Terra (균형) | gpt-5.6-terra |
~1.05M | $2.50 / $15 | 프로덕션 마이그레이션 타깃 |
| OpenAI [official] | GPT-5.6 Luna (저가) | gpt-5.6-luna |
~1.05M | $1 / $6 | 대량 요약·분류 |
| Google [official] | Gemini 3.1 Pro (현행 Pro 플래그십 · 3.5 Pro 는 미존재) | gemini-3.1-pro |
1M | $2 / $12 (>200K → $4/$18) | 최상위 멀티모달 추론, 에이전트 |
| Google [official] | Gemini 3.5 Flash | gemini-3.5-flash |
1M | $1.50 / $9 | 빠르고 저렴 |
| Google [official] | Gemini 3.6 Flash | gemini-3.6-flash |
1M | $1.50 / $7.50 | 최신 Flash, 출력 더 저렴 |
| DeepSeek (open) [official] | DeepSeek V4 Pro | deepseek-ai/DeepSeek-V4-Pro |
1M | $0.44 / $0.87 | 오픈웨이트 가성비 프론티어 (MIT) |
| DeepSeek (open) [official] | DeepSeek V4 Flash | DeepSeek-V4-Flash |
1M | $0.14 / $0.28 | 초저가 오픈 워크호스 |
| Alibaba Qwen [official] | Qwen 3.7 Max | qwen3.7-max |
1M | $2.50 / $7.50 (⚠️현재 50%할인 $1.25/$3.75, 2026-07-31 만료) | 에이전트 코딩 · 런칭시 closed-weights |
| Mistral (open) [official] | Mistral Large 3 | mistral-large-2512 |
256K | $2 / $6 (API) · 셀프호스트 | Apache 2.0, 다국어 |
| Meta (open) | Llama 5 | — | ⛔ 아래 박스 | — | 스펙 미확인 — 인용 금지 |
가격은 $입력 / $출력 (per 1M tokens).
프로바이더별
Anthropic — Claude [HIGH: first-party]
- Fable 5 (
claude-fable-5) — 가장 강력한 널리 배포된 모델. 1M ctx, 128K 출력. $10/$50 (verified 2026-07). thinking 항상 켜짐, 30일 데이터 보존 필요. 울트라 프리미엄. - Opus 5 (
claude-opus-5) — 대부분 기본값으로 삼을 플래그십. 1M ctx, 128K 출력. $5/$25 (verified 2026-07). SOTA 장기 에이전트 + 코딩. thinking 이 기본 ON(thinking생략 = adaptive)이고low/mediumeffort 가 유난히 강해 비용·지연 절감 1순위 레버. - Opus 4.8 (
claude-opus-4-8) — 이전 세대 플래그십. 1M ctx, 128K 출력. $5/$25 (verified 2026-07). Opus 5 와 동가·동컨텍스트지만thinking생략 시 OFF. - Opus 4.7 / 4.6 (
claude-opus-4-7,claude-opus-4-6) — 이전 세대, 여전히 활성. - Sonnet 5 (
claude-sonnet-5) — 속도/지능 균형 최고, 코딩·에이전트에서 Opus 근접. 1M ctx. $3/$15 — 인트로 $2/$10 은 2026-08-31 만료 (verified 2026-07). 이 날짜 이후엔 죽은 가격이니 인용 주의. - Haiku 4.5 (
claude-haiku-4-5) — 가장 빠르고 저렴. 200K ctx, 64K 출력. $1/$5 (verified 2026-07).
OpenAI — GPT-5.6 [official 가격: developers.openai.com · ctx aggregator]
- 두 날짜 주의: 제한 프리뷰 2026-06-26 (미국 정부 검증 ~20개 조직), 일반 공개(GA) 2026-07-09.
gpt-5.6은gpt-5.6-sol의 별칭. - 세 티어(천체 이름): Sol $5/$30 · Terra $2.50/$15 · Luna $1/$6 (verified 2026-07, developers.openai.com 공식). ~1.05M ctx (aggregator). 배치 API 는 50% 할인.
- ⚠️ 롱컨텍스트 서차지: 입력이 272K 토큰을 넘으면 요청 전체가 더 높은 요율($10/$45, Sol 기준)로 과금된다 — 초과분만이 아니라 전부. 예산 짤 때 주의. (공식 가격표엔 short/long 컬럼만 있고 임계값·요율 미공개 — aggregator, 재확인 필요)
- 구세대
gpt-5.4($2.50/$15 [confirmed]),gpt-5.1(가격 [unverified]) 도 아직 판매 중.
Google — Gemini [official: ai.google.dev]
- Gemini 3.5 Pro 는 존재하지 않는다. 2026-07 Google 공식 가격 페이지(ai.google.dev)에 3.5 Pro 항목이 없다 — "2M 컨텍스트 + Deep Think GA" 는 mid-2026 소문/미확인 정보였고 공식 확인 실패로 삭제한다. Deep Think 자체는 Google AI Ultra 구독(~$250/월) 기능이지 별도 API 과금 모델이 아니다.
- Gemini 3.1 Pro (
gemini-3.1-pro, 2026-02-19 출시) — 현행 Pro 플래그십. 1M ctx. $2/$12, >200K 프롬프트는 입력 $2→$4 / 출력 $12→$18 로 대략 2배 (verified 2026-07, 공식). - Flash 라인: Gemini 3.5 Flash $1.50/$9, Gemini 3.6 Flash $1.50/$7.50(출력 더 저렴), Flash-Lite 도 있음 (verified 2026-07, 공식). → "부패한다, 매달 재확인" 프레임은 유효.
DeepSeek — V4 (오픈웨이트) [official: api-docs.deepseek.com]
- 2026-04-24 출시. 2티어, MIT 라이선스 가중치 (Hugging Face).
- V4 Pro — 1.6T total / ~49B active MoE, 1M ctx. $0.44/$0.87, 캐시히트 입력 $0.003625 (verified 2026-07, 공식). 오픈웨이트 가성비 최강.
- V4 Flash — 284B / ~13B active, 1M ctx. $0.14/$0.28, 캐시히트 입력 $0.0028 (verified 2026-07, 공식). 초저가.
- R2 (추론 모델) — 계속 소문만, 미출시. V4 가 진짜 2026 플래그십.
Alibaba — Qwen [official: alibabacloud.com]
- Qwen 3.7 Max — 에이전트 우선 플래그십, 2026-05-20 발표. 1M ctx, 네이티브 확장 사고. 리스트 $2.50/$7.50, 현재 50% 할인 $1.25/$3.75 (2026-07-31 23:59 베이징 만료), 캐시 입력 $0.25 (verified 2026-07, Alibaba 공식 캠페인). 런칭 시 closed-weights (Model Studio/OpenRouter 만) — 통상 작은 변종을 몇 주~달 뒤 오픈. Qwen 3.8 도 일부 출처에 언급.
Mistral (오픈웨이트) [official: mistral.ai]
- Mistral Large 3 (
mistral-large-2512, 2025-12-02) — 675B/41B MoE, 256K ctx, 텍스트+이미지. Apache 2.0, 셀프호스트 가능 + API $2/$6 (verified 2026-07, mistral.ai 공식), 강한 다국어 + 함수호출.
Meta — Llama 5 ⛔ DO-NOT-CITE
인용 금지 박스. Llama 5 스펙(600B 파라미터 / 5M 토큰 컨텍스트 / 재귀적 자기개선 / Apache 2.0 / 2026-04-08 출시)은 조작 의심이다. 신뢰 못할 블로그 단일 출처에서만 나왔고, 1년 묵은 Gemini 2.0 과 비교하는 등 tell 이 보인다. Meta 공식 발표로 확인되기 전까지 이 위키에서 Llama 5 는 "열린 미확인 질문"이지 사실이 아니다. 어떤 스펙도 인용하지 마라. (2026-07 재확인: 상태 그대로. 예측시장 Manifold·Kalshi 는 여전히 "Meta 가 Llama 5 를 낼까"를 미결로 열어두고 있고, 그 스펙은 오직 ragyfied.com 단일 블로그에서만 나온다. Meta 공식 발표 없음 — 인용 금지 유지.)
참고
- 모델 선택 → model-choice-decision-guide
- 추론모델 vs 일반모델 프롬프팅 차이 → reasoning-vs-standard-models
- API 로 호출 → api-quickstart
- 캐싱으로 가격 후려치기 → prompt-caching
출처 신뢰도: Anthropic 은 first-party skill 참조 [HIGH]. 나머지 프로바이더는 2026-07 재검증에서 OpenAI(developers.openai.com)·Google(ai.google.dev)·DeepSeek(api-docs.deepseek.com)·Mistral(mistral.ai)·Qwen(alibabacloud.com) 가격을 각 사 공식 페이지로 재확인해 [official] 로 승격했다. 컨텍스트 크기·GPT-5.6 롱컨텍스트 서차지 등 일부 값은 여전히 aggregator [MED]. 원본 → 2026-07-23-models-landscape-research.