OpenAI GPT 모델 패밀리
OpenAI 모델을 티어·가격·컨텍스트로 고를 때, 그리고 Claude 와 대응시켜 볼 때 여는 문서.
신뢰도 경고. 이 페이지의 OpenAI 값은
developers.openai.com(1차) 확인이나,openai.com본체는 접근 차단(403)이라 GA 여부·릴리스 날짜는 미확정이다. 가격·모델 ID·컨텍스트는 휘발성이 크다 — 반드시 원본을 재확인하라. Anthropic 대응값은 claude-family 가 최종 권위다.
현행 라인업 — GPT-5.6 계열
GPT-5.6 은 base/mini/nano 네이밍을 버리고 3티어 이름을 쓴다. Sol=플래그십, Terra=밸런스, Luna=저가·고속. 셋 다 컨텍스트·최대출력이 동일하고 가격만 다르다.
| 티어 | 모델 ID | 컨텍스트 | 최대출력 | 입력 $/1M | 캐시입력 | 출력 $/1M |
|---|---|---|---|---|---|---|
| Sol (플래그십) | gpt-5.6-sol (별칭 gpt-5.6) |
1.05M | 128K | $5.00 | $0.50 | $30.00 |
| Terra (밸런스) | gpt-5.6-terra |
1.05M | 128K | $2.50 | $0.25 | $15.00 |
| Luna (고속·저가) | gpt-5.6-luna |
1.05M | 128K | $1.00 | $0.10 | $6.00 |
(전부 verified 2026-07, developers.openai.com)
- 캐시입력가 = 표준입력의 정확히 1/10.
- 컨텍스트는 1,050,000 토큰 — Claude 의 1M 보다 살짝 큰 값이다.
- 지식 컷오프: 세 모델 공통 2026-02-16 (verified 2026-07).
- 공식 선택 가이드: 복잡한 추론·코딩 → Sol, 지능/비용 균형 → Terra, 비용 민감·대량 → Luna.
이전 세대 (GPT-5.5 / 5.4)
pricing 페이지에서 확인된 하위·이전 티어. 최저가는 gpt-5.4-nano.
| 모델 ID | 입력 $/1M | 캐시입력 | 출력 $/1M |
|---|---|---|---|
gpt-5.5 (스냅샷 gpt-5.5-2026-04-23) |
$5.00 | $0.50 | $30.00 |
gpt-5.5-pro |
$30.00 | — | $180.00 |
gpt-5.4 |
$2.50 | $0.25 | $15.00 |
gpt-5.4-mini |
$0.75 | $0.075 | $4.50 |
gpt-5.4-nano |
$0.20 | $0.02 | $1.25 |
gpt-5.4-pro |
$30.00 | — | $180.00 |
(verified 2026-07, developers.openai.com) · GPT-5.5 지식 컷오프 = 2025-12-01.
- Sol($5/$30)은
gpt-5.5와, Terra($2.50/$15)는gpt-5.4와 같은 가격대다 — 같은 값에서 성능만 올린 세대교체로 보인다(가격 동일은 확인 사실, 세대교체 해석은 추론).
롱컨텍스트 과금 함정 🕳️
경계는 128K 가 아니라 272K 다. gpt-5.6-sol 공식 페이지: "Prompts with >272K input tokens are priced at 2x input and 1.5x output for the full request." (verified 2026-07)
즉 입력이 272,000 토큰을 넘는 순간, 그 요청 전체가 입력 2배·출력 1.5배로 과금된다. 초과분만이 아니라 전량이다. 1.05M 컨텍스트를 꽉 채우는 습관을 들이면 272K 문턱을 밟는 순간 비용이 튄다 — 긴 RAG 컨텍스트를 넣을 땐 272K 미만으로 유지하는 게 요금상 유리하다.
비용 절감 레버
| 레버 | 효과 |
|---|---|
| 배치 API | 입력·출력 일괄 50% 할인(비동기) |
| 캐시 입력 | 표준입력의 10% |
| 티어 다운시프트 | Sol→Terra→Luna 로 성능 대비 단가 하락 |
| 리전 데이터 레지던시 | 2026-03-05 이후 모델에 10% 마크업(절감 아님, 주의) |
Flex(반값)·Priority(2.5배) 티어는 애그리게이터만 언급, 1차 미확인 (재확인 필요).
추론 / effort (GPT-5.6)
reasoning.effort∈{none, minimal, low, medium, high, xhigh, max}, 기본 medium (verified 2026-07). Claude 의output_config.effort(기본 high)와 값셋이 유사하나 위치가 다르다 — OpenAI 는reasoning안, Anthropic 은output_config안.- raw 추론 토큰은 노출 안 함 —
summary: auto|concise로 요약만 받는다. - 스테이트리스(
store: false)면 reasoning item 에encrypted_content가 실려, 다음 요청에 재생해 추론 연속성을 잇는다. 추론모델 전반은 reasoning-models 참고.
Responses API vs Chat Completions
신규 프로젝트는 Responses API 권장. "While Chat Completions remains supported, Responses is recommended for all new projects." Chat Completions 는 deprecated 아님(계속 지원). Assistants API 는 폐기(2026-08-26 sunset)되고 Responses 로 흡수된다.
| 항목 | Chat Completions | Responses API |
|---|---|---|
| 엔드포인트 | POST /v1/chat/completions |
POST /v1/responses |
| 시스템 지시 | messages[] 안 system role |
top-level instructions |
| 구조화 출력 | response_format:{type:"json_schema",...} |
text:{format:{type:"json_schema",name,schema,strict}} |
| 툴 결과 반환 | {role:"tool", tool_call_id, content} |
{type:"function_call_output", call_id, output} |
| 응답 접근 | choices[0].message.content |
output_text / output[] (typed Items) |
Responses 만의 것: 상태유지(store:true/previous_response_id), 서버측 내장툴(web/file search, code interpreter, MCP), 암호화 reasoning item. stateful 파라미터 정확한 필드셋(previous_response_id/store/instructions 조합)은 (재확인 필요).
함수 호출 (strict)
- Responses 툴은 flat:
{type:"function", name, description, parameters, strict}. 결과 반환은{type:"function_call_output", call_id, output}. strict: true요구조건: 스키마에additionalProperties:false+ 전 필드required+ 옵션 필드는type:["string","null"]. "Settingstricttotruewill ensure function calls reliably adhere to the function schema, instead of being best effort."tool_choice:auto(기본)/required/특정 함수. 함수콜 스트리밍 이벤트는response.function_call_arguments.delta/.done. 텍스트 델타 이벤트명은 (재확인 필요).- 구조화 출력 상세·SDK 헬퍼는 structured-output, 툴 정의 실전은 set-up-tool-use.
Claude 대응표
OpenAI(Responses) ↔ Anthropic 대응. Anthropic 값은 claude-family·규격 §7 이 권위다.
| 항목 | OpenAI Responses | Anthropic Messages |
|---|---|---|
| 엔드포인트 | /v1/responses |
/v1/messages |
| 시스템 지시 | instructions |
system 파라미터 |
| 구조화 출력 | text.format.json_schema |
output_config.format.json_schema |
| 툴 strict | strict:true(+additionalProps:false) |
strict:true(툴 top-level, tool_choice 아님) |
| 툴 결과 반환 | {type:"function_call_output", call_id, output} |
user 턴 tool_result 블록(tool_use_id) |
| 추론 강도 | reasoning.effort(기본 medium) |
output_config.effort(기본 high)+thinking:{type:"adaptive"} |
| 추론 노출 | 요약(summary)+encrypted_content |
요약만(thinking.display:"summarized"), raw CoT 절대 미반환 |
| 상태 | 서버 보존(store/previous_response_id) |
무상태(매 요청 전체 히스토리 전송) |
핵심 비대칭: OpenAI Responses 는 서버가 대화 상태를 들고 있지만, Anthropic Messages 는 무상태라 매번 전체 히스토리를 다시 보낸다. 이 차이가 마이그레이션의 최대 함정이다.
가용성 (미확정)
- 2026-06-26 한정 프리뷰 → 2026-07-09 GA 로 전환되었다는 정황(검색 다수 일치)이나,
openai.com본체 403 으로 1차 미확인 [MED].
인용 금지 박스. VentureBeat 의 "~20 limited preview partners, per US Gov" 는 7/9 GA 이전 프리뷰 시점 기사로 이후 GA 와 상충한다 — 시점 오인 위험, 단독 인용 금지. GPT-5.6 벤치마크 점수 전반(coderabbit/techjournal/datacamp 등)은 검증 불가·빨리 썩음이라 인용하지 않는다. ChatGPT 'Ultra Mode' 주장은 1차 확인 전무.
참고
- claude-family — Anthropic 모델 라인업(대응표의 Claude 쪽 권위)
- openai-api-parity — Responses/Chat ↔ Messages API 필드 대응 상세
- reasoning-models — effort·추론 요약·encrypted reasoning 개념
- structured-output — json_schema strict 출력 실전
- model-choice-decision-guide — 티어·프로바이더 선택 판단
- prompt-caching — 캐시 입력 과금 구조
출처: 모델 ID·가격·컨텍스트·API 표면은 developers.openai.com 1차 [HIGH]. GA·릴리스 날짜는 openai.com 본체 403 으로 [MED]. Anthropic 대응값은 규격 §7 first-party. 원본 → 2026-07-25-openai-gpt-deep