모델
verified · type: entity · verified: 2026-07 · review: 30d · updated: 2026-07-25 · [model]

OpenAI GPT 모델 패밀리

OpenAI 모델을 티어·가격·컨텍스트로 고를 때, 그리고 Claude 와 대응시켜 볼 때 여는 문서.

신뢰도 경고. 이 페이지의 OpenAI 값은 developers.openai.com(1차) 확인이나, openai.com 본체는 접근 차단(403)이라 GA 여부·릴리스 날짜는 미확정이다. 가격·모델 ID·컨텍스트는 휘발성이 크다 — 반드시 원본을 재확인하라. Anthropic 대응값은 claude-family 가 최종 권위다.


현행 라인업 — GPT-5.6 계열

GPT-5.6 은 base/mini/nano 네이밍을 버리고 3티어 이름을 쓴다. Sol=플래그십, Terra=밸런스, Luna=저가·고속. 셋 다 컨텍스트·최대출력이 동일하고 가격만 다르다.

티어 모델 ID 컨텍스트 최대출력 입력 $/1M 캐시입력 출력 $/1M
Sol (플래그십) gpt-5.6-sol (별칭 gpt-5.6) 1.05M 128K $5.00 $0.50 $30.00
Terra (밸런스) gpt-5.6-terra 1.05M 128K $2.50 $0.25 $15.00
Luna (고속·저가) gpt-5.6-luna 1.05M 128K $1.00 $0.10 $6.00

(전부 verified 2026-07, developers.openai.com)

  • 캐시입력가 = 표준입력의 정확히 1/10.
  • 컨텍스트는 1,050,000 토큰 — Claude 의 1M 보다 살짝 큰 값이다.
  • 지식 컷오프: 세 모델 공통 2026-02-16 (verified 2026-07).
  • 공식 선택 가이드: 복잡한 추론·코딩 → Sol, 지능/비용 균형 → Terra, 비용 민감·대량 → Luna.

이전 세대 (GPT-5.5 / 5.4)

pricing 페이지에서 확인된 하위·이전 티어. 최저가는 gpt-5.4-nano.

모델 ID 입력 $/1M 캐시입력 출력 $/1M
gpt-5.5 (스냅샷 gpt-5.5-2026-04-23) $5.00 $0.50 $30.00
gpt-5.5-pro $30.00 $180.00
gpt-5.4 $2.50 $0.25 $15.00
gpt-5.4-mini $0.75 $0.075 $4.50
gpt-5.4-nano $0.20 $0.02 $1.25
gpt-5.4-pro $30.00 $180.00

(verified 2026-07, developers.openai.com) · GPT-5.5 지식 컷오프 = 2025-12-01.

  • Sol($5/$30)은 gpt-5.5 와, Terra($2.50/$15)는 gpt-5.4 와 같은 가격대다 — 같은 값에서 성능만 올린 세대교체로 보인다(가격 동일은 확인 사실, 세대교체 해석은 추론).

롱컨텍스트 과금 함정 🕳️

경계는 128K 가 아니라 272K 다. gpt-5.6-sol 공식 페이지: "Prompts with >272K input tokens are priced at 2x input and 1.5x output for the full request." (verified 2026-07)

즉 입력이 272,000 토큰을 넘는 순간, 그 요청 전체가 입력 2배·출력 1.5배로 과금된다. 초과분만이 아니라 전량이다. 1.05M 컨텍스트를 꽉 채우는 습관을 들이면 272K 문턱을 밟는 순간 비용이 튄다 — 긴 RAG 컨텍스트를 넣을 땐 272K 미만으로 유지하는 게 요금상 유리하다.

비용 절감 레버

레버 효과
배치 API 입력·출력 일괄 50% 할인(비동기)
캐시 입력 표준입력의 10%
티어 다운시프트 Sol→Terra→Luna 로 성능 대비 단가 하락
리전 데이터 레지던시 2026-03-05 이후 모델에 10% 마크업(절감 아님, 주의)

Flex(반값)·Priority(2.5배) 티어는 애그리게이터만 언급, 1차 미확인 (재확인 필요).

추론 / effort (GPT-5.6)

  • reasoning.effort{none, minimal, low, medium, high, xhigh, max}, 기본 medium (verified 2026-07). Claude 의 output_config.effort(기본 high)와 값셋이 유사하나 위치가 다르다 — OpenAI 는 reasoning 안, Anthropic 은 output_config 안.
  • raw 추론 토큰은 노출 안 함 — summary: auto|concise 로 요약만 받는다.
  • 스테이트리스(store: false)면 reasoning item 에 encrypted_content 가 실려, 다음 요청에 재생해 추론 연속성을 잇는다. 추론모델 전반은 reasoning-models 참고.

Responses API vs Chat Completions

신규 프로젝트는 Responses API 권장. "While Chat Completions remains supported, Responses is recommended for all new projects." Chat Completions 는 deprecated 아님(계속 지원). Assistants API 는 폐기(2026-08-26 sunset)되고 Responses 로 흡수된다.

항목 Chat Completions Responses API
엔드포인트 POST /v1/chat/completions POST /v1/responses
시스템 지시 messages[]system role top-level instructions
구조화 출력 response_format:{type:"json_schema",...} text:{format:{type:"json_schema",name,schema,strict}}
툴 결과 반환 {role:"tool", tool_call_id, content} {type:"function_call_output", call_id, output}
응답 접근 choices[0].message.content output_text / output[] (typed Items)

Responses 만의 것: 상태유지(store:true/previous_response_id), 서버측 내장툴(web/file search, code interpreter, MCP), 암호화 reasoning item. stateful 파라미터 정확한 필드셋(previous_response_id/store/instructions 조합)은 (재확인 필요).

함수 호출 (strict)

  • Responses 툴은 flat: {type:"function", name, description, parameters, strict}. 결과 반환은 {type:"function_call_output", call_id, output}.
  • strict: true 요구조건: 스키마에 additionalProperties:false + 전 필드 required + 옵션 필드는 type:["string","null"]. "Setting strict to true will ensure function calls reliably adhere to the function schema, instead of being best effort."
  • tool_choice: auto(기본)/required/특정 함수. 함수콜 스트리밍 이벤트는 response.function_call_arguments.delta/.done. 텍스트 델타 이벤트명은 (재확인 필요).
  • 구조화 출력 상세·SDK 헬퍼는 structured-output, 툴 정의 실전은 set-up-tool-use.

Claude 대응표

OpenAI(Responses) ↔ Anthropic 대응. Anthropic 값은 claude-family·규격 §7 이 권위다.

항목 OpenAI Responses Anthropic Messages
엔드포인트 /v1/responses /v1/messages
시스템 지시 instructions system 파라미터
구조화 출력 text.format.json_schema output_config.format.json_schema
툴 strict strict:true(+additionalProps:false) strict:true(툴 top-level, tool_choice 아님)
툴 결과 반환 {type:"function_call_output", call_id, output} user 턴 tool_result 블록(tool_use_id)
추론 강도 reasoning.effort(기본 medium) output_config.effort(기본 high)+thinking:{type:"adaptive"}
추론 노출 요약(summary)+encrypted_content 요약만(thinking.display:"summarized"), raw CoT 절대 미반환
상태 서버 보존(store/previous_response_id) 무상태(매 요청 전체 히스토리 전송)

핵심 비대칭: OpenAI Responses 는 서버가 대화 상태를 들고 있지만, Anthropic Messages 는 무상태라 매번 전체 히스토리를 다시 보낸다. 이 차이가 마이그레이션의 최대 함정이다.

가용성 (미확정)

  • 2026-06-26 한정 프리뷰 → 2026-07-09 GA 로 전환되었다는 정황(검색 다수 일치)이나, openai.com 본체 403 으로 1차 미확인 [MED].

인용 금지 박스. VentureBeat 의 "~20 limited preview partners, per US Gov" 는 7/9 GA 이전 프리뷰 시점 기사로 이후 GA 와 상충한다 — 시점 오인 위험, 단독 인용 금지. GPT-5.6 벤치마크 점수 전반(coderabbit/techjournal/datacamp 등)은 검증 불가·빨리 썩음이라 인용하지 않는다. ChatGPT 'Ultra Mode' 주장은 1차 확인 전무.


참고

출처: 모델 ID·가격·컨텍스트·API 표면은 developers.openai.com 1차 [HIGH]. GA·릴리스 날짜는 openai.com 본체 403 으로 [MED]. Anthropic 대응값은 규격 §7 first-party. 원본 → 2026-07-25-openai-gpt-deep