- openai/gpt-5-6
openai/gpt-5.6
250K 컨텍스트
GPT-5.6은 정식 출시되었으며 Sol, Terra, Luna 세 모델 모두 OurToken에서 완전히 사용할 수 있습니다. 하나의 OpenAI 호환 API로 연결됩니다.
GPT-5.6 모델 살펴보기
모델 소개
OpenAI gpt-5.6
GPT-5.6은 정식 출시되었으며 Sol, Terra, Luna 세 모델 모두 OurToken에서 완전히 사용할 수 있습니다. 하나의 OpenAI 호환 API로 연결됩니다.
GPT-5.6 제품군은 최대 성능의 Sol, 균형형 Terra, 저비용·고처리량 Luna라는 세 가지 프로덕션 경로를 제공합니다. 세 모델 모두 텍스트와 이미지 입력, 텍스트 출력, 250K 컨텍스트, 최대 128K 출력, Function Calling 및 별도 캐시 가격을 지원합니다.
돋보이는 이유
- 고난도 추론, coding, agent workflow에는 Sol.
- 성능, latency, 비용의 균형에는 Terra.
- 빈번한 request, 높은 throughput, 최저 token 가격에는 Luna.
- 동일한 OpenAI 호환 Responses API에서 model ID만 변경.
- 반복 작업은 cached input과 cache writes를 따로 계산.
주요 기능
- Models: gpt-5.6-sol, gpt-5.6-terra, gpt-5.6-luna
- Context Window: 250000 tokens
- Max Output: 128000 tokens
- Input: Text and Image
- Output: Text
- Function Calling: Supported
- OurToken Pricing: 20% of official price for each model
사양
적합한 GPT-5.6 API 모델 선택
워크로드, token 가격, caching, 프로덕션 요구사항으로 세 GPT-5.6 경로를 비교합니다.
GPT-5.6 Sol
어려운 추론, 고급 coding, repository 작업, tool use, 다단계 agent를 위한 플래그십 경로입니다.
GPT-5.6 Terra
매 request마다 Sol 성능이 필요하지 않은 프로덕션 coding, assistant, 분석, tool 작업을 위한 균형형 경로입니다.
GPT-5.6 Luna
대규모 assistant, 추출, 분류, 콘텐츠 처리, 일상적 coding 지원을 위한 최저 비용 경로입니다.
공통 250K 컨텍스트
세 경로 모두 250K 컨텍스트와 최대 128K 출력을 지원합니다.
통합 API 연동
하나의 OpenAI 호환 Responses API를 유지하고 전체 model ID로 전환합니다.
투명한 제품군 가격
각 전용 페이지에서 input, cached input, cache writes, output, 공식 가격과 할인 가격을 표시합니다.
GPT-5.6 모델 선택 방법
Sol, Terra, Luna를 작업에 맞추고 품질, latency, caching, 총비용을 검증합니다.
워크로드 분류
난이도, request 양, latency 목표, context 크기, 출력 길이와 tool 요구사항을 정리합니다.
01Terra로 시작
일반적인 프로덕션 coding, assistant, 분석, 자동화의 균형 기준으로 Terra를 사용합니다.
02어려운 작업은 Sol로
품질 목표에 못 미치는 추론, coding, 다단계 agent request를 Sol로 보냅니다.
03반복 작업은 Luna로
품질을 충족하는 고빈도·비용 민감 작업을 Luna에 라우팅합니다.
04Prompt Caching 계획
안정적인 prefix를 측정하고 cached input과 cache writes를 모두 비용에 포함합니다.
05전용 페이지 확인
각 모델의 정확한 가격, model ID, 예제, Features, How-to, FAQ를 확인합니다.
06GPT-5.6 제품군 FAQ
출시, 가용성, Sol vs Terra vs Luna, context, 가격, caching, API 통합에 대한 답변입니다.