- openai/gpt-5-6
openai/gpt-5.6
250K संदर्भ
GPT-5.6 जारी हो चुका है और Sol, Terra तथा Luna तीनों मॉडल एक OpenAI-compatible API के माध्यम से OurToken पर पूरी तरह उपलब्ध हैं।
GPT-5.6 मॉडल देखें
मॉडल परिचय
OpenAI gpt-5.6
GPT-5.6 जारी हो चुका है और Sol, Terra तथा Luna तीनों मॉडल एक OpenAI-compatible API के माध्यम से OurToken पर पूरी तरह उपलब्ध हैं।
GPT-5.6 परिवार में तीन production routes हैं: अधिकतम capability के लिए Sol, संतुलन के लिए Terra और कम लागत व high throughput के लिए Luna। तीनों मॉडल text और image input, text output, 250K context, 128K तक output, function calling और अलग cache pricing सपोर्ट करते हैं।
यह बेहतरीन क्यों है
- कठिन reasoning, coding और agent workflows के लिए Sol।
- Capability, latency और cost के संतुलन के लिए Terra।
- Frequent requests, high throughput और सबसे कम token price के लिए Luna।
- एक OpenAI-compatible Responses API में केवल model ID बदलें।
- Repeated workloads में cached input और cache writes अलग गणना करें।
मुख्य विशेषताएँ
- Models: gpt-5.6-sol, gpt-5.6-terra, gpt-5.6-luna
- Context Window: 250000 tokens
- Max Output: 128000 tokens
- Input: Text and Image
- Output: Text
- Function Calling: Supported
- OurToken Pricing: 20% of official price for each model
विशिष्टताएँ
सही GPT-5.6 API मॉडल चुनें
Workload fit, token price, caching और production जरूरतों के आधार पर तीनों routes तुलना करें।
GPT-5.6 Sol
कठिन reasoning, advanced coding, repository work, tools और multi-step agents का flagship route।
GPT-5.6 Terra
Production coding, assistants, analysis और tools के लिए balanced route, जब हर request में Sol आवश्यक न हो।
GPT-5.6 Luna
High-volume assistants, extraction, classification, content processing और routine coding support का lowest-cost route।
साझा 250K Context
तीनों routes 250K context और 128K तक output सपोर्ट करते हैं।
Unified API Integration
एक OpenAI-compatible Responses API रखें और पूरे model IDs के बीच switch करें।
पारदर्शी Family Pricing
हर स्वतंत्र पेज input, cached input, cache writes, output, official और discounted prices दिखाता है।
GPT-5.6 मॉडल कैसे चुनें
Workload को Sol, Terra या Luna से मिलाएं और quality, latency, caching तथा total cost जांचें।
Workload वर्गीकृत करें
Task difficulty, request volume, latency target, context size, output length और tool needs पहचानें।
01Terra से शुरू करें
सामान्य production coding, assistant, analysis और automation के balanced baseline के रूप में Terra लें।
02कठिन Tasks Sol पर भेजें
Quality target न मिलने पर कठिन reasoning, coding या multi-step agent requests Sol पर भेजें।
03Routine Work Luna पर भेजें
Quality पूरा करने वाले frequent और cost-sensitive tasks के लिए Luna उपयोग करें।
04Prompt Caching योजना बनाएं
Stable prompt prefixes मापें और cached input व cache writes दोनों को cost में शामिल करें।
05Dedicated Pages देखें
हर मॉडल का exact price, model ID, examples, Features, How-to और FAQ देखें।
06GPT-5.6 Family FAQ
Release, availability, Sol vs Terra vs Luna, context, pricing, caching और API integration के उत्तर।