29 सितंबर 2026 को जोड़ा गया: यह लेख जुलाई 2026 से आम तौर पर उपलब्ध GPT-5.6 (Luna / Terra / Sol) की रिलीज़ के बारे में है। उसके बाद OpenAI ने 3 सितंबर को GPT-6 Astra और 22 सितंबर (अमेरिकी समय) को GPT-6 Sol और GPT-6 Luna जारी किए, जो Sol और Luna नामों को अगली पीढ़ी में ले जाते हैं। 30 सितंबर 2026 तक उसकी API मॉडल सूची सलाह देती है कि शुरुआत तय न हो तो Astra, बुद्धिमत्ता और लागत के संतुलन के लिए 29 सितंबर को जारी GPT-6.1 Sol (ChatGPT में यह Work और Codex में मिलता है, चैट में नहीं; प्रति 10 लाख टोकन इनपुट $2 / आउटपुट $10), और लागत के प्रति संवेदनशील बड़े पैमाने के काम के लिए GPT-6 Luna ($0.10 / $0.50) चुनें; GPT-5.6 के मॉडल अब उसकी सिफ़ारिशों में नहीं हैं (ChatGPT की सहायता के अनुसार GPT-5.6 Sol, Terra और Luna संक्रमण अवधि के दौरान उपलब्ध रहेंगे)। Anthropic ने भी Claude Opus 5 (24 जुलाई), Claude Fable 5.1 (1 सितंबर) और Claude Opus 5.5 (22 सितंबर) जारी किए हैं। लागत के लिए Astra (low) और GPT-5.6 Sol (high) की मापी गई तुलना देखें। नीचे के पाठ में «फ्लैगशिप», «शीर्ष स्थान» जैसे शब्द और बेंचमार्क मान लेखन के समय के हैं। 22 सितंबर को हमने यह भी स्पष्ट किया कि DeepSWE पर Luna की किफ़ायत (प्रति डॉलर लगभग 24 अंक) OpenAI के आँकड़ों पर आधारित तीसरे पक्ष का अनुमान है, और उसका स्रोत बताया।
विषय-सूची
- 1. रिलीज़ का सार — तारीख, उपलब्धता और स्पेक्स की सूची
- 2. Luna / Terra / Sol — तीनों मॉडल का अंतर और चुनाव
- 3. कीमत संरचना — एक पायदान नीचे वाला Terra ध्यान देने योग्य
- 4. बेंचमार्क — Claude से सीधी तुलना
- 5. क्या नया है — 5 प्रमुख बिंदु
- 6. ChatGPT प्लान के अनुसार उपलब्धता
- 7. Claude (Fable 5 / Opus 4.8) से तुलना
- 8. सावधानियाँ — अप्रकाशित बेंचमार्क और कोडिंग की कमज़ोरी
- 9. उपयोग के अनुसार सुझाव — कौन-सा मॉडल चुनें
- FAQ
9 जुलाई 2026 को OpenAI ने अपना नया मॉडल परिवार "GPT-5.6" आम तौर पर उपलब्ध करा दिया (OpenAI की आधिकारिक घोषणा, 26 जून के सीमित प्रीव्यू के बाद औपचारिक रिलीज़)। सबसे बड़ी खासियत यह है कि पहले वाले "बेसिक + Pro" के दो-स्तरीय ढाँचे को छोड़कर, इसे Luna (तेज़ · कम लागत) / Terra (संतुलित) / Sol (फ्लैगशिप) यानी तीन-मॉडल व्यवस्था में बदल दिया गया है।
फ्लैगशिप Sol ने कोडिंग एजेंट प्रदर्शन के सूचकांक Artificial Analysis Coding Agent Index में 80 अंक हासिल कर शीर्ष स्थान पाया, और लंबे समय तक चलने वाले वास्तविक कार्य-प्रवाह को मापने वाले Agents' Last Exam में भी 53.6 के साथ Claude Fable 5 (40.5) से 13.1 अंक आगे निकल गया (OpenAI द्वारा प्रकाशित आँकड़े, Vellum द्वारा संकलित)। दूसरी ओर, वास्तविक प्रोडक्शन-स्तरीय कोडिंग के SWE-Bench Pro में Claude Fable 5 का 80.0%, जबकि Sol का 64.6% रहा — यानी कुछ क्षेत्र ऐसे भी हैं जहाँ यह Claude से स्पष्ट रूप से पीछे है (दोनों आँकड़े OpenAI की मूल्यांकन तालिका के हैं; Anthropic के सिस्टम कार्ड में भी Fable 5 का मान 80.0% है; Anthropic की घोषणा की तालिका का 80.3% Mythos 5 के साथ साझा कॉलम के दो मानों में से ऊँचा, यानी Mythos 5 का मान है)।
इस लेख में OpenAI की आधिकारिक घोषणा और कई स्वतंत्र बेंचमार्क रिपोर्टों के आधार पर, GPT-5.6 के तीनों मॉडल का अंतर, कीमत, बेंचमार्क, नई सुविधाएँ, ChatGPT प्लान के अनुसार उपलब्धता, Claude से तुलना और उपयोग के अनुसार चुनाव तक — सब कुछ पुष्ट जानकारी के आधार पर समझाया गया है।
GPT-5.6 रिलीज़
9 जुलाई 2026 आम उपलब्धता शुरू / तीन-मॉडल व्यवस्था
1. रिलीज़ का सार — तारीख, उपलब्धता और स्पेक्स की सूची
| मद | विवरण |
|---|---|
| परिवार का नाम | GPT-5.6 |
| आम उपलब्धता शुरू | 9 जुलाई 2026 (सीमित प्रीव्यू 26 जून) |
| विकासकर्ता | OpenAI |
| पिछली पीढ़ी | GPT-5.5 |
| मॉडल संरचना | Luna (तेज़ · कम लागत) / Terra (संतुलित) / Sol (फ्लैगशिप) — तीन मॉडल |
| कॉन्टेक्स्ट विंडो | लगभग 10 लाख टोकन (1,050,000) * तीनों मॉडल में समान |
| अधिकतम आउटपुट | 128,000 टोकन |
| ज्ञान कट-ऑफ | 16 फरवरी 2026 |
| API कीमत (Sol) | $5 (इनपुट) / $30 (आउटपुट) प्रति 1M टोकन |
| API कीमत (Terra) | $2 (इनपुट) / $12 (आउटपुट) प्रति 1M टोकन |
| API कीमत (Luna) | $0.20 (इनपुट) / $1.20 (आउटपुट) प्रति 1M टोकन |
| रीज़निंग effort | none / low / medium / high / xhigh / max — 6 स्तर |
| उपलब्धता चैनल | ChatGPT / ChatGPT Work / Codex / OpenAI API |
| साथ में घोषित | ChatGPT Work (व्यावसायिक एजेंट), Codex के साथ नया डेस्कटॉप ऐप, वॉइस मॉडल GPT-Live |
मुख्य बात यह है कि तीनों मॉडल एक ही लगभग 10 लाख टोकन का कॉन्टेक्स्ट और 128K का अधिकतम आउटपुट साझा करते हैं। अंतर सिर्फ "समझदारी", "गति" और "कीमत" में है — संभालने योग्य दस्तावेज़ की मात्रा नहीं बदलती। यह डिज़ाइन उपयोग और लागत के अनुसार ऊपर-नीचे चुनने के लिए बना है।
2. Luna / Terra / Sol — तीनों मॉडल का अंतर और चुनाव
GPT-5.6 का सबसे बड़ा बदलाव "दो-स्तर (बेसिक/Pro) → तीन-स्तर" में पुनर्गठन है। आइए हर एक की स्थिति समझते हैं।
सबसे सस्ता और तेज़ मॉडल। सरल वर्गीकरण, सारांश, चैट और बड़े पैमाने पर बैच प्रोसेसिंग के लिए आदर्श। OpenAI के लॉन्च चार्ट में दिए DeepSWE v1.1 स्कोर और अनुमानित API लागत के आधार पर Trilogy AI Center of Excellence (10 जुलाई 2026) ने अनुमान लगाया कि अपने सर्वोच्च स्कोर पर Luna प्रति अनुमानित API डॉलर लगभग 24 अंक देता है, जो Claude Fable 5 के 3.2 से कहीं अधिक है (लागत OpenAI के सिमुलेशन से निकले अनुमान हैं)।
उपयुक्त: उच्च-आवृत्ति · कम-कीमत वाले कार्य, आंतरिक टूल
पिछली पीढ़ी GPT-5.5 के बराबर प्रदर्शन को कहीं कम कीमत पर देने वाला "रोज़मर्रा का पसंदीदा"। TerminalBench 2.1 में 87.4% के साथ Sol के करीब पहुँचते हुए भी यूनिट कीमत Sol की सिर्फ़ 40% (30 जुलाई 2026 की कीमत कटौती के बाद)। कहा जाता है कि अधिकांश व्यावहारिक वर्कलोड के लिए Terra ही पर्याप्त है।
उपयुक्त: रोज़मर्रा की कोडिंग · लेखन · एजेंट
GPT-5.6 परिवार का सबसे समझदार मॉडल। एजेंट की समग्र क्षमता, लंबे कार्य और सुरक्षा में सर्वोच्च स्तर। OpenAI के अनुसार कोडिंग में टोकन दक्षता 54% बढ़ी है, और यह "कम टोकन में फ्रंटियर प्रदर्शन" देता है।
उपयुक्त: जटिल एजेंट, लंबे स्वायत्त कार्य
चुनाव का सिद्धांत सरल है। पहले Terra को डिफ़ॉल्ट बनाएँ, सटीकता कम पड़े तो Sol पर बढ़ें, और कीमत व गति सर्वोपरि हो तो Luna पर उतरें — यह "Terra से शुरुआत" वाली सोच लागत और गुणवत्ता का संतुलन बनाना आसान कर देती है।
3. कीमत संरचना — एक पायदान नीचे वाला Terra ध्यान देने योग्य
| मॉडल | इनपुट / 1M tokens | आउटपुट / 1M tokens | स्थिति |
|---|---|---|---|
| GPT-5.6 Sol | $5.00 | $30.00 | सर्वोच्च प्रदर्शन |
| GPT-5.6 Terra | $2.00 | $12.00 | Sol की 40% यूनिट कीमत में GPT-5.5 समकक्ष |
| GPT-5.6 Luna | $0.20 | $1.20 | सबसे सस्ता · सबसे तेज़ |
ध्यान देने योग्य है Terra का कीमत-बनाम-प्रदर्शन। OpenAI का कहना है कि "Terra पिछली पीढ़ी GPT-5.5 के बराबर प्रदर्शन को लगभग आधी कीमत पर देता है"। यानी अब तक जिन कई कार्यों के लिए Sol (पुराने बेसिक के समकक्ष) की ज़रूरत होती थी, वे आधी लागत में निपट सकते हैं।
वहीं Sol की $5/$30 कीमत Claude Opus 4.8 ($5/$25) की तुलना में इनपुट में बराबर और आउटपुट में थोड़ी अधिक है। फ्लैगशिप स्तर पर हर कंपनी की प्रति-यूनिट कीमत लगभग एक-सी होती जा रही है, और अंतर अब "प्रदर्शन" और "टोकन दक्षता" से तय होने के दौर में है।
4. बेंचमार्क — Claude से सीधी तुलना
GPT-5.6 बेंचमार्क (प्रमुख 4 मद)
Sol / Terra / Luna vs Claude Fable 5
स्रोत: OpenAI की GPT-5.6 घोषणा की मूल्यांकन तालिका (Coding Agent Index — Artificial Analysis; Sol का Agents' Last Exam — घोषणा के पाठ से)। Claude Fable 5 के मान भी OpenAI की तालिका से हैं; Anthropic की अपनी घोषणा SWE-Bench Pro 80.3% और TerminalBench 2.1 88.0% देती है (दोनों ही Mythos 5 के साथ साझा कॉलम के दो मानों में से ऊँचा मान; सिस्टम कार्ड में अकेले Fable 5 के मान 80.0% और 84.3% हैं)
| बेंचमार्क | Sol | Terra | Luna | Claude Fable 5 |
|---|---|---|---|---|
| TerminalBench 2.1 | 88.8% | 87.4% | 84.7% | 83.1% |
| SWE-Bench Pro | 64.6% | 63.4% | 62.7% | 80.0% |
| Agents' Last Exam | 53.6 | 50.4 | 50.3 | 40.5 |
| Coding Agent Index | 80 | 77.4 | 74.6 | 77.2 |
| MRCR लंबे-पाठ रिकॉल | 91.5% | 89.6% | 41.3% | — |
निष्कर्ष: एजेंट में मज़बूत, वास्तविक प्रोडक्शन-स्तरीय कोडिंग में Claude आगे
GPT-5.6 Sol ने एजेंट समग्र क्षमता (Agents' Last Exam) और कोडिंग एजेंट सूचकांक में पहला स्थान हासिल किया। OpenAI की तालिका के अनुसार TerminalBench में भी यह Claude Fable 5 (83.1%) से आगे है। लेकिन SWE-Bench Pro (वास्तविक रिपॉज़िटरी में प्रोडक्शन-स्तरीय बग फ़िक्स) में Claude Fable 5 के 80.0% के मुकाबले Sol 64.6% (Terra 63.4%, Luna 62.7%) रहा — यानी 15 अंक से अधिक के अंतर से पीछे। "एजेंट के रूप में स्वायत्त रूप से काम करने की क्षमता" और "वास्तविक कोडबेस को सटीक रूप से ठीक करने की क्षमता" अलग-अलग चीज़ें हैं — यही इसका सीधा-सादा विश्लेषण है।
साथ ही Luna का लंबे-पाठ रिकॉल (MRCR) 41.3% है, जो Sol/Terra से काफ़ी नीचे गिर जाता है। 10 लाख टोकन की विंडो होने के बावजूद, Luna में बहुत लंबे पाठ को सटीक रूप से संभालना उपयुक्त नहीं है। लंबे पाठ के लिए Terra या उससे ऊपर चुनें।
5. क्या नया है — 5 प्रमुख बिंदु
① दो-स्तरीय ढाँचे से तीन-मॉडल व्यवस्था तक
सबसे बड़ा बदलाव। पुराने "बेसिक + महँगा Pro" से पुनर्गठित होकर अब Luna / Terra / Sol के तीन स्तर हो गए हैं। खासकर Terra "GPT-5.5 समकक्ष को Sol की 40% यूनिट कीमत पर" वाले कीमत-बनाम-प्रदर्शन के साथ लागत डिज़ाइन का मुख्य किरदार बन जाता है।
② टोकन दक्षता में सुधार (कोडिंग में 54%)
OpenAI के CEO सैम ऑल्टमैन ने कहा है कि एजेंटिक कोडिंग कार्यों में Sol की टोकन दक्षता 54% अधिक है (CNBC को दिए इंटरव्यू में; तुलना का आधार नहीं बताया गया)। एक ही काम में यदि खपत होने वाले टोकन कम हो जाएँ, तो प्रति-यूनिट कीमत समान होने पर भी कुल लागत घट जाती है। यही कारण है कि सिर्फ़ कीमत तालिका नहीं, बल्कि "प्रति कार्य वास्तविक लागत" के आधार पर तुलना करनी चाहिए।
③ Programmatic Tool Calling (Responses API)
डेवलपर्स के लिए नई सुविधा के रूप में, मॉडल द्वारा JavaScript जनरेट व एक्ज़ीक्यूट करके टूल कॉल को ऑर्केस्ट्रेट करने वाला "Programmatic Tool Calling" Responses API में जोड़ा गया है (Simon Willison का विश्लेषण)। इससे कई टूल में फैले जटिल एजेंट को कम राउंड-ट्रिप में चलाया जा सकता है। रीज़निंग effort को none / low / medium / high / xhigh / max — इन 6 स्तरों में नियंत्रित किया जाता है।
④ ChatGPT Work · नया डेस्कटॉप ऐप
GPT-5.6 के साथ ही व्यावसायिक एजेंट "ChatGPT Work", Codex के साथ आने वाला नया डेस्कटॉप ऐप, और ग्राहकों के लिए होस्टिंग सेवा भी घोषित की गई। यह ChatGPT को "केवल चैट" से "काम को अंजाम देने वाले प्लेटफ़ॉर्म" तक विस्तारित करने की दिशा में एक कदम है।
⑤ वॉइस मॉडल GPT-Live (फुल-डुप्लेक्स संवाद)
वॉइस के मोर्चे पर नई शृंखला GPT-Live आई। पहले वाली टर्न-आधारित प्रणाली (बात पूरी होने के बाद जवाब) के बजाय, यह फुल-डुप्लेक्स तरीके से इंसान की तरह बीच में टोकने और हाँ-में-हाँ मिलाने वाला संवाद साकार करती है। भुगतान करने वाले उपयोगकर्ताओं को GPT-Live-1 और मुफ़्त उपयोगकर्ताओं को GPT-Live-1 mini मिलता है।
6. ChatGPT प्लान के अनुसार उपलब्धता
| प्लान | मासिक अनुमान | GPT-5.6 का उपयोग | मॉडल चयन |
|---|---|---|---|
| Free | $0 | △ ChatGPT Work / Codex के भीतर केवल Terra | नहीं (Terra निश्चित) |
| Go | $8/माह | △ ChatGPT Work / Codex के भीतर केवल Terra | नहीं (Terra निश्चित) |
| Plus | $20/माह | ✅ Sol / Terra / Luna | हाँ (effort भी सेट कर सकते हैं) |
| Pro | $100–$200/माह | ✅ Sol / Terra / Luna | हाँ (effort भी सेट कर सकते हैं) |
| Business | $25/सीट– | ✅ Sol / Terra / Luna | हाँ (effort भी सेट कर सकते हैं) |
| Enterprise | अनुरोध पर | ✅ Sol / Terra / Luna | हाँ (effort भी सेट कर सकते हैं) |
Free / Go उपयोगकर्ता भी ChatGPT Work या Codex के भीतर Terra का उपयोग कर सकते हैं — यह इसकी खासियत है। हालाँकि मॉडल को स्वतंत्र रूप से चुनने और रीज़निंग effort तक समायोजित करने की सुविधा Plus या उससे ऊपर में ही है। वॉइस वाला GPT-Live मुफ़्त में भी mini संस्करण में उपलब्ध है। (प्लान संरचना · कीमत रिलीज़ के समय की विभिन्न रिपोर्टों पर आधारित। नवीनतम के लिए ChatGPT आधिकारिक मूल्य पृष्ठ देखें।)
7. Claude (Fable 5 / Opus 4.8) से तुलना
GPT-5.6 Sol vs Claude Fable 5 vs Claude Opus 4.8
फ्लैगशिप स्तर पर उपयोग का बँटवारा
संक्षेप में — "एजेंट के रूप में व्यापक रूप से स्वायत्त चलाना हो" तो GPT-5.6 Sol, और "वास्तविक कोडबेस को सटीक रूप से ठीक करना · लंबे समय तक कोडिंग करवाना हो" तो Claude — यही बँटवारा है। कीमत के लिहाज़ से Claude Opus 4.8 ($5/$25) की आउटपुट कीमत Sol ($5/$30) से सस्ती है और कोडिंग गुणवत्ता भी ऊँची है, इसलिए कोडिंग उपयोग में Claude पक्ष की किफ़ायत चमकती है।
8. सावधानियाँ — अप्रकाशित बेंचमार्क और कोडिंग की कमज़ोरी
① कुछ बेंचमार्क OpenAI ने प्रकाशित नहीं किए
स्वतंत्र विश्लेषण (Vellum) ने लॉन्च के तुरंत बाद बताया था कि OpenAI ने SWE-bench Verified · GPQA Diamond · AIME · MMLU · ARC-AGI-2 · FrontierMath प्रकाशित नहीं किए। हालाँकि 22 सितंबर 2026 को देखी गई OpenAI की घोषणा-पृष्ठ की मूल्यांकन तालिका में GPQA Diamond (Sol 94.6%) और FrontierMath (Tier 1–3 में 89%, Tier 4 में 83%) मौजूद हैं। SWE-bench Verified · AIME · MMLU उसमें नहीं हैं, और ARC-AGI-2 में Sol का मान (92.5%) पहली बार 3 सितंबर की GPT-6 Astra घोषणा की तुलना-तालिका में आया। एजेंट-संबंधी सूचकांक ही केंद्र में हैं, और सामान्य रीज़निंग व गणित की तुलना के आँकड़े कम होना — मूल्यांकन के समय इस पर ध्यान देना चाहिए। यह संभावना घटाकर पढ़ना ज़रूरी है कि सिर्फ़ अच्छे आँकड़े ही पेश किए गए हों।
② वास्तविक प्रोडक्शन-स्तरीय कोडिंग में Sol भी कमज़ोर
जैसा पहले बताया, SWE-Bench Pro में Sol 64.6% के मुकाबले Claude Fable 5 का 80.0% (दोनों OpenAI की मूल्यांकन तालिका से)। यदि प्रोडक्शन रिपॉज़िटरी में बग फ़िक्स या PR बनाना मुख्य उद्देश्य है, तो GPT-5.6 के बजाय Claude पर विचार करने का मूल्य है। ध्यान दें कि OpenAI ने यह मान अपनी तालिका में रखा है, पर अलग से एक विश्लेषण भी प्रकाशित किया है जिसके अनुसार SWE-Bench Pro के लगभग 30% कार्यों में खामियाँ हैं (जैसा Vellum बताता है)।
③ Luna लंबे-पाठ प्रोसेसिंग में कमज़ोर
Luna सस्ता और तेज़ होने के साथ-साथ लंबे-पाठ रिकॉल (MRCR) में 41.3% के साथ काफ़ी नीचे है। लंबे स्पेसिफ़िकेशन, लॉग या कोडबेस पूरे-के-पूरे Luna को देने से बचें, और लंबे पाठ को Terra या उससे ऊपर पर सौंपें।
④ ज्ञान कट-ऑफ 16 फरवरी 2026 है
उसके बाद की घटनाएँ प्रशिक्षण में शामिल नहीं हैं। जिन कार्यों में नवीनतम जानकारी चाहिए, उनमें वेब सर्च टूल का साथ में उपयोग अनिवार्य है।
9. उपयोग के अनुसार सुझाव — कौन-सा मॉडल चुनें
- रोज़मर्रा की कोडिंग · लेखन · सारांश
- लागत और गुणवत्ता का संतुलन प्राथमिकता
- "पहले डिफ़ॉल्ट के रूप में उपयोग करने वाला" एक मॉडल
- जटिल स्वायत्त एजेंट संचालन
- लंबे कार्य · सुरक्षा संबंधी काम
- जहाँ सटीकता लागत से अधिक ज़रूरी हो
- उच्च-आवृत्ति · कम-कीमत बड़े पैमाने की प्रोसेसिंग
- वर्गीकरण · निष्कर्षण · छोटी चैट
- छोटे पाठ केंद्रित (लंबे पाठ से बचें)
- प्रोडक्शन रिपॉज़िटरी में बग फ़िक्स · PR
- लंबे समय की स्वायत्त कोडिंग
- सटीकता · सुरक्षा सर्वोपरि
FAQ
Q1. GPT-5.6 कब से उपयोग किया जा सकता है?
9 जुलाई 2026 को आम उपलब्धता शुरू हुई (सीमित प्रीव्यू 26 जून)। इसे ChatGPT, ChatGPT Work, Codex और OpenAI API में उपयोग किया जा सकता है।
Q2. Luna / Terra / Sol में क्या अंतर है?
ये समझदारी, गति और कीमत — इन तीन धुरियों पर ऊपर-नीचे क्रमबद्ध मॉडल हैं। Luna = सबसे सस्ता · सबसे तेज़, Terra = संतुलित (GPT-5.5 समकक्ष, Sol की 40% यूनिट कीमत पर), Sol = सर्वोच्च प्रदर्शन। कॉन्टेक्स्ट (लगभग 10 लाख टोकन) और अधिकतम आउटपुट (128K) तीनों मॉडल में समान हैं। पहले Terra को डिफ़ॉल्ट बनाकर, ज़रूरत के अनुसार Sol/Luna पर जाना सुझाया जाता है।
Q3. क्या मुफ़्त प्लान में भी GPT-5.6 उपयोग कर सकते हैं?
सामान्य चैट में तो नहीं, लेकिन ChatGPT Work या Codex के भीतर Free / Go में भी Terra का उपयोग किया जा सकता है। मॉडल को स्वतंत्र रूप से चुनने या रीज़निंग effort समायोजित करने के लिए Plus ($20/माह) या उससे ऊपर चाहिए। वॉइस वाला GPT-Live मुफ़्त में भी mini संस्करण में उपलब्ध है।
Q4. GPT-5.6 और Claude में कोडिंग में कौन मज़बूत है?
यह सूचकांक पर निर्भर करता है। टर्मिनल संचालन (TerminalBench 2.1) में Sol का 88.8% Claude Fable 5 के 83.1% से आगे है, लेकिन वास्तविक प्रोडक्शन-स्तरीय SWE-Bench Pro में Claude Fable 5 का 80.0% और Sol का 64.6% — यानी Claude बहुत आगे है (सभी मान OpenAI की मूल्यांकन तालिका के; Anthropic के सिस्टम कार्ड में भी SWE-Bench Pro पर Fable 5 का 80.0%)। यदि प्रोडक्शन रिपॉज़िटरी में बग फ़िक्स मुख्य उद्देश्य हो तो Claude, और व्यापक स्वायत्त एजेंट के लिए Sol — इस तरह बाँटकर उपयोग करना व्यावहारिक है।
Q5. कीमत कैसी है?
प्रति 1M टोकन, Sol $5/$30, Terra $2/$12, Luna $0.20/$1.20 (इनपुट/आउटपुट) — अगस्त 2026 तक। 30 जुलाई 2026 को Luna 80% और Terra 20% सस्ता हुआ, जबकि Sol की कीमत अपरिवर्तित रही। Terra, GPT-5.5 समकक्ष प्रदर्शन को Sol की लगभग 40% यूनिट कीमत पर देने की स्थिति में है, और लागत डिज़ाइन का मुख्य किरदार बनता है। ध्यान रहे कि Sol 21 अगस्त 2026 को प्रचार कीमत पर आ गया (इनपुट $4 / आउटपुट $20, तीन महीने चलने की घोषणा के साथ)। वह GPT-6 Astra के मुक़ाबले सस्ता पड़ता है या नहीं, इसकी तुलना मापे गए आँकड़ों से क्या GPT-6 Astra का low सचमुच सस्ता है? में की गई है।
Q6. कॉन्टेक्स्ट विंडो और ज्ञान कट-ऑफ क्या है?
तीनों मॉडल लगभग 10 लाख टोकन (1,050,000) का कॉन्टेक्स्ट और 128K का अधिकतम आउटपुट रखते हैं। ज्ञान कट-ऑफ 16 फरवरी 2026 है।
Q7. क्या डेवलपर्स के लिए नई सुविधाएँ हैं?
Responses API में Programmatic Tool Calling (मॉडल द्वारा JavaScript जनरेट करके टूल कॉल तैयार करने की सुविधा) जोड़ी गई है। रीज़निंग effort को none / low / medium / high / xhigh / max — इन 6 स्तरों में नियंत्रित किया जा सकता है।
Q8. GPT-Live क्या है?
यह GPT-5.6 के साथ ही घोषित की गई नई वॉइस मॉडल शृंखला है। टर्न-आधारित के बजाय फुल-डुप्लेक्स होने के कारण, बीच में टोकने और हाँ-में-हाँ मिलाने सहित प्राकृतिक संवाद संभव है। भुगतान में GPT-Live-1 और मुफ़्त में GPT-Live-1 mini उपलब्ध है।
Q9. क्या कोई ऐसा बेंचमार्क है जो OpenAI ने प्रकाशित नहीं किया?
हाँ। घोषणा की मूल्यांकन तालिका में SWE-bench Verified · AIME · MMLU नहीं हैं। स्वतंत्र विश्लेषण (Vellum) ने लॉन्च के तुरंत बाद बताया था कि GPQA Diamond और FrontierMath भी नहीं हैं, लेकिन 22 सितंबर 2026 को देखी गई तालिका में GPQA Diamond (Sol 94.6%) और FrontierMath मौजूद हैं। चूँकि एजेंट-संबंधी सूचकांक ही केंद्र में हैं, इसलिए सामान्य रीज़निंग व गणित की वास्तविक क्षमता का अलग से मूल्यांकन ज़रूरी है।
Q10. क्या मौजूदा GPT ऐप वैसे ही चलेंगे?
API काफ़ी हद तक संगत है, और मॉडल ID बदलकर माइग्रेट किया जा सकता है। हालाँकि अब तीन-मॉडल व्यवस्था होने के कारण, किस कार्य के लिए Luna/Terra/Sol में से किसे नियुक्त करना है — इसका पुनः डिज़ाइन करने पर लागत और गुणवत्ता को अनुकूलित किया जा सकता है। अधिकांश मामलों में Terra से शुरुआत कारगर रहती है।
निष्कर्ष: तीन-मॉडल व्यवस्था के साथ "ऊपर-नीचे चुनने" के दौर की ओर
GPT-5.6 एकल प्रमुख मॉडल के रूप में नहीं, बल्कि Luna / Terra / Sol के तीन-स्तरीय ढाँचे में आया। Sol एजेंट समग्र क्षमता और कोडिंग एजेंट सूचकांक में शीर्ष पर है, Terra "GPT-5.5 समकक्ष को Sol की 40% यूनिट कीमत पर" वाले कीमत-बनाम-प्रदर्शन के साथ व्यावहारिक मुख्य किरदार बना, और Luna बड़े पैमाने की प्रोसेसिंग में किफ़ायत का किरदार निभाता है — हर एक की भूमिका स्पष्ट है।
दूसरी ओर, वास्तविक प्रोडक्शन-स्तरीय कोडिंग (SWE-Bench Pro) में यह Claude से बड़े अंतर से हारता है, OpenAI की मूल्यांकन तालिका में सामान्य रीज़निंग व गणित की तुलना के आँकड़े कम होना, और Luna की लंबे-पाठ प्रोसेसिंग कमज़ोर होना — ऐसे तत्व भी हैं जिनकी वजह से इसे बिना शर्त सर्वश्रेष्ठ नहीं कहा जा सकता।
2026 का समझदार संचालन आखिरकार यही है कि "कार्य के अनुसार GPT-5.6 के तीनों मॉडल और Claude को बाँटकर इस्तेमाल करें"। रोज़मर्रा में Terra, जटिल एजेंट में Sol, बड़े पैमाने की प्रोसेसिंग में Luna, और प्रोडक्शन कोडिंग में Claude — मल्टी-मॉडल को आधार मानकर लागत और गुणवत्ता को अनुकूलित करते चलें।
संबंधित लेख
- GPT-6 Astra रिलीज़ पूर्ण व्याख्या — GPT-5.6 का उत्तराधिकारी मौजूदा फ्लैगशिप
- GPT-5.5 रिलीज़ पूर्ण व्याख्या — पिछली पीढ़ी GPT-5.5 का विवरण
- Claude Opus 4.8 रिलीज़ पूर्ण व्याख्या — सीधा प्रतिस्पर्धी मॉडल
- Claude Fable 5 रिलीज़ पूर्ण व्याख्या — SWE-Bench Pro में शीर्ष मॉडल
- Claude vs ChatGPT कीमत तुलना — दोनों की प्लान संरचना
- ChatGPT Work क्या है? GPT-5.6 वर्क एजेंट की व्याख्या — दस्तावेज़, शीट और स्लाइड बनाने वाला वर्क एजेंट
- GPT-5.6 vs GPT-5.5 विस्तृत तुलना — एक फ्लैगशिप से Luna/Terra/Sol के 3 मॉडल तक, किस पर जाएँ
- Kimi K3 क्या है? 2.8T पैरामीटर वाला वह मॉडल जिस पर “तीसरे स्थान” का दावा है — कीमत, open weights और बाज़ार पर असर