Claude का उपयोग करते समय सबसे पहले जो सवाल आता है वह है: "Opus, Sonnet, या Haiku — कौन सा चुनें?"

तीनों मॉडल की API कीमतों में 5 गुना तक का अंतर है, और प्रदर्शन में भी स्पष्ट फ़र्क दिखता है। लेकिन सबसे महंगा मॉडल हमेशा सबसे अच्छा विकल्प नहीं होता। कुछ कार्यों के लिए Haiku अधिक व्यावहारिक हो सकता है, जबकि अन्य में वाकई Opus की ज़रूरत होती है।

यह लेख जून 2026 तक की नवीनतम कीमतों, प्रदर्शन और स्पीड की तुलना प्रस्तुत करता है, साथ ही प्रत्येक कार्य की अनुमानित लागत भी बताता है।

1. तीन मॉडल एक नज़र में

Claude के तीन मॉडल: स्थिति और विशेषताएं

उच्च प्रदर्शन, अधिक लागत ← → तेज़ और किफ़ायती

Opus 4.8
फ्लैगशिप
जटिल कोडिंग
वैज्ञानिक तर्क
एजेंट ऑर्केस्ट्रेशन
10 लाख टोकन कॉन्टेक्स्ट
$5 / $25
Sonnet 4.6
संतुलित
दैनिक कोडिंग
लेखन और विश्लेषण
गणित और डेटा
10 लाख टोकन कॉन्टेक्स्ट
$3 / $15
Haiku 4.5
तेज़ और किफ़ायती
चैटबॉट
वर्गीकरण और टैगिंग
बैच प्रोसेसिंग
2 लाख टोकन कॉन्टेक्स्ट
$1 / $5

प्रति दस लाख टोकन मूल्य (इनपुट / आउटपुट)

मॉडलस्थितिरिलीज़संक्षेप में
Opus 4.8फ्लैगशिपफ़रवरी 2026सबसे बुद्धिमान। एजेंट और जटिल कोडिंग के लिए
Sonnet 4.6संतुलितफ़रवरी 2026स्पीड-बुद्धिमत्ता का सर्वश्रेष्ठ संतुलन। दैनिक उपयोग के लिए
Haiku 4.5तेज़ और किफ़ायतीअक्टूबर 2025सबसे तेज़। हाई-वॉल्यूम और रियल-टाइम कार्यों के लिए

ये नाम साहित्यिक रचनाओं की लंबाई को दर्शाते हैं। ओपस (एक बड़ी कृति) सबसे गहन सोच का प्रतिनिधित्व करता है, सॉनेट (14 पंक्तियों की कविता) संतुलित गहराई देता है, और हाइकू (3 पंक्तियों की कविता) त्वरित और संक्षिप्त उत्तर प्रदान करता है।

2. API मूल्य तुलना

कीमतें बदल सकती हैं। नवीनतम सटीक आंकड़े हमेशा Anthropic के आधिकारिक प्राइसिंग पेज पर देखें (यह लेख जून 2026 का है)।

API मूल्य तुलना (प्रति दस लाख टोकन)

Opus 4.8
इनपुट$5
आउटपुट$25
बैच इनपुट$2.50
बैच आउटपुट$12.50
कैश हिट$0.50
आउटपुट लागत 5×
Sonnet 4.6
इनपुट$3
आउटपुट$15
बैच इनपुट$1.50
बैच आउटपुट$7.50
कैश हिट$0.30
आउटपुट लागत 3×
Haiku 4.5
इनपुट$1
आउटपुट$5
बैच इनपुट$0.50
बैच आउटपुट$2.50
कैश हिट$0.10
आउटपुट लागत 1× (आधार)
बैच + कैश मिलाकर लागत में 95% तक की कमी संभव
कैश हिट = इनपुट लागत का 1/10, बैच = मानक मूल्य का आधा

मानक मूल्य (प्रति दस लाख टोकन)

मॉडलइनपुटआउटपुटबैच इनपुटबैच आउटपुटकैश हिट
Opus 4.8$5$25$2.50$12.50$0.50
Sonnet 4.6$3$15$1.50$7.50$0.30
Haiku 4.5$1$5$0.50$2.50$0.10

सबसे महंगे (Opus आउटपुट $25/MTok) और सबसे सस्ते (Haiku आउटपुट $5/MTok) के बीच 5 गुना का अंतर है। हालांकि, Opus 4.8 अपने पिछले संस्करण से 3 गुना सस्ता है (Opus 4.1 की कीमत $75/MTok थी)।

लागत कम करने के उपाय

Batch API लागत को आधा कर देता है, और कैश हिट इनपुट लागत को 1/10 तक कम कर देता है। दोनों को मिलाकर 95% तक की बचत संभव है। अगर आप हाई-वॉल्यूम प्रोसेसिंग कर रहे हैं, तो पहले इन विकल्पों को ज़रूर देखें।

"टोकन" क्या है?

API मूल्य "टोकन" पर आधारित है। अंग्रेज़ी में लगभग 1 शब्द ≈ 1.3 टोकन। दस लाख टोकन लगभग 7,50,000 शब्द होते हैं — यानी करीब 10 औसत लंबाई के उपन्यास।

3. सब्सक्रिप्शन प्लान

मासिक सब्सक्रिप्शन API पे-एज़-यू-गो की तुलना में बिल्कुल अलग मूल्य संरचना प्रदान करते हैं।

प्लानकीमतउपलब्ध मॉडलडिफ़ॉल्ट
Free$0केवल Sonnet 4.5Sonnet 4.5
Pro$20/माहसभी मॉडलSonnet 4.6
Max 5x$100/माहसभी मॉडलOpus 4.8
Max 20x$200/माहसभी मॉडलOpus 4.8

सब्सक्रिप्शन "असीमित" नहीं हैं, इनमें उपयोग सीमाएं होती हैं। फिर भी, ये API मूल्य से काफ़ी सस्ते हैं। एक उपयोगकर्ता की रिपोर्ट के अनुसार उन्होंने 8 महीने में 10 अरब टोकन इस्तेमाल किए — API दरों पर यह $15,000+ होता, लेकिन उनके Max सब्सक्रिप्शन की लागत लगभग $800 रही (≈19 गुना का अंतर)।

Claude Code में मॉडल बदलना

Claude Code में आप लॉन्च के समय claude --model opus या claude --model sonnet से मॉडल बदल सकते हैं, या सेशन के बीच में /model sonnet से। Pro का डिफ़ॉल्ट Sonnet है, Max का Opus। Claude Code के बारे में अधिक जानने के लिए Claude Chat बनाम Cowork बनाम Code देखें।

4. प्रदर्शन बेंचमार्क

बेंचमार्कक्या मापता हैOpus 4.8Sonnet 4.6अंतर
SWE-bench Verifiedकोडिंग क्षमता88.6%79.6%+9.0 अंक
GPQA Diamondवैज्ञानिक तर्क93.6%74.1%+19.5 अंक

मौजूदा फ्लैगशिप Opus 4.8 हर मोर्चे पर Sonnet 4.6 से आगे है: कोडिंग (SWE-bench Verified) में करीब 9 अंक और स्नातकोत्तर-स्तरीय विज्ञान (GPQA Diamond) में लगभग 19 अंक की बढ़त के साथ। सबसे कठिन तर्क और स्वायत्त कोडिंग कार्यों के लिए Opus स्पष्ट विकल्प है।

इसके बावजूद, Sonnet 4.6 रोज़मर्रा की कोडिंग में बेहद करीब पहुँच जाता है, वह भी कीमत के एक अंश पर, जो इसे अधिकांश प्रोडक्शन ट्रैफ़िक के लिए बेहतर डिफ़ॉल्ट विकल्प बनाता है। Opus 4.8 के पूर्ण बेंचमार्क विवरण के लिए, Opus 4.8 रिलीज़ की विस्तृत समीक्षा देखें।

Haiku 4.5 के आधिकारिक बेंचमार्क सीमित हैं, लेकिन Anthropic इसे "निकट-अग्रणी बुद्धिमत्ता" वाला मानता है। सीधे-सादे कार्यों के लिए यह सबसे कम लागत पर Sonnet-स्तरीय सटीकता के करीब पहुँच जाता है।

5. स्पीड और कॉन्टेक्स्ट विंडो

मॉडलस्पीड (अनुमानित)कॉन्टेक्स्ट विंडोअधिकतम आउटपुट
Opus 4.8~20–30 टोकन/सेकंड10 लाख टोकन1,28,000 टोकन
Sonnet 4.6~40–60 टोकन/सेकंड10 लाख टोकन64,000 टोकन
Haiku 4.5Sonnet से 2–5 गुना तेज़2 लाख टोकन64,000 टोकन

Haiku की सबसे बड़ी ताक़त स्पीड है। इसका टाइम-टू-फ़र्स्ट-टोकन (TTFT) सबसे कम है, जो रियल-टाइम चैटबॉट और ऑटोकम्पलीट जैसी सुविधाओं के लिए आदर्श है।

Opus 10 लाख टोकन की कॉन्टेक्स्ट विंडो प्रदान करता है (लगभग 10–20 उपन्यास), जो पूरे कोडबेस को एक बार में प्रोसेस करने जैसे कार्यों के लिए उपयोगी है। इसका 1,28,000 टोकन का अधिकतम आउटपुट Sonnet/Haiku से दोगुना है, जो एक बार में लंबे दस्तावेज़ तैयार करने के लिए उपयुक्त है।

6. उपयोग के अनुसार लागत अनुमान

यहां बताया गया है कि मानक API दरों पर (बिना कैशिंग या बैचिंग के) सामान्य कार्यों की लागत कितनी होती है।

परिदृश्य 1: 2,000 शब्दों का लेख तैयार करना

इनपुट: ~1,000 टोकन, आउटपुट: ~2,700 टोकन

मॉडलइनपुट लागतआउटपुट लागतकुल
Opus 4.8$0.005$0.068~$0.07
Sonnet 4.6$0.003$0.041~$0.04
Haiku 4.5$0.001$0.014~$0.02

परिदृश्य 2: कोड फ़ाइल पढ़कर रीफैक्टर करना

इनपुट: ~10,000 टोकन (कोड + निर्देश), आउटपुट: ~5,000 टोकन

मॉडलइनपुट लागतआउटपुट लागतकुल
Opus 4.8$0.05$0.125~$0.18
Sonnet 4.6$0.03$0.075~$0.11
Haiku 4.5$0.01$0.025~$0.04

परिदृश्य 3: चैटबॉट — प्रतिदिन 1,000 प्रश्न

200 इनपुट टोकन + 300 आउटपुट टोकन प्रति प्रश्न × 1,000

मॉडलदैनिक लागतमासिक (30 दिन)
Opus 4.8$8.50$255
Sonnet 4.6$5.10$153
Haiku 4.5$1.70$51

चैटबॉट जैसे हाई-वॉल्यूम परिदृश्यों में, Haiku और Opus के बीच मासिक अंतर $200 से अधिक होता है। एक व्यावहारिक तरीका है Haiku को डिफ़ॉल्ट रखना और केवल जटिल प्रश्नों को Sonnet या Opus पर भेजना।

7. आपको कौन सा मॉडल चुनना चाहिए?

मॉडल चयन फ़्लोचार्ट

कार्य कैसा है?
जटिल / सटीक
Opus 4.8
बड़ा रीफैक्टरिंग
शैक्षणिक विश्लेषण
एजेंट ऑर्केस्ट्रेशन
जटिल तर्क
$5 / $25 MTok
सामान्य / दैनिक
Sonnet 4.6
दैनिक कोडिंग
लेखन
डेटा विश्लेषण
Claude Code डेव
$3 / $15 MTok
हाई वॉल्यूम / तेज़
Haiku 4.5
चैटबॉट
वर्गीकरण
बैच प्रोसेसिंग
रियल-टाइम उत्तर
$1 / $5 MTok
संदेह हो तो: Sonnet से शुरू करें। ज़रूरत पर Opus या Haiku पर जाएं
उपयोगअनुशंसितकारण
दैनिक कोडिंग और लेखनSonnet 4.6Opus की कोडिंग गुणवत्ता का 98%, 40% सस्ता, 2 गुना तेज़
बड़े पैमाने का रीफैक्टरिंगOpus 4.810 लाख कॉन्टेक्स्ट विंडो और 1,28,000 आउटपुट यहां काम आते हैं
शैक्षणिक विश्लेषणOpus 4.8GPQA में 17 अंक का अंतर। गहन तर्क का विकल्प नहीं
चैटबॉट और सहायताHaiku 4.5सबसे तेज़ + सबसे सस्ता। मानक उत्तरों के लिए बिल्कुल सही
बैच प्रोसेसिंगHaiku 4.51/5 लागत, वॉल्यूम को कुशलता से संभालता है
Claude Code डेवलपमेंटSonnet 4.6Pro प्लान पर्याप्त है। जटिल आर्किटेक्चर के लिए ही Opus पर स्विच करें

व्यावहारिक सलाह

जब संदेह हो, तो Sonnet से शुरू करें। अधिकांश कार्य यह अच्छे से संभाल लेता है। जब Sonnet की गुणवत्ता अपर्याप्त लगे तभी Opus पर जाएं, और सरल, दोहराव वाले कार्यों के लिए Haiku पर आएं। यह स्तरबद्ध दृष्टिकोण सर्वश्रेष्ठ लागत-प्रदर्शन अनुपात देता है।

अक्सर पूछे जाने वाले प्रश्न

Opus और Sonnet के बीच कोडिंग प्रदर्शन में कितना अंतर है?

SWE-bench Verified (एक कोडिंग बेंचमार्क) पर Opus 4.8 का स्कोर 80.8% और Sonnet 4.6 का 79.6% है — अंतर केवल 1.2 अंक। रोज़मर्रा की कोडिंग में यह फ़र्क मुश्किल से नज़र आता है। लागत के अंतर ($25 बनाम $15/MTok आउटपुट) को देखते हुए, Sonnet बेहतर मूल्य प्रदान करता है। हालांकि, बड़े पैमाने के आर्किटेक्चर डिज़ाइन और जटिल तर्क कार्यों में Opus की स्पष्ट बढ़त है।

सब्सक्रिप्शन सस्ता है या API पे-एज़-यू-गो?

नियमित उपयोग के लिए, सब्सक्रिप्शन API मूल्य से काफ़ी सस्ते हैं — Pro प्लान ($20/माह) की तुलना में समकक्ष API उपयोग पर $180+ प्रति माह खर्च होगा (≈9 गुना), और ऊपर दिए Max उदाहरण में यह ≈19 गुना तक पहुँचता है। API मूल्य तभी उपयुक्त है जब बहुत कम उपयोग हो या विशिष्ट बैच प्रोसेसिंग करनी हो। ChatGPT मूल्य से तुलना के लिए Claude बनाम ChatGPT मूल्य तुलना देखें।

Haiku 4.5 कितना "स्मार्ट" है?

Anthropic इसे "निकट-अग्रणी बुद्धिमत्ता" वाला बताता है। आधिकारिक बेंचमार्क सीमित हैं, लेकिन सामग्री वर्गीकरण, सारांश, और प्रश्न-उत्तर जैसे सीधे कार्यों के लिए इसकी सटीकता Sonnet-स्तरीय होने की उम्मीद है। जटिल तर्क या लंबे कोड जनरेशन में Sonnet/Opus से अंतर स्पष्ट होता है। 1/5 लागत पर, जहां "बड़े पैमाने पर पर्याप्त गुणवत्ता" प्राथमिकता हो, वहां यह उत्कृष्ट है।

क्या Opus 4.8 पिछले Opus मॉडल से सस्ता है?

हां, काफ़ी सस्ता। Opus 4.1 आउटपुट के लिए $75/MTok चार्ज करता था, जबकि Opus 4.8 $25/MTok लेता है — 3 गुना कम, और प्रदर्शन भी बेहतर है। कॉन्टेक्स्ट विंडो भी 2 लाख से बढ़कर 10 लाख टोकन (5 गुना वृद्धि) हो गई है, जिससे कुल मिलाकर मूल्य प्रस्ताव काफ़ी बेहतर है।