विषय-सूची
- 1. Sonnet 5.5 एक नज़र में: परफ़ॉर्मेंस, कीमत और माइग्रेशन के जाल
- 2. मुख्य स्पेसिफ़िकेशन और उपलब्धता
- 3. कीमत: cache की न्यूनतम लंबाई छोड़कर Sonnet 5 जैसी ही
- 4. Benchmark: Anthropic की तालिका के भीतर पढ़ें
- 5. Sonnet 5 से आने पर 400 लौटाने वाले 5 ब्रेकिंग बदलाव, और उनके समाधान
- 6. बिना एरर के होने वाले बदलाव
- 7. डिफ़ॉल्ट effort: API पर high, Claude Code में medium
- 8. Sonnet 5.5, Opus 5.5 और Haiku में से चुनना
- 9. Claude Code और GitHub Copilot में इस्तेमाल
- 10. माइग्रेशन के कदम (API उपयोगकर्ताओं के लिए)
- सारांश
- FAQ
28 सितंबर 2026 को Anthropic ने Claude Sonnet 5.5 जारी किया। घोषणा के मुताबिक यह Claude 5.5 परिवार का दूसरा मॉडल है, जो छह दिन पहले आए Opus 5.5 के बाद आया है, और पिछला Sonnet 5 (30 जून 2026 को जारी) अब Legacy (पुराना, पर अब भी उपलब्ध) में चला गया है। आधिकारिक मॉडल सूची इसे गति और बुद्धिमत्ता का सबसे अच्छा मेल वाला मॉडल बताती है।
संक्षेप में: कीमत बिल्कुल Sonnet 5 जितनी है (प्रति 10 लाख टोकन इनपुट $2, आउटपुट $10 और cache रीड $0.20), और Anthropic की तुलना तालिका की ज़्यादातर पंक्तियों में यह Sonnet 5 से काफ़ी आगे है। लेकिन API का बर्ताव अलग है: पाँच ऐसे बदलाव हैं जिनसे Sonnet 5 पर चलने वाला कोड 400 एरर देने लगता है। सबसे अहम यह कि thinking बंद करने के लिए thinking: {"type": "disabled"} अब काम नहीं करता, और उसकी जगह आया between_tools सिर्फ़ effort high या उससे नीचे पर स्वीकार होता है। यह लेख आधिकारिक दस्तावेज़ और घोषणा को मूल पाठ में आपस में मिलाकर, उसी क्रम में समझाता है जिसमें आपको ज़रूरत पड़ेगी: क्या बदला, माइग्रेट करने पर क्या टूटता है, और इसमें और Opus 5.5 में से कैसे चुनें।
29 सितंबर 2026 तक की जानकारी: लॉन्च के अगले दिन लिखा गया, आधिकारिक Claude Platform दस्तावेज़ (Models overview, Sonnet 5.5 का पेज, What's new, माइग्रेशन गाइड, Pricing, Thinking, Effort और Prompt caching), Anthropic की घोषणा, Claude Code के दस्तावेज़ और CHANGELOG, और GitHub का changelog मूल पाठ में पढ़कर। घोषणा के मुताबिक कुछ हफ़्तों में आने वाला Claude Haiku 5.5 इस समय तक जारी नहीं हुआ था।
कीमत वही, 5 ब्रेकिंग बदलाव
— आधिकारिक तौर पर गति और बुद्धिमत्ता का सबसे अच्छा मेल
1. Sonnet 5.5 एक नज़र में: परफ़ॉर्मेंस, कीमत और माइग्रेशन के जाल
Anthropic की तुलना तालिका में यह हर पंक्ति में Sonnet 5 से आगे है और GDPval-AA पर Opus 5.5 से सिर्फ़ 2 अंक पीछे है। फिर भी घोषणा खुद कहती है कि जटिल, खुले छोर वाले काम में Opus 5.5 साफ़ तौर पर ज़्यादा मज़बूत बना हुआ है।
हर दर Sonnet 5 जैसी ही है। बदली है cache की जा सकने वाली न्यूनतम लंबाई, जो 1,024 से घटकर 512 टोकन हो गई। घोषणा कहती है कि यह प्रति काम 30% तक सस्ता है, लेकिन यह Anthropic का अपना माप है।
पाँच बदलाव: thinking बंद करना अब between_tools से / forced tool use पर 400 / thinking blocks मॉडल और बातचीत से बँधे / पुराना computer use tool अस्वीकार / advisor के कुछ जोड़े अस्वीकार। इसके ऊपर, tool calls के बीच का टेक्स्ट अब thinking blocks में लौटता है।
एक वाक्य में, Sonnet 5.5 एक ऐसा Sonnet है जो उसी कीमत पर एक पायदान ऊपर चढ़ा, और जिसे लगभग Opus 5.5 जैसे ही नियमों से संभालना होता है। पाँच ब्रेकिंग बदलावों में से तीन (forced tool use, thinking-block का बंधन और पुराना computer use tool) Opus 5.5 और Fable 5.1 पर भी लागू होते हैं। सिर्फ़ Sonnet 5.5 के लिए खास दो बातें हैं: thinking घटाने का एक रास्ता अलग मान between_tools के रूप में बचा है, और advisor tool के जोड़ों पर पाबंदियाँ हैं।
2. मुख्य स्पेसिफ़िकेशन और उपलब्धता
तुलना में तीन मॉडल हैं: Sonnet 5, जिसकी जगह यह आया है; इसके ऊपर Opus 5.5; और इसके नीचे Haiku 4.5।
| विषय | Sonnet 5.5 | Sonnet 5 (Legacy) | Opus 5.5 | Haiku 4.5 |
|---|---|---|---|---|
| API मॉडल ID | claude-sonnet-5-5 |
claude-sonnet-5 |
claude-opus-5-5 |
claude-haiku-4-5-20251001 |
| कीमत (इनपुट/आउटपुट) | $2 / $10 | $2 / $10 | $4 / $20 | $1 / $5 |
| कॉन्टेक्स्ट / अधिकतम आउटपुट | 1M / 128K | 1M / 128K | 1M / 128K | 200K / 64K |
| Thinking | डिफ़ॉल्ट रूप से adaptive thinking (न्यूनतम between_tools) |
डिफ़ॉल्ट रूप से adaptive thinking (disabled से बंद हो सकती है) |
adaptive thinking हमेशा चालू (बंद नहीं हो सकती) | Extended thinking (बजट के आधार पर) |
| API पर डिफ़ॉल्ट effort | high | high | medium | समर्थित नहीं |
| भरोसेमंद ज्ञान कटऑफ़ | जून 2026 | जनवरी 2026 | जून 2026 | फ़रवरी 2025 |
| cache की न्यूनतम लंबाई | 512 टोकन | 1,024 टोकन | 512 टोकन | 4,096 टोकन |
| गति (आधिकारिक सापेक्ष लेबल) | Fast | — | Moderate | Fastest |
| सेवा समाप्ति | 28 सितंबर 2027 से पहले नहीं | 30 जून 2027 से पहले नहीं | 22 सितंबर 2027 से पहले नहीं | 15 अक्टूबर 2026 से पहले नहीं |
स्रोत: Anthropic, "Models overview", "Claude Sonnet 5.5", "Claude Sonnet 5" और "Prompt caching" (29 सितंबर 2026 को जाँचा गया)। गति मौजूदा मॉडलों के भीतर का सापेक्ष लेबल है और Legacy Sonnet 5 के लिए नहीं दिया गया। सेवा समाप्ति की तारीखें Anthropic के चलाए प्लेटफ़ॉर्म के लिए वादे हैं; Amazon Bedrock और Google Cloud अपनी तारीखें खुद तय करते हैं।
Sonnet 5 से सिर्फ़ तीन पंक्तियाँ अलग हैं: thinking, ज्ञान कटऑफ़ और cache की न्यूनतम लंबाई। कॉन्टेक्स्ट, अधिकतम आउटपुट और API का डिफ़ॉल्ट effort वही हैं, और tokenizer भी Sonnet 5 वाला ही है, इसलिए एक ही टेक्स्ट से उतने ही टोकन बनते हैं (What's new)। Message Batches API पर beta header output-300k-2026-03-24 जोड़ने से आउटपुट की सीमा 300K टोकन हो जाती है (Sonnet 5 जैसा ही)। यह भी ध्यान दें कि temperature, top_p या top_k के गैर-डिफ़ॉल्ट मान भेजने पर 400 आता है। यह Sonnet 5 पर भी सच था, इसलिए यह सिर्फ़ तब मायने रखता है जब आप सीधे Sonnet 4.6 या उससे पुराने मॉडल से आ रहे हों।
कहाँ उपलब्ध है
Claude API (claude-sonnet-5-5), Amazon Bedrock (anthropic.claude-sonnet-5-5), Claude Platform on AWS, Google Cloud और Microsoft Foundry। लॉन्च के दिन ही यह हर प्लेटफ़ॉर्म पर आ गया।
claude.ai और Claude ऐप्स (Anthropic ने Sonnet 5.5 का system prompt प्रकाशित किया है), Claude Code (v2.1.284 और बाद के), और GitHub Copilot (Pro, Pro+, Max, Business और Enterprise)।
pricing पेज पर fast mode (तेज़ संस्करण) सिर्फ़ Opus 5.5, Opus 5 और Opus 4.8 के लिए है; Sonnet 5.5 में यह नहीं है। Bedrock पर Sonnet 5.5 के लिए structured outputs (strict tool use सहित) उपलब्ध नहीं हैं (माइग्रेशन गाइड)।
3. कीमत: cache की न्यूनतम लंबाई छोड़कर Sonnet 5 जैसी ही
आधिकारिक What's new पेज कहता है कि इसकी कीमत Sonnet 5 जितनी है, और prompt caching व batch processing की कीमत भी वही है। विस्तृत दरें ये हैं।
| प्रति 10 लाख टोकन | Sonnet 5.5 | Sonnet 5 | Opus 5.5 | Haiku 4.5 |
|---|---|---|---|---|
| इनपुट | $2 | $2 | $4 | $1 |
| आउटपुट | $10 | $10 | $20 | $5 |
| cache राइट (5 मिनट) | $2.50 | $2.50 | $5 | $1.25 |
| cache राइट (1 घंटा) | $4 | $4 | $8 | $2 |
| cache रीड | $0.20 | $0.20 | $0.20 | $0.10 |
| Batch API (इनपुट/आउटपुट) | $1 / $5 | $1 / $5 | $2 / $10 | $0.50 / $2.50 |
स्रोत: Anthropic, "Pricing" (29 सितंबर 2026 को जाँचा गया)। Batch API पर इनपुट और आउटपुट दोनों सामान्य दरों से 50% सस्ते हैं।
"वही कीमत" के भीतर बदल सकने वाली दो बातें
दरें एक जैसी होने से बिल एक जैसा होगा, इसकी गारंटी नहीं है। दो कारक इसे बदल सकते हैं।
पहला है cache की न्यूनतम लंबाई। Sonnet 5 पर 1,024 टोकन से छोटे prompt, cache_control होने पर भी cache नहीं होते थे। Sonnet 5.5 पर यह सीमा घटकर 512 टोकन हो गई है। उदाहरण के लिए, जो काम हर call में 800 टोकन का system prompt और tool definitions भेजता है, वह Sonnet 5 पर caching के योग्य नहीं था, लेकिन Sonnet 5.5 पर cache होता है। कुछ cache हुआ या नहीं, यह जवाब के usage से पता चलता है: अगर cache_creation_input_tokens और cache_read_input_tokens दोनों 0 हैं, तो कुछ cache नहीं हुआ (आधिकारिक Prompt caching पेज)। न्यूनतम लंबाई से कम होने पर एरर नहीं आता, इसलिए माइग्रेट करते समय ऐसे कामों की जाँच करना फ़ायदेमंद है जिनमें caching चुपचाप लागू ही नहीं हो रही थी।
दूसरा है प्रति काम टोकन की संख्या। घोषणा कहती है कि उसी काम के लिए इसे कहीं कम टोकन चाहिए, Anthropic की जाँच में यह प्रति काम 30% तक सस्ता है, और Sonnet 5 से 30% से ज़्यादा तेज़ी से आउटपुट बनाता है। ये Anthropic के अपने माप हैं। साथ ही, आधिकारिक दस्तावेज़ कहता है कि effort के स्तर दोबारा कैलिब्रेट किए गए हैं, इसलिए ज़रूरी नहीं कि उसी स्तर पर यह उतना ही सोचे जितना Sonnet 5 सोचता था। Thinking के टोकन दिखाए न जाएँ, तब भी आउटपुट टोकन के रूप में बिल होते हैं। माइग्रेशन के बाद पता करने का एकमात्र तरीका है अपने ही काम पर usage मापकर तुलना करना।
हल किया हुआ उदाहरण: एक काम जिसमें 1 करोड़ cache-रीड, 5 लाख इनपुट और 3 लाख आउटपुट टोकन हैं (टोकन संख्याएँ इस लेख की मान्यता हैं; राइट की लागत शामिल नहीं)
- Sonnet 5.5: $2.00 + $1.00 + $3.00 = $6.00 (Sonnet 5 पर भी यही)
- Opus 5.5: $2.00 + $2.00 + $6.00 = $10.00 (Sonnet 5.5 का लगभग 1.7 गुना, 2 गुना नहीं)
- Haiku 4.5: $1.00 + $0.50 + $1.50 = $3.00 (Sonnet 5.5 का ठीक आधा)
यह समान टोकन संख्या पर दरों की तुलना है; असल में हर मॉडल अलग संख्या में टोकन इस्तेमाल करता है। दरें Anthropic के "Pricing" से हैं।
Opus 5.5 से अंतर "2 गुना" नहीं है, क्योंकि सिर्फ़ cache रीड की कीमत Opus 5.5 पर भी वही $0.20 है। किसी agentic काम में cache का हिस्सा जितना ज़्यादा होगा, Sonnet 5.5 चुनने से बचत उतनी कम होगी। सभी Claude मॉडलों की कीमतें Opus, Sonnet और Haiku की कीमतों की हमारी तुलना में हैं।
4. Benchmark: Anthropic की तालिका के भीतर पढ़ें
घोषणा की तुलना तालिका में चार कॉलम हैं: Sonnet 5.5, Sonnet 5, Opus 5.5 और GPT-6 Sol। पहले तालिका की शर्तें देखें।
- तालिका Anthropic की घोषणा से है, और ज़्यादातर पंक्तियाँ Anthropic के अपने माप हैं। अपवाद हैं GDPval-AA v2.1 और AA-Briefcase v1.1, जिन्हें Artificial Analysis ने चलाया (फ़ुटनोट 3)।
- Artificial Analysis ने ये टेस्ट रिलीज़ से पहले के ऐसे परिवेश में चलाए जिसमें एक बग था, जो structured outputs इस्तेमाल करने वाले अनुरोधों के जवाब बिगाड़ सकता था। Anthropic का कहना है कि कोई असर हुआ भी हो तो वह छोटा होगा और स्कोर को कम दिखाएगा, और बताता है कि बग ठीक कर दिया गया है।
- Opus 5.5 का Terminal-Bench 4.0 आँकड़ा xhigh पर है और वह Opus 5.5 का सबसे अच्छा स्कोर है (फ़ुटनोट 1)। Sonnet 5.5 के FrontierCode के दो आँकड़े हैं: max पर 46.2% और xhigh पर 52.1% (फ़ुटनोट 2)।
- GPT-6 Sol के GDPval-AA, AA-Briefcase और Chartography स्कोर के साथ यह टिप्पणी है कि वे OpenAI के इमेज समझने वाले बग को ठीक करने से पहले के हो सकते हैं (फ़ुटनोट 4)।
| Benchmark | Sonnet 5.5 | Sonnet 5 | Opus 5.5 | GPT-6 Sol |
|---|---|---|---|---|
| Terminal-Bench 4.0 टर्मिनल में agentic कोडिंग |
70.6% | 10.3% | 66.4% (xhigh) | — |
| FrontierCode 1.1 (Main) बदलाव merge होते हैं या नहीं |
52.1% (xhigh) 46.2% (max) |
42.4% | 54.4% | 49.3% |
| CursorBench 4.0 अस्पष्ट, कई फ़ाइलों वाले काम |
55.5% | 34.1% | 57.8% | — |
| GDPval-AA v2.1 (Elo) 44 पेशों का असली काम (Artificial Analysis द्वारा) |
1844 | 1449 | 1846 | 1487 |
| AA-Briefcase v1.1 (Elo) लंबी अवधि का ज्ञान-आधारित काम (Artificial Analysis द्वारा) |
1811 | 1359 | 1822 | 1483 |
| Humanity's Last Exam कई विषयों में तर्क (tools के साथ) |
64.5% | 54.9% | 67.7% | — |
| OSWorld 2.1 कंप्यूटर उपयोग (तालिका में "partial" टिप्पणी) |
80.1% | 57.0% | 81.8% | — |
| Chartography चार्ट पढ़ना (tools के बिना) |
61.6% | 15.6% | 64.4% | 53.6% |
स्रोत: Anthropic की "Introducing Claude Sonnet 5.5" की तुलना तालिका और फ़ुटनोट (28 सितंबर 2026; 29 सितंबर को जाँचा गया)। बोल्ड हर पंक्ति का सबसे ऊँचा मान दिखाता है; "—" का मतलब है कि तालिका में मान नहीं है। तरीके का विवरण उसी घोषणा से लिंक किए गए Sonnet 5.5 system card में है।
तीन बातें उभरकर आती हैं।
- Sonnet 5 से छलाँग बड़ी है। Terminal-Bench 4.0 10.3% से 70.6% पर पहुँचा, और Chartography (tools के बिना) 15.6% से 61.6% पर: उसी तालिका के भीतर कई गुना ऊपर। GDPval-AA लगभग 400 अंक बढ़ा।
- ज़्यादातर पंक्तियों में Opus 5.5 से अंतर कुछ ही अंकों का है। GDPval-AA में 2 अंक, CursorBench में 2.3 अंक और OSWorld 2.1 में 1.7 अंक का अंतर है। Terminal-Bench 4.0 पर Sonnet 5.5, Opus 5.5 के सबसे अच्छे स्कोर (xhigh पर 66.4%) से भी आगे है।
- फिर भी Anthropic, Opus 5.5 को इससे ऊपर रखता है। घोषणा कहती है कि benchmark क्षमता का सिर्फ़ एक पहलू पकड़ते हैं, और अंदरूनी तौर पर भी और बाहरी परीक्षकों के बीच भी, लगातार विवेक माँगने वाले जटिल, खुले छोर वाले काम में Opus 5.5 साफ़ तौर पर ज़्यादा मज़बूत बना हुआ है।
effort स्तर के हिसाब से लागत: घोषणा के चार्ट के विवरण से
घोषणा में ऐसे चार्ट भी हैं जो हर effort स्तर के लिए स्कोर को प्रति काम लागत के सामने दिखाते हैं। उनके विवरण में यह लिखा है।
Claude ऐप्स के डिफ़ॉल्ट medium पर, यह प्रति काम दसवें हिस्से से भी कम लागत में Sonnet 5 के सबसे अच्छे स्कोर को साफ़ पीछे छोड़ देता है।
Claude Platform के डिफ़ॉल्ट high पर, यह प्रति काम लगभग पाँचवें हिस्से की लागत में GPT-6 Sol के सबसे अच्छे स्कोर की बराबरी करता है। उसी high स्तर पर Sonnet 5 से 10 अंक ऊपर है, लगभग पंद्रहवें हिस्से की लागत में।
सबसे निचले स्तर low पर, यह प्रति काम दसवें हिस्से से भी कम लागत में Sonnet 5 के सबसे अच्छे स्कोर से आगे निकल जाता है।
medium पर, यह प्रति काम लगभग नौवें हिस्से की लागत में Sonnet 5 के सबसे अच्छे स्कोर से आगे निकल जाता है।
स्रोत: Anthropic की "Introducing Claude Sonnet 5.5" के चार्ट विवरण। Terminal-Bench और CursorBench के चार्ट में GPT-5.6 Sol दिखाया गया है, क्योंकि GPT-6 Sol के स्कोर प्रकाशित नहीं हुए हैं (उसी पेज की टिप्पणी)।
FrontierCode के दो आँकड़ों पर ध्यान देना चाहिए। Sonnet 5.5 का स्कोर max (46.2%) पर xhigh (52.1%) से कम है। Anthropic की घोषणा के फ़ुटनोट के मुताबिक, max पर यह ज़्यादा बार Claude Code की code-review skill चलाता था और काम को कई subagents में बाँटता था, जिससे कुछ मामलों में timeout और काम के दायरे से बाहर के संपादन हुए। effort बढ़ाने से स्कोर हमेशा नहीं बढ़ता, इसलिए स्तर अपने ही काम पर तुलना करके चुनें (खंड 7)। GPT-6 Sol के आँकड़े GPT-6 Sol और Luna की रिलीज़ पर हमारे लेख में हैं।
इसे Opus 5.5 की घोषणा की तालिका से न मिलाएँ: उसी Opus 5.5 के लिए भी Chartography, Opus 5.5 की घोषणा में "tools के साथ" 89.0% और इस तालिका में "tools के बिना" 64.4% दर्ज है, यानी अलग-अलग शर्तों में। अगर आप दोनों घोषणाओं से आँकड़े चुनकर साथ रखेंगे, तो अलग-अलग शर्तों में मापे गए मानों की तुलना कर बैठेंगे। तुलना एक ही तालिका के कॉलमों तक रखें।
5. Sonnet 5 से आने पर 400 लौटाने वाले 5 ब्रेकिंग बदलाव, और उनके समाधान
आधिकारिक What's new in Claude Sonnet 5.5 में Sonnet 5 पर चलने वाले कोड पर असर डालने वाले पाँच ब्रेकिंग बदलाव (breaking changes) दिए गए हैं। हर एक 400 invalid_request_error के साथ विफल होता है।
① thinking बंद करने के लिए disabled की जगह between_tools
Sonnet 5 पर thinking: {"type": "disabled"} किसी भी effort स्तर पर thinking बंद कर देता था। Sonnet 5.5 पर disabled इस संदेश के साथ 400 लौटाता है:
"thinking.type.disabled" is not supported for this model. Use "thinking.type.between_tools" for the lowest thinking setting, or "thinking.type.adaptive" and "output_config.effort" to control thinking behavior.
इसकी जगह है thinking: {"type": "between_tools"}, इस मॉडल की सबसे कम thinking वाली सेटिंग, जो जवाब देने से पहले मॉडल की "शुरुआती thinking" रोक देती है। tools के बिना वाले अनुरोधों में जवाब में सिर्फ़ टेक्स्ट होता है, ठीक वैसे ही जैसे Sonnet 5 पर disabled के साथ होता था। कोई beta header नहीं चाहिए, और यह Sonnet 5.5 देने वाले हर प्लेटफ़ॉर्म पर काम करता है। लेकिन अगर आप इसे disabled की सीधी जगह पर रख देंगे, तो तीन बातें आपको उलझाएँगी।
- effort xhigh और max पर यह 400 लौटाता है।
between_toolsसिर्फ़ low, medium और high पर स्वीकार होता है। जो काम Sonnet 5 पर "xhigh और thinking बंद" के साथ चलते थे, उनमें या तो effort को high या उससे नीचे करना होगा, या thinking बंद करना छोड़ना होगा। - इसके साथ दूसरे फ़ील्ड नहीं भेज सकते।
between_toolsके साथdisplay,budget_tokensयाblock_bindingभेजने पर 400 आता है। - बातचीत के बीच effort नहीं बदल सकते। per-message effort (beta) से अलग स्तर भेजने पर 400 आता है। अगर आप हर बारी में स्तर बदलना चाहते हैं, तो adaptive thinking इस्तेमाल करें (
thinkingछोड़ दें या{"type": "adaptive"}भेजें)।
यह रहा माइग्रेशन गाइड का Python में पहले-और-बाद वाला उदाहरण। ध्यान दें कि "पहले" वाला उदाहरण xhigh इस्तेमाल करता है, इसलिए "बाद" वाले में उसे high पर उतारा गया है।
# Before: Sonnet 5 पर चलता है, Sonnet 5.5 पर 400 client.messages.create( model="claude-sonnet-5", max_tokens=16000, thinking={"type": "disabled"}, output_config={"effort": "xhigh"}, messages=[{"role": "user", "content": "..."}], ) # After: शुरुआती thinking रोकें; effort high या उससे नीचे हो client.messages.create( model="claude-sonnet-5-5", max_tokens=16000, thinking={"type": "between_tools"}, output_config={"effort": "high"}, messages=[{"role": "user", "content": "..."}], )
between_tools के साथ भी, tool calls के बीच मॉडल जो छोटे प्रगति-नोट लिखता है, वे सारांश टेक्स्ट वाले thinking blocks के रूप में लौटते हैं। उन्हें फेंकें नहीं; assistant की बाकी बारी के साथ उन्हें बिना बदले वापस भेजें। आप जो blocks वापस भेजते हैं, उनसे मॉडल को अपने लिखे नोट्स का पूरा टेक्स्ट मिलता है (What's new)। मैन्युअल बजट {"type": "enabled", "budget_tokens": N} अब भी Sonnet 5 की तरह 400 लौटाता है।
② forced tool use पर एरर
tool_choice को {"type": "any"} या {"type": "tool", "name": "..."} पर सेट करने से 400 आता है। token counting API भी यही जाँच लागू करता है। सिर्फ़ auto (डिफ़ॉल्ट) और none की अनुमति है।
tool_choice: type "tool" and "any" are not supported for this model.
समाधान: tool_choice को auto पर रखें और tool definitions में strict: true जोड़ें (strict tool use), या schema को structured outputs में ले जाएँ। auto के साथ मॉडल tool बुलाए बिना टेक्स्ट में जवाब दे सकता है, इसलिए prompt में साफ़ लिखें कि उसे वह tool कब इस्तेमाल करना है। strict tool use, JSON Schema का सिर्फ़ एक हिस्सा स्वीकार करता है, और schema के हर object में additionalProperties: false ज़रूरी है। एक अनुरोध में आप ज़्यादा से ज़्यादा 20 tools को strict बना सकते हैं, और MCP, computer use या browser use toolsets पर strict सेट नहीं किया जा सकता।
# Before: Sonnet 5 पर चलता है, Sonnet 5.5 पर 400 client.messages.create( model="claude-sonnet-5", max_tokens=1024, tools=tools, tool_choice={"type": "tool", "name": "get_weather"}, messages=[{"role": "user", "content": "What's the weather in Paris?"}], ) # After: auto + strict; tool कब इस्तेमाल करना है, यह prompt में लिखें client.messages.create( model="claude-sonnet-5-5", max_tokens=1024, tools=[{**tool, "strict": True} for tool in tools], tool_choice={"type": "auto"}, messages=[{"role": "user", "content": "What's the weather in Paris? Use the get_weather tool."}], )
Amazon Bedrock पर बात अलग है। Bedrock पर Sonnet 5.5 के लिए structured outputs (strict tool use सहित) उपलब्ध नहीं हैं, इसलिए strict के बिना auto भेजें, prompt में लिखें कि tool कब बुलाना है, और tool के इनपुट अपने कोड में जाँचें (माइग्रेशन गाइड)।
③ thinking blocks मॉडल और बातचीत से बँधे हैं
हर thinking block में दर्ज रहता है कि उसे किस मॉडल ने बनाया। Sonnet 5.5 Sonnet 5, Opus 4.8, Haiku 4.5 और पुराने मॉडलों के thinking blocks पढ़ सकता है, लेकिन Opus 5, Opus 5.5, Fable या Mythos के नहीं। और कोई दूसरा मॉडल Sonnet 5.5 के thinking blocks नहीं पढ़ सकता।
- Sonnet 5 से Sonnet 5.5 पर जाने पर पहले का तर्क साथ आ जाता है।
- Sonnet 5.5 से किसी दूसरे मॉडल पर जाने का मतलब है कि स्विच के बाद की बारियाँ Sonnet 5.5 के तर्क के बिना चलती हैं। अनुरोध खुद सफल होता है, और छोड़े गए blocks का बिल नहीं बनता।
Fable 5.1 और Mythos 5.1, Opus 5.5 के thinking blocks पढ़ सकते हैं, लेकिन Sonnet 5.5 के blocks कोई नहीं पढ़ सकता। अगर आप "सिर्फ़ मुश्किल हिस्से Sonnet 5.5 से ऊपर Opus 5.5 को" भेजते हैं, तो यह मानकर टेस्ट करें कि जिस मॉडल पर आप भेजते हैं, वहाँ Sonnet 5.5 का तर्क गायब हो जाता है।
एक जाँच और है: Sonnet 5.5 के thinking block से पहले की हर चीज़ (system, tools और पिछले संदेश) block बनने के बाद बदली है या नहीं। 31 अगस्त 2026, 00:00 UTC को या उसके बाद बने खातों के लिए यह Claude API, Amazon Bedrock और Google Cloud पर डिफ़ॉल्ट रूप से लागू है, और बीच में बदले गए इतिहास के साथ block भेजने पर 400 आता है।
समाधान: बातचीत को सिर्फ़ आगे जोड़कर बढ़ाएँ। निर्देश या tools बदलने हों, तो इतिहास दोबारा लिखने के बजाय बातचीत के बीच वाला system message इस्तेमाल करें (Sonnet 5.5 पर नई उपलब्ध सुविधा, जो Sonnet 5 में नहीं है)। अगर दोबारा लिखना टाला न जा सके, तो beta header thinking-binding-controls-2026-08-01 जोड़ें और thinking.block_binding.prefix_mismatch_behavior को "drop_block" पर सेट करें, ताकि एरर के बजाय प्रभावित blocks छोड़ दिए जाएँ। लेकिन block_binding सिर्फ़ adaptive thinking के साथ काम करता है, इसलिए between_tools के साथ या तो सिर्फ़ आगे जोड़ें, या दोबारा लिखी गई बारी से आगे के thinking blocks खुद हटा दें।
④ Claude API और Google Cloud पर पुराना computer use tool अस्वीकार
Sonnet 5 beta header के साथ पुराने tool computer_20251124 के ज़रिए computer use भी स्वीकार करता था। Claude API और Google Cloud पर Sonnet 5.5 सिर्फ़ toolset computer_toolset_20260801 स्वीकार करता है, और पुराना tool घोषित करने पर 400 आता है। Claude API पर संदेश इस तरह शुरू होता है:
'claude-sonnet-5-5' does not support tool types: computer_20251124.
समाधान: beta header हटाएँ, tools को [{"type": "computer_toolset_20260801"}] से बदलें, और अपने agent loop को toolset के ढाँचे के अनुसार अपडेट करें (सदस्यों के लिए tool_use blocks, एक साथ कई actions, और नतीजों में toolset_name)। अगर आप fine-grained-tool-streaming-2025-05-14 beta header भेजते हैं, तो उसे हटाएँ। toolset के साथ उसे भेजने पर 400 आता है, इसलिए जिस tool को ज़रूरत हो उसमें eager_input_streaming: true जोड़ें। Amazon Bedrock पर पुराना tool अब भी काम करता है, इसलिए वहाँ कोई बदलाव ज़रूरी नहीं।
⑤ advisor tool के कुछ जोड़े अस्वीकार
advisor tool (beta) एक executor मॉडल को किसी ज़्यादा मज़बूत मॉडल से सलाह लेने देता है। जब Sonnet 5.5 executor हो, तो advisor के रूप में Opus 4.8, Opus 4.7, Opus 4.6, Sonnet 5 या Sonnet 4.6 बताने पर 400 आता है। अनुमत advisor हैं Opus 5, Opus 5.5, Sonnet 5.5, Fable 5, Fable 5.1, Mythos 5 और Mythos 5.1।
इसके अलावा, Sonnet 5.5 जिन advisors को स्वीकार करता है, वे सभी अपनी सलाह encrypted advisor_redacted_result block में लौटाते हैं, इसलिए client सलाह का टेक्स्ट नहीं पढ़ सकता। जो कुछ भी सलाह को लॉग करता था या स्क्रीन पर दिखाता था, उसे दोबारा बनाना होगा। "Sonnet 5 executor, Opus 4.8 advisor" जैसे सस्ते जोड़े Sonnet 5.5 पर जैसे के तैसे नहीं चल सकते।
6. बिना एरर के होने वाले बदलाव
पाँचों ब्रेकिंग बदलाव 400 देते हैं, इसलिए वे आपकी नज़र में आ जाएँगे। पेचीदा हैं बर्ताव के वे बदलाव जो कोई एरर नहीं देते।
| बदलाव | क्या होता है / क्या करें |
|---|---|
| tool calls के बीच का टेक्स्ट thinking blocks में चला जाता है | एक-दो वाक्य से लंबे नोट, जैसे "अब मैं X जाँचूँगा", जो Sonnet 5 पर text blocks थे, अब प्रगति वाले thinking blocks में लौटते हैं (छोटी एक-पंक्ति टेक्स्ट ही रहती है)। डिफ़ॉल्ट display: "omitted" के साथ उनकी सामग्री खाली होती है, इसलिए जो UI उपयोगकर्ताओं को प्रगति स्ट्रीम करता था, वह tool calls के दौरान चुप हो जाता है। adaptive thinking के साथ display को "updates" (beta, header thinking-display-updates-2026-08-18) या "summarized" पर सेट करें, और गैर-खाली thinking blocks को उसके बाद आने वाले tool_use से पहले दिखाएँ। between_tools के साथ टेक्स्ट बिना किसी सेटिंग के लौटता है। |
| effort के स्तर दोबारा कैलिब्रेट हुए | ज़रूरी नहीं कि उसी स्तर पर यह उतना ही सोचे जितना Sonnet 5 पर। आधिकारिक सलाह है कि सेटिंग्स जस की तस न ले जाएँ, बल्कि effort दोबारा ट्यून करें (खंड 7)। |
| इनकार की अब पाँच श्रेणियाँ हैं | cyber, bio, frontier_llm, reasoning_extraction और general_harms। इनकार पर stop_reason: "refusal" के साथ HTTP 200 लौटता है, इसलिए stop_details पढ़कर उसे संभालें। सर्वर-साइड fallback (fallbacks: "default", beta, सिर्फ़ Claude API) सिर्फ़ cyber और frontier_llm को Sonnet 5 पर दोबारा आज़माता है। |
| thinking blocks उन्हें बनाने वाले खाते से बँधे हैं | Sonnet 5.5 के thinking blocks सिर्फ़ उन्हें बनाने वाला खाता या उससे जुड़े खाते इस्तेमाल कर सकते हैं। दूसरे खाते से भेजे जाने पर blocks छोड़ दिए जाते हैं और अनुरोध सफल होता है। घोषणा कहती है कि इसमें Claude Code में सेशन के बीच खाता बदलना भी शामिल है। |
| cache की न्यूनतम लंबाई घटी | 512 से 1,023 टोकन के prompt अब cache होते हैं। इससे राइट की लागत जुड़ती है (5 मिनट के लिए इनपुट का 1.25 गुना), जबकि दूसरी call से आप सिर्फ़ रीड की दर देते हैं (खंड 3)। |
स्रोत: What's new in Claude Sonnet 5.5, Migrating to Claude Sonnet 5.5, Anthropic की घोषणा
घोषणा safeguards में हुए बदलाव भी बताती है। Sonnet 5.5 पहला Sonnet है जो cyber safeguards और fallback के साथ आता है, क्योंकि साइबर हमलों में इस्तेमाल हो सकने वाली इसकी क्षमताएँ Opus 5 के स्तर तक पहुँच गई हैं; ज़्यादा जोखिम वाला साइबर सुरक्षा का काम दिखाई देने वाले ढंग से Sonnet 5 पर स्विच हो जाता है। रोज़मर्रा के डेवलपमेंट में bugs ढूँढना और ठीक करना इससे प्रभावित नहीं होता। जीव विज्ञान के safeguards Sonnet 5 जैसे ही हैं।
दूसरी ओर, कुछ सुविधाएँ जोड़ी गईं। per-message effort (beta; prompt cache बनाए रखते हुए स्तर बदलने देता है), बातचीत के बीच system messages और बातचीत के बीच tools बदलना (beta), ये सब Sonnet 5 पर उपलब्ध नहीं थे। What's new में compaction भी है, जो आपके कहने पर बातचीत का सार बनाता है (beta, header compact-2026-09-04), और संदेशों के भीतर tools परिभाषित करना (beta, header inline-tools-2026-09-15)।
7. डिफ़ॉल्ट effort: API पर high, Claude Code में medium
Opus 5.5 ने API पर भी अपना डिफ़ॉल्ट effort medium कर दिया, लेकिन Sonnet 5.5, API का डिफ़ॉल्ट high ही रखता है। वहीं, घोषणा कहती है कि Claude Code और ऐप्स में डिफ़ॉल्ट अब medium है। वही Sonnet 5.5 डिफ़ॉल्ट रूप से API और Claude Code में एक स्तर अलग सोचता है।
आधिकारिक effort पेज Sonnet 5.5 के लिए ये शुरुआती बिंदु सुझाता है:
| काम का प्रकार | शुरुआती स्तर (आधिकारिक सुझाव) | टिप्पणी |
|---|---|---|
| सामान्य काम (नीचे के दो को छोड़कर) | high | API के डिफ़ॉल्ट जैसा ही |
| agentic कोडिंग और कई चरणों वाला tool use | medium से शुरू करें | साफ़ परिभाषित काम के लिए medium; कठिन या लंबे काम के लिए high |
| चैट जैसा latency के प्रति संवेदनशील काम | medium या low | गति को प्राथमिकता |
| xhigh और max | सिर्फ़ तब जब evals बेहतर गुणवत्ता दिखाएँ | between_tools के साथ नहीं जोड़े जा सकते |
स्रोत: Anthropic, "Effort" का "Recommended effort levels for Claude Sonnet 5.5", और माइग्रेशन गाइड
वही पेज यह भी सुझाता है कि max_tokens को thinking और जवाब दोनों के लिए काफ़ी बड़ा रखें, और agentic कोडिंग के लिए max_tokens को इस मॉडल की सीमा 128,000 पर रखें और जवाब streaming से लें। जिन सेटिंग्स में thinking की सामग्री लौटाई नहीं जाती, उनमें भी thinking के टोकन max_tokens में गिने जाते हैं। effort खुद कैसे काम करता है, यह effort सेटिंग पर हमारी गाइड में है, और adaptive thinking adaptive बनाम extended thinking में।
8. Sonnet 5.5, Opus 5.5 और Haiku में से चुनना
आधिकारिक मॉडल सूची अब भी कहती है कि दुविधा हो तो Opus 5.5 से शुरू करें; Sonnet 5.5 शुरुआती बिंदु नहीं बना है। इसके साथ, घोषणा Sonnet 5.5 की ताकत साफ़ दायरे वाले रोज़मर्रा के काम, bug fixes, और दस्तावेज़, स्लाइड व स्प्रेडशीट बनाना बताती है, और Opus 5.5 की सावधान विवेक माँगने वाला जटिल काम। यह भी कहती है कि कम effort पर Sonnet 5.5, Opus 5.5 का सबसे अच्छा पूरक है, और ऊँचे स्तरों पर दोनों मिलती-जुलती लागत में मिलता-जुलता परफ़ॉर्मेंस दे सकते हैं। यानी अगर आप xhigh या max पर चलाते हैं, तो Sonnet 5.5 चुनने से लागत में ज़्यादा फ़ायदा नहीं मिलता।
- आप low से high पर, साफ़ परिभाषित implementation और bug fixes तेज़ी से करना चाहते हैं।
- आप बहुत सारे दस्तावेज़, स्लाइड और स्प्रेडशीट बनाते हैं।
- आप इंतज़ार घटाने के लिए शुरुआती thinking काटना चाहते हैं (
between_tools)। - आप आज Sonnet 5 इस्तेमाल करते हैं (यह उसी कीमत का विकल्प है)।
- खुले छोर वाले डिज़ाइन या रिसर्च में लगातार विवेक चाहिए।
- आप तय नहीं कर पा रहे (आधिकारिक शुरुआती बिंदु)।
- आप ऊँचे effort पर चलाने वाले हैं, जहाँ Sonnet 5.5 से लागत का अंतर घट जाता है।
- आपको fast mode चाहिए (सिर्फ़ Opus में)।
- आपका वॉल्यूम ज़्यादा है और प्रति आइटम लागत सबसे पहले है (Haiku 4.5 की कीमत Sonnet 5.5 की आधी है)।
- 200K टोकन का कॉन्टेक्स्ट काफ़ी है।
- घोषणा कहती है कि Haiku 5.5 कुछ हफ़्तों में आ रहा है।
- Haiku 4.5 की सेवा समाप्ति 15 अक्टूबर 2026 से पहले नहीं है, इसलिए अपनी योजना पहले से जाँच लें।
दुविधा हो तो इस क्रम में चलें: ① अपने काम पर Sonnet 5.5 को medium और high पर चलाएँ → ② कमी लगे तो medium पर Opus 5.5 से तुलना करें → ③ अगर xhigh पर Sonnet 5.5 की लागत लगभग Opus 5.5 जितनी हो, तो Opus 5.5 चुनें। Opus 5.5 का विस्तृत विवरण Opus 5.5 की रिलीज़ पर हमारे लेख में है, और मौजूदा मॉडलों की पूरी सूची प्रमुख AI मॉडल और उनके ज्ञान कटऑफ़ में।
9. Claude Code और GitHub Copilot में इस्तेमाल
Claude Code ने v2.1.284 के CHANGELOG (28 सितंबर 2026) में Sonnet 5.5 जोड़ा और Anthropic API पर इसे डिफ़ॉल्ट Sonnet बना दिया।
Pro, Max, Team, Enterprise और API पर default अब भी Opus 5.5 है। Sonnet 5.5 इस्तेमाल करने के लिए /model sonnet चुनें (या शुरू करते समय claude --model sonnet)। v2.1.284 से पुराने वर्ज़न इसे इस्तेमाल नहीं कर सकते, इसलिए claude update चलाएँ।
sonnet किसकी ओर इशारा करता है, यह provider पर निर्भर हैयह सिर्फ़ Anthropic API पर Sonnet 5.5 बनता है। Claude Platform on AWS पर यह Sonnet 4.6 की ओर, और Bedrock, Google Cloud के Agent Platform और Microsoft Foundry पर Sonnet 4.5 की ओर इशारा करता है। वहाँ पूरा मॉडल नाम चुनें या ANTHROPIC_DEFAULT_SONNET_MODEL सेट करें।
Sonnet 5.5, medium से शुरू होता है। user settings में पुराने ढंग का top-level effortLevel, Opus 5.5 और बाद के मॉडलों पर कोई असर नहीं करता। thinking toggle, alwaysThinkingEnabled और MAX_THINKING_TOKENS=0 का भी Sonnet 5.5 पर कोई असर नहीं होता।
जब कोई safeguard classifier सक्रिय होता है, तो साइबर सुरक्षा का काम Sonnet 5 पर दोबारा चलाया जाता है और सेशन उसी मॉडल पर जारी रहता है (वापस जाने के लिए /model इस्तेमाल करें)। जीव विज्ञान के लिए Sonnet 5.5 का कोई fallback मॉडल नहीं है, इसलिए बात इनकार पर खत्म होती है।
स्रोत: Claude Code, "Model configuration" और CHANGELOG (v2.1.284; 29 सितंबर 2026 को जाँचा गया)
Anthropic API पर Sonnet 5.5 का कॉन्टेक्स्ट हमेशा 10 लाख (1M) टोकन होता है, बिना [1m] प्रत्यय और बिना अतिरिक्त शुल्क के। auto-compact डिफ़ॉल्ट रूप से लगभग 967K टोकन पर चलता है। LLM gateway के ज़रिए (ANTHROPIC_BASE_URL सेट होने पर) कॉन्टेक्स्ट 200K टोकन माना जाता है, इसलिए model picker में "Sonnet 5.5 (1M context)" (sonnet[1m]) चुनें।
योजना Opus को और अमल Sonnet को देने वाला opusplan, Anthropic API पर क्रमशः Opus 5.5 और Sonnet 5.5 पर चलता है। इसका इस्तेमाल opusplan पर हमारी गाइड में है। Claude Code खुद बातचीत को सिर्फ़ आगे जोड़कर बढ़ाता है, इसलिए खंड 5 ③ वाली इतिहास की जाँच से नहीं टकराता (Opus 5.5 की माइग्रेशन गाइड के अनुसार)।
GitHub Copilot
उसी दिन, 28 सितंबर को, GitHub ने अपने changelog में Sonnet 5.5 की सामान्य उपलब्धता (general availability) की घोषणा की। यह Copilot Pro, Pro+, Max, Business और Enterprise पर उपलब्ध है, और VS Code, Visual Studio, Copilot CLI, Copilot coding agent, github.com, JetBrains IDEs, Xcode वगैरह के model picker से चुना जा सकता है। रोलआउट धीरे-धीरे हो रहा है, इसलिए यह तुरंत न दिखे, ऐसा हो सकता है। बिलिंग provider की सूची-कीमत पर उपयोग के आधार पर होती है। Business और Enterprise पर admins Copilot settings की model policy से तय करते हैं कि यह उपलब्ध हो या नहीं।
10. माइग्रेशन के कदम (API उपयोगकर्ताओं के लिए)
माइग्रेशन गाइड की checklist से, Sonnet 5 से आने पर लागू होने वाले बिंदु, काम के क्रम में, ये हैं। Claude Code में इसमें मदद के लिए /claude-api migrate भी है (माइग्रेशन गाइड में बताई गई bundled skill; संपादन से पहले यह आपसे दायरे की पुष्टि करती है)।
- मॉडल ID को
claude-sonnet-5सेclaude-sonnet-5-5में बदलें (Bedrock परanthropic.claude-sonnet-5-5)। thinking: {"type": "disabled"}को{"type": "between_tools"}से बदलें और effort को high या उससे नीचे रखें।tool_choiceमेंanyऔरtoolकोautoऔर strict tool use से बदलें (Bedrock पर सिर्फ़autoइस्तेमाल करें और इनपुट खुद जाँचें)।- अगर आप बातचीत के बीच
system,toolsया पिछले संदेश दोबारा लिखते हैं, तो सिर्फ़ आगे जोड़ने पर आ जाएँ। - अगर आप Claude API या Google Cloud पर computer use इस्तेमाल करते हैं, तो
computer_toolset_20260801पर जाएँ और loop अपडेट करें। - अगर आपका advisor tool, advisor के रूप में Opus 4.8, Opus 4.7, Sonnet 5 जैसा कुछ इस्तेमाल करता है, तो Sonnet 5.5 जिसे स्वीकार करता है उस पर जाएँ, और मानकर चलें कि सलाह encrypted लौटेगी।
- अगर आप स्क्रीन पर प्रगति दिखाते हैं, तो
displayको"updates"या"summarized"पर सेट करें (between_toolsके साथ ज़रूरी नहीं)। stop_reason: "refusal"को संभालें और fallback सेट करें।- अगर आप दूसरे मॉडलों पर route करते हैं, तो यह मानकर टेस्ट करें कि Sonnet 5.5 का तर्क आगे नहीं जाता।
- effort दोबारा ट्यून करें और लागत व latency दोबारा मापें। 1,024 टोकन से छोटे prompts की caching भी जाँचें।
स्रोत: Anthropic, "Migrating to Claude Sonnet 5.5" के "Every starting model" और "Migrating to Claude Sonnet 5.5 from Claude Sonnet 5", काम के क्रम में दोबारा व्यवस्थित
अगर आप सीधे Sonnet 4.6 या उससे पुराने मॉडल से आ रहे हैं, तो आपको उन कामों में भी thinking चलने से निपटना होगा जिनमें thinking तय नहीं की गई थी, बजट और temperature जैसे पैरामीटर पर आने वाले 400, और उसी टेक्स्ट के लिए लगभग 30% ज़्यादा टोकन से भी। अगर आप इसे Claude Managed Agents के ज़रिए इस्तेमाल करते हैं, तो मॉडल नाम के अलावा कुछ बदलने की ज़रूरत नहीं (माइग्रेशन गाइड की टिप्पणी)।
सारांश
Claude Sonnet 5.5 एक ऐसी रिलीज़ है जिसने कीमत बदले बिना परफ़ॉर्मेंस काफ़ी बढ़ाई, और बदले में अपने API नियम Opus 5.5 की ओर खिसका दिए। Anthropic की अपनी तालिका में यह हर पंक्ति में Sonnet 5 से बेहतर हुआ और ज़्यादातर में Opus 5.5 से कुछ ही अंक पीछे रहा। दूसरी ओर, disabled, forced tool use, पुराना computer use tool, दोबारा लिखा गया इतिहास और advisor के कुछ जोड़े अब 400 एरर देते हैं।
सबसे आसानी से छूटने वाली बातें हैं कि thinking बंद करने की जगह आया between_tools सिर्फ़ high या उससे नीचे पर स्वीकार होता है, और यह बेमेल कि डिफ़ॉल्ट effort API पर high है लेकिन Claude Code में medium। API पर effort साफ़ तौर पर सेट करें; Claude Code में /model sonnet से चुनें और फिर effort का स्तर जाँचें। यह सचमुच सस्ता हुआ या नहीं, इसे इकाई कीमतों से नहीं, usage से मापें।
आखिर में, benchmark के आँकड़े उस तालिका में, उन शर्तों के तहत मापे गए मान हैं। Anthropic खुद लिखता है कि जटिल, खुले छोर वाले काम में Opus 5.5 साफ़ तौर पर ज़्यादा मज़बूत बना हुआ है। शुरुआत अपने ही काम पर Sonnet 5.5 को medium और high पर तुलना करके करें।
FAQ
Q. क्या Sonnet 5.5, Sonnet 5 से महँगा है?
A. दरें हर मद में एक जैसी हैं (इनपुट $2, आउटपुट $10, cache रीड $0.20, और Batch API पर आधी कीमत)। Anthropic कहता है कि यह प्रति काम 30% तक सस्ता है, लेकिन यह उसका अपना माप है। क्योंकि effort के स्तर दोबारा कैलिब्रेट हुए हैं, माइग्रेशन के बाद usage से जाँचें।
Q. क्या thinking बंद करने का कोई तरीका है?
A. API पर thinking: {"type": "between_tools"} शुरुआती thinking रोक देता है। tools के बिना वाले अनुरोधों में जवाब में सिर्फ़ टेक्स्ट होता है। लेकिन effort xhigh और max पर यह 400 लौटाता है, और tool calls के बीच के प्रगति-नोट thinking blocks में लौटते हैं। Claude Code में thinking बंद करने वाली सेटिंग्स का Sonnet 5.5 पर कोई असर नहीं होता।
Q. मैंने मॉडल ID बदली और 400 एरर आया।
A. कौन-सा बदलाव है, यह एरर संदेश से पता चलता है। "thinking.type.disabled" का मतलब thinking सेटिंग, tool_choice: type "tool" and "any" का मतलब forced tool use, और computer_20251124 का मतलब पुराना computer use tool। अगर यह between_tools इस्तेमाल करते हुए हो, तो देखें कि effort xhigh या उससे ऊपर तो नहीं, या आप उसके साथ display जैसे फ़ील्ड तो नहीं भेज रहे। अगर आप advisor tool इस्तेमाल करते हैं, तो advisor मॉडल पर शक करें; अगर बातचीत के बीच इतिहास दोबारा लिखते हैं, तो thinking-block की जाँच पर (खंड 5 ③)।
Q. Claude Code, Sonnet 5.5 इस्तेमाल नहीं कर रहा।
A. डिफ़ॉल्ट मॉडल Opus 5.5 है, इसलिए /model sonnet से चुनें। अगर फिर भी Sonnet 5 है, तो आपका वर्ज़न v2.1.284 से पुराना है, इसलिए claude update चलाएँ। Bedrock, Google Cloud, Claude Platform on AWS और Microsoft Foundry पर sonnet किसी पुराने Sonnet की ओर इशारा करता है, इसलिए पूरा मॉडल नाम चुनें या ANTHROPIC_DEFAULT_SONNET_MODEL सेट करें।
Q. डिफ़ॉल्ट Opus 5.5 रखूँ या Sonnet 5.5?
A. आधिकारिक शुरुआती बिंदु Opus 5.5 है। अगर आपका काम मुख्य रूप से low से high effort पर चलने वाला साफ़ दायरे का implementation, bug fixes और दस्तावेज़ बनाना है, तो Sonnet 5.5 की लागत प्रति इनपुट और आउटपुट टोकन आधी है। अगर आप xhigh या max पर चलाते हैं, तो घोषणा के मुताबिक लागत का अंतर घट जाता है, इसलिए दोनों की तुलना अपने ही काम पर करें।
* इस लेख के आँकड़े इन पर आधारित हैं: Anthropic की आधिकारिक घोषणा "Introducing Claude Sonnet 5.5" (benchmark उसी पेज की तुलना तालिका और चार्ट विवरण से), आधिकारिक दस्तावेज़ "Models overview", "Claude Sonnet 5.5", "What's new in Claude Sonnet 5.5", "Migrating to Claude Sonnet 5.5", "Pricing", "Thinking", "Effort" और "Prompt caching", Claude Code का "Model configuration" और CHANGELOG, और GitHub का changelog (सभी 29 सितंबर 2026 को जाँचे गए)। स्पेसिफ़िकेशन और कीमतें बदल सकती हैं, इसलिए अंतिम जानकारी आधिकारिक दस्तावेज़ में पक्की कर लें।
संबंधित लेख: Claude Opus 5.5 की रिलीज़ का विवरण, Claude Fable 5.1 के ब्रेकिंग बदलाव और माइग्रेशन, Claude की कीमतों की तुलना।