28 सितंबर 2026 को Anthropic ने Claude Sonnet 5.5 जारी किया। घोषणा के मुताबिक यह Claude 5.5 परिवार का दूसरा मॉडल है, जो छह दिन पहले आए Opus 5.5 के बाद आया है, और पिछला Sonnet 5 (30 जून 2026 को जारी) अब Legacy (पुराना, पर अब भी उपलब्ध) में चला गया है। आधिकारिक मॉडल सूची इसे गति और बुद्धिमत्ता का सबसे अच्छा मेल वाला मॉडल बताती है।

संक्षेप में: कीमत बिल्कुल Sonnet 5 जितनी है (प्रति 10 लाख टोकन इनपुट $2, आउटपुट $10 और cache रीड $0.20), और Anthropic की तुलना तालिका की ज़्यादातर पंक्तियों में यह Sonnet 5 से काफ़ी आगे है। लेकिन API का बर्ताव अलग है: पाँच ऐसे बदलाव हैं जिनसे Sonnet 5 पर चलने वाला कोड 400 एरर देने लगता है। सबसे अहम यह कि thinking बंद करने के लिए thinking: {"type": "disabled"} अब काम नहीं करता, और उसकी जगह आया between_tools सिर्फ़ effort high या उससे नीचे पर स्वीकार होता है। यह लेख आधिकारिक दस्तावेज़ और घोषणा को मूल पाठ में आपस में मिलाकर, उसी क्रम में समझाता है जिसमें आपको ज़रूरत पड़ेगी: क्या बदला, माइग्रेट करने पर क्या टूटता है, और इसमें और Opus 5.5 में से कैसे चुनें।

29 सितंबर 2026 तक की जानकारी: लॉन्च के अगले दिन लिखा गया, आधिकारिक Claude Platform दस्तावेज़ (Models overview, Sonnet 5.5 का पेज, What's new, माइग्रेशन गाइड, Pricing, Thinking, Effort और Prompt caching), Anthropic की घोषणा, Claude Code के दस्तावेज़ और CHANGELOG, और GitHub का changelog मूल पाठ में पढ़कर। घोषणा के मुताबिक कुछ हफ़्तों में आने वाला Claude Haiku 5.5 इस समय तक जारी नहीं हुआ था।

CLAUDE SONNET 5.5 — 2026.09.28

कीमत वही, 5 ब्रेकिंग बदलाव

— आधिकारिक तौर पर गति और बुद्धिमत्ता का सबसे अच्छा मेल

मॉडल ID
claude-sonnet-5-5
तारीख वाला प्रत्यय नहीं (आधिकारिक मॉडल सूची)
कीमत (प्रति 10 लाख टोकन)
$2 / $10
Sonnet 5 जितनी ही (आधिकारिक pricing पेज)
डिफ़ॉल्ट effort
API पर high
Claude Code और ऐप्स में medium (आधिकारिक दस्तावेज़ और घोषणा)
सावधान
5 ब्रेकिंग बदलाव
आधिकारिक तौर पर breaking changes के रूप में सूचीबद्ध
स्रोत: Anthropic की आधिकारिक घोषणा और Claude Platform दस्तावेज़ (28 सितंबर 2026)

1. Sonnet 5.5 एक नज़र में: परफ़ॉर्मेंस, कीमत और माइग्रेशन के जाल

① परफ़ॉर्मेंस

Anthropic की तुलना तालिका में यह हर पंक्ति में Sonnet 5 से आगे है और GDPval-AA पर Opus 5.5 से सिर्फ़ 2 अंक पीछे है। फिर भी घोषणा खुद कहती है कि जटिल, खुले छोर वाले काम में Opus 5.5 साफ़ तौर पर ज़्यादा मज़बूत बना हुआ है।

② कीमत

हर दर Sonnet 5 जैसी ही है। बदली है cache की जा सकने वाली न्यूनतम लंबाई, जो 1,024 से घटकर 512 टोकन हो गई। घोषणा कहती है कि यह प्रति काम 30% तक सस्ता है, लेकिन यह Anthropic का अपना माप है।

③ माइग्रेशन के जाल

पाँच बदलाव: thinking बंद करना अब between_tools से / forced tool use पर 400 / thinking blocks मॉडल और बातचीत से बँधे / पुराना computer use tool अस्वीकार / advisor के कुछ जोड़े अस्वीकार। इसके ऊपर, tool calls के बीच का टेक्स्ट अब thinking blocks में लौटता है।

एक वाक्य में, Sonnet 5.5 एक ऐसा Sonnet है जो उसी कीमत पर एक पायदान ऊपर चढ़ा, और जिसे लगभग Opus 5.5 जैसे ही नियमों से संभालना होता है। पाँच ब्रेकिंग बदलावों में से तीन (forced tool use, thinking-block का बंधन और पुराना computer use tool) Opus 5.5 और Fable 5.1 पर भी लागू होते हैं। सिर्फ़ Sonnet 5.5 के लिए खास दो बातें हैं: thinking घटाने का एक रास्ता अलग मान between_tools के रूप में बचा है, और advisor tool के जोड़ों पर पाबंदियाँ हैं।

2. मुख्य स्पेसिफ़िकेशन और उपलब्धता

तुलना में तीन मॉडल हैं: Sonnet 5, जिसकी जगह यह आया है; इसके ऊपर Opus 5.5; और इसके नीचे Haiku 4.5।

विषय Sonnet 5.5 Sonnet 5 (Legacy) Opus 5.5 Haiku 4.5
API मॉडल ID claude-sonnet-5-5 claude-sonnet-5 claude-opus-5-5 claude-haiku-4-5-20251001
कीमत (इनपुट/आउटपुट) $2 / $10 $2 / $10 $4 / $20 $1 / $5
कॉन्टेक्स्ट / अधिकतम आउटपुट 1M / 128K 1M / 128K 1M / 128K 200K / 64K
Thinking डिफ़ॉल्ट रूप से adaptive thinking (न्यूनतम between_tools) डिफ़ॉल्ट रूप से adaptive thinking (disabled से बंद हो सकती है) adaptive thinking हमेशा चालू (बंद नहीं हो सकती) Extended thinking (बजट के आधार पर)
API पर डिफ़ॉल्ट effort high high medium समर्थित नहीं
भरोसेमंद ज्ञान कटऑफ़ जून 2026 जनवरी 2026 जून 2026 फ़रवरी 2025
cache की न्यूनतम लंबाई 512 टोकन 1,024 टोकन 512 टोकन 4,096 टोकन
गति (आधिकारिक सापेक्ष लेबल) Fast — Moderate Fastest
सेवा समाप्ति 28 सितंबर 2027 से पहले नहीं 30 जून 2027 से पहले नहीं 22 सितंबर 2027 से पहले नहीं 15 अक्टूबर 2026 से पहले नहीं

स्रोत: Anthropic, "Models overview", "Claude Sonnet 5.5", "Claude Sonnet 5" और "Prompt caching" (29 सितंबर 2026 को जाँचा गया)। गति मौजूदा मॉडलों के भीतर का सापेक्ष लेबल है और Legacy Sonnet 5 के लिए नहीं दिया गया। सेवा समाप्ति की तारीखें Anthropic के चलाए प्लेटफ़ॉर्म के लिए वादे हैं; Amazon Bedrock और Google Cloud अपनी तारीखें खुद तय करते हैं।

Sonnet 5 से सिर्फ़ तीन पंक्तियाँ अलग हैं: thinking, ज्ञान कटऑफ़ और cache की न्यूनतम लंबाई। कॉन्टेक्स्ट, अधिकतम आउटपुट और API का डिफ़ॉल्ट effort वही हैं, और tokenizer भी Sonnet 5 वाला ही है, इसलिए एक ही टेक्स्ट से उतने ही टोकन बनते हैं (What's new)। Message Batches API पर beta header output-300k-2026-03-24 जोड़ने से आउटपुट की सीमा 300K टोकन हो जाती है (Sonnet 5 जैसा ही)। यह भी ध्यान दें कि temperature, top_p या top_k के गैर-डिफ़ॉल्ट मान भेजने पर 400 आता है। यह Sonnet 5 पर भी सच था, इसलिए यह सिर्फ़ तब मायने रखता है जब आप सीधे Sonnet 4.6 या उससे पुराने मॉडल से आ रहे हों।

कहाँ उपलब्ध है

API / क्लाउड

Claude API (claude-sonnet-5-5), Amazon Bedrock (anthropic.claude-sonnet-5-5), Claude Platform on AWS, Google Cloud और Microsoft Foundry। लॉन्च के दिन ही यह हर प्लेटफ़ॉर्म पर आ गया।

ऐप्स / डेवलपर टूल

claude.ai और Claude ऐप्स (Anthropic ने Sonnet 5.5 का system prompt प्रकाशित किया है), Claude Code (v2.1.284 और बाद के), और GitHub Copilot (Pro, Pro+, Max, Business और Enterprise)।

इसमें क्या नहीं है

pricing पेज पर fast mode (तेज़ संस्करण) सिर्फ़ Opus 5.5, Opus 5 और Opus 4.8 के लिए है; Sonnet 5.5 में यह नहीं है। Bedrock पर Sonnet 5.5 के लिए structured outputs (strict tool use सहित) उपलब्ध नहीं हैं (माइग्रेशन गाइड)।

3. कीमत: cache की न्यूनतम लंबाई छोड़कर Sonnet 5 जैसी ही

आधिकारिक What's new पेज कहता है कि इसकी कीमत Sonnet 5 जितनी है, और prompt caching व batch processing की कीमत भी वही है। विस्तृत दरें ये हैं।

प्रति 10 लाख टोकन Sonnet 5.5 Sonnet 5 Opus 5.5 Haiku 4.5
इनपुट $2 $2 $4 $1
आउटपुट $10 $10 $20 $5
cache राइट (5 मिनट) $2.50 $2.50 $5 $1.25
cache राइट (1 घंटा) $4 $4 $8 $2
cache रीड $0.20 $0.20 $0.20 $0.10
Batch API (इनपुट/आउटपुट) $1 / $5 $1 / $5 $2 / $10 $0.50 / $2.50

स्रोत: Anthropic, "Pricing" (29 सितंबर 2026 को जाँचा गया)। Batch API पर इनपुट और आउटपुट दोनों सामान्य दरों से 50% सस्ते हैं।

"वही कीमत" के भीतर बदल सकने वाली दो बातें

दरें एक जैसी होने से बिल एक जैसा होगा, इसकी गारंटी नहीं है। दो कारक इसे बदल सकते हैं।

पहला है cache की न्यूनतम लंबाई। Sonnet 5 पर 1,024 टोकन से छोटे prompt, cache_control होने पर भी cache नहीं होते थे। Sonnet 5.5 पर यह सीमा घटकर 512 टोकन हो गई है। उदाहरण के लिए, जो काम हर call में 800 टोकन का system prompt और tool definitions भेजता है, वह Sonnet 5 पर caching के योग्य नहीं था, लेकिन Sonnet 5.5 पर cache होता है। कुछ cache हुआ या नहीं, यह जवाब के usage से पता चलता है: अगर cache_creation_input_tokens और cache_read_input_tokens दोनों 0 हैं, तो कुछ cache नहीं हुआ (आधिकारिक Prompt caching पेज)। न्यूनतम लंबाई से कम होने पर एरर नहीं आता, इसलिए माइग्रेट करते समय ऐसे कामों की जाँच करना फ़ायदेमंद है जिनमें caching चुपचाप लागू ही नहीं हो रही थी।

दूसरा है प्रति काम टोकन की संख्या। घोषणा कहती है कि उसी काम के लिए इसे कहीं कम टोकन चाहिए, Anthropic की जाँच में यह प्रति काम 30% तक सस्ता है, और Sonnet 5 से 30% से ज़्यादा तेज़ी से आउटपुट बनाता है। ये Anthropic के अपने माप हैं। साथ ही, आधिकारिक दस्तावेज़ कहता है कि effort के स्तर दोबारा कैलिब्रेट किए गए हैं, इसलिए ज़रूरी नहीं कि उसी स्तर पर यह उतना ही सोचे जितना Sonnet 5 सोचता था। Thinking के टोकन दिखाए न जाएँ, तब भी आउटपुट टोकन के रूप में बिल होते हैं। माइग्रेशन के बाद पता करने का एकमात्र तरीका है अपने ही काम पर usage मापकर तुलना करना।

हल किया हुआ उदाहरण: एक काम जिसमें 1 करोड़ cache-रीड, 5 लाख इनपुट और 3 लाख आउटपुट टोकन हैं (टोकन संख्याएँ इस लेख की मान्यता हैं; राइट की लागत शामिल नहीं)

  • Sonnet 5.5: $2.00 + $1.00 + $3.00 = $6.00 (Sonnet 5 पर भी यही)
  • Opus 5.5: $2.00 + $2.00 + $6.00 = $10.00 (Sonnet 5.5 का लगभग 1.7 गुना, 2 गुना नहीं)
  • Haiku 4.5: $1.00 + $0.50 + $1.50 = $3.00 (Sonnet 5.5 का ठीक आधा)

यह समान टोकन संख्या पर दरों की तुलना है; असल में हर मॉडल अलग संख्या में टोकन इस्तेमाल करता है। दरें Anthropic के "Pricing" से हैं।

Opus 5.5 से अंतर "2 गुना" नहीं है, क्योंकि सिर्फ़ cache रीड की कीमत Opus 5.5 पर भी वही $0.20 है। किसी agentic काम में cache का हिस्सा जितना ज़्यादा होगा, Sonnet 5.5 चुनने से बचत उतनी कम होगी। सभी Claude मॉडलों की कीमतें Opus, Sonnet और Haiku की कीमतों की हमारी तुलना में हैं।

4. Benchmark: Anthropic की तालिका के भीतर पढ़ें

घोषणा की तुलना तालिका में चार कॉलम हैं: Sonnet 5.5, Sonnet 5, Opus 5.5 और GPT-6 Sol। पहले तालिका की शर्तें देखें।

  • तालिका Anthropic की घोषणा से है, और ज़्यादातर पंक्तियाँ Anthropic के अपने माप हैं। अपवाद हैं GDPval-AA v2.1 और AA-Briefcase v1.1, जिन्हें Artificial Analysis ने चलाया (फ़ुटनोट 3)।
  • Artificial Analysis ने ये टेस्ट रिलीज़ से पहले के ऐसे परिवेश में चलाए जिसमें एक बग था, जो structured outputs इस्तेमाल करने वाले अनुरोधों के जवाब बिगाड़ सकता था। Anthropic का कहना है कि कोई असर हुआ भी हो तो वह छोटा होगा और स्कोर को कम दिखाएगा, और बताता है कि बग ठीक कर दिया गया है।
  • Opus 5.5 का Terminal-Bench 4.0 आँकड़ा xhigh पर है और वह Opus 5.5 का सबसे अच्छा स्कोर है (फ़ुटनोट 1)। Sonnet 5.5 के FrontierCode के दो आँकड़े हैं: max पर 46.2% और xhigh पर 52.1% (फ़ुटनोट 2)।
  • GPT-6 Sol के GDPval-AA, AA-Briefcase और Chartography स्कोर के साथ यह टिप्पणी है कि वे OpenAI के इमेज समझने वाले बग को ठीक करने से पहले के हो सकते हैं (फ़ुटनोट 4)।
Benchmark Sonnet 5.5 Sonnet 5 Opus 5.5 GPT-6 Sol
Terminal-Bench 4.0
टर्मिनल में agentic कोडिंग
70.6% 10.3% 66.4% (xhigh) —
FrontierCode 1.1 (Main)
बदलाव merge होते हैं या नहीं
52.1% (xhigh)
46.2% (max)
42.4% 54.4% 49.3%
CursorBench 4.0
अस्पष्ट, कई फ़ाइलों वाले काम
55.5% 34.1% 57.8% —
GDPval-AA v2.1 (Elo)
44 पेशों का असली काम (Artificial Analysis द्वारा)
1844 1449 1846 1487
AA-Briefcase v1.1 (Elo)
लंबी अवधि का ज्ञान-आधारित काम (Artificial Analysis द्वारा)
1811 1359 1822 1483
Humanity's Last Exam
कई विषयों में तर्क (tools के साथ)
64.5% 54.9% 67.7% —
OSWorld 2.1
कंप्यूटर उपयोग (तालिका में "partial" टिप्पणी)
80.1% 57.0% 81.8% —
Chartography
चार्ट पढ़ना (tools के बिना)
61.6% 15.6% 64.4% 53.6%

स्रोत: Anthropic की "Introducing Claude Sonnet 5.5" की तुलना तालिका और फ़ुटनोट (28 सितंबर 2026; 29 सितंबर को जाँचा गया)। बोल्ड हर पंक्ति का सबसे ऊँचा मान दिखाता है; "—" का मतलब है कि तालिका में मान नहीं है। तरीके का विवरण उसी घोषणा से लिंक किए गए Sonnet 5.5 system card में है।

तीन बातें उभरकर आती हैं।

  • Sonnet 5 से छलाँग बड़ी है। Terminal-Bench 4.0 10.3% से 70.6% पर पहुँचा, और Chartography (tools के बिना) 15.6% से 61.6% पर: उसी तालिका के भीतर कई गुना ऊपर। GDPval-AA लगभग 400 अंक बढ़ा।
  • ज़्यादातर पंक्तियों में Opus 5.5 से अंतर कुछ ही अंकों का है। GDPval-AA में 2 अंक, CursorBench में 2.3 अंक और OSWorld 2.1 में 1.7 अंक का अंतर है। Terminal-Bench 4.0 पर Sonnet 5.5, Opus 5.5 के सबसे अच्छे स्कोर (xhigh पर 66.4%) से भी आगे है।
  • फिर भी Anthropic, Opus 5.5 को इससे ऊपर रखता है। घोषणा कहती है कि benchmark क्षमता का सिर्फ़ एक पहलू पकड़ते हैं, और अंदरूनी तौर पर भी और बाहरी परीक्षकों के बीच भी, लगातार विवेक माँगने वाले जटिल, खुले छोर वाले काम में Opus 5.5 साफ़ तौर पर ज़्यादा मज़बूत बना हुआ है।

effort स्तर के हिसाब से लागत: घोषणा के चार्ट के विवरण से

घोषणा में ऐसे चार्ट भी हैं जो हर effort स्तर के लिए स्कोर को प्रति काम लागत के सामने दिखाते हैं। उनके विवरण में यह लिखा है।

Terminal-Bench 4.0

Claude ऐप्स के डिफ़ॉल्ट medium पर, यह प्रति काम दसवें हिस्से से भी कम लागत में Sonnet 5 के सबसे अच्छे स्कोर को साफ़ पीछे छोड़ देता है।

FrontierCode 1.1

Claude Platform के डिफ़ॉल्ट high पर, यह प्रति काम लगभग पाँचवें हिस्से की लागत में GPT-6 Sol के सबसे अच्छे स्कोर की बराबरी करता है। उसी high स्तर पर Sonnet 5 से 10 अंक ऊपर है, लगभग पंद्रहवें हिस्से की लागत में।

CursorBench 4.0

सबसे निचले स्तर low पर, यह प्रति काम दसवें हिस्से से भी कम लागत में Sonnet 5 के सबसे अच्छे स्कोर से आगे निकल जाता है।

AA-Briefcase v1.1

medium पर, यह प्रति काम लगभग नौवें हिस्से की लागत में Sonnet 5 के सबसे अच्छे स्कोर से आगे निकल जाता है।

स्रोत: Anthropic की "Introducing Claude Sonnet 5.5" के चार्ट विवरण। Terminal-Bench और CursorBench के चार्ट में GPT-5.6 Sol दिखाया गया है, क्योंकि GPT-6 Sol के स्कोर प्रकाशित नहीं हुए हैं (उसी पेज की टिप्पणी)।

FrontierCode के दो आँकड़ों पर ध्यान देना चाहिए। Sonnet 5.5 का स्कोर max (46.2%) पर xhigh (52.1%) से कम है। Anthropic की घोषणा के फ़ुटनोट के मुताबिक, max पर यह ज़्यादा बार Claude Code की code-review skill चलाता था और काम को कई subagents में बाँटता था, जिससे कुछ मामलों में timeout और काम के दायरे से बाहर के संपादन हुए। effort बढ़ाने से स्कोर हमेशा नहीं बढ़ता, इसलिए स्तर अपने ही काम पर तुलना करके चुनें (खंड 7)। GPT-6 Sol के आँकड़े GPT-6 Sol और Luna की रिलीज़ पर हमारे लेख में हैं।

इसे Opus 5.5 की घोषणा की तालिका से न मिलाएँ: उसी Opus 5.5 के लिए भी Chartography, Opus 5.5 की घोषणा में "tools के साथ" 89.0% और इस तालिका में "tools के बिना" 64.4% दर्ज है, यानी अलग-अलग शर्तों में। अगर आप दोनों घोषणाओं से आँकड़े चुनकर साथ रखेंगे, तो अलग-अलग शर्तों में मापे गए मानों की तुलना कर बैठेंगे। तुलना एक ही तालिका के कॉलमों तक रखें।

5. Sonnet 5 से आने पर 400 लौटाने वाले 5 ब्रेकिंग बदलाव, और उनके समाधान

आधिकारिक What's new in Claude Sonnet 5.5 में Sonnet 5 पर चलने वाले कोड पर असर डालने वाले पाँच ब्रेकिंग बदलाव (breaking changes) दिए गए हैं। हर एक 400 invalid_request_error के साथ विफल होता है।

① thinking बंद करने के लिए disabled की जगह between_tools

Sonnet 5 पर thinking: {"type": "disabled"} किसी भी effort स्तर पर thinking बंद कर देता था। Sonnet 5.5 पर disabled इस संदेश के साथ 400 लौटाता है:

"thinking.type.disabled" is not supported for this model. Use "thinking.type.between_tools" for the lowest thinking setting, or "thinking.type.adaptive" and "output_config.effort" to control thinking behavior.

इसकी जगह है thinking: {"type": "between_tools"}, इस मॉडल की सबसे कम thinking वाली सेटिंग, जो जवाब देने से पहले मॉडल की "शुरुआती thinking" रोक देती है। tools के बिना वाले अनुरोधों में जवाब में सिर्फ़ टेक्स्ट होता है, ठीक वैसे ही जैसे Sonnet 5 पर disabled के साथ होता था। कोई beta header नहीं चाहिए, और यह Sonnet 5.5 देने वाले हर प्लेटफ़ॉर्म पर काम करता है। लेकिन अगर आप इसे disabled की सीधी जगह पर रख देंगे, तो तीन बातें आपको उलझाएँगी।

  • effort xhigh और max पर यह 400 लौटाता है। between_tools सिर्फ़ low, medium और high पर स्वीकार होता है। जो काम Sonnet 5 पर "xhigh और thinking बंद" के साथ चलते थे, उनमें या तो effort को high या उससे नीचे करना होगा, या thinking बंद करना छोड़ना होगा।
  • इसके साथ दूसरे फ़ील्ड नहीं भेज सकते। between_tools के साथ display, budget_tokens या block_binding भेजने पर 400 आता है।
  • बातचीत के बीच effort नहीं बदल सकते। per-message effort (beta) से अलग स्तर भेजने पर 400 आता है। अगर आप हर बारी में स्तर बदलना चाहते हैं, तो adaptive thinking इस्तेमाल करें (thinking छोड़ दें या {"type": "adaptive"} भेजें)।

यह रहा माइग्रेशन गाइड का Python में पहले-और-बाद वाला उदाहरण। ध्यान दें कि "पहले" वाला उदाहरण xhigh इस्तेमाल करता है, इसलिए "बाद" वाले में उसे high पर उतारा गया है।

# Before: Sonnet 5 पर चलता है, Sonnet 5.5 पर 400
client.messages.create(
    model="claude-sonnet-5",
    max_tokens=16000,
    thinking={"type": "disabled"},
    output_config={"effort": "xhigh"},
    messages=[{"role": "user", "content": "..."}],
)

# After: शुरुआती thinking रोकें; effort high या उससे नीचे हो
client.messages.create(
    model="claude-sonnet-5-5",
    max_tokens=16000,
    thinking={"type": "between_tools"},
    output_config={"effort": "high"},
    messages=[{"role": "user", "content": "..."}],
)

between_tools के साथ भी, tool calls के बीच मॉडल जो छोटे प्रगति-नोट लिखता है, वे सारांश टेक्स्ट वाले thinking blocks के रूप में लौटते हैं। उन्हें फेंकें नहीं; assistant की बाकी बारी के साथ उन्हें बिना बदले वापस भेजें। आप जो blocks वापस भेजते हैं, उनसे मॉडल को अपने लिखे नोट्स का पूरा टेक्स्ट मिलता है (What's new)। मैन्युअल बजट {"type": "enabled", "budget_tokens": N} अब भी Sonnet 5 की तरह 400 लौटाता है।

② forced tool use पर एरर

tool_choice को {"type": "any"} या {"type": "tool", "name": "..."} पर सेट करने से 400 आता है। token counting API भी यही जाँच लागू करता है। सिर्फ़ auto (डिफ़ॉल्ट) और none की अनुमति है।

tool_choice: type "tool" and "any" are not supported for this model.

समाधान: tool_choice को auto पर रखें और tool definitions में strict: true जोड़ें (strict tool use), या schema को structured outputs में ले जाएँ। auto के साथ मॉडल tool बुलाए बिना टेक्स्ट में जवाब दे सकता है, इसलिए prompt में साफ़ लिखें कि उसे वह tool कब इस्तेमाल करना है। strict tool use, JSON Schema का सिर्फ़ एक हिस्सा स्वीकार करता है, और schema के हर object में additionalProperties: false ज़रूरी है। एक अनुरोध में आप ज़्यादा से ज़्यादा 20 tools को strict बना सकते हैं, और MCP, computer use या browser use toolsets पर strict सेट नहीं किया जा सकता।

# Before: Sonnet 5 पर चलता है, Sonnet 5.5 पर 400
client.messages.create(
    model="claude-sonnet-5",
    max_tokens=1024,
    tools=tools,
    tool_choice={"type": "tool", "name": "get_weather"},
    messages=[{"role": "user", "content": "What's the weather in Paris?"}],
)

# After: auto + strict; tool कब इस्तेमाल करना है, यह prompt में लिखें
client.messages.create(
    model="claude-sonnet-5-5",
    max_tokens=1024,
    tools=[{**tool, "strict": True} for tool in tools],
    tool_choice={"type": "auto"},
    messages=[{"role": "user",
               "content": "What's the weather in Paris? Use the get_weather tool."}],
)

Amazon Bedrock पर बात अलग है। Bedrock पर Sonnet 5.5 के लिए structured outputs (strict tool use सहित) उपलब्ध नहीं हैं, इसलिए strict के बिना auto भेजें, prompt में लिखें कि tool कब बुलाना है, और tool के इनपुट अपने कोड में जाँचें (माइग्रेशन गाइड)।

③ thinking blocks मॉडल और बातचीत से बँधे हैं

हर thinking block में दर्ज रहता है कि उसे किस मॉडल ने बनाया। Sonnet 5.5 Sonnet 5, Opus 4.8, Haiku 4.5 और पुराने मॉडलों के thinking blocks पढ़ सकता है, लेकिन Opus 5, Opus 5.5, Fable या Mythos के नहीं। और कोई दूसरा मॉडल Sonnet 5.5 के thinking blocks नहीं पढ़ सकता।

  • Sonnet 5 से Sonnet 5.5 पर जाने पर पहले का तर्क साथ आ जाता है।
  • Sonnet 5.5 से किसी दूसरे मॉडल पर जाने का मतलब है कि स्विच के बाद की बारियाँ Sonnet 5.5 के तर्क के बिना चलती हैं। अनुरोध खुद सफल होता है, और छोड़े गए blocks का बिल नहीं बनता।

Fable 5.1 और Mythos 5.1, Opus 5.5 के thinking blocks पढ़ सकते हैं, लेकिन Sonnet 5.5 के blocks कोई नहीं पढ़ सकता। अगर आप "सिर्फ़ मुश्किल हिस्से Sonnet 5.5 से ऊपर Opus 5.5 को" भेजते हैं, तो यह मानकर टेस्ट करें कि जिस मॉडल पर आप भेजते हैं, वहाँ Sonnet 5.5 का तर्क गायब हो जाता है।

एक जाँच और है: Sonnet 5.5 के thinking block से पहले की हर चीज़ (system, tools और पिछले संदेश) block बनने के बाद बदली है या नहीं। 31 अगस्त 2026, 00:00 UTC को या उसके बाद बने खातों के लिए यह Claude API, Amazon Bedrock और Google Cloud पर डिफ़ॉल्ट रूप से लागू है, और बीच में बदले गए इतिहास के साथ block भेजने पर 400 आता है।

समाधान: बातचीत को सिर्फ़ आगे जोड़कर बढ़ाएँ। निर्देश या tools बदलने हों, तो इतिहास दोबारा लिखने के बजाय बातचीत के बीच वाला system message इस्तेमाल करें (Sonnet 5.5 पर नई उपलब्ध सुविधा, जो Sonnet 5 में नहीं है)। अगर दोबारा लिखना टाला न जा सके, तो beta header thinking-binding-controls-2026-08-01 जोड़ें और thinking.block_binding.prefix_mismatch_behavior को "drop_block" पर सेट करें, ताकि एरर के बजाय प्रभावित blocks छोड़ दिए जाएँ। लेकिन block_binding सिर्फ़ adaptive thinking के साथ काम करता है, इसलिए between_tools के साथ या तो सिर्फ़ आगे जोड़ें, या दोबारा लिखी गई बारी से आगे के thinking blocks खुद हटा दें।

④ Claude API और Google Cloud पर पुराना computer use tool अस्वीकार

Sonnet 5 beta header के साथ पुराने tool computer_20251124 के ज़रिए computer use भी स्वीकार करता था। Claude API और Google Cloud पर Sonnet 5.5 सिर्फ़ toolset computer_toolset_20260801 स्वीकार करता है, और पुराना tool घोषित करने पर 400 आता है। Claude API पर संदेश इस तरह शुरू होता है:

'claude-sonnet-5-5' does not support tool types: computer_20251124.

समाधान: beta header हटाएँ, tools को [{"type": "computer_toolset_20260801"}] से बदलें, और अपने agent loop को toolset के ढाँचे के अनुसार अपडेट करें (सदस्यों के लिए tool_use blocks, एक साथ कई actions, और नतीजों में toolset_name)। अगर आप fine-grained-tool-streaming-2025-05-14 beta header भेजते हैं, तो उसे हटाएँ। toolset के साथ उसे भेजने पर 400 आता है, इसलिए जिस tool को ज़रूरत हो उसमें eager_input_streaming: true जोड़ें। Amazon Bedrock पर पुराना tool अब भी काम करता है, इसलिए वहाँ कोई बदलाव ज़रूरी नहीं।

⑤ advisor tool के कुछ जोड़े अस्वीकार

advisor tool (beta) एक executor मॉडल को किसी ज़्यादा मज़बूत मॉडल से सलाह लेने देता है। जब Sonnet 5.5 executor हो, तो advisor के रूप में Opus 4.8, Opus 4.7, Opus 4.6, Sonnet 5 या Sonnet 4.6 बताने पर 400 आता है। अनुमत advisor हैं Opus 5, Opus 5.5, Sonnet 5.5, Fable 5, Fable 5.1, Mythos 5 और Mythos 5.1।

इसके अलावा, Sonnet 5.5 जिन advisors को स्वीकार करता है, वे सभी अपनी सलाह encrypted advisor_redacted_result block में लौटाते हैं, इसलिए client सलाह का टेक्स्ट नहीं पढ़ सकता। जो कुछ भी सलाह को लॉग करता था या स्क्रीन पर दिखाता था, उसे दोबारा बनाना होगा। "Sonnet 5 executor, Opus 4.8 advisor" जैसे सस्ते जोड़े Sonnet 5.5 पर जैसे के तैसे नहीं चल सकते।

6. बिना एरर के होने वाले बदलाव

पाँचों ब्रेकिंग बदलाव 400 देते हैं, इसलिए वे आपकी नज़र में आ जाएँगे। पेचीदा हैं बर्ताव के वे बदलाव जो कोई एरर नहीं देते।

बदलाव क्या होता है / क्या करें
tool calls के बीच का टेक्स्ट thinking blocks में चला जाता है एक-दो वाक्य से लंबे नोट, जैसे "अब मैं X जाँचूँगा", जो Sonnet 5 पर text blocks थे, अब प्रगति वाले thinking blocks में लौटते हैं (छोटी एक-पंक्ति टेक्स्ट ही रहती है)। डिफ़ॉल्ट display: "omitted" के साथ उनकी सामग्री खाली होती है, इसलिए जो UI उपयोगकर्ताओं को प्रगति स्ट्रीम करता था, वह tool calls के दौरान चुप हो जाता है। adaptive thinking के साथ display को "updates" (beta, header thinking-display-updates-2026-08-18) या "summarized" पर सेट करें, और गैर-खाली thinking blocks को उसके बाद आने वाले tool_use से पहले दिखाएँ। between_tools के साथ टेक्स्ट बिना किसी सेटिंग के लौटता है।
effort के स्तर दोबारा कैलिब्रेट हुए ज़रूरी नहीं कि उसी स्तर पर यह उतना ही सोचे जितना Sonnet 5 पर। आधिकारिक सलाह है कि सेटिंग्स जस की तस न ले जाएँ, बल्कि effort दोबारा ट्यून करें (खंड 7)।
इनकार की अब पाँच श्रेणियाँ हैं cyber, bio, frontier_llm, reasoning_extraction और general_harms। इनकार पर stop_reason: "refusal" के साथ HTTP 200 लौटता है, इसलिए stop_details पढ़कर उसे संभालें। सर्वर-साइड fallback (fallbacks: "default", beta, सिर्फ़ Claude API) सिर्फ़ cyber और frontier_llm को Sonnet 5 पर दोबारा आज़माता है।
thinking blocks उन्हें बनाने वाले खाते से बँधे हैं Sonnet 5.5 के thinking blocks सिर्फ़ उन्हें बनाने वाला खाता या उससे जुड़े खाते इस्तेमाल कर सकते हैं। दूसरे खाते से भेजे जाने पर blocks छोड़ दिए जाते हैं और अनुरोध सफल होता है। घोषणा कहती है कि इसमें Claude Code में सेशन के बीच खाता बदलना भी शामिल है।
cache की न्यूनतम लंबाई घटी 512 से 1,023 टोकन के prompt अब cache होते हैं। इससे राइट की लागत जुड़ती है (5 मिनट के लिए इनपुट का 1.25 गुना), जबकि दूसरी call से आप सिर्फ़ रीड की दर देते हैं (खंड 3)।

स्रोत: What's new in Claude Sonnet 5.5, Migrating to Claude Sonnet 5.5, Anthropic की घोषणा

घोषणा safeguards में हुए बदलाव भी बताती है। Sonnet 5.5 पहला Sonnet है जो cyber safeguards और fallback के साथ आता है, क्योंकि साइबर हमलों में इस्तेमाल हो सकने वाली इसकी क्षमताएँ Opus 5 के स्तर तक पहुँच गई हैं; ज़्यादा जोखिम वाला साइबर सुरक्षा का काम दिखाई देने वाले ढंग से Sonnet 5 पर स्विच हो जाता है। रोज़मर्रा के डेवलपमेंट में bugs ढूँढना और ठीक करना इससे प्रभावित नहीं होता। जीव विज्ञान के safeguards Sonnet 5 जैसे ही हैं।

दूसरी ओर, कुछ सुविधाएँ जोड़ी गईं। per-message effort (beta; prompt cache बनाए रखते हुए स्तर बदलने देता है), बातचीत के बीच system messages और बातचीत के बीच tools बदलना (beta), ये सब Sonnet 5 पर उपलब्ध नहीं थे। What's new में compaction भी है, जो आपके कहने पर बातचीत का सार बनाता है (beta, header compact-2026-09-04), और संदेशों के भीतर tools परिभाषित करना (beta, header inline-tools-2026-09-15)।

7. डिफ़ॉल्ट effort: API पर high, Claude Code में medium

Opus 5.5 ने API पर भी अपना डिफ़ॉल्ट effort medium कर दिया, लेकिन Sonnet 5.5, API का डिफ़ॉल्ट high ही रखता है। वहीं, घोषणा कहती है कि Claude Code और ऐप्स में डिफ़ॉल्ट अब medium है। वही Sonnet 5.5 डिफ़ॉल्ट रूप से API और Claude Code में एक स्तर अलग सोचता है।

आधिकारिक effort पेज Sonnet 5.5 के लिए ये शुरुआती बिंदु सुझाता है:

काम का प्रकार शुरुआती स्तर (आधिकारिक सुझाव) टिप्पणी
सामान्य काम (नीचे के दो को छोड़कर) high API के डिफ़ॉल्ट जैसा ही
agentic कोडिंग और कई चरणों वाला tool use medium से शुरू करें साफ़ परिभाषित काम के लिए medium; कठिन या लंबे काम के लिए high
चैट जैसा latency के प्रति संवेदनशील काम medium या low गति को प्राथमिकता
xhigh और max सिर्फ़ तब जब evals बेहतर गुणवत्ता दिखाएँ between_tools के साथ नहीं जोड़े जा सकते

स्रोत: Anthropic, "Effort" का "Recommended effort levels for Claude Sonnet 5.5", और माइग्रेशन गाइड

वही पेज यह भी सुझाता है कि max_tokens को thinking और जवाब दोनों के लिए काफ़ी बड़ा रखें, और agentic कोडिंग के लिए max_tokens को इस मॉडल की सीमा 128,000 पर रखें और जवाब streaming से लें। जिन सेटिंग्स में thinking की सामग्री लौटाई नहीं जाती, उनमें भी thinking के टोकन max_tokens में गिने जाते हैं। effort खुद कैसे काम करता है, यह effort सेटिंग पर हमारी गाइड में है, और adaptive thinking adaptive बनाम extended thinking में।

8. Sonnet 5.5, Opus 5.5 और Haiku में से चुनना

आधिकारिक मॉडल सूची अब भी कहती है कि दुविधा हो तो Opus 5.5 से शुरू करें; Sonnet 5.5 शुरुआती बिंदु नहीं बना है। इसके साथ, घोषणा Sonnet 5.5 की ताकत साफ़ दायरे वाले रोज़मर्रा के काम, bug fixes, और दस्तावेज़, स्लाइड व स्प्रेडशीट बनाना बताती है, और Opus 5.5 की सावधान विवेक माँगने वाला जटिल काम। यह भी कहती है कि कम effort पर Sonnet 5.5, Opus 5.5 का सबसे अच्छा पूरक है, और ऊँचे स्तरों पर दोनों मिलती-जुलती लागत में मिलता-जुलता परफ़ॉर्मेंस दे सकते हैं। यानी अगर आप xhigh या max पर चलाते हैं, तो Sonnet 5.5 चुनने से लागत में ज़्यादा फ़ायदा नहीं मिलता।

Sonnet 5.5 चुनें
  • आप low से high पर, साफ़ परिभाषित implementation और bug fixes तेज़ी से करना चाहते हैं।
  • आप बहुत सारे दस्तावेज़, स्लाइड और स्प्रेडशीट बनाते हैं।
  • आप इंतज़ार घटाने के लिए शुरुआती thinking काटना चाहते हैं (between_tools)।
  • आप आज Sonnet 5 इस्तेमाल करते हैं (यह उसी कीमत का विकल्प है)।
Opus 5.5 चुनें
  • खुले छोर वाले डिज़ाइन या रिसर्च में लगातार विवेक चाहिए।
  • आप तय नहीं कर पा रहे (आधिकारिक शुरुआती बिंदु)।
  • आप ऊँचे effort पर चलाने वाले हैं, जहाँ Sonnet 5.5 से लागत का अंतर घट जाता है।
  • आपको fast mode चाहिए (सिर्फ़ Opus में)।
Haiku चुनें
  • आपका वॉल्यूम ज़्यादा है और प्रति आइटम लागत सबसे पहले है (Haiku 4.5 की कीमत Sonnet 5.5 की आधी है)।
  • 200K टोकन का कॉन्टेक्स्ट काफ़ी है।
  • घोषणा कहती है कि Haiku 5.5 कुछ हफ़्तों में आ रहा है।
  • Haiku 4.5 की सेवा समाप्ति 15 अक्टूबर 2026 से पहले नहीं है, इसलिए अपनी योजना पहले से जाँच लें।

दुविधा हो तो इस क्रम में चलें: ① अपने काम पर Sonnet 5.5 को medium और high पर चलाएँ → ② कमी लगे तो medium पर Opus 5.5 से तुलना करें → ③ अगर xhigh पर Sonnet 5.5 की लागत लगभग Opus 5.5 जितनी हो, तो Opus 5.5 चुनें। Opus 5.5 का विस्तृत विवरण Opus 5.5 की रिलीज़ पर हमारे लेख में है, और मौजूदा मॉडलों की पूरी सूची प्रमुख AI मॉडल और उनके ज्ञान कटऑफ़ में।

9. Claude Code और GitHub Copilot में इस्तेमाल

Claude Code ने v2.1.284 के CHANGELOG (28 सितंबर 2026) में Sonnet 5.5 जोड़ा और Anthropic API पर इसे डिफ़ॉल्ट Sonnet बना दिया।

डिफ़ॉल्ट मॉडल अब भी Opus 5.5 है

Pro, Max, Team, Enterprise और API पर default अब भी Opus 5.5 है। Sonnet 5.5 इस्तेमाल करने के लिए /model sonnet चुनें (या शुरू करते समय claude --model sonnet)। v2.1.284 से पुराने वर्ज़न इसे इस्तेमाल नहीं कर सकते, इसलिए claude update चलाएँ।

sonnet किसकी ओर इशारा करता है, यह provider पर निर्भर है

यह सिर्फ़ Anthropic API पर Sonnet 5.5 बनता है। Claude Platform on AWS पर यह Sonnet 4.6 की ओर, और Bedrock, Google Cloud के Agent Platform और Microsoft Foundry पर Sonnet 4.5 की ओर इशारा करता है। वहाँ पूरा मॉडल नाम चुनें या ANTHROPIC_DEFAULT_SONNET_MODEL सेट करें।

effort medium से शुरू; thinking बंद नहीं होती

Sonnet 5.5, medium से शुरू होता है। user settings में पुराने ढंग का top-level effortLevel, Opus 5.5 और बाद के मॉडलों पर कोई असर नहीं करता। thinking toggle, alwaysThinkingEnabled और MAX_THINKING_TOKENS=0 का भी Sonnet 5.5 पर कोई असर नहीं होता।

cyber का fallback Sonnet 5; जीव विज्ञान पर इनकार

जब कोई safeguard classifier सक्रिय होता है, तो साइबर सुरक्षा का काम Sonnet 5 पर दोबारा चलाया जाता है और सेशन उसी मॉडल पर जारी रहता है (वापस जाने के लिए /model इस्तेमाल करें)। जीव विज्ञान के लिए Sonnet 5.5 का कोई fallback मॉडल नहीं है, इसलिए बात इनकार पर खत्म होती है।

स्रोत: Claude Code, "Model configuration" और CHANGELOG (v2.1.284; 29 सितंबर 2026 को जाँचा गया)

Anthropic API पर Sonnet 5.5 का कॉन्टेक्स्ट हमेशा 10 लाख (1M) टोकन होता है, बिना [1m] प्रत्यय और बिना अतिरिक्त शुल्क के। auto-compact डिफ़ॉल्ट रूप से लगभग 967K टोकन पर चलता है। LLM gateway के ज़रिए (ANTHROPIC_BASE_URL सेट होने पर) कॉन्टेक्स्ट 200K टोकन माना जाता है, इसलिए model picker में "Sonnet 5.5 (1M context)" (sonnet[1m]) चुनें।

योजना Opus को और अमल Sonnet को देने वाला opusplan, Anthropic API पर क्रमशः Opus 5.5 और Sonnet 5.5 पर चलता है। इसका इस्तेमाल opusplan पर हमारी गाइड में है। Claude Code खुद बातचीत को सिर्फ़ आगे जोड़कर बढ़ाता है, इसलिए खंड 5 ③ वाली इतिहास की जाँच से नहीं टकराता (Opus 5.5 की माइग्रेशन गाइड के अनुसार)।

GitHub Copilot

उसी दिन, 28 सितंबर को, GitHub ने अपने changelog में Sonnet 5.5 की सामान्य उपलब्धता (general availability) की घोषणा की। यह Copilot Pro, Pro+, Max, Business और Enterprise पर उपलब्ध है, और VS Code, Visual Studio, Copilot CLI, Copilot coding agent, github.com, JetBrains IDEs, Xcode वगैरह के model picker से चुना जा सकता है। रोलआउट धीरे-धीरे हो रहा है, इसलिए यह तुरंत न दिखे, ऐसा हो सकता है। बिलिंग provider की सूची-कीमत पर उपयोग के आधार पर होती है। Business और Enterprise पर admins Copilot settings की model policy से तय करते हैं कि यह उपलब्ध हो या नहीं।

10. माइग्रेशन के कदम (API उपयोगकर्ताओं के लिए)

माइग्रेशन गाइड की checklist से, Sonnet 5 से आने पर लागू होने वाले बिंदु, काम के क्रम में, ये हैं। Claude Code में इसमें मदद के लिए /claude-api migrate भी है (माइग्रेशन गाइड में बताई गई bundled skill; संपादन से पहले यह आपसे दायरे की पुष्टि करती है)।

  1. मॉडल ID को claude-sonnet-5 से claude-sonnet-5-5 में बदलें (Bedrock पर anthropic.claude-sonnet-5-5)।
  2. thinking: {"type": "disabled"} को {"type": "between_tools"} से बदलें और effort को high या उससे नीचे रखें।
  3. tool_choice में any और tool को auto और strict tool use से बदलें (Bedrock पर सिर्फ़ auto इस्तेमाल करें और इनपुट खुद जाँचें)।
  4. अगर आप बातचीत के बीच system, tools या पिछले संदेश दोबारा लिखते हैं, तो सिर्फ़ आगे जोड़ने पर आ जाएँ।
  5. अगर आप Claude API या Google Cloud पर computer use इस्तेमाल करते हैं, तो computer_toolset_20260801 पर जाएँ और loop अपडेट करें।
  6. अगर आपका advisor tool, advisor के रूप में Opus 4.8, Opus 4.7, Sonnet 5 जैसा कुछ इस्तेमाल करता है, तो Sonnet 5.5 जिसे स्वीकार करता है उस पर जाएँ, और मानकर चलें कि सलाह encrypted लौटेगी।
  7. अगर आप स्क्रीन पर प्रगति दिखाते हैं, तो display को "updates" या "summarized" पर सेट करें (between_tools के साथ ज़रूरी नहीं)।
  8. stop_reason: "refusal" को संभालें और fallback सेट करें।
  9. अगर आप दूसरे मॉडलों पर route करते हैं, तो यह मानकर टेस्ट करें कि Sonnet 5.5 का तर्क आगे नहीं जाता।
  10. effort दोबारा ट्यून करें और लागत व latency दोबारा मापें। 1,024 टोकन से छोटे prompts की caching भी जाँचें।

स्रोत: Anthropic, "Migrating to Claude Sonnet 5.5" के "Every starting model" और "Migrating to Claude Sonnet 5.5 from Claude Sonnet 5", काम के क्रम में दोबारा व्यवस्थित

अगर आप सीधे Sonnet 4.6 या उससे पुराने मॉडल से आ रहे हैं, तो आपको उन कामों में भी thinking चलने से निपटना होगा जिनमें thinking तय नहीं की गई थी, बजट और temperature जैसे पैरामीटर पर आने वाले 400, और उसी टेक्स्ट के लिए लगभग 30% ज़्यादा टोकन से भी। अगर आप इसे Claude Managed Agents के ज़रिए इस्तेमाल करते हैं, तो मॉडल नाम के अलावा कुछ बदलने की ज़रूरत नहीं (माइग्रेशन गाइड की टिप्पणी)।

सारांश

Claude Sonnet 5.5 एक ऐसी रिलीज़ है जिसने कीमत बदले बिना परफ़ॉर्मेंस काफ़ी बढ़ाई, और बदले में अपने API नियम Opus 5.5 की ओर खिसका दिए। Anthropic की अपनी तालिका में यह हर पंक्ति में Sonnet 5 से बेहतर हुआ और ज़्यादातर में Opus 5.5 से कुछ ही अंक पीछे रहा। दूसरी ओर, disabled, forced tool use, पुराना computer use tool, दोबारा लिखा गया इतिहास और advisor के कुछ जोड़े अब 400 एरर देते हैं।

सबसे आसानी से छूटने वाली बातें हैं कि thinking बंद करने की जगह आया between_tools सिर्फ़ high या उससे नीचे पर स्वीकार होता है, और यह बेमेल कि डिफ़ॉल्ट effort API पर high है लेकिन Claude Code में medium। API पर effort साफ़ तौर पर सेट करें; Claude Code में /model sonnet से चुनें और फिर effort का स्तर जाँचें। यह सचमुच सस्ता हुआ या नहीं, इसे इकाई कीमतों से नहीं, usage से मापें।

आखिर में, benchmark के आँकड़े उस तालिका में, उन शर्तों के तहत मापे गए मान हैं। Anthropic खुद लिखता है कि जटिल, खुले छोर वाले काम में Opus 5.5 साफ़ तौर पर ज़्यादा मज़बूत बना हुआ है। शुरुआत अपने ही काम पर Sonnet 5.5 को medium और high पर तुलना करके करें।

FAQ

Q. क्या Sonnet 5.5, Sonnet 5 से महँगा है?

A. दरें हर मद में एक जैसी हैं (इनपुट $2, आउटपुट $10, cache रीड $0.20, और Batch API पर आधी कीमत)। Anthropic कहता है कि यह प्रति काम 30% तक सस्ता है, लेकिन यह उसका अपना माप है। क्योंकि effort के स्तर दोबारा कैलिब्रेट हुए हैं, माइग्रेशन के बाद usage से जाँचें।

Q. क्या thinking बंद करने का कोई तरीका है?

A. API पर thinking: {"type": "between_tools"} शुरुआती thinking रोक देता है। tools के बिना वाले अनुरोधों में जवाब में सिर्फ़ टेक्स्ट होता है। लेकिन effort xhigh और max पर यह 400 लौटाता है, और tool calls के बीच के प्रगति-नोट thinking blocks में लौटते हैं। Claude Code में thinking बंद करने वाली सेटिंग्स का Sonnet 5.5 पर कोई असर नहीं होता।

Q. मैंने मॉडल ID बदली और 400 एरर आया।

A. कौन-सा बदलाव है, यह एरर संदेश से पता चलता है। "thinking.type.disabled" का मतलब thinking सेटिंग, tool_choice: type "tool" and "any" का मतलब forced tool use, और computer_20251124 का मतलब पुराना computer use tool। अगर यह between_tools इस्तेमाल करते हुए हो, तो देखें कि effort xhigh या उससे ऊपर तो नहीं, या आप उसके साथ display जैसे फ़ील्ड तो नहीं भेज रहे। अगर आप advisor tool इस्तेमाल करते हैं, तो advisor मॉडल पर शक करें; अगर बातचीत के बीच इतिहास दोबारा लिखते हैं, तो thinking-block की जाँच पर (खंड 5 ③)।

Q. Claude Code, Sonnet 5.5 इस्तेमाल नहीं कर रहा।

A. डिफ़ॉल्ट मॉडल Opus 5.5 है, इसलिए /model sonnet से चुनें। अगर फिर भी Sonnet 5 है, तो आपका वर्ज़न v2.1.284 से पुराना है, इसलिए claude update चलाएँ। Bedrock, Google Cloud, Claude Platform on AWS और Microsoft Foundry पर sonnet किसी पुराने Sonnet की ओर इशारा करता है, इसलिए पूरा मॉडल नाम चुनें या ANTHROPIC_DEFAULT_SONNET_MODEL सेट करें।

Q. डिफ़ॉल्ट Opus 5.5 रखूँ या Sonnet 5.5?

A. आधिकारिक शुरुआती बिंदु Opus 5.5 है। अगर आपका काम मुख्य रूप से low से high effort पर चलने वाला साफ़ दायरे का implementation, bug fixes और दस्तावेज़ बनाना है, तो Sonnet 5.5 की लागत प्रति इनपुट और आउटपुट टोकन आधी है। अगर आप xhigh या max पर चलाते हैं, तो घोषणा के मुताबिक लागत का अंतर घट जाता है, इसलिए दोनों की तुलना अपने ही काम पर करें।

* इस लेख के आँकड़े इन पर आधारित हैं: Anthropic की आधिकारिक घोषणा "Introducing Claude Sonnet 5.5" (benchmark उसी पेज की तुलना तालिका और चार्ट विवरण से), आधिकारिक दस्तावेज़ "Models overview", "Claude Sonnet 5.5", "What's new in Claude Sonnet 5.5", "Migrating to Claude Sonnet 5.5", "Pricing", "Thinking", "Effort" और "Prompt caching", Claude Code का "Model configuration" और CHANGELOG, और GitHub का changelog (सभी 29 सितंबर 2026 को जाँचे गए)। स्पेसिफ़िकेशन और कीमतें बदल सकती हैं, इसलिए अंतिम जानकारी आधिकारिक दस्तावेज़ में पक्की कर लें।

संबंधित लेख: Claude Opus 5.5 की रिलीज़ का विवरण, Claude Fable 5.1 के ब्रेकिंग बदलाव और माइग्रेशन, Claude की कीमतों की तुलना।