Claude Fable 5.1 पर माइग्रेट करना सिर्फ़ मॉडल ID बदलकर काम खत्म मान लेने का मामला नहीं है। Anthropic ने साफ़ लिखा है कि इनमें से 3 बदलाव ब्रेकिंग हैं (What's new in Claude Fable 5.1)। और उन 3 में से 2 वहाँ दिखते हैं जहाँ से वे पैदा नहीं हुए — यानी वे जिन्हें पकड़ पाना आसान नहीं होता।

⚠️ तीसरा बदलाव 31 अगस्त 2026 को या उसके बाद बने अकाउंट पर अनिवार्य रूप से लागू होता है। उससे पुराने अकाउंट पर API सिर्फ़ बेमेल को दर्ज करता है और उस पर तभी अमल करता है जब आप स्पष्ट रूप से ऐसा कहें।

यानी "हमारे यहाँ तो चल रहा है, सब ठीक है" इस बात पर टिका है कि अकाउंट कब बना था। अभी-अभी खड़ा किया गया स्टेजिंग एनवायरनमेंट फेल हो सकता है जबकि प्रोडक्शन नहीं होगा।

1. पहले स्थिति समझें — यह फ्लैगशिप की अदला-बदली नहीं है

यहाँ चूक हुई तो माइग्रेशन का फ़ैसला ही ग़लत बैठेगा। Fable 5.1 Fable 5 का उत्तराधिकारी है, Opus 5 की जगह लेने वाला नहीं।

दस्तावेज़ इस पर बिल्कुल दो-टूक है: "ज़्यादातर वर्कलोड के लिए Claude Opus 5 से शुरू करें"। Fable 5.1 की ओर आप तब जाते हैं जब माँग भरी रीज़निंग और लंबे समय तक चलने वाला एजेंटिक काम हो, या high effort पर आँके गए Opus 5 से भी बात न बने

  Claude Fable 5.1 Claude Opus 5
स्थिति माँग भरी रीज़निंग, लंबे समय चलने वाला एजेंटिक काम यहीं से शुरू करें (जटिल एजेंटिक कोडिंग और एंटरप्राइज़ इस्तेमाल)
कीमत (प्रति 1M टोकन) इनपुट $10 / आउटपुट $50 इनपुट $5 / आउटपुट $25
कैश रीड $0.25 (बेस इनपुट का 0.025 गुना) बेस इनपुट का 0.1 गुना
नॉलेज कटऑफ जून 2026 मई 2026
कॉन्टेक्स्ट / अधिकतम आउटपुट 1M / 128k 1M / 128k
इससे पहले सेवा बंद नहीं की जाएगी 1 सितंबर 2027 24 जुलाई 2027

Fable 5 कहीं नहीं गया है। आधिकारिक मॉडल सूची में वह legacy (सेवा जारी) के रूप में बना हुआ है। माइग्रेशन अभी आप पर थोपा नहीं जा रहा — हालाँकि, जैसा आगे बताया है, लागत ज़रूर घटती है।

Mythos 5.1 का प्रदर्शन वही है, बस सुरक्षा-उपाय अलग हैं। इसकी पहुँच Project Glasswing के प्रतिभागियों तक सीमित है।

📌 सब्सक्रिप्शन की तरफ़ की बात: रिलीज़ वाले दिन इस्तेमाल का कोटा रीसेट कर दिया गया। आधिकारिक @ClaudeDevs अकाउंट ने घोषणा की कि 5.1 जारी करने के साथ ही उसने सभी उपयोगकर्ताओं की 5-घंटे और साप्ताहिक सीमाएँ रीसेट कर दीं। यह API की कीमत की बात नहीं है — यह Claude Code जैसी जगहों पर सब्सक्रिप्शन के इस्तेमाल-कोटे की बात है, और यह स्पेसिफ़िकेशन का स्थायी हिस्सा नहीं, बल्कि किसी बड़ी घोषणा के साथ किया गया एक अस्थायी उपाय है। इस तरह के रीसेट पहले कितनी बार हो चुके हैं, और कहाँ तक बात पुष्ट है और कहाँ से अपुष्ट, यह साप्ताहिक सीमा के जल्दी रीसेट होने की हमारी जाँच में देखा गया है। ध्यान रहे कि साप्ताहिक सीमाएँ खुद 14 सितंबर 2026 को संशोधित हो रही हैं, इसलिए अगर आप कोटे के हिसाब से योजना बनाते हैं तो वह भी देख लें।

2. ब्रेकिंग चेंज 1 — ज़बरदस्ती कराया गया टूल कॉल अब 400 देता है

यह तुरंत एरर देता है, इसलिए तीनों में सबसे आसानी से पकड़ में आता है।

tool_choice: type "tool" and "any" are not supported for this model.

tool_choice में {"type": "any"} या {"type": "tool", "name": "..."} देने पर 400 invalid_request_error लौटता है। डिफ़ॉल्ट {"type": "auto"} और {"type": "none"} जस के तस हैं। यही जाँच टोकन काउंटिंग एंडपॉइंट पर भी लागू होती है।

💡 इसकी वजह ऐसे समझाई गई है कि बात जँचती है। यह मॉडल हर वक़्त सोचता रहता है, और टूल कॉल ज़बरदस्ती कराने पर वह सोच छूट जाती है। तब मॉडल जो सोचता, उसे टूल के आर्ग्युमेंट में लिख देता है, जिससे आर्ग्युमेंट की गुणवत्ता गिरती है — इसीलिए इसे बंद कर दिया गया।

इसकी जगह क्या करें

अगर स्कीमा का पालन ज़रूरी है

tool_choice: auto वैसा ही रखें और strict: true (strict tool use) कर दें, या structured outputs पर चले जाएँ

अगर टूल का इस्तेमाल हमेशा ज़रूरी है

प्रॉम्प्ट में लिखें कि उसे कब इस्तेमाल करना है ("मौसम के सवालों का जवाब get_weather टूल से दो")। Anthropic का कहना है कि Fable 5.1 स्पष्ट टूल निर्देशों का भरोसेमंद ढंग से पालन करता है

3. ब्रेकिंग चेंज 2 — थिंकिंग ब्लॉक मॉडल से बँध जाते हैं

यहीं से मामला उलझने लगता है। थिंकिंग ब्लॉक अब यह दर्ज करते हैं कि उन्हें किस मॉडल ने बनाया, और वे सिर्फ़ एक ही दिशा में आगे ले जाए जा सकते हैं

✅ जो दिशा बची रहती है

पिछली पीढ़ी (Opus 5, Fable 5 या उससे पुराने) से Fable 5.1 पर आने वाली बातचीत अपनी रीज़निंग बरकरार रखते हुए चलती रहती है

❌ जो दिशा खो जाती है

Fable 5.1 से वापस पिछली पीढ़ी पर जाने से वहाँ चले टर्न की रीज़निंग खो जाती है। पिछली पीढ़ियाँ Fable 5.1 के थिंकिंग ब्लॉक पढ़ ही नहीं सकतीं

⚠️ सबसे खतरनाक बात यह है कि डिफ़ॉल्ट रूप से यह चुपचाप फेल होता है। जब कोई रिक्वेस्ट ऐसे ब्लॉक लेकर आती है जिन्हें वह पढ़ नहीं सकता, तो API उन ब्लॉक को मॉडल के सामने पहुँचने से पहले ही फेंक देता है। जो फेंका गया वह न input_tokens में गिना जाता है और न उसका बिल बनता है — यानी वह इनवॉइस में भी नहीं दिखता।

यह उन सभी डिज़ाइनों पर चोट करता है जो बातचीत के बीच में मॉडल बदलते हैं। राउटर, फ़ॉलबैक, लागत घटाने के लिए मॉडल का गतिशील चयन। इनमें से हर एक "चलता हुआ दिखता है, बस रीज़निंग गायब हो जाती है" वाली हालत में पहुँच सकता है।

इसे दिखाई देने लायक बनाने के लिए thinking-binding-controls-2026-08-01 बीटा हेडर लगाएँ। तब फेंके जाने की सूचना टॉप-लेवल input_transformations ऐरे में मिलती है। इसके बिना कोई सूचना मिलती ही नहीं।

4. ब्रेकिंग चेंज 3 — पिछला टर्न एडिट करने पर सब टूट जाता है

तीनों में सबसे व्यापक असर मौजूदा कोड पर इसी का पड़ता है। Fable 5.1 के थिंकिंग ब्लॉक से पहले बैठी किसी भी चीज़ को बदलना — system प्रॉम्प्ट, tools, या उससे पुराना कोई भी मैसेज — अगली रिक्वेस्ट को फेल कर देता है

The block is bound to a different conversation

वे पैटर्न जो आगे के सारे थिंकिंग ब्लॉक अमान्य कर देते हैं

  • पिछले टर्न को एडिट करना, क्रम बदलना या मिटाना और उसके बाद वाले टर्न बनाए रखना
  • हर रिक्वेस्ट पर पिछले टर्न में टेक्स्ट घुसाना और अगली रिक्वेस्ट में हटा देना (रिमाइंडर या स्टेटस लाइन)
  • उसी बातचीत के भीतर system प्रॉम्प्ट या tools ऐरे को दोबारा बनाना
  • कोई इमेज या डॉक्युमेंट URL जो बाद की रिक्वेस्ट में अलग बाइट लौटाए (जाँच बाइट की होती है, URL की नहीं, इसलिए एक ही फ़ाइल के लिए बदलते साइन्ड URL से कोई दिक्कत नहीं)

इसके उलट, जो करने से कुछ नहीं टूटता

  • थिंकिंग ब्लॉक शुरुआत से लगातार हटाना (सबसे पुराने पहले)
  • सर्वर-साइड कॉम्पैक्शन या कॉन्टेक्स्ट एडिटिंग से इतिहास छाँटना
  • cache_control मार्कर को खिसकाना
  • रिक्वेस्ट के बीच effort बदलना

ध्यान रहे कि शुरुआत के अलावा कहीं से भी एक थिंकिंग ब्लॉक खींच लेने पर उसके बाद का सब कुछ अमान्य हो जाता है

⚠️ यह आप पर लागू होगा या नहीं, यह इस पर निर्भर है कि आपका अकाउंट कब बना। यह जाँच 31 अगस्त 2026 को या उसके बाद बने अकाउंट पर अनिवार्य है। उससे पुराने अकाउंट पर API सिर्फ़ बेमेल दर्ज करता है और उस पर तभी अमल करता है जब आप thinking.block_binding.prefix_mismatch_behavior सेट करें।

अभी-अभी खड़ा किया गया स्टेजिंग एनवायरनमेंट फेल हो सकता है जबकि प्रोडक्शन नहीं — और इसका उलटा भी होता है।

कैसे पता करें कि आपका कोड इसकी चपेट में है

Anthropic ने एक ठोस तरीका बताया है। prefix_mismatch_behavior: "drop_block" सेट करें, एक सेशन चलाएँ, और input_transformations को लॉग करें। अगर आप इतिहास एडिट कर रहे हैं, तो वहाँ reason: "prefix_binding_mismatch" दिखाई देगा।

यह भी ध्यान दें कि Claude Code, claude.ai, Claude Managed Agents और Claude Agent SDK इस तरह बनाए गए हैं कि यह प्रीफ़िक्स न टूटे। दायरे में सिर्फ़ वह कोड आता है जो messages ऐरे खुद जोड़ता है।

5. कैश रीड चौथाई कीमत पर — असल बचत कितनी है

न इनपुट महँगा हुआ है, न आउटपुट। बदली है तो सिर्फ़ कैश रीड की कीमत।

मद प्रति 1M टोकन
बेस इनपुट $10
कैश राइट (5 मिनट) $12.50
कैश राइट (1 घंटा) $20
कैश रीड $0.25
आउटपुट $50
बैच प्रोसेसिंग इनपुट $5 / आउटपुट $25

इससे कितना फ़ायदा होगा, यह इस बात से तय होता है कि कैश किया गया प्रीफ़िक्स आप कितनी बार दोबारा पढ़ते हैं। बाकी Claude मॉडल पर एक कैश रीड बेस इनपुट का 0.1 गुना पड़ता है, जबकि Fable 5.1 और Mythos 5.1 पर 0.025 गुनाएजेंटिक रन जितना लंबा और वही प्रीफ़िक्स जितनी बार दोबारा पढ़ा जाएगा, अंतर उतना ही चौड़ा होगा।

Anthropic जो बचत बताता है वह है सामान्य वर्कलोड पर लगभग 25% और एजेंट-भारी काम पर लगभग 45% तककैश राइट और 512 टोकन की न्यूनतम कैश-योग्य लंबाई नहीं बदली है।

6. कोड बदले बिना भी बदल जाने वाले 7 व्यवहार

माइग्रेशन में नज़रअंदाज़ यहीं होता है। API का ढाँचा वही है, फिर भी उससे बाहर आने वाली चीज़ अलग है। Anthropic ने 7 गिनाए हैं।

समानांतर टूल कॉल कम हो जाते हैं

जहाँ Fable 5 उन्हें एक साथ छोड़ता था, वहाँ आपको एक टर्न में एक कॉल मिल सकता है। जवाब की गुणवत्ता नहीं गिरती, पर टोकन, राउंड ट्रिप और असल समय बढ़ जाते हैं

प्रगति का ब्योरा कम देता है

high effort पर यह सबसे साफ़ दिखता है। जो UI चलती हुई टिप्पणी पर टिका है वह चुप लगेगा

low effort पर याददाश्त से जवाब

यह सर्च और रिट्रीवल टूल कम बार बुलाता है। जिन टर्न में ताज़ा जानकारी चाहिए, वहाँ effort बढ़ाएँ

गद्य सघन हो जाता है

वाक्य लंबे चल सकते हैं और पैराग्राफ़ के विराम कम पड़ सकते हैं

फ़ॉर्मैटिंग घट जाती है

यह बोल्ड, हेडिंग और बुलेट पहले से कम इस्तेमाल करता है। पुराने मॉडल के लिए लिखे "फ़ॉर्मैट मत करो" वाले निर्देश अब ज़रूरत से ज़्यादा असर करते हैं

सारांश में उद्धरण बिना चिह्न के

किसी दस्तावेज़ का सारांश बनाते समय मूल का कोई अंश उद्धरण के तौर पर चिह्नित किए बिना दोहरा देने की संभावना ज़्यादा है

छोटे सुधार पर भी पूरा दोबारा लिखना

नतीजा वही रहता है, लेकिन आउटपुट टोकन और समय अतिरिक्त खर्च होते हैं

हर एक के लिए Anthropic ने प्रॉम्प्टिंग का उपाय दिया है। समानांतर कॉल के लिए एक पंक्ति जोड़ें कि स्वतंत्र रीड एक साथ भेजे जाएँ; और जब प्रगति चाहिए हो, तो शुरुआत, बीच और अंत का कथन स्पष्ट रूप से माँगें।

7. जो नया जोड़ा गया है

Anthropic 5 चीज़ें जुड़ी हुई गिनाता है। उनमें से एक है सस्ती कैश रीड, और चूँकि उसका वज़न सबसे ज़्यादा है, इसलिए उसे पीछे अध्याय 5 में अलग जगह दी गई है। आगे बाकी 4 हैं।

बातचीत के बीच effort बदलना (बीटा)

प्रॉम्प्ट कैश तोड़े बिना दक्षता ऊपर-नीचे करें। कठिन चरणों पर बढ़ाएँ, रूटीन पर घटाएँ

टर्न तक सीमित सिस्टम मैसेज (बीटा)

clear_at: "next_user_message"यही वह सुविधा है जो ब्रेकिंग चेंज 3 वाले "घुसाओ फिर हटाओ" पैटर्न की सुरक्षित जगह लेती है, बिना इतिहास दोबारा लिखे

प्रगति टेक्स्ट के रूप में (बीटा)

display: "updates"रीज़निंग छिपी रहती है और आपको सिर्फ़ टूल कॉल के बीच की प्रगति मुख्य टेक्स्ट के रूप में मिलती है

कंटेंट की उत्पत्ति

जनरेट किए टेक्स्ट पर सांख्यिकीय वॉटरमार्कन कोई टोकन बढ़ता है, न कोई छिपा अक्षर, और न उपयोगकर्ता या संगठन की कोई जानकारी जाती है। इमेज और वीडियो पर C2PA

दूसरे वाले को ध्यान से देखिए। "रिमाइंडर घुसाओ, फिर हटाओ" वाली जिस शैली को ब्रेकिंग चेंज 3 मना करता है, उसके सामने उसी मकसद को पूरा करने वाला विकल्प एक साथ आया है। माइग्रेशन को "यह करना बंद करो" नहीं, बल्कि "इसे यहाँ ले आओ" के रूप में रखा गया है।

8. माइग्रेशन के चरण — 5 जाँचें

मॉडल ID बदलने के अलावा Anthropic ये 5 बिंदु गिनाता है।

model = "claude-fable-5"    # Before
model = "claude-fable-5-1"  # After
  क्या जाँचें
1 tool_choice से any और tool हटाएँ। स्कीमा लागू कराने का काम strict tool use या structured outputs पर ले जाएँ
2 थिंकिंग ब्लॉक जैसे आए वैसे ही लौटाएँ, और इतिहास को सिर्फ़ जोड़ने लायक रखें। जो कुछ आप घुसाकर हटाते थे वह टर्न तक सीमित सिस्टम मैसेज पर जाए; system और tools के बदलाव बातचीत-के-बीच वाली सुविधा पर जाएँ
3 effort को डिफ़ॉल्ट (high) से दोबारा ट्यून करें। बातचीत के बीच बदलने पर भी विचार करें
4 देखें कि आपका एजेंट लूप कहीं एक टर्न में एक कॉल पर तो नहीं आ गया
5 अपने eval दोबारा चलाएँ। रिफ़्यूज़ल हैंडलिंग, फ़ॉलबैक और टोकन गिनती नहीं बदली हैं

रिफ़्यूज़ल के आसपास कुछ नहीं बदला। stop_reason: "refusal" अब भी लौटता है, और Fable 5.1 के लिए मंज़ूर फ़ॉलबैक हैं Opus 4.8 और Opus 5। कोई आउटपुट आने से पहले आया रिफ़्यूज़ल बिल नहीं होता, और मॉडल बदलने की प्रॉम्प्ट कैश लागत फ़ॉलबैक क्रेडिट के रूप में वापस मिल जाती है।

📌 डेटा 30 दिन तक रखा जाता है, और ज़ीरो डेटा रिटेंशन आम तौर पर उपलब्ध नहीं है (सिवाय वहाँ जहाँ Anthropic ने स्पष्ट मंज़ूरी दी हो)। Fable 5 और Mythos 5 की तरह यह भी Covered Model में आता है। आपकी शर्तों के हिसाब से यह अकेली बात तय कर सकती है कि आप इसे अपना सकते हैं या नहीं।

सारांश

  • यह फ्लैगशिप की अदला-बदली नहीं है। Anthropic लिखता है कि ज़्यादातर इस्तेमाल Opus 5 से शुरू होने चाहिए, और Fable 5.1 माँग भरी रीज़निंग तथा लंबे समय चलने वाले एजेंटिक काम के लिए है
  • ब्रेकिंग चेंज 3 हैं। ज़बरदस्ती कराया गया टूल कॉल 400 देता है / थिंकिंग ब्लॉक मॉडल से बँधते हैं / पिछला टर्न एडिट करने पर वे अमान्य हो जाते हैं
  • दूसरा वाला चुपचाप फेल होता है। जो ब्लॉक पढ़े नहीं जा सकते वे फेंक दिए जाते हैं और बिलिंग में कभी नहीं दिखते। इसे पकड़ने के लिए बीटा हेडर चाहिए
  • तीसरा इस पर लागू होता है कि अकाउंट कब बना था (31 अगस्त 2026 से अनिवार्य)। स्टेजिंग और प्रोडक्शन का व्यवहार अलग हो सकता है
  • कीमत नहीं बढ़ी। सिर्फ़ कैश रीड, घटकर चौथाई (बेस इनपुट का 0.025 गुना)। फ़ायदा इस पर निर्भर है कि वही प्रीफ़िक्स कितनी बार दोबारा पढ़ा जाता है
  • कोड बदले बिना 7 व्यवहार बदल जाते हैं। खासकर समानांतर टूल कॉल का घटना सीधे लागत और समय पर असर डालता है

FAQ

Q1. क्या मुझे तुरंत माइग्रेट कर लेना चाहिए?

कोई आपको जल्दी नहीं मचा रहा। Fable 5 legacy के रूप में उपलब्ध रहेगा, और सेवा बंद होने के बारे में कहा गया है कि वह 1 सितंबर 2027 से पहले नहीं होगीआगे बढ़ने की वजह लागत है — कैश रीड घटकर चौथाई रह जाती है, इसलिए रन जितना लंबा और वही प्रीफ़िक्स जितनी बार दोबारा पढ़ा जाए, फ़ायदा उतना ज़्यादा। अगर आपका ट्रैफ़िक ज़्यादातर छोटे इकहरे कॉल का है, तो फ़र्क कम रहेगा।

Q2. अगर मैं सिर्फ़ Claude Code इस्तेमाल करता हूँ, तो क्या ब्रेकिंग चेंज मुझ पर असर डालते हैं?

तीसरा वाला नहीं। Anthropic ने साफ़ कहा है कि Claude Code, claude.ai, Claude Managed Agents और Claude Agent SDK इस तरह बनाए गए हैं कि प्रीफ़िक्स न टूटे। असर उस कोड पर पड़ता है जो messages ऐरे खुद जोड़ता है

Q3. हम मॉडल गतिशील रूप से बदलते हैं। हमें क्या ठीक करना होगा?

यही दूसरे बदलाव का असली केंद्र है। Fable 5.1 से वापस पिछली पीढ़ी पर जाने से उस टर्न की रीज़निंग खो जाती है। और बुरा यह कि डिफ़ॉल्ट रूप से वह चुपचाप फेंक दी जाती है और बिलिंग में कभी नहीं दिखती। शुरुआत thinking-binding-controls-2026-08-01 बीटा हेडर लगाने, input_transformations को लॉग करने और यह नापने से करें कि फेंका जाना असल में हो भी रहा है या नहीं

Q4. Opus 5 और Fable 5.1 में से किसे चुनूँ?

Anthropic की बात को उसी रूप में मान लेना समझदारी है — पहले Opus 5 आज़माएँ, और Fable 5.1 की ओर तब जाएँ जब high effort पर भी बात न बने। कीमत इनपुट और आउटपुट दोनों पर Opus 5 से दोगुनी है, और सिर्फ़ कैश रीड ही उलटी दिशा में सस्ती है। काम कैसे बाँटें, इसका ब्योरा मॉडल चयन गाइड में है।

Q5. मैं कॉन्टेक्स्ट बचाने के लिए थिंकिंग ब्लॉक हटाना चाहता हूँ। क्या हटा सकता हूँ?

हटाने के तरीके पर शर्तें हैं। उन्हें शुरुआत से लगातार, सबसे पुराने पहले, हटाना ठीक है, लेकिन बीच से एक खींच लेने पर उसके बाद का हर थिंकिंग ब्लॉक अमान्य हो जाता है। अगर आप सर्वर-साइड कॉन्टेक्स्ट एडिटिंग या कॉम्पैक्शन इस्तेमाल करते हैं, तो वह एडिटिंग नहीं गिनी जाती।

Q6. आपने वॉटरमार्क का ज़िक्र किया। क्या इससे आउटपुट पर असर पड़ता है?

Anthropic कहता है कि नहीं — यानी गुणवत्ता और पठनीयता वही रहती है, न कोई टोकन बढ़ता है और न कोई छिपा अक्षर, और उपयोगकर्ता या संगठन की कोई जानकारी भी नहीं जाती। आपकी रिक्वेस्ट या रिस्पॉन्स में कोई बदलाव ज़रूरी नहीं। इमेज और वीडियो पर Files API के ज़रिए C2PA Content Credentials लगते हैं।

Q7. क्या मैं Mythos 5.1 इस्तेमाल कर सकता हूँ?

प्रदर्शन Fable 5.1 जैसा ही है, लेकिन पहुँच Project Glasswing के प्रतिभागियों तक सीमित है। फ़र्क सुरक्षा-उपायों में है: उदाहरण के लिए Terminal-Bench 4.0 पर Fable 5.1 को 55.8% मिलता है जबकि Mythos 5.1 को 60.9% — इस अंतर को Anthropic एक ही मॉडल पर अलग सुरक्षा-उपायों का नतीजा बताता है।

संबंधित लेख