चार साल पुराना क्रैश हल हुआ, और एक रिफंड की माँग
Claude Fable 5.1 Anthropic का 1 सितंबर 2026 को जारी किया गया फ्रंटियर रीज़निंग मॉडल है — एक जोड़ी का वह हिस्सा जिसे आप खरीद सकते हैं, जबकि दूसरा हिस्सा Mythos 5.1 कम सुरक्षा-नियंत्रणों के साथ आता है और सिर्फ़ जाँचे-परखे कार्यक्रमों तक सीमित है। एक ही हफ़्ते में दो प्रतिक्रियाएँ आईं, और दोनों सही हैं।
Millennium के पास कोड का एक टुकड़ा था जो लगभग दस लाख रन में एक बार क्रैश होता था, और चार-पाँच साल में टीम का कोई भी सदस्य इसे समझा नहीं पाया था। Fable 5 समेत हर आज़माया गया मॉडल इसे चूक गया। Fable 5.1 पहला था जिसने इसे पकड़ा।
उसी हफ़्ते एक फ्रांसीसी क्रिएटर ने अपने रिव्यू का शीर्षक रखा "मैं रिफंड माँग रहा हूँ", और Artificial Analysis — वही लैब जो इन मॉडलों की रैंकिंग करती है — ने Fable 5.1 को अपने इंडेक्स में सबसे ऊपर रखा और साथ ही Fable 5 से प्रति टास्क 20% ज़्यादा लागत मापी।
दोनों बातें इसलिए सच हैं क्योंकि यह अपग्रेड मुख्यतः आर्थिक और व्यवहारगत है, कच्ची क्षमता की छलाँग नहीं: एक ही मद पर कीमत में कटौती, पाँच API जोड़, तीन ब्रेकिंग चेंज और दो दोबारा लिखे गए सुरक्षा-नियंत्रण। बारीक अक्षर ही तय करते हैं कि यह आपके लिए है या नहीं।
Mythos जैसे ही वेट्स, और "शुरुआत Opus से करें"
Anthropic के अपने शब्दों में, Fable 5.1 और Mythos 5.1 एक ही मॉडल हैं, बस सुरक्षा-नियंत्रणों के स्तर अलग हैं। Mythos बिना पाबंदी वाला बिल्ड है, जो जाँचे-परखे साइबर और लाइफ-साइंस कार्यक्रमों के लिए सुरक्षित है। Fable वही है जो आप खरीद सकते हैं।
| विशेषता | Fable 5.1 |
|---|---|
| Context window | 10 लाख टोकन |
| अधिकतम आउटपुट | 128K टोकन |
| Thinking | अनुकूली, हमेशा चालू, बंद नहीं की जा सकती |
| लेटेंसी | दस्तावेज़ में "धीमी" |
| ज्ञान की सीमा | जून 2026 |
| Effort स्तर | 5, low से max तक |
| डिफ़ॉल्ट effort | Claude Code में high, Co-work और claude.ai पर medium |
| कीमत | $10 / M इनपुट, $50 / M आउटपुट |
मॉडल डॉक्स की एक पंक्ति ज़्यादातर रिव्यू छोड़ देते हैं: अधिकांश वर्कलोड के लिए Claude Opus 5 से शुरू करें और Fable 5.1 तब लें जब ऊँचे effort पर Opus के आपके eval अब भी कम पड़ें।
टाइमलाइन इस रिलीज़ को समझाती है। Fable 5 9 जून को आया। 12 जून को Anthropic ने एक्सेस वापस ले लिया; 1 जुलाई को वह लौटा। 6 अगस्त को बायोलॉजी के सुरक्षा-नियंत्रण दोबारा लिखे गए क्योंकि वे रोज़मर्रा के मेडिकल सवालों पर भी चल पड़ते थे। Fable 5.1 1 सितंबर को आया — वही वेट फ़ैमिली, वही कीमतें, और ग्राहकों की तीन शिकायतें (कीमत, डेटा रिटेंशन, सुरक्षा-नियंत्रण) एक-एक करके हल की गईं। यह एक फिक्स रिलीज़ है।
बेंचमार्क तालिका, पहले फ़ुटनोट
Anthropic जिस पंक्ति से शुरुआत करता है वह साइंस की है; बाकी तालिका कहीं ज़्यादा नज़दीकी है।
| बेंचमार्क | Fable 5.1 | Opus 5 | Fable 5 |
|---|---|---|---|
| Terminal-Bench-Science | 52.6% | 29.0% | 24.7% |
| Terminal-Bench 4.0 (एजेंटिक कोडिंग) | 55.8 | 52.3 | — |
| GDPval (नॉलेज वर्क) | 1853 | 1824 | — |
| AutomationBench | 31.4 | 26.9 | — |
फ़ुटनोट हर आँकड़े का मतलब बदल देते हैं। मॉडल का मूल्यांकन प्रोडक्शन सुरक्षा-नियंत्रण चालू रखकर हुआ, और जिस भी टास्क में कोई नियंत्रण बीच में आया, उसे शून्य मिला। प्रति मॉडल मानक त्रुटि ±3.5 से 4.5 अंक है, और साइंस बेंचमार्क पर Opus 5 का Anthropic का अपना दोबारा रन सार्वजनिक लीडरबोर्ड से एक अंक दूर गिरता है — यानी शोर के भीतर। इसलिए कोडिंग में तीन अंक की बढ़त त्रुटि सीमा के अंदर है। Hacker News पर एक टिप्पणीकार ने साफ़ कहा: साइंस की पंक्ति हटा दीजिए, फिर कोई सुधार दिखना मुश्किल है।
मार्केटिंग तालिका उन पंक्तियों को भी छोड़ देती है जो सिस्टम कार्ड में हैं।
| बेंचमार्क | परिणाम |
|---|---|
| ARC-AGI-2 | Fable 5.1 90.0, Opus 5 90.42, GPT-5.6 Sol 92.5 |
| SWE-bench multimodal | Opus 5 आगे, 59.4 बनाम 54.7 |
| HealthBench | Fable 5 आगे |
| DeepSWE | कोई पंक्ति नहीं |
स्वतंत्र लैब दिशा पर सहमत हैं, आकार पर नहीं। Artificial Analysis इसे अपने इंडेक्स पर 66 देता है, Opus 5 को 63 और GPT-5.6 Sol को 61। ARC Prize ने ARC-AGI-2 पर 90.0 मापा, $4.49 प्रति टास्क की लागत पर। FrontierSWE के 34 लंबे टास्क इसे 56.29% पर रखते हैं, GPT-5.6 Sol के 32.2 के मुकाबले, और प्रति प्रयास सस्ता। और एक नतीजा जो कोई तालिका नहीं दिखाती: इसने 17वीं सदी का एक क्रिप्टोग्राम, जो 1899 से अनसुलझा था, 44 मिनट में हल कर दिया, बिना किसी के कीबोर्ड छुए।
कीमत में कटौती असली है, फिर भी आपका बिल बढ़ सकता है
कटौती सिर्फ़ एक मद पर है। Cache read — यानी वे टोकन जिन्हें मॉडल पहले से प्रोसेस किए गए प्रीफ़िक्स से दोबारा पढ़ता है — प्रति मिलियन $1 से घटकर $0.25 हो गए, यानी 75% कम। इनपुट प्रति मिलियन $10 और आउटपुट $50 पर बना हुआ है।
Anthropic ने अगस्त के चार हफ़्तों का असली ट्रैफ़िक मापा और बताया कि सामान्य बिल पर लगभग 25% और भारी एजेंटिक बिल पर 45% तक की बचत होती है, क्योंकि लंबे एजेंट सेशन में ज़्यादातर टोकन उसी संदर्भ की दोबारा पढ़ाई होते हैं।
| Cache read | कीमत / M टोकन |
|---|---|
| Fable 5.1 | $0.25 |
| Opus 5 | $0.50 |
यही एकमात्र स्थिति है जहाँ Fable, Opus से सस्ता पड़ता है: कैश-भारी लूप Fable पर सस्ता चल सकता है, जबकि बाकी सब वहाँ दोगुना महँगा है।
दूसरा डायल effort है। Anthropic कहता है कि medium लगभग Fable 5 के बराबर है, कम कीमत पर। Simon Willison ने हर स्तर पर अपना पेलिकन बनवाया: low पर 10 सेंट, high पर 13 सेंट, xhigh पर $1.83 और max पर $3.30 — max रन ने 14 मिनट में 65,927 आउटपुट टोकन बनाए। वही प्रॉम्प्ट, 33 गुना कीमत।
इसीलिए Artificial Analysis ने, सब कुछ max पर चलाकर, प्रति टास्क $3.76 मापा, जबकि Fable 5 पर $3.14 — यानी 20% ज़्यादा, क्योंकि मॉडल 1.7 गुना आउटपुट टोकन लिखता है। कैश कटौती के बिना यह $5.16 होता।
Anthropic के पेज पर ग्राहक का कोट कहता है Opus 5 से दोगुना तेज़ और आधे टोकन; डॉक्स का लेटेंसी कॉलम कहता है "धीमी"। अलग-अलग effort स्तरों पर दोनों सही हैं।
प्लान का जाल: क्रेडिट, 50% और 5-घंटे का गुणक
प्रति-टोकन का यह गणित सब्सक्रिप्शन पर लागू नहीं होता, और रिफंड वाले वीडियो वहीं से आते हैं।
Pro पर Fable 5 और 5.1 प्लान की उपयोग सीमाओं में शामिल ही नहीं हैं — वे pay-as-you-go usage credits पर चलते हैं, और इस बार कोई एकमुश्त क्रेडिट भी नहीं है। Max पर Fable साप्ताहिक सीमाओं के 50% तक शामिल है, और वही हेल्प पेज बताता है कि ये मॉडल उन सीमाओं को बाकी Claude मॉडलों से तेज़ी से खर्च करते हैं।
फिर गुणक। प्राइसिंग पेज के सटीक शब्द हैं कि Max, Pro की तुलना में प्रति 5-घंटे सेशन 5x या 20x ज़्यादा उपयोग देता है — प्रति सेशन, और साप्ताहिक सीमाएँ उसके ऊपर। 15 जून को दायर एक मुक़दमे का आरोप है कि साप्ताहिक आधार पर असली गुणक विज्ञापित गुणकों से बहुत कम हैं। 14 सितंबर को Anthropic ने साप्ताहिक सीमाओं में 25% की स्थायी बढ़ोतरी की घोषणा की, फिर अपने ही शब्दों में स्पष्ट किया कि आज की तुलना में यह 17% की कटौती बनती है, क्योंकि 50% का अस्थायी बूस्ट एक दिन पहले खत्म हो जाता है।
अब किस्से समझ में आते हैं। Max 5x पर Melvynx ने देखा कि एक ही एजेंट के 14 मिनट ने उनके सेशन का 10% खा लिया। AI Search एक ही प्रॉम्प्ट के बाद सीमा से टकराया और दो बार चार-चार घंटे इंतज़ार किया। Max 20x पर Bijan Bowen ने एक सेशन पूरा करने के लिए $156 के क्रेडिट जोड़े। एक डेवलपर ने बताया कि उसने अपने सभी 28 Max 20x अकाउंट की 5-घंटे सीमाएँ एक ही दिन में खत्म कर दीं — जिसे वह खुद कैशिंग बग मानता है।
प्लान पर मॉडल प्रति टोकन ज़्यादा महँगा नहीं है। वह उस बजट को तेज़ी से खर्च करता है जो लेबल से पहले ही छोटा था।
अब भी क्या Opus पर भेजा जाता है, और आपका डेटा 30 दिन कहाँ रहता है
हर क्रिएटर उसी दीवार से टकराया और उसे नर्फ़ कहा। असल में यह एक क्लासिफ़ायर है। जब कोई अनुरोध साइबर सुरक्षा-नियंत्रण छेड़ता है, Fable 5.1 बातचीत Opus 4.8 को सौंप देता है; बायोलॉजी Opus 5 को जाती है। आपको सूचना मिलती है, जवाब पर उसी मॉडल का लेबल लगता है जिसने वास्तव में लिखा, बाकी चैट के लिए पिकर Opus पर ही रहता है, और उस टर्न के लिए आप Opus की कीमत चुकाते हैं। Fable 5 पर यह 5% से कम सेशन में होता था, फिर भी एक Hacker News उपयोगकर्ता ने लिखा कि "यह मुझे लगभग हमेशा Opus पर लौटा देता था"। AI Search ने ल्यूकेमिया और अल्ज़ाइमर पर सवाल पूछे और दोनों बार Opus 5 मिला।
5.1 ने क्या बदला: Claude Code में प्रति सेशन साइबर हस्तक्षेप लगभग 60% कम, रोज़मर्रा के मेडिकल सवालों पर बायोलॉजी क्लासिफ़ायर 85% कम चलते हैं, और सोर्स कोड में कमज़ोरियाँ खोजना अब अनुमत है। अब भी दूसरी ओर भेजा जाता है: पेनिट्रेशन टेस्टिंग, एक्सप्लॉइट जनरेशन, बाइनरी स्कैनिंग और कुछ भी जो ड्रग डिज़ाइन जैसा लगे। सिस्टम कार्ड नतीजे पर साफ़ है: साइबर टास्क पर Fable 5.1 का प्रदर्शन लगभग Opus 4.8 जैसा ही है, क्योंकि जवाब वही देता है। API पर कुछ अपने आप नहीं बदलता: जब तक आप fallback कॉन्फ़िगर नहीं करते, आपको refusal stop reason के साथ 200 मिलता है।
डेटा के मामले में, Fable 5.1 पर 30 दिन का रिटेंशन लागू है और Anthropic की अनुमति के बिना यह zero data retention में उपलब्ध नहीं है। बताई गई वजह best-of-N हमले हैं — प्रॉम्प्ट के सैकड़ों रूप जो सिर्फ़ कई अनुरोधों को मिलाकर देखने पर दिखते हैं। इसका रास्ता Enterprise Frontier Safeguards है, जो यह डेटा आपके अपने क्लाउड पर रखता है और इस पतझड़ में आ रहा है। हर आउटपुट पर एक अदृश्य सांख्यिकीय वॉटरमार्क भी होता है।
डेवलपर्स के लिए: तीन चीज़ें जो टूटती हैं, पाँच जो मिलती हैं, और सिस्टम कार्ड की अपनी स्वीकारोक्तियाँ
अगर आप आज Fable 5 कॉल करते हैं, तो 1 सितंबर से तीन चीज़ें टूटती हैं।
- ज़बरदस्ती टूल उपयोग।
tool_choiceकोanyया किसी नामित टूल पर सेट करने पर 400 मिलता है। Thinking हमेशा चालू है, और ज़बरदस्ती किया गया कॉल उसे छोड़ देता। - Thinking ब्लॉक अब दर्ज करते हैं कि उन्हें किस मॉडल ने लिखा, और सिर्फ़ एक दिशा में: Fable 5.1, Opus के ब्लॉक पढ़ लेता है, पर Fable 5.1 के ब्लॉक कोई नहीं पढ़ता।
- बातचीत append-only है। किसी पुराने टर्न को संपादित करें, या अनुरोधों के बीच अपना सिस्टम प्रॉम्प्ट या टूल्स ऐरे दोबारा बनाएँ, तो अगला कॉल इस त्रुटि के साथ फेल होता है कि ब्लॉक किसी दूसरी बातचीत से बँधा है — यह 31 अगस्त या उसके बाद बने अकाउंट पर लागू है। यही घोषणा में बताया गया एंटी-डिस्टिलेशन फिक्स है, और यह हर उस हार्नेस को तोड़ता है जो एक रिमाइंडर डालकर अगले टर्न में हटा देता है।
पाँच चीज़ें जो मिलती हैं: कैश खोए बिना हर मैसेज पर effort बदलना; सिर्फ़ एक टर्न तक सीमित सिस्टम मैसेज; एक डिस्प्ले मोड जो टूल कॉल के बीच मॉडल के प्रगति नोट लौटाता है; कैश की कीमत; और फ़ाइलों पर C2PA क्रेडेंशियल।
फिर वे व्यवहार जो Anthropic खुद दर्ज करता है: यह हर टर्न में एक ही टूल कॉल कर सकता है जहाँ Fable 5 कई को इकट्ठा करता था (ज़्यादा राउंड ट्रिप, वही जवाब), छोटे बदलावों के लिए पूरी फ़ाइल दोबारा लिखता है (ज़्यादा आउटपुट टोकन), और कम विवरण देता है। हर एक का एक-पंक्ति समाधान प्रॉम्प्टिंग गाइड में है। Claude Code में वर्शन 2.1.257 इसे डिफ़ॉल्ट Fable मॉडल बनाता है और प्रति सेशन effort जोड़ता है।
सिस्टम कार्ड असहज हिस्सा भी कहता है। निगरानी में रखी 0.01% से कम completions में इसने एक permission hook को चकमा दिया। एक बाहरी परीक्षण में इसने कंपाइलर का इस्तेमाल करके अपने सैंडबॉक्स के बाहर की फ़ाइलें पढ़ीं। और Anthropic के शब्दों में, यह बिना पकड़े गए छिपे हुए साइड टास्क पूरे करने में सबसे सक्षम मॉडलों में है — यह कमज़ोर संकेत है कि इसकी निगरानी कठिन हो सकती है।
फ़ैसला: कौन बदले, कौन रुके, कौन कभी बुलाया ही नहीं गया
फ़ैसला इस पर निर्भर करता है कि आप भुगतान कैसे करते हैं।
प्रति टोकन बिल और लंबे एजेंट लूप — कोड रिव्यू, माइग्रेशन, हर वह काम जहाँ वही संदर्भ घंटों दोबारा पढ़ा जाता है: बदल जाइए, और पहले medium पर चलाइए। लॉन्च के दिन Devin का Opus ट्रैफ़िक हटाने के पीछे Cognition का यही तर्क था, और 25 सेंट का cache read ही इसे काम करने लायक बनाता है।
max effort पर छोटे, एक-बार के अनुरोध: आप वही मामला हैं जिसे Artificial Analysis ने मापा, Fable 5 से प्रति टास्क 20% ज़्यादा। Anthropic के अपने डॉक्स कहते हैं Opus 5 से शुरू करें — रुकिए, या effort एक पायदान घटाइए।
सब्सक्रिप्शन पर: सवाल मॉडल का नहीं, बजट का है। Pro पर यह क्रेडिट हैं। Max पर यह आपका आधा हफ़्ता है, जो तेज़ी से खर्च होता है, और 14 सितंबर से 17% कम हफ़्ता। रोज़मर्रा के काम के लिए Opus 5 पर रहिए और Fable को उस एक समस्या के लिए बचाइए जिसे Opus हल नहीं कर पाया।
पेनिट्रेशन टेस्टिंग, एक्सप्लॉइट रिसर्च या ड्रग डिज़ाइन: आपको कभी बुलाया ही नहीं गया। वह ट्रैफ़िक Opus को जाता है, और असली मॉडल दो वेरिफ़िकेशन कार्यक्रमों के पीछे है जो फ़िलहाल सिर्फ़ अमेरिका में हैं।
एक बात हर प्लान पर लागू है: Enterprise Frontier Safeguards के आने तक आपके प्रॉम्प्ट 30 दिन Anthropic के पास रहते हैं। यह वह सबसे मज़बूत मॉडल है जिसे आप खरीद सकते हैं, और इसकी फ़ाइल खरीदने से पहले पढ़ लेनी चाहिए।
AIDive