ज्यादातर लोग यह मानते हैं कि सॉफ्टवेयर अपडेट एक फोन अपडेट की तरह होता है जहाँ आपको समान कीमत पर अधिक सुविधाएँ मिलती हैं। एंथ्रोपिक (Anthropic) ने क्लाउड फेबल 5.1 (Claude Fable 5.1) की रिलीज के साथ उस चक्र को तोड़ दिया है। हालाँकि यह मॉडल अपने पूर्ववर्ती की तुलना में काफी अधिक सक्षम है, लेकिन यह बाजार में एक अजीब स्थिति में है। इसे चलाने में एंथ्रोपिक द्वारा दो महीने पहले जारी किए गए मॉडल की तुलना में दोगुनी लागत आती है, और यह उपयोगकर्ताओं को सबमिट बटन पर क्लिक करने से पहले अपने बजट के बारे में अधिक गंभीरता से सोचने के लिए मजबूर करता है।
एंथ्रोपिक ने इस मंगलवार को क्लाउड फेबल 5.1 और उसके सहयोगी मिथोस 5.1 (Mythos 5.1) को जारी किया। जून में मूल फेबल 5 के लॉन्च के बाद से हाई-एंड मिथोस लाइन का यह पहला बड़ा अपडेट है। यह रिलीज कंपनी के लिए तीन महीने की उथल-पुथल भरी अवधि के बाद आई है। इस दौरान, एंथ्रोपिक को 18 दिनों के निर्यात-नियंत्रण शटडाउन और मूल्य निर्धारण विवाद का सामना करना पड़ा, जिससे कई उपयोगकर्ता सोच में पड़ गए कि उन्हें वास्तव में किस मॉडल का उपयोग करना चाहिए।
यह समझने के लिए कि यह अपडेट क्यों महत्वपूर्ण है, आपको यह देखना होगा कि इन मॉडलों का परीक्षण कैसे किया जाता है। एंथ्रोपिक 'टर्मिनल-बेंच-साइंस 0.1' (Terminal-Bench-Science 0.1) नामक परीक्षण का उपयोग करता है। यह बेंचमार्क मापता है कि क्या एक एआई एजेंट कंप्यूटर टर्मिनल के भीतर वैज्ञानिक अनुसंधान कार्य कर सकता है। यह अनिवार्य रूप से इस बात का परीक्षण है कि क्या एआई एक अथक इंटर्न के रूप में कार्य कर सकता है जो मानवीय मदद के बिना लैब कंप्यूटर को चलाना जानता है।
फेबल 5.1 ने इस परीक्षण में 52.6% स्कोर किया। तुलना के लिए, पिछले संस्करण, फेबल 5 ने केवल 24.7% अंक प्राप्त किए थे। मिड-रेंज फ्लैगशिप मॉडल, ओपस 5 (Opus 5) ने 29.0% स्कोर किया। सरल शब्दों में, नया मॉडल जटिल वैज्ञानिक तर्क में उस मॉडल की तुलना में दोगुना से भी अधिक बेहतर है जिसे उसने प्रतिस्थापित किया है। तीन महीनों में सुधार का यह स्तर उद्योग के लिए असामान्य है, जहाँ लाभ आमतौर पर एकल अंकों में मापा जाता है।
कोडिंग के लिए एक अलग परीक्षण—टर्मिनल-बेंच 4.0—पर मॉडल ने समान प्रगति दिखाई। फेबल 5.1 ने 55.8% कार्यों को सही ढंग से पूरा किया। यह फेबल 5 के 42.0% से एक महत्वपूर्ण छलांग है और ओपस 5 के 52.3% से काफी आगे है। डेटा से पता चलता है कि जो लोग कोड लिखने, चलाने और डीबग करने के लिए एआई का उपयोग करते हैं, उनके लिए फेबल 5.1 अब एंथ्रोपिक की लाइनअप में शीर्ष पसंद है।
| मॉडल का नाम | विज्ञान बेंचमार्क स्कोर | कोडिंग बेंचमार्क स्कोर | इनपुट मूल्य (प्रति 1M टोकन) | आउटपुट मूल्य (प्रति 1M टोकन) |
|---|---|---|---|---|
| Claude Fable 5.1 | 52.6% | 55.8% | $10 | $50 |
| Claude Fable 5 | 24.7% | 42.0% | $10 | $50 |
| Claude Opus 5 | 29.0% | 52.3% | $5 | $25 |
हालाँकि प्रदर्शन में उछाल प्रभावशाली है, लेकिन मूल्य निर्धारण रोजमर्रा के उपयोगकर्ता के लिए एक दुविधा पैदा करता है। जुलाई में, एंथ्रोपिक ने ओपस 5 जारी किया था। वह मॉडल एक बड़ी सफलता थी क्योंकि यह पुराने फेबल 5 से बेहतर था लेकिन इसकी लागत ठीक आधी थी। कुछ हफ्तों के लिए, ऐसा लगा कि हाई-एंड "फेबल" टियर खत्म हो गया है क्योंकि सस्ता मॉडल स्पष्ट रूप से बेहतर था।
फेबल 5.1 प्रदर्शन का ताज वापस पाकर इसे बदल देता है, लेकिन यह $10 प्रति मिलियन इनपुट टोकन और $50 प्रति मिलियन आउटपुट टोकन की मूल उच्च कीमत को बनाए रखता है। टोकन डिजिटल कच्चे तेल की तरह हैं जो एआई को शक्ति देते हैं। वे डेटा के छोटे टुकड़े हैं जिन्हें मॉडल संसाधित करता है, जो लगभग 750 शब्दों के बराबर होते हैं। यदि आप एक डेवलपर हैं जो प्रति घंटे हजारों अनुरोध चला रहे हैं, तो $10 बनाम $5 का भुगतान करना एक लाभदायक महीने और नुकसान के बीच का अंतर है।
एंथ्रोपिक 'रीजनिंग एफर्ट' (reasoning effort) नामक एक नई सुविधा के साथ इस झटके को कम करने की कोशिश कर रहा है। हर कार्य के लिए मॉडल को पूरी शक्ति पर चलाने के बजाय, उपयोगकर्ता एक प्रतीकात्मक डायल घुमा सकते हैं। कंपनी का दावा है कि फेबल 5.1 को कम या मध्यम प्रयास स्तर पर चलाने से पुराने फेबल 5 की तुलना में बेहतर परिणाम मिलते हैं लेकिन कम लागत पर। हालाँकि, उन उपयोगकर्ताओं के लिए जिन्हें उन समस्याओं को हल करने के लिए मॉडल की आवश्यकता है जिन्हें अन्य एआई छू भी नहीं सकते, उन्हें पूरी प्रीमियम दर का भुगतान करना होगा।
एक क्षेत्र ऐसा है जहाँ नया मॉडल वस्तुनिष्ठ रूप से सभी के लिए सस्ता है। एंथ्रोपिक ने कैश रीड की लागत में 75% की कटौती की है। एआई आर्किटेक्चर की दुनिया में, कैशिंग एक किताब को एक विशिष्ट पृष्ठ पर खुला रखने जैसा है ताकि आपको इसे दोबारा न खोजना पड़े। यदि आप एक एआई को एक घंटे में दस बार एक ही 500-पृष्ठ के दस्तावेज़ का विश्लेषण करने के लिए कहते हैं, तो कैशिंग एआई को हर बार पूरी चीज़ को दोबारा पढ़ने से बचाती है।
सामान्य काम के लिए, इससे लागत में लगभग 25% की कमी आती है। अत्यधिक एजेंटिक वर्कलोड के लिए—जहाँ एक एआई किसी प्रोजेक्ट को पूरा करने के लिए लगातार दर्जनों छोटे कदम उठाता है—बचत 45% तक पहुँच जाती है। यह पावर उपयोगकर्ताओं के लिए $10 की कीमत को अधिक सहनीय बनाता है, लेकिन यह इस तथ्य को नहीं बदलता है कि एक प्रश्न के लिए शुरुआती कीमत अभी भी उच्च बनी हुई है।
नए मॉडल तक पहुँच को भी इस तरह से वर्गीकृत किया गया है जो मानक ग्राहकों को निराश कर सकता है। यदि आपके पास क्लाउड प्रो (Claude Pro) योजना या मानक टीम सीट है, तो फेबल 5.1 आपके निश्चित मासिक शुल्क में शामिल नहीं है। आपको उपयोग क्रेडिट अलग से खरीदना होगा, ठीक वैसे ही जैसे प्रीपेड फोन काम करता है। केवल महंगे मैक्स (Max) प्लान या प्रीमियम एंटरप्राइज सीटों वाले लोगों को ही उनके सब्सक्रिप्शन के हिस्से के रूप में मॉडल मिलता है, और तब भी, यह केवल उनकी साप्ताहिक उपयोग सीमाओं के 50% तक ही कवर करता है।
एंथ्रोपिक ने फेबल 5.1 के साथ मिथोस 5.1 भी जारी किया। कंपनी इन्हें अलग-अलग सुरक्षा फिल्टर के साथ एक ही अंतर्निहित मॉडल के रूप में वर्णित करती है। फेबल 5.1 वह संस्करण है जिसका उपयोग आम जनता करती है। इसमें खतरनाक गतिविधियों में मदद करने से रोकने के लिए सख्त सुरक्षा उपाय हैं।
मिथोस 5.1 अलग है। यह साइबर सुरक्षा और जीवन विज्ञान में जांचे गए पेशेवरों तक सीमित है। इन विशेषज्ञों को यह समझने के लिए एआई की आवश्यकता होती है कि वायरस कैसे काम करते हैं या हैकर्स सिस्टम में कैसे सेंध लगाते हैं ताकि वे बेहतर सुरक्षा बना सकें। चूंकि मिथोस 5.1 में हल्के फिल्टर हैं, इसलिए इसने वास्तव में कोडिंग परीक्षणों पर उच्च स्कोर किया—फेबल 5.1 के 55.8% की तुलना में 60.9%। यह अंतर इसलिए मौजूद है क्योंकि मानक सुरक्षा फिल्टर कभी-कभी वैध कोडिंग कार्यों को दुर्भावनापूर्ण समझ लेते हैं और एआई को उन्हें पूरा करने से रोक देते हैं।
यदि आप ईमेल को सारांशित करने या कवर लेटर लिखने जैसे बुनियादी कार्यों के लिए एआई का उपयोग करते हैं, तो आपको शायद फेबल 5.1 को अनदेखा कर देना चाहिए। ओपस 5 मॉडल रोजमर्रा के काम के लिए बेहतर मूल्य बना हुआ है। यह तेज़, सस्ता और सामान्य लेखन कार्यों के लिए पर्याप्त सक्षम है। ईमेल सारांश के लिए फेबल 5.1 का उपयोग करना वैसा ही है जैसे आप अपने चौथी कक्षा के गणित के होमवर्क में मदद करने के लिए किसी रॉकेट वैज्ञानिक को काम पर रखें।
हालाँकि, यदि आप एक सॉफ्टवेयर इंजीनियर या शोधकर्ता हैं, तो गणित बदल जाता है। 52% सफलता दर पर वैज्ञानिक अनुसंधान कार्यों को पूरा करने की क्षमता एक मौलिक बदलाव है। इसका मतलब है कि एआई एक साधारण टेक्स्ट जनरेटर से एक कार्यात्मक एजेंट की ओर बढ़ रहा है जो बहु-चरणीय प्रक्रियाओं को संभाल सकता है। इन उपयोगकर्ताओं के लिए, उच्च कीमत उनके द्वारा बचाए गए समय के लिए एक व्यावहारिक समझौता है।
बड़ी तस्वीर को देखते हुए, फेबल 5.1 दिखाता है कि एआई उद्योग दो रास्तों में विभाजित हो रहा है। एक रास्ता जनता के लिए एआई को यथासंभव सस्ता बनाने पर केंद्रित है। दूसरा रास्ता, जिसका प्रतिनिधित्व फेबल 5.1 करता है, लागत की परवाह किए बिना कंप्यूटर क्या कर सकते हैं, इसकी सीमा को आगे बढ़ा रहा है। एक उपभोक्ता के रूप में, अब आपको यह तय करना होगा कि आप एक बुनियादी उपकरण के लिए भुगतान कर रहे हैं या एक उच्च-प्रदर्शन इंजन के लिए। अगले सप्ताह अपनी स्वयं की उपयोग की आदतों का निरीक्षण करें। यदि आप पाते हैं कि आप एआई से एक ही कार्य को तीन बार करने के लिए कह रहे हैं, इससे पहले कि वह इसे सही कर पाए, तो एक स्मार्ट मॉडल की प्रीमियम कीमत वास्तव में लंबे समय में आपके पैसे बचा सकती है।
Sources:
Anthropic Official Technical Announcement (September 2026)
Terminal-Bench Science 0.1 Performance Report
Anthropic API Pricing Schedule
Cyber and Life Sciences Verification Program Documentation



हमारा एंड-टू-एंड एन्क्रिप्टेड ईमेल और क्लाउड स्टोरेज समाधान सुरक्षित डेटा एक्सचेंज का सबसे शक्तिशाली माध्यम प्रदान करता है, जो आपके डेटा की सुरक्षा और गोपनीयता सुनिश्चित करता है।
/ एक नि: शुल्क खाता बनाएं