Workstation Logo
एआई समाधान
एआई वर्कस्टेशनAI SME Packagesप्राइवेट एआईजीपीयू क्लस्टरएज एआईएंटरप्राइज एआई लैबउद्योग अनुसार एआईWSL ProxyRing Promoter
उत्पाद
AI SME PackagesCRMमार्केटिंगOpenAI एजेंट्सWSL ProxyRing Promoter
हमारे बारे में
साझेदारग्राहक कहानियाँ
लेख
प्रलेखन
ब्लॉग
संपर्क करेंLogin
Workstation

AI workstations, AI Multi Agentic Software, GPU infrastructure, and intelligent agent solutions for modern businesses.

UK Office: 77-79 Marlowes, Hemel Hempstead HP1 1LF - Directions - Take Junction 20 off M25 Outer London
Company No: 11641870
Mon - Fri: 9:00 AM - 6:00 PM GMT
+44 7515 356 146

Belgium Office: Workstation SRL, Rue Vanderkindere 34, 1180 Uccle, Brussels
BE 0751.518.683
Mon - Fri: 9:00 AM - 6:00 PM CET
+32 492 45 67 46

AI Solutions

AI WorkstationsAI SME PackagesPrivate AIGPU ClustersEdge AIEnterprise AIWSL ProxyRing Promoter

Resources

ArticlesDocumentationBlogSearch

Company

About UsPartnersContact

© 2026 Workstation AI. All rights reserved.

PrivacyCookies
Home / Articles / Technology
एआईकोडिंगFinOps

Claude मॉडल तुलना: Haiku vs Sonnet vs Opus vs Fable 5 (Mythos 5)

मॉडल स्पेक्स, लागत/टोकन अर्थशास्त्र, effort और thinking के अंतर, तथा Haiku, Sonnet, Opus, Fable 5 और gated Mythos 5 पर प्रोडक्शन राउटिंग ब्लूप्रिंट की गहन गाइड।

July 8, 2026Technology11 min read

यह दीर्घ-रूप संदर्भ है. पांच मिनट के स्किम संस्करण (त्वरित तालिका + राउटर नियम) के लिए, देखें साथी ब्लॉग.

Claude models comparison: Haiku, Sonnet, Opus, Fable 5, Mythos 5

1. क्लाउड मॉडल की तुलना आखिर क्यों करें?

अधिकांश टीमें पैसे नहीं खोतीं क्योंकि उनके संकेत ख़राब होते हैं। वे पैसे खो देते हैं क्योंकि वे हर चीज़ के लिए सबसे महंगे मॉडल का उपयोग करते हैं, या क्योंकि वे मॉडल की पसंद को एक अस्पष्ट प्राथमिकता की तरह मानते हैं बजटीय उत्पाद निर्णय. क्लाउड का लाइनअप स्पष्ट रूप से स्तरीय है: इसे इसलिए बनाया गया है ताकि आप मिलान कर सकें कार्य का आकार सबसे छोटे मॉडल के लिए जो इसे अच्छी तरह से पूरा करेगा।

व्यावहारिक परिणाम: मॉडल चयन सबसे सरल लीवरों में से एक है जिसे आप सुधार के लिए उपयोग कर सकते हैं विलंबता, गुणवत्ता, और प्रति परिणाम लागत एक ही समय में.

2. आधुनिक क्लाउड लाइनअप (2026)

सभी मौजूदा क्लाउड मॉडल समर्थन करते हैं पाठ और छवि इनपुट, बहुभाषी क्षमताएँ, और दृष्टि, और वे क्लाउड ⟦एपीआई⟧, क्लाउड प्लेटफ़ॉर्म पर AWS, Amazon Bedrock, Google क्लाउड और Microsoft फाउंड्री के माध्यम से उपलब्ध हैं।

2.1 विशिष्टताएँ जिनकी आपको वास्तव में परवाह करनी चाहिए

मॉडल ⟦एपीआई⟧ आईडी प्रसंग विंडो अधिकतम आउटपुट मूल्य निर्धारण (इनपुट/आउटपुट) विचारशील आचरण
Claude Haiku 4.5 claude-haiku-4-5-20251001 (उपनाम: claude-haiku-4-5) 200K टोकन 64K टोकन $1 / $5 प्रति एमटोक विस्तारित सोच उपलब्ध (अनुकूली बंद)
Claude Sonnet 5 claude-sonnet-5 1एम टोकन 128K टोकन $3 / $15 प्रति एमटोक अनुकूली सोच सदैव चालू रहती है
Claude Opus 4.8 claude-opus-4-8 1एम टोकन 128K टोकन $5 / $25 प्रति एमटोक अनुकूली सोच सदैव चालू रहती है
Claude Fable 5 claude-fable-5 1एम टोकन 128K टोकन $10 / $50 प्रति एमटोक अनुकूली सोच सदैव चालू रहती है

Claude Mythos 5 (claude-mythos-5) गेटेड है और Fable 5 के समान विशिष्टताओं और कीमतों को साझा करता है, लेकिन इसे एक अलग सुरक्षा आर्किटेक्चर (Fable 5 के समान कोई सुरक्षा क्लासिफायर नहीं) के साथ जोड़ा गया है। यदि आपके पास पहुंच नहीं है, तो आप अभी भी जहां उपलब्ध हो वहां Fable 5 का उपयोग करके अनिवार्य रूप से वही एकीकरण तर्क चला सकते हैं।

2.2 ज्ञान कटऑफ (यह "वर्तमान जानकारी" के लिए क्यों महत्वपूर्ण है)

एंथ्रोपिक के मॉडल अवलोकन सूचियाँ:

  • विश्वसनीय ज्ञान कटऑफ: Fable 5 / Opus 4.8 / Sonnet 5 के लिए जनवरी 2026; फरवरी 2025 Haiku 4.5 के लिए।
  • प्रशिक्षण डेटा कटऑफ: मोटे तौर पर Fable 5 / Opus 4.8 / Sonnet 5 के लिए जनवरी 2026; Haiku 4.5 के लिए जुलाई 2025।

व्यावहारिक दृष्टिकोण: यदि आपको कटऑफ के बाद तथ्यों की आवश्यकता है, तो उपयोग करें पुनर्प्राप्ति (RAG) या एक उपकरण, मॉडल स्तर की परवाह किए बिना।

3. व्यवहार में स्तरों का क्या अर्थ है

3.1 विलंबता और आउटपुट-टोकन वास्तविकता

संपूर्ण लाइनअप में, टोकन अर्थशास्त्र अधिक भिन्न होता है आउटपुट इनपुट की तुलना में. इसके बारे में सोचने का एक सरल तरीका:

  • जब आप संक्षिप्त संरचित उत्तर चाहते हैं तो हाइकु सबसे सस्ता (और सबसे तेज़) है।
  • ओपस और सॉनेट अधिक खर्च करते हैं, लेकिन जब आपके संकेत सीमित होते हैं तब भी उनका पैमाना अच्छा होता है।
  • Fable 5 महंगा है क्योंकि यह कठिन, लंबे समय तक चलने के लिए है जहां मॉडल को समय के साथ दायरे में रहने की आवश्यकता होती है।

यदि आप किसी मॉडल को अनबाउंड टेक्स्ट तैयार करने देते हैं, तो आउटपुट टोकन खर्च पर हावी हो जाते हैं। इसीलिए अधिकतम आउटपुट (या टीएलडीआर-प्रथम के लिए मजबूत निर्देश) सभी स्तरों के लिए मायने रखता है, न कि केवल Fable 5 के लिए।

3.2 अनुकूली बनाम विस्तारित सोच

एंथ्रोपिक की अवलोकन तालिका दो अंतरों पर प्रकाश डालती है:

  • Fable 5 / Opus 4.8 / Sonnet 5 अनुकूली सोच हमेशा चालू रखें।
  • Haiku 4.5 विस्तारित सोच उपलब्ध है, लेकिन अनुकूली सोच बंद है।

व्यावहारिक दृष्टिकोण: उच्च-मात्रा वाले कार्यों के लिए हाइकु का उपयोग करें, लेकिन ध्यान रखें कि यह समान लंबे-क्षितिज वाले "हमेशा अनुकूलित" व्यवहार के लिए अनुकूलित नहीं है। जब आप अस्पष्टता या गहरी योजना की जरूरतों से जूझते हैं, तो सॉनेट/ओपस/फेबल की ओर कदम बढ़ाएं।

3.3 लागत-गुणवत्ता डायल के रूप में प्रयास करें

Fable 5 और Mythos 5 पर बुद्धिमत्ता, विलंबता और लागत के बीच व्यापार-बंद के लिए प्रयास प्राथमिक नियंत्रण है। Opus 4.8 और Sonnet 5 API सतहों पर प्रयास नियंत्रण को भी उजागर करते हैं।

व्यावहारिक निहितार्थ: सबसे आम प्रवासन गलती "गलत संकेत" नहीं है। यह "हर जगह अधिकतम प्रयास" है। अधिकांश उत्पादन कार्यभार के लिए, आप जानबूझकर प्रयास को रूट करके सर्वोत्तम मूल्य प्राप्त करते हैं (कम/मध्यम पर सस्ते कार्य, उच्च प्रयास पर कठिन कार्य)।

4. एक निर्णय मैट्रिक्स जिसे आप लागू कर सकते हैं

यह पूछने के बजाय कि "कौन सा मॉडल सबसे अच्छा है?", पूछें "कौन सा मॉडल खत्म हो सकता है।" यह सबसे कम महंगे टोकन के साथ वर्कफ़्लो?”

कार्य का स्वरूप चुनें क्यों
आशय वर्गीकरण, रूटिंग, इकाई निष्कर्षणहाइकुतेज़, सस्ता और उच्च थ्रूपुट के लिए आदर्श
दैनिक कोडिंग सहायता, दस्तावेज़ीकरण, संरचित तर्कसॉनेटसर्वोत्तम गति/गुणवत्ता संतुलन
जटिल एजेंटिक कोडिंग, एंटरप्राइज़ विश्लेषण, गहन डिबगिंगओपसलंबे और बहु-चरणीय उद्यम कार्यों पर मजबूत प्रदर्शन
दिनभर एजेंट चलता है, प्रतिनिधिमंडल के साथ बहु-दस्तावेज़ संश्लेषणFable 5 (या गेटेड Mythos 5)लंबी-क्षितिज स्वायत्तता और दायरे में रहने के लिए डिज़ाइन किया गया

5. उत्पादन के लिए रूटिंग ब्लूप्रिंट (सस्ता -> स्मार्ट -> फ्रंटियर)

यह एक व्यावहारिक पैटर्न है जो तब अच्छा काम करता है जब आपके पास कार्यों का मिश्रण होता है: कुछ आसान, कुछ कठिन, और बहुत सारे "ज्यादातर आसान लेकिन कभी-कभी मुश्किल"।

5.1 चरण-दर-चरण राउटर

  1. हाइकु के साथ वर्गीकरण करें. इरादा और कठिन जटिलता निर्धारित करें; यह भी अनुमान लगाएं कि क्या आपको लंबे संदर्भ या उपकरण के उपयोग की आवश्यकता है।
  2. सॉनेट या ओपस पर मुख्य पथ चलाएँ। अधिकांश "गंभीर लेकिन सीमित" कार्यों के लिए सॉनेट। ओपस जब आप जटिल एजेंटिक कोडिंग या गहन डिबगिंग की अपेक्षा करते हैं।
  3. वास्तविक दीर्घ-क्षितिज कार्य के लिए Fable 5 तक बढ़ें। उदाहरण: क्रॉस-रेपो रिफैक्टर्स, मल्टी-डॉक्यूमेंट सिंथेसिस जहां मॉडल को कई बाधाओं को जीवित रखना चाहिए, और स्वायत्त रन जो उप-कार्य सौंपते हैं।
  4. फ़ॉलबैक/अस्वीकार को संभालें। यदि Fable 5 सुरक्षा क्लासिफायर के कारण मना कर देता है, तो अपने उत्पाद की आवश्यकताओं के आधार पर Opus 4.8 (या कोई अन्य उपयुक्त मॉडल) पर वापस आएँ।

5.2 राउटर का बजट बनाएं (वृद्धि को बचत को नष्ट न करने दें)

एक राउटर लागत प्रभावी तभी हो सकता है जब वृद्धि दुर्लभ हो। बाधाएँ जोड़ें ताकि महँगा स्तर बढ़ न सके:

  • प्रत्येक स्तर पर अधिकतम आउटपुट टोकन सेट करें।
  • टीएलडीआर-प्रथम निर्देशों का उपयोग करें ताकि पर्याप्त जानकारी होने पर मॉडल जल्दी बंद हो सके।
  • बार-बार इनपुट लागत को कम करने के लिए स्थिर उपसर्गों (सिस्टम प्रॉम्प्ट और टूल स्कीमा) को कैश करें।

6. सांकेतिक अर्थशास्त्र का उपयोग आप विवेक जांच के रूप में कर सकते हैं

चूँकि मूल्य निर्धारण प्रति टोकन है, आप प्रति अनुरोध लागत का अनुमान लगा सकते हैं। मॉडल अवलोकन मूल्य निर्धारण मूल्यों का उपयोग करना:

  • Fable 5: $10 इनपुट / $50 आउटपुट प्रति एमटोक
  • Opus 4.8: $5 इनपुट / $25 आउटपुट प्रति एमटोक
  • Sonnet 5: $3 इनपुट / $15 आउटपुट प्रति एमटोक
  • Haiku 4.5: प्रति एमटोक $1 इनपुट/$5 आउटपुट

मोटा फ़ॉर्मूला (अपने अनुमान जोड़ें):

cost ~= (input_tokens / 1_000_000) * input_price
     + (output_tokens / 1_000_000) * output_price

विवेक नियम: यदि आउटपुट टोकन बड़े हैं, तो Fable 5 शीघ्र ही प्रमुख लागत चालक बन जाता है। यही कारण है कि त्वरित संरचना और आउटपुट कैप कई टीमों की अपेक्षा से अधिक मायने रखते हैं।

7. सभी स्तरों पर पैटर्न का संकेत देना

अधिकांश प्रेरक सर्वोत्तम प्रथाएं प्रत्येक क्लाउड मॉडल पर लागू होती हैं: स्पष्ट लक्ष्य प्रदान करें, आउटपुट प्रारूप को सीमित करें, और केवल वही मांगें जो आपको चाहिए। स्तर-विशिष्ट अंतर आपके तरीके में दिखाई देते हैं नियंत्रण लंबाई और नियंत्रण प्रयास.

7.1 सामान्य नियम जो बजट लीक को रोकते हैं

  • परिणाम के साथ आगे बढ़ें. आपकी पहली पंक्ति में यह लिखा होना चाहिए कि क्या हुआ या आपने क्या पाया।
  • पहले टीएलडीआर का अनुरोध करें। जब संभव हो तो मॉडल को जल्दी रुकने दें।
  • कैप स्कोप रेंगना। जब तक अनुरोध न किया जाए, अतिरिक्त सुविधाओं, रिफ़ैक्टरों या "होने में अच्छा" सुधारों की मांग न करें।
  • बाउंड आउटपुट लंबाई. अधिकतम आउटपुट टोकन या सख्त प्रारूप का उपयोग करें।

7.2 जब Fable 5 कार्य बदलता है

Fable 5 लंबी-क्षितिज स्वायत्तता के लिए बनाया गया है: यह विस्तारित अवधि में उत्पादक आउटपुट को बनाए रख सकता है, उप-कार्य सौंप सकता है, और जब कार्य वास्तव में बहु-चरणीय हो तो सुसंगत रह सकता है। प्रेरक अंतर केवल "अधिक तर्क" नहीं है। यह है कि आप वर्कफ़्लो को इस प्रकार संरचित कर सकते हैं (और करना भी चाहिए)। लक्ष्य + चौकियाँ + उपकरण-संचालित साक्ष्य, हर चीज़ को एक ही बार में उत्तर देने के लिए बाध्य करने के बजाय।

8. उदाहरण वर्कफ़्लोज़ (कहाँ क्या उपयोग करें)

8.1 Haiku 4.5

  • आने वाले अनुरोधों (इरादे + जटिलता) को वर्गीकृत करें और दाएं स्तर पर रूट करें।
  • डाउनस्ट्रीम सिस्टम के लिए JSON में संरचित फ़ील्ड निकालें।
  • सख्त स्कीमा और अधिकतम आउटपुट कैप के साथ छोटे अनुच्छेदों का सारांश बनाएं।

8.2 Sonnet 5

  • "क्या/क्यों/कैसे" प्रारूप के साथ कोड को रिफैक्टर करें और समझाएं।
  • सुसंगत स्वर और संक्षिप्त आउटपुट के साथ ग्राहक-सामना करने वाली सामग्री का मसौदा तैयार करें।
  • एजेंट टूलींग बनाएं जिसके लिए अभी भी गति (टूल कॉलिंग + शॉर्ट लूप) की आवश्यकता है।

8.3 Opus 4.8

  • जटिल एजेंटिक कोडिंग: बहु-फ़ाइल परिवर्तन, गहन डिबगिंग, और अधिक सावधानीपूर्वक सिस्टम-व्यापी तर्क।
  • एंटरप्राइज़ दस्तावेज़ विश्लेषण: स्प्रेडशीट, स्लाइड और लंबी रिपोर्ट।
  • कठिन लेकिन सीमित कार्य जहां आप अभी भी एक एंटरप्राइज़-ग्रेड उत्तर चाहते हैं, न कि केवल एक स्केच।

8.4 Fable 5 (और Mythos 5)

  • टूल के उपयोग और सत्यापन चरणों के साथ रेपो में दिनों तक चलने वाला कोड माइग्रेशन।
  • बहु-दस्तावेज़ संश्लेषण जहां लंबे समय तक निर्देश प्रतिधारण और सुसंगतता आवश्यक है।
  • स्वायत्त कार्यप्रवाह जो उप-कार्य सौंपते हैं और मध्यवर्ती परिणामों के बाद भी जारी रहते हैं।

9. माइग्रेशन नोट्स

9.1 Opus 4.8 पर माइग्रेट करना

यदि आप वर्तमान में ओपस 4.7 या इससे पहले के संस्करण पर हैं, तो इससे शुरुआत करें:

  • यह सुनिश्चित करते हुए कि आप सेट हैं effort स्पष्ट रूप से जब आपके पास विलंबता या बजट आवश्यकताएँ हों।
  • किसी भी शीघ्र कौशल की समीक्षा करना जो अति-अनुदेशात्मक हो सकता है। उच्च क्षमता अति-विशिष्ट निर्देशों को बढ़ा सकती है।
  • आउटपुट लंबाई मान्यताओं का पुन: परीक्षण करना और जहां आवश्यक हो वहां अधिकतम आउटपुट कैप लागू करना।

9.2 ओपस से Fable 5 की ओर पलायन

Fable 5 एक "तेज़ ओपस" नहीं है। इसे दीर्घ-क्षितिज कार्यों के लिए वर्कफ़्लो टूल के रूप में मानें:

  • लक्ष्य + चेकपॉइंट संरचना की ओर बढ़ें (विशेषकर एजेंटिक रन के लिए)।
  • सभी चीज़ों को एक लंबे धागे में बांधने के बजाय उप-कार्य सौंपें।
  • कैशिंग और बाउंडेड आउटपुट का उपयोग करें ताकि लंबे समय तक खर्च न बढ़े।

10. सामान्य गोचर

  • हर चीज़ के लिए कल्पित कहानी का उपयोग करना। यह कठिन, लंबे-क्षितिज वाले मामलों के लिए है।
  • कोई आउटपुट कैप नहीं. यहां तक कि हाइकु भी महंगा हो सकता है यदि आप इसे असीमित पाठ उत्पन्न करने दें।
  • यह मानते हुए कि संदर्भ विंडो विनिमेय हैं। हाइकु में 200K टोकन हैं; अन्य 1M पर डिफ़ॉल्ट हैं।
  • कटऑफ के अंतर को नजरअंदाज करना. यदि आपको कटऑफ के बाद की जानकारी चाहिए, तो पुनर्प्राप्ति/उपकरण का उपयोग करें।
  • रूटिंग प्रयास नहीं. हर जगह अधिकतम प्रयास निर्धारित करने से अक्सर परिणामों में सुधार हुए बिना लागत बढ़ जाती है।

11. निचली पंक्ति

क्लाउड का लाइनअप इसलिए डिज़ाइन किया गया है ताकि आप एक मॉडल राउटर बना सकें जो प्रत्येक कार्य आकार के सबसे छोटे सक्षम स्तर से मेल खाता हो। सस्ते रूटिंग और निष्कर्षण के लिए हाइकु से शुरुआत करें। अधिकांश दैनिक कार्यों के लिए सॉनेट का उपयोग करें। जटिल उद्यम और एजेंटिक कोडिंग के लिए ओपस की ओर बढ़ें। सच्चे लंबे-क्षितिज रन के लिए रिजर्व Fable 5 (और गेटेड Mythos 5) जिसके लिए निरंतर स्वायत्तता और सुसंगतता की आवश्यकता होती है।

जब संदेह हो, तो अपने संकेतों को सीमित रखें, आउटपुट की लंबाई निर्धारित करें और प्रति परिणाम आउटपुट टोकन को मापें। वह एक मीट्रिक मॉडल की पसंद को स्पष्ट कर देता है।


इस आलेख के लिए SEO स्नैपशॉट

  • एसईओ शीर्षक: क्लाउड मॉडल की तुलना: हाइकु बनाम सॉनेट बनाम ओपस बनाम Fable 5 (Mythos 5)
  • मेटा विवरण: एंथ्रोपिक क्लाउड हाइकू, सॉनेट, ओपस, Fable 5, और गेटेड Mythos 5 की तुलना करें। इसमें विवरण, लागत/टोकन रणनीति, रूटिंग ब्लूप्रिंट और प्रत्येक स्तर का उपयोग कब करना है, शामिल है।
  • प्राथमिक कीवर्ड: क्लाउड मॉडल तुलना, Claude Opus 4.8, Claude Fable 5, Claude Sonnet 5, Claude Haiku 4.5, Claude Mythos 5, टोकन बजटिंग, एजेंटिक कोडिंग
  • ट्विटर/एक्स: क्लाउड मॉडल स्तरों ने समझाया: सस्ते रूटिंग के लिए हाइकु, दैनिक कार्य के लिए सॉनेट, जटिल कोडिंग के लिए ओपस, दिनों तक चलने वाले एजेंटिक रन के लिए Fable 5। अंदर टोकन-बजट रूटिंग ब्लूप्रिंट।
  • लिंक्डइन: एंथ्रोपिक क्लाउड हाइकू, सॉनेट, ओपस, Fable 5, और गेटेड Mythos 5 की एक व्यावहारिक, कार्यान्वयन योग्य तुलना। विशिष्टताएँ, लागत मॉडल और एक राउटर जो आउटपुट टोकन को नियंत्रण में रखता है। Workstation से.
Share this article

More in Technology

LLM बाधाओं का खुलासा: ऑब्ज़र्वेबिलिटी, OTEL और लागत नियंत्रण

LLM बाधाओं का खुलासा: ऑब्ज़र्वेबिलिटी, OTEL और लागत नियंत्रण

तकनीकी ब्रीफ: OTEL स्पैन स्कीमा, कलेक्टर, FinOps PromQL, एजेंट बजट, स्कोरिंग, और प्रोडक्शन एजेंटों के लिए LLM प्लेटफ़ॉर्म

Read more
टर्बोचार्जिंग LLMs

टर्बोचार्जिंग LLMs

तकनीकी संक्षिप्त: ओएस-शैली केवी पेजिंग, लगभग-शून्य-अपशिष्ट सेवा, एजेंट डिबग लूप, वर्कस्टेशन टोकन जेनरेशन, और एम्बेडिंग-गेटेड अव्यक्त ध्यान

Read more
Rust Async ब्लॉकिंग, Rayon और आधुनिक अनुप्रयोग

Rust Async ब्लॉकिंग, Rayon और आधुनिक अनुप्रयोग

तकनीकी संक्षिप्त: सहकारी शेड्यूलिंग, spawn_blocking बनाम Rayon बनाम समर्पित थ्रेड, और आधुनिक एप्लिकेशन एस्टेट के लिए Workstation पॉलीग्लॉट मार्गदर्शन

Read more