Claude Opus 5
Anthropic का प्रमुख Opus मॉडल, 24 जुलाई 2026 को जारी — Claude Fable 5 की आधी कीमत पर फ्रंटियर के करीब की क्षमता, थिंकिंग डिफ़ॉल्ट रूप से चालू और low से max तक पूरी effort रेंज।
1M tokens · Text / Vision / Code · Prompt cache
Claude Opus 5 Anthropic का मौजूदा प्रमुख Opus मॉडल है, जो Opus 4.8 के उत्तराधिकारी के रूप में 24 जुलाई 2026 को जारी हुआ। यह Claude Fable 5 की फ्रंटियर क्षमता के करीब आधी कीमत पर पहुँचता है, और कोडिंग तथा नॉलेज वर्क के कई मूल्यांकनों में — जिनमें Frontier-Bench v0.1 और GDPval-AA v2 शामिल हैं — Fable 5 से आगे भी निकल जाता है। कीमत Opus 4.8 जैसी ही है: प्रति 10 लाख टोकन $5 इनपुट और $25 आउटपुट। यानी Opus स्तर पर पहले से चल रहे एजेंट सीधे इस पर शिफ्ट किए जा सकते हैं।
Claude Opus 5 क्या है?
24 जुलाई 2026 को जारी · Anthropic का प्रमुख Opus स्तर — निरपेक्ष सीमा में Fable 5 से नीचे, कई एजेंटिक और नॉलेज-वर्क मूल्यांकनों में उससे आगे, और टोकन कीमत आधी। VM0 पर कठिन एजेंट काम के लिए डिफ़ॉल्ट विकल्प।
Anthropic ने Claude Opus 5 को 24 जुलाई 2026 को Claude API, Claude ऐप्स, Amazon Bedrock, Google Cloud और Microsoft Foundry पर जारी किया; VM0 ने इसे 25 जुलाई 2026 को इनबिल्ट मॉडल के रूप में जोड़ा। यह उसी कीमत पर Opus 4.8 की जगह लेता है और उसके Frontier-Bench v0.1 स्कोर को लगभग दोगुना कर देता है — यही मुख्य दावा है: प्रति टोकन उतनी ही लागत पर काफी ज़्यादा क्षमता।
इसकी स्थिति क्षमता की निरपेक्ष सीमा की नहीं, बल्कि एजेंटिक कोडिंग और एंटरप्राइज़ नॉलेज वर्क के वर्कहॉर्स की है — कई फ़ाइलों में फैले फीचर, बड़े रिफैक्टर, लंबे स्वायत्त रन और शुरू से अंत तक तैयार डिलिवरेबल। कठिन SWE-bench Pro सेट और तथ्यात्मक विस्तार में Fable 5 अब भी आगे है; प्रति पूर्ण कार्य लागत में Opus 5 जीतता है — और एजेंट ट्रैफ़िक बढ़ने पर यही आंकड़ा बिल में दिखता है।
Opus 4.8 की तुलना में API के दो व्यवहार बदले हैं। थिंकिंग डिफ़ॉल्ट रूप से चालू है, इसलिए बिना किसी कॉन्फ़िगरेशन वाली रिक्वेस्ट भी उत्तर देने से पहले तर्क करती है, और इसे बंद करना केवल high या उससे कम effort पर संभव है। कैश होने योग्य न्यूनतम प्रॉम्प्ट भी घटकर 512 टोकन रह गया है, इसलिए जो छोटे सिस्टम प्रॉम्प्ट पहले कैश नहीं होते थे, अब होते हैं। Opus 5 के साथ साइबर सुरक्षा के कड़े सुरक्षा उपाय भी आते हैं: प्रतिबंधित या उच्च-जोखिम क्षेत्रों की रिक्वेस्ट अस्वीकृति के रूप में लौट सकती है।
Claude Opus 5 में क्या उल्लेखनीय है
मुख्य architecture और capability विशेषताएँ।
Opus 5 का कॉन्टेक्स्ट विंडो 10 लाख टोकन का है — अधिकतम मान ही डिफ़ॉल्ट है — और आउटपुट अधिकतम 128K टोकन, ज्ञान की कट-ऑफ़ मई 2026। थिंकिंग डिफ़ॉल्ट रूप से चालू है और तर्क की गहराई effort स्तरों low, medium, high, xhigh और max से तय होती है; कच्ची विचार शृंखला कभी उजागर नहीं होती, केवल पठनीय सारांश मिलता है। असिस्टेंट संदेश का प्रीफ़िल समर्थित नहीं है और सैंपलिंग पैरामीटर (temperature, top_p, top_k) अस्वीकार कर दिए जाते हैं — व्यवहार प्रॉम्प्ट से नियंत्रित करें। इनपुट में टेक्स्ट, हाई-रेज़ॉल्यूशन विज़न और कोड शामिल हैं।
एक नज़र में specs
Claude Opus 5 benchmarks
Anthropic की लॉन्च सामग्री से लिए गए वेंडर-रिपोर्टेड स्कोर। डेटासेट, effort सेटिंग और एजेंट स्कैफ़ोल्ड के आधार पर तीसरे पक्ष के ट्रैकर उन्हीं बेंचमार्क के लिए अलग आंकड़े देते हैं, इसलिए इन्हें कॉन्फ़िगरेशन पर निर्भर मानकर पढ़ें।
Claude Opus 5 pricing
Provider सूची मूल्य, प्रति 1M tokens।
Claude Opus 5 व्यवहार में कैसा प्रदर्शन करता है
Production agent runs से देखा गया व्यवहार।
प्रति पूर्ण कार्य लागत
Fable 5 की जगह Opus 5 चुनने की सबसे स्पष्ट वजह: एजेंटिक काम में तुलनीय नतीजे, लगभग आधी टोकन कीमत पर। Zapier के AutomationBench पर समान प्रति-कार्य लागत पर इसकी पास दर अगले सर्वश्रेष्ठ मॉडल से करीब 1.5 गुना है, और सबसे कम effort सेटिंग पर भी यह किसी भी अन्य मॉडल से ज़्यादा कार्य पूरे करता है।
डिफ़ॉल्ट रूप से चालू थिंकिंग
Opus 4.8 के उलट, thinking पैरामीटर छोड़ देने वाली रिक्वेस्ट भी उत्तर से पहले सोचती है। इसका हिसाब रखें: max_tokens थिंकिंग और उत्तर दोनों पर एक साथ सीमा लगाता है, इसलिए बिना-थिंकिंग वाले वर्कलोड के लिए तय की गई सीमा आउटपुट काट सकती है। थिंकिंग बंद करना केवल high या उससे कम effort पर संभव है।
लागत का मुख्य नियंत्रण effort है
इस मॉडल पर low और medium असामान्य रूप से मज़बूत हैं और अक्सर वही देते हैं जो पिछले प्रमुख मॉडल अपनी सर्वोच्च सेटिंग पर देते थे। high से शुरू करें — सबसे कठिन कोडिंग और एजेंटिक रन के लिए xhigh — फिर नीचे उतरते हुए वह सबसे सस्ता स्तर चुनें जिसे आपके मूल्यांकन स्वीकार करते हों।
अपना काम खुद जाँचता है
Opus 5 बिना कहे अपना आउटपुट जाँचता है, इसलिए पुराने मॉडलों से लाए गए सत्यापन निर्देश अक्सर दोहराव वाला काम पैदा करते हैं। यह डिफ़ॉल्ट रूप से लंबे उत्तर भी लिखता है; effort घटाने के बजाय संक्षिप्त लिखने का छोटा निर्देश ज़्यादा कारगर रहता है।
Claude Opus 5 के लिए सर्वश्रेष्ठ agent tasks
एक ही रन में पूरा होने वाला मल्टी-फ़ाइल फीचर
पूरा स्पेसिफ़िकेशन पहले ही दे दें और इसे चलने दें। Opus 4.8 की तुलना में Opus 5 की बढ़त कठिन, बहु-चरणीय इंजीनियरिंग काम में सबसे ज़्यादा है — बड़े रिफैक्टर, शुरू से अंत तक फीचर — और सिंगल-टर्न एडिट में सबसे कम। इसलिए इसे अपनी कठिनाई सीमा के ऊपरी सिरे पर लगाएँ।
रातभर चलने देने लायक एजेंट
लंबे स्वायत्त रन में ही कीमत का अंतर जुड़ता जाता है। Fable जैसी गुणवत्ता और आधी टोकन लागत पर, रात में चलने वाला ट्रायाज, माइग्रेशन या रिसर्च एजेंट प्रति पूर्ण कार्य लगभग आधी लागत लेता है।
वह वर्कफ़्लो जिसे पूरा होना है, सिर्फ़ जवाब नहीं देना
टूल के साथ बहु-चरणीय कार्य जिनका असली अंतिम बिंदु हो — टिकट बनाना, स्प्रेडशीट अपडेट करना, रिकॉर्ड मिलाना। Anthropic के AutomationBench और OSWorld नतीजे एक ही बात कहते हैं: यह उन कार्यों को अंत तक पूरा करता है जिन्हें दूसरे मॉडल बीच में छोड़ देते हैं।
Claude Opus 5 बनाम अन्य models
Claude Opus 5 बनाम Claude Opus 4.8
कीमत वही, स्तर वही, क्षमता स्पष्ट रूप से अधिक: Opus 5 ने Opus 4.8 के Frontier-Bench स्कोर को लगभग दोगुना किया और SWE-bench Verified में सात अंक जोड़े। माइग्रेशन में मॉडल आईडी बदलना और प्रॉम्प्ट दोबारा ट्यून करना है — थिंकिंग अब डिफ़ॉल्ट रूप से चालू है, इसलिए max_tokens फिर से जाँचें और “अपने काम की पुष्टि करो” जैसे निर्देश हटा दें, जो अब सिर्फ़ दोहराव पैदा करते हैं।
Claude Opus 5 बनाम GPT 5.6 Sol
दोनों शीर्ष श्रेणी के एजेंटिक मॉडल हैं। Frontier-Bench पर Opus 5 आगे है (43.3% बनाम 34.4%); DeepSWE v1.1 पर Sol आगे है (72.7% बनाम 68.8%)। VM0 पर यह खरीद का नहीं, रूटिंग का फ़ैसला है — एक ही एजेंट दोनों पर चलाकर तुलना करें।
निष्कर्ष: क्या आपको Claude Opus 5 इस्तेमाल करना चाहिए?
VM0 पर डिफ़ॉल्ट प्रमुख मॉडल। Opus 5 Fable 5 की सीमा के इतने करीब पहुँच जाता है कि ज़्यादातर एजेंटिक काम में कीमत ही निर्णायक बन जाती है, और Opus 4.8 पर पहले से चल रही किसी भी चीज़ के लिए यह सीधा प्रतिस्थापन है। नियमित लूप Sonnet 5 पर रखें और Fable 5 उन गिने-चुने कार्यों के लिए बचाकर रखें जिन्हें वाकई शीर्ष क्षमता चाहिए।
अक्सर पूछे जाने वाले सवाल
Claude Opus 5 कब जारी हुआ?
Anthropic ने Opus 5 को 24 जुलाई 2026 को Claude API और Claude ऐप्स के साथ-साथ Amazon Bedrock, Google Cloud और Microsoft Foundry पर जारी किया। VM0 ने इसे 25 जुलाई 2026 को इनबिल्ट मॉडल के रूप में जोड़ा (मॉडल आईडी claude-opus-5)।
क्या Claude Opus 5, Claude Fable 5 से बेहतर है?
कई मूल्यांकनों में हाँ: Opus 5 Frontier-Bench v0.1, GDPval-AA v2 और SWE-bench Verified में Fable 5 से आगे है। Fable 5 कठिन SWE-bench Pro सेट और तथ्यात्मक विस्तार में अब भी आगे है और सबसे कठिन तर्क के लिए ऊँची सीमा बना हुआ है। ज़्यादातर एजेंटिक काम में प्रति पूर्ण कार्य लागत के हिसाब से Opus 5 जीतता है।
क्या Claude Opus 5 में थिंकिंग डिफ़ॉल्ट रूप से चालू है?
हाँ। thinking पैरामीटर छोड़ने वाली रिक्वेस्ट भी उत्तर से पहले तर्क करती है — यह Opus 4.8 से बदलाव है, जहाँ माँगे बिना थिंकिंग बंद रहती थी। गहराई effort (low से max) से नियंत्रित होती है, और थिंकिंग केवल high या उससे कम effort पर बंद की जा सकती है। कच्ची विचार शृंखला कभी नहीं लौटाई जाती, केवल पठनीय सारांश मिलता है।
Opus 4.8 से माइग्रेट करते समय क्या बदलता है?
मॉडल आईडी, और उसके बाद प्रॉम्प्ट ट्यूनिंग। थिंकिंग डिफ़ॉल्ट रूप से चालू होने का मतलब है कि max_tokens अब उत्तर के साथ तर्क को भी कवर करता है; सत्यापन निर्देशों को दोबारा लिखने के बजाय हटा देना चाहिए, क्योंकि Opus 5 खुद जाँच करता है; और उत्तर डिफ़ॉल्ट रूप से लंबे होते हैं, इसलिए लंबाई मायने रखती हो तो संक्षिप्तता का स्पष्ट निर्देश जोड़ें।
विकल्प
VM0 पर Claude Opus 5 का उपयोग
VM0 पर Claude Opus 5 तक पहुँचने के दो तरीके
VM0, Claude Opus 5 को VM0 क्रेडिट में बिल होने वाले Built-in मॉडल के रूप में और Anthropic API key के साथ ब्रिंग-योर-ओन के ज़रिए भी सपोर्ट करता है। Built-in रास्ता VM0 Managed रूटिंग और नीचे बताए गए प्राइस टियर का उपयोग करता है; ब्रिंग-योर-ओन रास्ते में अपस्ट्रीम वेंडर सीधे आपसे शुल्क लेता है और VM0 क्रेडिट रूपांतरण पूरी तरह छूट जाता है।
VM0 की सिफ़ारिश
VM0, Claude Opus 5 को ऑर्केस्ट्रेशन, कोड से जुड़े काम और उन चरणों के लिए मुख्य एजेंट मॉडल मानता है जहाँ गलत उत्तर महँगा पड़ता है।
क्रेडिट और $$$ प्राइस टियर
VM0 हर Built-in मॉडल को चार चरणों वाले क्रेडिट स्केल — $, $$, $$$, $$$$ — पर रखता है, जो मॉडल पिकर में बैज के रूप में और zero model ls की price tier पंक्ति में दिखता है। Claude Opus 5 $$$ पर है। यही टियर तय करता है कि आपके VM0 क्रेडिट बैलेंस से कितना कटेगा; ऊपर की तालिका में दिया वेंडर लिस्ट प्राइस वह है जो अपस्ट्रीम प्रोवाइडर वसूलता है, इससे पहले कि VM0 उसे क्रेडिट में बदले।
July 25, 2026 से VM0 पर उपलब्ध।