सभी models

Kimi K3: Moonshot का 2.8T फ्रंटियर मॉडल

Moonshot का 2.8 ट्रिलियन पैरामीटर वाला Mixture-of-Experts मॉडल — 1M टोकन कॉन्टेक्स्ट विंडो, नेटिव इमेज और वीडियो इनपुट, और ओपन वेट्स।

1M tokens · Text / Vision / Video / Code · Prompt cache

VM0 Kimi K3 को नहीं चलाता। यह पेज इसके स्पेसिफिकेशन, कीमत और बेंचमार्क का संदर्भ है। VM0 पर इसी तरह के काम के लिए फ़िलहाल Claude Fable 5.1 इस्तेमाल करें।

Claude Fable 5.1 देखें

Kimi K3, Moonshot AI का फ्रंटियर मॉडल है जो 16 जुलाई 2026 को आया: कुल 2.8 ट्रिलियन पैरामीटर वाला स्पार्स Mixture-of-Experts नेटवर्क, जिसमें हर टोकन पर 896 में से 16 एक्सपर्ट सक्रिय होते हैं, 1,048,576 टोकन की कॉन्टेक्स्ट विंडो और नेटिव इमेज व वीडियो इनपुट। Artificial Analysis ने Intelligence Index v4.1 पर इसे 57.1 दिया — परखे गए कॉन्फ़िगरेशन में चौथा स्थान, Claude Fable 5.1 (59.9) और GPT 5.6 Sol (58.9) से पीछे, Claude Opus 4.8 से आगे।

लिस्ट कीमत है $3.00 प्रति मिलियन इनपुट टोकन, कैश हिट पर $0.30 और $15.00 प्रति मिलियन आउटपुट टोकन — पूरी विंडो पर एक समान, बिना लॉन्ग-कॉन्टेक्स्ट सरचार्ज के। ओपन वेट्स 27 जुलाई 2026 को Moonshot के अपने Kimi K3 License के तहत Hugging Face पर आए। VM0 Kimi K3 को नहीं चलाता। VM0 की लाइनअप में सबसे नज़दीकी मॉडल Claude Fable 5.1 है, जिसकी विंडो भी 1M टोकन की है और जो उसी Intelligence Index में सबसे आगे है।

Kimi K3 क्या है?

16 जुलाई 2026 · Moonshot की फ्रंटियर लाइन। K2.7 Code समेत Kimi K2 सीरीज़ का उत्तराधिकारी।

Kimi K3, Moonshot AI का फ्रंटियर मॉडल है, जिसे 16 जुलाई 2026 को पेश किया गया और जो Kimi ऐप तथा Kimi API पर kimi-k3 के रूप में उपलब्ध है। यह स्पार्स Mixture-of-Experts मॉडल है: कुल 2.8 ट्रिलियन पैरामीटर, पर हर टोकन पर 896 में से सिर्फ़ 16 एक्सपर्ट सक्रिय। इसी वजह से इतने बड़े आकार के बावजूद इन्फ़रेंस की कीमत मिड-टियर डेंस मॉडल के आसपास रहती है।

K2 लाइन के मुक़ाबले सबसे बड़ा सुधार लंबे चलने वाले एजेंट काम में दिखता है। Moonshot की लॉन्च सूट में K3, Program Bench, SWE Marathon, BrowseComp, SpreadsheetBench 2 और Automation Bench में सभी परखे गए मॉडलों से आगे है, जबकि FrontierSWE में Claude Fable 5.1 और DeepSWE में GPT 5.6 Sol से पीछे रहता है। आर्थिक रूप से मूल्यवान नॉलेज वर्क आंकने वाले Artificial Analysis के GDPval-AA v2 Elo पर यह 1668 तक पहुँचता है — Kimi K2.6 के 1190 से काफ़ी ऊपर और Claude Opus 4.8 के 1600 से भी आगे।

Kimi K3 में क्या उल्लेखनीय है

मुख्य architecture और capability विशेषताएँ।

K3 अपने MoE स्टैक के साथ दो एफ़िशिएंसी तकनीकें जोड़ता है, जिन्हें Moonshot Kimi Delta Attention और Attention Residuals कहता है और जिनसे 6.3 गुना तक तेज़ डिकोडिंग का दावा है। 1,048,576 टोकन की विंडो एक ही दर पर मिलती है, कोई कॉन्टेक्स्ट टियरिंग नहीं। आउटपुट डिफ़ॉल्ट रूप से 131,072 टोकन तक जाता है और उसी विंडो के भीतर और ऊँचा सेट किया जा सकता है। इनपुट में टेक्स्ट, इमेज और वीडियो; आउटपुट टेक्स्ट। platform.kimi.ai पर API, OpenAI-संगत है, और वेट्स — MXFP4 में लगभग 594 GB — सेल्फ-होस्टिंग के लिए प्रकाशित हैं।

एक नज़र में specs

परिवारKimi K3
पैरामीटरकुल 2.8T / 896 में से 16 एक्सपर्ट सक्रिय (MoE)
मोडैलिटीइनपुट: टेक्स्ट, इमेज, वीडियो; आउटपुट: टेक्स्ट
कॉन्टेक्स्ट विंडो1,048,576 टोकन
अधिकतम आउटपुटडिफ़ॉल्ट 131K टोकन, विंडो के भीतर कॉन्फ़िगर करने योग्य
लाइसेंसKimi K3 License (ओपन वेट्स, 27 जुलाई 2026)

Kimi K3 benchmarks

कोडिंग, एजेंट और विज़ुअल स्कोर Moonshot के लॉन्च आंकड़े हैं, जिनमें हर मॉडल अधिकतम रीज़निंग एफ़र्ट पर था; Intelligence Index और GDPval Elo, Artificial Analysis के स्वतंत्र माप हैं। वेंडर की तालिका ऊपरी सीमा होती है, गारंटी नहीं — और स्वतंत्र परीक्षकों ने Moonshot के अपने आंकड़े से काफ़ी ऊँची हैलुसिनेशन दर बताई है।

Artificial Analysis Intelligence Index v4.1स्वतंत्र; चौथा स्थान, Fable 5 (59.9) और GPT 5.6 Sol (58.9) के बाद
57.1
GDPval-AA v2 (Elo)स्वतंत्र; Opus 4.8 (1600) से ऊपर
1668
GPQA Diamondवेंडर-रिपोर्टेड
93.5
Terminal-Bench 2.1वेंडर-रिपोर्टेड; Sol 88.8
88.3
FrontierSWEवेंडर-रिपोर्टेड; Fable 5 86.6
81.2
DeepSWEवेंडर-रिपोर्टेड; Sol 73.0
67.5
SWE Marathonवेंडर-रिपोर्टेड; लॉन्च सूट में सर्वोच्च
42.0
BrowseCompवेंडर-रिपोर्टेड; लॉन्च सूट में सर्वोच्च
91.2

Kimi K3 pricing

Provider सूची मूल्य, प्रति 1M tokens।

Input$3.00
Output$15.00
Cache read$0.30
Cache writeबिल नहीं किया गया

Kimi K3 व्यवहार में कैसा प्रदर्शन करता है

वेंडर की लॉन्च सामग्री और स्वतंत्र मूल्यांकनों में दर्ज व्यवहार।

लंबे एजेंट रन

जिन बेंचमार्क में K3 साफ़ आगे है — SWE Marathon, Automation Bench, BrowseComp — वे सैकड़ों चरणों तक लक्ष्य पर टिके रहना मापते हैं, न कि एक ही जवाब की शुद्धता। यह Moonshot की उस पोज़िशनिंग से मेल खाता है कि यह पहले एजेंट इंजन है।

1M टोकन पर एक समान कीमत

पूरी 1,048,576 टोकन विंडो एक ही दर पर बिल होती है, किसी सीमा के बाद कोई सरचार्ज नहीं। इसके उलट GPT-5.5 की 1M विंडो में 272K टोकन से ऊपर के इनपुट की कीमत अलग है, और यही बात कहीं और बहुत लंबे सिंगल-कॉन्टेक्स्ट रन को महँगा बनाती है।

प्रति कार्य लागत

Artificial Analysis ने अपने इंडेक्स पर प्रति कार्य $0.94 मापा — Claude Opus 4.8 के $1.80 का लगभग आधा और GPT 5.6 Sol के $1.04 के बराबर। Moonshot कोडिंग वर्कलोड में 90% से ऊपर कैश हिट दर बताता है, जिससे प्रभावी इनपुट लागत $0.30 की ओर खिसकती है।

Kimi K3 के लिए सर्वश्रेष्ठ agent tasks

पूरा रिपॉज़िटरी एक ही कॉन्टेक्स्ट में पढ़ना

एक समान कीमत वाली 1M टोकन विंडो में पूरा कोडबेस, एक तिमाही के सपोर्ट टिकट या लंबा दस्तावेज़ सेट एक ही रिक्वेस्ट में आ जाता है — न चंकिंग की ज़रूरत, न विंडो के आख़िर में कोई सरचार्ज।

ब्राउज़िंग और रिसर्च एजेंट

BrowseComp 91.2, Moonshot की लॉन्च तालिका का सबसे ऊँचा स्कोर है, GPT 5.6 Sol और Claude Fable 5.1 से आगे। स्रोत ढूँढना, हवाला आगे तक पीछा करना, आंकड़े मिलाना — इस मल्टी-हॉप वेब रिसर्च में K3 की एजेंट ट्रेनिंग सबसे साफ़ दिखती है।

स्क्रीनशॉट और वीडियो इनपुट

K3 इमेज और वीडियो नेटिव रूप से लेता है, इसलिए स्क्रीनशॉट पढ़ने वाले QA एजेंट और रिकॉर्डेड क्लिप प्रोसेस करने वाली पाइपलाइनों को रीज़निंग मॉडल के आगे अलग विज़न मॉडल जोड़ने की ज़रूरत नहीं पड़ती।

Kimi K3 को कब छोड़ें

K3 से बचें जब काम के लिए वेंडर-ऑडिटेड सेफ़्टी प्रोफ़ाइल या अमेरिका/EU में अनुबंध आधारित एंटरप्राइज़ सपोर्ट चाहिए; जब प्रॉम्प्ट इतने छोटे हों कि $0.30 वाली कैश दर कभी लगे ही नहीं और कोई किफ़ायती मॉडल काम चला दे; और जब सेल्फ-होस्टिंग ही मक़सद हो — 594 GB MXFP4 वेट्स के प्रोडक्शन डिप्लॉयमेंट के लिए 64 या उससे ज़्यादा एक्सेलेरेटर चाहिए। स्वतंत्र परीक्षणों में Moonshot के प्रकाशित आंकड़े से कहीं ऊँची हैलुसिनेशन दर भी मापी गई है, इसलिए तथ्यों से भरे आउटपुट की जाँच अब भी ज़रूरी है। और VM0 पर तो K3 विकल्प ही नहीं है।

Kimi K3 बनाम अन्य models

Kimi K3 बनाम Claude Fable 5.1

Intelligence Index (59.9 बनाम 57.1) और FrontierSWE (86.6 बनाम 81.2) में Fable 5 आगे है; Terminal-Bench 2.1, BrowseComp और SWE Marathon K3 ले जाता है। दोनों की विंडो 1M टोकन की है। फ़ैसला अक्सर कीमत और उपलब्धता से होता है: Fable 5 प्रति मिलियन टोकन $10/$50 है और VM0 पर चलता है; K3 $3/$15 है और VM0 पर नहीं चलता।

Kimi K3 बनाम GPT 5.6 Sol

Intelligence Index पर Sol 58.9 और K3 57.1 है; DeepSWE (73.0 बनाम 67.5) और Terminal-Bench (आधे अंक से) भी Sol जीतता है। K3 जवाब देता है Sol की 400K के मुक़ाबले 1M विंडो और एक-तिहाई इनपुट कीमत से। मापी गई प्रति कार्य लागत पास-पास है: K3 के लिए $0.94, Sol के लिए $1.04।

Kimi K3 बनाम Claude Opus 4.8

ज़्यादातर एजेंटिक सूट और GDPval-AA Elo (1668 बनाम 1600) में K3 आगे है, कीमत भी $3/$15 बनाम $5/$25। प्रोडक्शन में टूल-रूटिंग की विश्वसनीयता में बढ़त Opus 4.8 के पास रहती है, और वह VM0 पर उपलब्ध है जबकि K3 नहीं।

Kimi K3 बनाम Kimi K2.7 Code

K3 उत्तराधिकारी है: 256K के मुक़ाबले 1M टोकन कॉन्टेक्स्ट, नेटिव वीडियो इनपुट और एजेंटिक बेंचमार्क में कहीं ऊँची छत — कीमत लगभग तीन गुना ($3/$15 बनाम $1.14/$4.80)। आज दोनों में से कोई VM0 पर नहीं चलता; K2.7 Code हटाया जा चुका है और K3 कभी जोड़ा ही नहीं गया।

निष्कर्ष: क्या आपको Kimi K3 इस्तेमाल करना चाहिए?

अब तक जारी सबसे मज़बूत ओपन-वेट मॉडल, और एजेंट काम में क्लोज़्ड फ्रंटियर से टक्कर लेने वाला पहला — वह भी Fable 5 की एक-तिहाई कीमत पर। VM0 इसे नहीं चलाता, इसलिए इस पेज को संदर्भ की तरह पढ़ें: VM0 पर उसी तरह के 1M टोकन एजेंट वर्कलोड के लिए Claude Fable 5.1 सबसे नज़दीकी विकल्प है।

अक्सर पूछे जाने वाले सवाल

क्या मैं VM0 पर Kimi K3 इस्तेमाल कर सकता हूँ?

फ़िलहाल नहीं। Kimi K3 VM0 की मॉडल लाइनअप में नहीं है — इसे न चैट में चुना जा सकता है, न वर्कफ़्लो में, और अपनी API की से जोड़ा भी नहीं जा सकता। VM0 जो मॉडल चलाता है उनमें Claude Fable 5.1 सबसे नज़दीक है: वही 1M टोकन कॉन्टेक्स्ट विंडो और उसी Intelligence Index में सबसे ऊँचा स्कोर।

Kimi K3 कब रिलीज़ हुआ?

Moonshot AI ने Kimi K3 को 16 जुलाई 2026 को Kimi ऐप और Kimi API में लॉन्च किया, और 27 जुलाई 2026 को Hugging Face पर ओपन वेट्स प्रकाशित किए।

Kimi K3 की कॉन्टेक्स्ट विंडो कितनी है?

इनपुट और आउटपुट मिलाकर 1,048,576 टोकन, और पूरी विंडो पर एक ही कीमत। आउटपुट डिफ़ॉल्ट रूप से 131,072 टोकन है और बची हुई कॉन्टेक्स्ट सीमा में और ऊँचा सेट किया जा सकता है।

Kimi K3 की कीमत क्या है?

कैश मिस पर $3.00 प्रति मिलियन इनपुट टोकन, कैश हिट पर $0.30 प्रति मिलियन और $15.00 प्रति मिलियन आउटपुट टोकन, बिना लॉन्ग-कॉन्टेक्स्ट सरचार्ज के। Kimi ऐप में पेड टियर 256K विंडो के साथ $19 प्रति माह से शुरू होते हैं, और पूरी 1M विंडो $39 प्रति माह से खुलती है।

क्या Kimi K3 ओपन सोर्स है?

वेट्स Moonshot के अपने Kimi K3 License के तहत खुले हैं, जो अधिकतर MIT जैसा है पर उसमें दो व्यावसायिक शर्तें हैं: model-as-a-service कारोबार को किसी भी लगातार 12 महीनों में $20M से ऊपर राजस्व होने पर Moonshot के साथ अलग समझौता करना होगा, और 10 करोड़ से ज़्यादा मासिक सक्रिय उपयोगकर्ता या $20M मासिक राजस्व वाले किसी भी उत्पाद को अपने इंटरफ़ेस में "Kimi K3" दिखाना होगा।

विकल्प

VM0 पर Kimi K3 की उपलब्धता

Kimi K3 VM0 की मॉडल लाइनअप का हिस्सा नहीं है, इसलिए इसे न चैट में चुना जा सकता है और न किसी वर्कफ़्लो में, और अपनी API की से जोड़ा भी नहीं जा सकता। VM0 आज जो मॉडल चलाता है उनमें Claude Fable 5.1 सबसे नज़दीक है।