घर ब्लॉग

Kimi K3 बनाम DeepSeek V4 Pro 0813 बनाम MiniMax M3 बनाम MiMo V2.6 Pro: तीन कोडिंग परीक्षण

Kimi K3 बनाम DeepSeek V4 Pro 0813 बनाम MiniMax M3 बनाम MiMo V2.6 Pro: तीन कोडिंग परीक्षण

Oct 7, 2026

EmpirioLabs AI

हम डालते हैं किमी K3, डीपसीक V4 प्रो 0813, मिनीमैक्स एम3 तथा MiMo V2.6 प्रो तीन एक-शॉट कोडिंग परीक्षणों में एक दूसरे के खिलाफ, सभी EmpirioLabs पर चलते हैं। एक ही संकेत, एक शॉट, कोई संपादन नहीं, और प्रत्येक परिणाम एक वास्तविक ब्राउज़र में लाइव प्रस्तुत किया गया।

चार तरफ़ा तुलना देखें

चश्मा एक नज़र में

किमी K3डीपसीक V4 प्रो 0813मिनीमैक्स एम3MiMo V2.6 प्रो
निर्मातामूनशॉट एआईडीपसीकमिनीमैक्सशाओमी
संदर्भ विंडो1,000,000 टोकन1,000,000 टोकन1,000,000 टोकन1,000,000 टोकन
इनपुटपाठ, चित्र और वीडियोटेक्स्टपाठ, चित्र और वीडियोपाठ, चित्र, वीडियो और ऑडियो
तर्कपूर्ण आधारअधिकतम तक प्रयासअधिकतम तक प्रयासचालू या बंद सोचनाचालू या बंद सोचना
संरचित आउटपुटसख्त JSON स्कीमासख्त JSON स्कीमाJSON मोडसख्त JSON स्कीमा
इनपुट मूल्य$3.00 प्रति 1M टोकन$1.32 प्रति 1M टोकन$0.225 प्रति 1M टोकन 512K संदर्भ तक, ऊपर $0.45$0.435 प्रति 1M टोकन
उत्पादन मूल्य$15.00 प्रति 1M टोकन$3.96 प्रति 1M टोकन$0.90 प्रति 1M टोकन 512K संदर्भ तक, ऊपर $1.80$0.87 प्रति 1M टोकन

हमने इसे कैसे चलाया

प्रत्येक मॉडल को तीन कार्यों के लिए समान संकेत प्राप्त हुआ: एक एकल HTML फ़ाइल में स्पिन चक्र पर वॉशिंग मशीन का निर्माण करें; एक एकल HTML फ़ाइल में एक पौधे का निर्माण करें, समय-चूक का निर्माण; एक एकल HTML फ़ाइल में एक पॉट में पॉपकॉर्न पॉपिंग का निर्माण करें। प्रत्येक कार्य ने एक एकल स्व-निहित HTML फ़ाइल के लिए कहा, जिसमें कोई बाहरी पुस्तकालय नहीं है जो अपने आप एनिमेट करता है। Kimi K3 और DeepSeek V4 Pro 0813 reasoning_effort: "अधिकतम"; MiniMax M3 और MiMo V2.6 Pro, जिनके पास कोई प्रयास सेटिंग नहीं है, सोच के साथ चले। प्रत्येक मॉडल में 65,536 टोकन आउटपुट बजट और प्रति कार्य एक शॉट था। प्रत्येक पैनल पर लाइन की गिनती और tokens-per-second रीडआउट को वास्तविक एपीआई कॉल से मापा जाता है, और प्रत्येक परिणाम वह फ़ाइल होती है जिसे मॉडल लौटाता है, जैसा है वैसा ही प्रस्तुत किया जाता है।

क्या देखना है

MiniMax M3 ने अपनी फ़ाइलों को सबसे तेजी से लगभग 114 टोकन प्रति सेकंड पर लौटाया। MiMo V2.6 Pro ने सबसे लंबी फ़ाइलें लिखीं, औसतन लगभग 1090 लाइनें, और MiniMax M3 सबसे कॉम्पैक्ट, लगभग 500। MiMo V2.6 Pro ने सबसे अधिक आउटपुट टोकन का उपयोग किया, लगभग 42,000 प्रति कार्य इसके तर्क सहित। देखें कि प्रत्येक मॉडल अपने दृश्य को कैसे जीवंत करता है: गति, विवरण और यह कैसे अपने आप चलता रहता है। हम विजेता घोषित नहीं कर रहे हैं। क्लिप चलाएं और अपने स्वयं के उपयोग के मामले के लिए आउटपुट का न्याय करें।

EmpirioLabs पर एक ही परीक्षण चलाएं

curl https://api.empiriolabs.ai/v1/chat/completions \ -H "प्राधिकरण: वाहक $EMPIRIOLABS_API_KEY" \ -h "सामग्री-प्रकार: application/json" \ -d '{ "मॉडल": "kimi-k3", "reasoning_effort": "अधिकतम", "संदेश": [{"भूमिका": "उपयोगकर्ता", "सामग्री": "एक एकल HTML फ़ाइल में स्पिन चक्र पर वॉशिंग मशीन बनाएं।

विनिमय करना मॉडल सेवा मेरे deepseek-v4-pro-0813, न्यूनतम-एम3 या mimo-v2-6-pro दूसरों के खिलाफ एक ही अनुरोध चलाने के लिए, या उन्हें अंतःक्रियात्मक रूप से आजमाएं खेल।.

अक्सर पूछे जाने वाले प्रश्नों

क्या परिणाम संपादित या पुन: प्रयास किए गए थे?

नहीं। प्रत्येक पैनल पहली फ़ाइल है जिसे मॉडल ने उस प्रॉम्प्ट के लिए लौटाया है, जो बिल्कुल लौटाया गया है। एक अनुरोध जो बिना फ़ाइल के वापस आया था, उसे फिर से भेजा गया था।

उच्चतम तर्क सेटिंग क्यों?

एक निष्पक्ष सिर से सिर तक प्रत्येक मॉडल को अपने सबसे अच्छे रूप में दिखाता है, इसलिए प्रत्येक अपनी उच्चतम तर्क सेटिंग पर चला: किमी K3 और डीपसीक V4 प्रो 0813 के लिए अधिकतम प्रयास, MiniMax M3 और MiMo V2.6 Pro के लिए सोच रहा है।

मुझे किस मॉडल का उपयोग करना चाहिए?

MiMo V2.6 Pro का आउटपुट मूल्य यहां चारों में से सबसे कम है। निर्णय लेने से पहले प्रत्येक के खिलाफ अपना कार्यभार चलाएं: एक ही अनुरोध सभी चार के लिए काम करता है और केवल मॉडल का नाम बदल दिया जाता है।

इसे अजमाएं

खेल का मैदान (c) सभी मॉडल (c) मूल्य निर्धारण

बेहतर समापन बिंदुओं का उपयोग करने के लिए तैयार हैं?

हमारे मॉडलों का अन्वेषण करें, या व्यावसायिक पूछताछ, कस्टम परिनियोजन, या किसी भी अन्य चीज़ के बारे में हमसे संपर्क करें।