हम डालते हैं किमी K3, डीपसीक V4 प्रो 0813, मिनीमैक्स एम3 तथा MiMo V2.6 प्रो तीन एक-शॉट कोडिंग परीक्षणों में एक दूसरे के खिलाफ, सभी EmpirioLabs पर चलते हैं। एक ही संकेत, एक शॉट, कोई संपादन नहीं, और प्रत्येक परिणाम एक वास्तविक ब्राउज़र में लाइव प्रस्तुत किया गया।
चार तरफ़ा तुलना देखें
चश्मा एक नज़र में
| किमी K3 | डीपसीक V4 प्रो 0813 | मिनीमैक्स एम3 | MiMo V2.6 प्रो | |
|---|---|---|---|---|
| निर्माता | मूनशॉट एआई | डीपसीक | मिनीमैक्स | शाओमी |
| संदर्भ विंडो | 1,000,000 टोकन | 1,000,000 टोकन | 1,000,000 टोकन | 1,000,000 टोकन |
| इनपुट | पाठ, चित्र और वीडियो | टेक्स्ट | पाठ, चित्र और वीडियो | पाठ, चित्र, वीडियो और ऑडियो |
| तर्कपूर्ण आधार | अधिकतम तक प्रयास | अधिकतम तक प्रयास | चालू या बंद सोचना | चालू या बंद सोचना |
| संरचित आउटपुट | सख्त JSON स्कीमा | सख्त JSON स्कीमा | JSON मोड | सख्त JSON स्कीमा |
| इनपुट मूल्य | $3.00 प्रति 1M टोकन | $1.32 प्रति 1M टोकन | $0.225 प्रति 1M टोकन 512K संदर्भ तक, ऊपर $0.45 | $0.435 प्रति 1M टोकन |
| उत्पादन मूल्य | $15.00 प्रति 1M टोकन | $3.96 प्रति 1M टोकन | $0.90 प्रति 1M टोकन 512K संदर्भ तक, ऊपर $1.80 | $0.87 प्रति 1M टोकन |
हमने इसे कैसे चलाया
प्रत्येक मॉडल को तीन कार्यों के लिए समान संकेत प्राप्त हुआ: एक एकल HTML फ़ाइल में स्पिन चक्र पर वॉशिंग मशीन का निर्माण करें; एक एकल HTML फ़ाइल में एक पौधे का निर्माण करें, समय-चूक का निर्माण; एक एकल HTML फ़ाइल में एक पॉट में पॉपकॉर्न पॉपिंग का निर्माण करें। प्रत्येक कार्य ने एक एकल स्व-निहित HTML फ़ाइल के लिए कहा, जिसमें कोई बाहरी पुस्तकालय नहीं है जो अपने आप एनिमेट करता है। Kimi K3 और DeepSeek V4 Pro 0813 reasoning_effort: "अधिकतम"; MiniMax M3 और MiMo V2.6 Pro, जिनके पास कोई प्रयास सेटिंग नहीं है, सोच के साथ चले। प्रत्येक मॉडल में 65,536 टोकन आउटपुट बजट और प्रति कार्य एक शॉट था। प्रत्येक पैनल पर लाइन की गिनती और tokens-per-second रीडआउट को वास्तविक एपीआई कॉल से मापा जाता है, और प्रत्येक परिणाम वह फ़ाइल होती है जिसे मॉडल लौटाता है, जैसा है वैसा ही प्रस्तुत किया जाता है।
क्या देखना है
MiniMax M3 ने अपनी फ़ाइलों को सबसे तेजी से लगभग 114 टोकन प्रति सेकंड पर लौटाया। MiMo V2.6 Pro ने सबसे लंबी फ़ाइलें लिखीं, औसतन लगभग 1090 लाइनें, और MiniMax M3 सबसे कॉम्पैक्ट, लगभग 500। MiMo V2.6 Pro ने सबसे अधिक आउटपुट टोकन का उपयोग किया, लगभग 42,000 प्रति कार्य इसके तर्क सहित। देखें कि प्रत्येक मॉडल अपने दृश्य को कैसे जीवंत करता है: गति, विवरण और यह कैसे अपने आप चलता रहता है। हम विजेता घोषित नहीं कर रहे हैं। क्लिप चलाएं और अपने स्वयं के उपयोग के मामले के लिए आउटपुट का न्याय करें।
EmpirioLabs पर एक ही परीक्षण चलाएं
curl https://api.empiriolabs.ai/v1/chat/completions \ -H "प्राधिकरण: वाहक $EMPIRIOLABS_API_KEY" \ -h "सामग्री-प्रकार: application/json" \ -d '{ "मॉडल": "kimi-k3", "reasoning_effort": "अधिकतम", "संदेश": [{"भूमिका": "उपयोगकर्ता", "सामग्री": "एक एकल HTML फ़ाइल में स्पिन चक्र पर वॉशिंग मशीन बनाएं।
विनिमय करना मॉडल सेवा मेरे deepseek-v4-pro-0813, न्यूनतम-एम3 या mimo-v2-6-pro दूसरों के खिलाफ एक ही अनुरोध चलाने के लिए, या उन्हें अंतःक्रियात्मक रूप से आजमाएं खेल।.
अक्सर पूछे जाने वाले प्रश्नों
क्या परिणाम संपादित या पुन: प्रयास किए गए थे?
नहीं। प्रत्येक पैनल पहली फ़ाइल है जिसे मॉडल ने उस प्रॉम्प्ट के लिए लौटाया है, जो बिल्कुल लौटाया गया है। एक अनुरोध जो बिना फ़ाइल के वापस आया था, उसे फिर से भेजा गया था।
उच्चतम तर्क सेटिंग क्यों?
एक निष्पक्ष सिर से सिर तक प्रत्येक मॉडल को अपने सबसे अच्छे रूप में दिखाता है, इसलिए प्रत्येक अपनी उच्चतम तर्क सेटिंग पर चला: किमी K3 और डीपसीक V4 प्रो 0813 के लिए अधिकतम प्रयास, MiniMax M3 और MiMo V2.6 Pro के लिए सोच रहा है।
मुझे किस मॉडल का उपयोग करना चाहिए?
MiMo V2.6 Pro का आउटपुट मूल्य यहां चारों में से सबसे कम है। निर्णय लेने से पहले प्रत्येक के खिलाफ अपना कार्यभार चलाएं: एक ही अनुरोध सभी चार के लिए काम करता है और केवल मॉडल का नाम बदल दिया जाता है।
इसे अजमाएं
खेल का मैदान (c) सभी मॉडल (c) मूल्य निर्धारण



