نضع كيمي K3, ديب سيك V4 Pro 0813, ميني ماكس M3 و MiMo V2.6 Pro يتم عرض بعضها البعض عبر ثلاثة اختبارات ترميز أحادية، جميعها تعمل على EmpirioLabs. نفس الطلب، لقطة واحدة، بدون تعديلات، وكل النتائج تعرض مباشرة في متصفح حقيقي.
شاهد المقارنة بين الأربعة
المواصفات من النظرة الأولى
| كيمي K3 | ديب سيك V4 Pro 0813 | ميني ماكس M3 | MiMo V2.6 Pro | |
|---|---|---|---|---|
| الصانع | مونشوت AI | ديب سيك | ميني ماكس | شاومي |
| نافذة السياق | 1,000,000 رمز | 1,000,000 رمز | 1,000,000 رمز | 1,000,000 رمز |
| المدخلات | النص والصور والفيديو | النص | النص والصور والفيديو | النصوص، الصور، الفيديو والصوت |
| الأسباب | الجهد يصل إلى الحد الأقصى | الجهد يصل إلى الحد الأقصى | التفكير بشكل متقطع أو غير | التفكير بشكل متقطع أو غير |
| الإنتاج المنظم | مخطط JSON صارم | مخطط JSON صارم | وضع JSON | مخطط JSON صارم |
| سعر المدخلات | $3.00 لكل مليون رمز | $1.32 لكل مليون رمز | $0.225 لكل مليون رمز حتى 512 ألف سياق، $0.45 أعلاه | $0.435 لكل مليون رمز |
| سعر الإنتاج | $15.00 لكل مليون رمز | $3.96 لكل مليون رمز | $0.90 لكل مليون رمز حتى 512 ألف سياق، $1.80 أعلاه | $0.87 لكل مليون رمز |
كيف أدرناها
كل نموذج تلقى نفس التوجيه لثلاث مهام: بناء غسالة على دورة دوران في ملف HTML واحد؛ بناء نبتة تنمو تايم لابس في ملف HTML واحد؛ بناء بوبكورن بوبوب كورن في وعاء في ملف HTML واحد. كل مهمة كانت تطلب ملف HTML مستقل واحد بدون مكتبات خارجية تتحرك بنفسها. Kimi K3 و DeepSeek V4 Pro 0813 كانا يعملان عند reasoning_effort: "ماكس"; MiniMax M3 و MiMo V2.6 Pro، اللذان لا يحتويان على إعداد الجهد، كانا يعملان مع التفكير. كل نموذج كان لديه 65,536 ميزانية إخراج رمزية وطلقة واحدة لكل مهمة. يتم قياس عدد الأسطر وقراءة tokens-per-second في كل لوحة من استدعاءات API الحقيقية، وكل نتيجة هي الملف الذي أعاده النموذج، وتم عرضه كما هو.
ما الذي يجب البحث عنه
أعاد MiniMax M3 ملفاته الأسرع، بحوالي 114 رمزا في الثانية. كتب MiMo V2.6 Pro أطول الملفات، حوالي 1090 سطرا في المتوسط، وMiniMax M3 الأكثر إحكاما، حوالي 500. استخدم MiMo V2.6 Pro أكبر عدد من رموز الإخراج، حوالي 42,000 لكل مهمة بما في ذلك أسبابه. شاهد كيف يحيي كل نموذج مشهده: الحركة، التفاصيل وكيف يستمر في العمل بمفرده. نحن لا نعلن فائزا. شغل المقطع وقيم المخرجات حسب حالة استخدامك الخاصة.
أجر نفس الاختبار على EmpirioLabs
curl https://api.empiriolabs.ai/v1/chat/completions \ -H "التفويض: حامل $EMPIRIOLABS_API_KEY" \ -H "نوع المحتوى: application/json" \ -d '{ "model": "kimi-k3", "reasoning_effort": "max", "messages": [{"role": "user", "content": "بناء غسالة على دورة دوران في ملف HTML واحد."}] }'
تبديل النموذج إلى deepseek-v4-pro-0813, مينيماكس-إم3 أو mimo-v2-6-pro لتشغيل نفس الطلب ضد الآخرين، أو تجربتهم بشكل تفاعلي في الملعب.
الأسئلة الشائعة
هل تم تعديل النتائج أم إعادة تجربتها؟
لا. كل لوحة هي أول ملف أعاده النموذج لذلك الطلب، وتم عرضه تماما كما تم إرجاعه. الطلب الذي عاد بدون ملف تم إرساله مرة أخرى.
لماذا أعلى إعداد للمنطق؟
المقارنة المباشرة تظهر لكل طرازة في أفضل حالاتها، لذا كل واحدة تعمل بأعلى مستوى منطقي: أقصى جهد لكاميرا Kimi K3 وDeepSeek V4 Pro 0813، مع التفكير في MiniMax M3 وMiMo V2.6 Pro.
أي موديل يجب أن أستخدم؟
MiMo V2.6 Pro لديه أقل سعر إخراج من بين الأربعة هنا. قم بإجراء عبء العمل الخاص بك مقابل كل واحد قبل اتخاذ القرار: نفس الطلب يعمل مع جميع الأربعة مع تغيير اسم النموذج فقط.



