私たちは置いた キミK3, GLM 5.3, Qwen3.8 マックス および DeepSeek V4 Pro 0813 4つのワンショットコーディングテストで互いに競い合い、すべてEmpirioLabs上で実行されます。同じプロンプトで、1回の試み、編集ややり直しはなく、すべての結果が実際のブラウザでリアルタイムでレンダリングされます。
4人比較を見てください
仕様の概要
| キミK3 | GLM 5.3 | Qwen3.8 マックス | DeepSeek V4 Pro 0813 | |
|---|---|---|---|---|
| メイカー | ムーンショットAI | Z.ai | アリババ | ディープシーク |
| コンテキストウィンドウ | 1,000,000トークン | 1,000,000トークン | 1,000,000トークン | 1,000,000トークン |
| 入力 | テキスト、画像、ビデオ | 本文 | テキスト、画像、ビデオ | 本文 |
| 推論制御 | reasoning_effort、低から最大 | reasoning_effort、低から最大 | reasoning_effort、最高値までゼロ | reasoning_effort、最高値までゼロ |
| 構造化出力 | 厳密なJSONスキーマ | JSONモード | 厳密なJSONスキーマ | 厳密なJSONスキーマ |
| 投入価格 | 100万トークンあたり$3.00 | 100万トークンあたり$1.40 | 100万トークンあたり$2.00 | 100万トークンあたり$1.32 |
| 出力価格 | 100万トークンあたり$15.00 | 100万トークンあたり$4.40 | 100万トークンあたり$6.00 | 100万トークンあたり$3.96 |
運営方法
各モデルには、アニメーションA*探索で生成・解く迷路、落ち砂シミュレーション、波に乗る帆船の海の夕焼け、夜の窓から雨が流れ落ちる4つのタスクが割り当てられました。すべてのタスクは外部ライブラリのない単一の自己完結型HTMLファイルを求めました。4つのモデルすべてが reasoning_effort:「マックス」 65,536トークン出力予算、ワンショット、リトライなし。各パネルのライン数とtokens-per-second読み取り値は実際のAPI呼び出しから測定され、各結果はモデルが返したファイルで、そのままレンダリングされます。
注意すべき点
DeepSeek V4 Pro 0813はファイルリターンが最も速く、約100トークン/秒でした。Qwen3.8 Maxは最も長いファイル(平均約540行)、Kimi K3は最もコンパクトで約360行を書きました。GLM 5.3は最も多くの出力トークンを使用し、作業ごとに約47,000トークン(推論を含む)を使いました。各モデルがどのように迷路探索をアニメーション化し、砂を積み上げ、波を動かし、雨粒を合成するかを見てみてください。勝者を決めるつもりはありません。クリップを実行し、自分のユースケースに合わせて出力を判断してください。
同じテストをEmpirioLabsで行ってください
curl https://api.empiriolabs.ai/v1/chat/completions \ -h "認証:ベアラー $EMPIRIOLABS_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "kimi-k3", "reasoning_effort": "max", "messages": [{"role": "user", "content": "Build a maze that that generated and solves that generated and solves that that auto to one HTML file."}] }'
スワップ モデル から glm-5-3, qwen3-8-max または deepseek-v4-pro-0813 同じリクエストを他のものに対して実行したり、インタラクティブに試したりするために プレイグラウンドお問い合わせ.
よくある質問
結果は編集されたり再試されたりしましたか?
いいえ。各モデルは同じプロンプトで1回の試行があり、レンダリングされた結果は返されたファイルとまったく同じです。
なぜマックス・リザンズなのか?
公平な一騎打ちでは、各モデルのベストパフォーマンスが見られます。4台すべてEmpirioLabsreasoning_effortコントロールが露出しているため、4台とも最高設定で動作しました。
どのモデルを使うべきでしょうか?
DeepSeek V4 Pro 0813は4つの中で最もトークンあたりの価格が低く、ここで最も早く回答されました。Kimi K3とQwen3.8 Maxは画像と動画、テキストの両方に対応しています。GLM 5.3は価格面でDeepSeekに近いです。それぞれのワークロードを比較して判断してください。



