ホーム ブログ

Kimi K3 vs GLM 5.3 vs Qwen 3.8 Max vs DeepSeek V4 Pro:4つのワンショットコーディングテスト

Kimi K3 vs GLM 5.3 vs Qwen 3.8 Max vs DeepSeek V4 Pro:4つのワンショットコーディングテスト

Oct 4, 2026

EmpirioLabs AI

私たちは置いた キミK3, GLM 5.3, Qwen3.8 マックス および DeepSeek V4 Pro 0813 4つのワンショットコーディングテストで互いに競い合い、すべてEmpirioLabs上で実行されます。同じプロンプトで、1回の試み、編集ややり直しはなく、すべての結果が実際のブラウザでリアルタイムでレンダリングされます。

4人比較を見てください

仕様の概要

キミK3GLM 5.3Qwen3.8 マックスDeepSeek V4 Pro 0813
メイカームーンショットAIZ.aiアリババディープシーク
コンテキストウィンドウ1,000,000トークン1,000,000トークン1,000,000トークン1,000,000トークン
入力テキスト、画像、ビデオ本文テキスト、画像、ビデオ本文
推論制御reasoning_effort、低から最大reasoning_effort、低から最大reasoning_effort、最高値までゼロreasoning_effort、最高値までゼロ
構造化出力厳密なJSONスキーマJSONモード厳密なJSONスキーマ厳密なJSONスキーマ
投入価格100万トークンあたり$3.00100万トークンあたり$1.40100万トークンあたり$2.00100万トークンあたり$1.32
出力価格100万トークンあたり$15.00100万トークンあたり$4.40100万トークンあたり$6.00100万トークンあたり$3.96

運営方法

各モデルには、アニメーションA*探索で生成・解く迷路、落ち砂シミュレーション、波に乗る帆船の海の夕焼け、夜の窓から雨が流れ落ちる4つのタスクが割り当てられました。すべてのタスクは外部ライブラリのない単一の自己完結型HTMLファイルを求めました。4つのモデルすべてが reasoning_effort:「マックス」 65,536トークン出力予算、ワンショット、リトライなし。各パネルのライン数とtokens-per-second読み取り値は実際のAPI呼び出しから測定され、各結果はモデルが返したファイルで、そのままレンダリングされます。

注意すべき点

DeepSeek V4 Pro 0813はファイルリターンが最も速く、約100トークン/秒でした。Qwen3.8 Maxは最も長いファイル(平均約540行)、Kimi K3は最もコンパクトで約360行を書きました。GLM 5.3は最も多くの出力トークンを使用し、作業ごとに約47,000トークン(推論を含む)を使いました。各モデルがどのように迷路探索をアニメーション化し、砂を積み上げ、波を動かし、雨粒を合成するかを見てみてください。勝者を決めるつもりはありません。クリップを実行し、自分のユースケースに合わせて出力を判断してください。

同じテストをEmpirioLabsで行ってください

curl https://api.empiriolabs.ai/v1/chat/completions \ -h "認証:ベアラー $EMPIRIOLABS_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "kimi-k3", "reasoning_effort": "max", "messages": [{"role": "user", "content": "Build a maze that that generated and solves that generated and solves that that auto to one HTML file."}] }'

スワップ モデル から glm-5-3, qwen3-8-max または deepseek-v4-pro-0813 同じリクエストを他のものに対して実行したり、インタラクティブに試したりするために プレイグラウンドお問い合わせ.

よくある質問

結果は編集されたり再試されたりしましたか?

いいえ。各モデルは同じプロンプトで1回の試行があり、レンダリングされた結果は返されたファイルとまったく同じです。

なぜマックス・リザンズなのか?

公平な一騎打ちでは、各モデルのベストパフォーマンスが見られます。4台すべてEmpirioLabsreasoning_effortコントロールが露出しているため、4台とも最高設定で動作しました。

どのモデルを使うべきでしょうか?

DeepSeek V4 Pro 0813は4つの中で最もトークンあたりの価格が低く、ここで最も早く回答されました。Kimi K3とQwen3.8 Maxは画像と動画、テキストの両方に対応しています。GLM 5.3は価格面でDeepSeekに近いです。それぞれのワークロードを比較して判断してください。

試してみて

プレイグラウンド お問い合わせ 全モデル お問い合わせ 料金について

より良いエンドポイントを使う準備はできていますか?

当社のモデルをご覧いただくか、ビジネスの問い合わせ、カスタム展開、その他何でもご連絡ください。