ホーム ブログ

キミK3 vs GLM 5.3 vs Qwen3.8 Max vs DeepSeek V4 Pro:セルフプレイ型フラッピーバードとミサイルコマンド

キミK3 vs GLM 5.3 vs Qwen3.8 Max vs DeepSeek V4 Pro:セルフプレイ型フラッピーバードとミサイルコマンド

Oct 6, 2026

EmpirioLabs AI

私たちは置いた キミK3, GLM 5.3, Qwen3.8 Max 0902 および DeepSeek V4 Pro 0813 2つのワンショットコーディングテストで互いに競い合い、すべてEmpirioLabs上で実行されます。同じプロンプト、1回の試み、編集やリトライなし、すべての結果が実際のブラウザでリアルタイムでレンダリングされます。

4人比較を見てください

仕様の概要

キミK3GLM 5.3Qwen3.8 Max 0902DeepSeek V4 Pro 0813
メイカームーンショットAIZ.aiアリババディープシーク
コンテキストウィンドウ1,000,000トークン1,000,000トークン1,000,000トークン1,000,000トークン
入力テキスト、画像、ビデオ本文テキスト、画像、ビデオ本文
働き方改革最大まで最大まで最大まで最大まで
構造化出力厳密なJSONスキーマJSONモード厳密なJSONスキーマ厳密なJSONスキーマ
投入価格100万トークンあたり$3.00100万トークンあたり$1.40100万トークンあたり$2.00100万トークンあたり$1.32
出力価格100万トークンあたり$15.00100万トークンあたり$4.40100万トークンあたり$6.00100万トークンあたり$3.96

運営方法

各モデルは、2つのタスクに対して同じプロンプトを受け取りました:単一のHTMLファイルで自動再生するFlappy Birdゲームを作成すること。単一のHTMLファイルで自己再生するMissile Commandゲームを作成すること。すべてのタスクは、外部ライブラリを持たず、単独でアニメーションする単一の自己完結型HTMLファイルを求めました。4つのモデルすべてが reasoning_effort:「マックス」 65,536トークン出力予算、ワンショット、リトライなし。各パネルのライン数とtokens-per-second読み取り値は実際のAPI呼び出しから測定され、各結果はモデルが返したファイルで、そのままレンダリングされます。

注意すべき点

DeepSeek V4 Pro 0813は約115トークン/秒で最速のファイルを返しました。DeepSeek V4 Pro 0813は平均約920行のファイルが最も長く、Kimi K3は約490行で最もコンパクトでした。GLM 5.3は最も多くの出力トークンを使用し、推論を含めてタスクあたり約59,000トークンを使いました。各モデルがどのようにシーンに命を吹き込むかを見てください:動き、ディテール、そして自立して動作し続ける様子。勝者を決めるつもりはありません。クリップを実行し、自分のユースケースに合わせて出力を判断してください。

同じテストをEmpirioLabsで行ってください

curl https://api.empiriolabs.ai/v1/chat/completions \ -H 「認証:ベアラー $EMPIRIOLABS_API_KEY」\ -H 「Content-Type: application/json」 \ -d '{ "model": "kimi-k3", "reasoning_effort": "max", "messages": [{"role": "user", "content": "Build a Flappy Bird game that that just play one HTML file."}] }'

スワップ モデル から glm-5-3, qwen3-8-max-0902 または deepseek-v4-pro-0813 同じリクエストを他のものに対して実行したり、インタラクティブに試したりするために プレイグラウンドお問い合わせ.

よくある質問

結果は編集されたり再試されたりしましたか?

いいえ。各モデルは同じプロンプトで1回の試行があり、レンダリングされた結果は返されたファイルとまったく同じです。

なぜマックス・リザンズなのか?

公平な一騎打ちでは、各モデルのベストパフォーマンスが見られます。4台すべてEmpirioLabsreasoning_effortコントロールが露出しているため、4台とも最高設定で動作しました。

どのモデルを使うべきでしょうか?

DeepSeek V4 Pro 0813は、ここで4つの中で最も出力価格が低いです。それぞれの作業負荷を比較して判断してください:同じリクエストはモデル名を変えるだけで4つすべてで動作します。

試してみて

プレイグラウンド お問い合わせ 全モデル お問い合わせ 料金について

より良いエンドポイントを使う準備はできていますか?

当社のモデルをご覧いただくか、ビジネスの問い合わせ、カスタム展開、その他何でもご連絡ください。