Qwen3.8 MaxはEmpirioLabsで利用可能です。 これはアリババのQwen3.8シリーズの旗艦層であり、コーディング、長期エージェント業務、専門的なタスク向けに設計された兆スケールのmixture-of-expertsモデルで、1Mトークンコンテキストウィンドウ、深い思考、テキスト・画像・動画入力を備えています。OpenAI互換API上で動作しているので、フィールドを1つ変更するだけで切り替えられます。
Qwen3.8 Maxが得意とすること
MaxはQwen3.8ファミリーの機能層であり、単なる速度よりも質が重視される作業に適しています。つまり、大規模なリポジトリをまたぐコーディング、長期間実行されるエージェントループ、ドキュメントやスクリーンショットの理解、そして多くのコンテキストを同時に保持しなければならない分析などです。画像や動画を読み込み、標準関数呼び出しでツールを呼び出し、要求に応じて厳格なスキーマ準拠のJSONを返し、ウェブ検索、コード実行、URL読み取り、組み込みツールを通じて画像検索が可能です。
どう呼べばいいか
標準的なチャットの送信:
curl https://api.empiriolabs.ai/v1/chat/completions \ -H 「Authorization: Bearer $EMPIRIOLABS_API_KEY」 \ -H "Content-Type: application/json" \ -d '{ "model": "qwen3-8-max", "messages": [ {"role": "user", "content": "このモジュールをリファクタリングし、トレードオフを説明してください。"} ] }''
同じモデルIDは同じモデルでも使えます お問い合わせ、人形について お問い合わせ、そしてGoogle互換版でも /v1beta/models/qwen3-8-max:コンテンツ生成 つまり、ほとんどの既存のSDKセットアップは書き直しなしで動作します。
思考はデフォルトでオンになっています
Qwen3.8 回答前に理由を最大限に設定し、それをオフにしない限り。セット enable thinking を使う から 偽り 短時間で遅延に敏感な通話や、レイズ thinking_budget 問題をより強く処理したいときに最大262144トークンを使えます。推論トークンは出力トークンとして請求されるため、単純なプロンプトに大きな予算をかけると、このモデルに過剰支出が起こる主な原因となります。
エージェントをポートする前に知っておくべき実用的な詳細:思考が有効になっている間、モデルは受け入れます tool_choice ただし、 自動車.特定の関数を強制する tool_choice:「必須」 または明示的なツールオブジェクトが拒否される場合もあります。エージェントが最初のツールコールを強制した場合は、選択を自動で残すか、そのステップで思考を無効にしてください。
組み込みツールはデフォルトでオン
モデルには5つの組み込みツールが付属しています:ウェブ検索、ウェブエクストラクター、コードインタープリター、text-to-image検索、image-to-image検索です。これらはすべてデフォルトで有効にされており、リサーチスタイルのプロンプトには便利ですが、単なる完了には無駄です。なぜなら、ツールの定義がすべてのプロンプトに付随しているからです。不要なものは tool_* パラメータ:
{ "model": "qwen3-8-max", "messages": [{"role": "user", "content": "今週仕様で何が変わった?"}], "tool_web_search": true, "tool_web_extractor": true, "tool_code_interpreter": false, "tool_web_search_image": false, "tool_image_search": false }
上流には2つの依存関係が強制されます。ウェブエクストラクターはウェブ検索と並行して動作し、ウェブエクストラクタとコードインタプリタの両方が思考を有効にする必要があります。ウェブ検索と2つの画像検索ツールは呼び出した呼び出しごとに請求され、1つのリクエストで複数回呼び出すことができるため、応答は正確に実行された内容を報告します usage.tool_usageお問い合わせ.
構造化出力
Qwen3.8 MaxはJSONモードだけでなく厳格なJSONスキーマを強制するため、正確なレスポンス形状を求めて修復ステップなしで解析できます:
{ "model": "qwen3-8-max", "messages": [{"role": "user", "content": "請求書フィールドを抽出."}], "response_format": { "type": "json_schema", "json_schema": { "name": "invoice", "strict": true, "schema": { "type": "object", "properties": { "vendor": {"type": "string"}, "total": {"type": "number"} }, "required": ["vendor", "total"], "additionalProperties": false } }
画像と映像
OpenAI対応の視覚モデルと同様に画像や動画を添付できます。 image_url または video_url 内容部分。複数の画像を一つのメッセージに送り、位置ごとに参照することができます。ビデオの場合、 video_fps フレームの密度を制御し、 vl_high_resolution_images 画像入力のプロンプトサイズと詳細をトレードします。
料金について
Qwen3.8 Maxは、入力トークンと出力トークンごとに料金が設定され、実際に実行された際に検索ツールで少額の通話手数料がかかる仕組みです。思考トークンは出力トークンとしてカウントされます。現在の料金は Qwen3.8 Max モデルページ そして、 プライシングページ、常にライブレートカードを反映します。
試してみて
開けて EmpirioLabs Playground コードを書かずにプロンプトや添付ファイル、ツールのトグルをテストしたり、 API参照 パラメータリストの全内容については。



