
コーディング、長期的なエージェント、プロフェッショナルな仕事のための兆スケールのMoEフラッグシップであり、100万トークンの文脈で画像と映像の理解を兼ね備えています。
コーディング、長期的なエージェント、プロフェッショナルな仕事のための兆スケールのMoEフラッグシップであり、100万トークンの文脈で画像と映像の理解を兼ね備えています。
テキスト、画像、ビデオ入力、最大262144トークンまでのenable_thinking・thinking_budget思考モード、関数呼び出し、厳格なJSONスキーマを含む構造化出力、そしてtool_web_search、tool_web_extractor、tool_code_interpreter、tool_web_search_image、tool_image_searchの5つの組み込みツールをサポートします。思考トークンは出力トークンとして請求されます。
別名 Alibaba Cloud Qwen3.8 Max
qwen3-8-max/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/qwen3-8-max:generateContentqwen3.8-maxEmpirioLabs カタログのライブ従量課金料金です。使った分だけの支払いで、月額最低料金はありません。
Qwen3.8 Max は OpenAI 互換の Chat Completions API を提供します。任意の OpenAI SDK を EmpirioLabs API キーで https://api.empiriolabs.ai/v1 に向け、モデル ID qwen3-8-max を使ってください。 EmpirioLabs ダッシュボードで API キーを取得してください。
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3-8-max",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="qwen3-8-max",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)EmpirioLabs 上の Qwen3.8 Max API が対応するリクエストパラメーターです。フィールドを省略した場合はデフォルト値が適用されます。
| パラメータ | タイプ | デフォルト | 範囲 / 値 | 説明 |
|---|---|---|---|---|
| temperature | number | 0.7 | 0 から 2 | サンプリング温度。0は決定的で、2は最大のランダム性です。 |
| top_p | number | 0.9 | 0 から 1 | 原子核サンプリング確率質量。値が低いほど出力がより集中します。 |
| max_tokens | number | 4096 | 1 から 131072 | 最大出力トークン。 |
| stop | string | - | - | 最大4つの文字列で、モデルはこれ以上のトークン生成を停止します。 |
| enable_thinking | boolean | true | - | 答える前に論理を可能にしましょう。 |
| reasoning_effort | enum | medium | none, low, medium, high, max | 推論の努力レベル。誰も思考を妨げるものではありません。低、中、高、最大は選択したモデルに合わせて限定された思考予算を設定します。 |
| thinking_budget | number | 32768 | 1 から 262144 | 思考時に推論のために確保される最大トークンが有効になっています。 |
| vl_high_resolution_images | boolean | true | - | 画像入力には高解像度処理を使いましょう。 |
| max_pixels | number | 2621440 | 4096 から 16777216 | 高解像度処理を無効にした場合の画像あたりの最大ピクセル数。 |
| video_fps | number | 2 | 0.1 から 10 | 映像入力からサンプリングするためのフレーム毎秒です。 |
| treat_images_as_video | boolean | false | - | 一連の画像をビデオフレームとして扱いましょう。 |
| tool_web_search | boolean | true | - | リアルタイムの情報をウェブで検索しましょう。呼び出しごとにリクエストコストが$0.02増加します。 |
| tool_web_extractor | boolean | true | - | URLからコンテンツを抽出し読み取ること。ウェブ検索と思考が必要です。 |
| tool_code_interpreter | boolean | true | - | サンドボックスでPythonコードを実行してください。考える必要がある。 |
テキスト、画像、動画入力もサポートされています。ウェブ検索、ウェブエクストラクター、コードインタプリタ、text-to-image検索、image-to-image検索は、tool_*パラメータを通じて公開されるオプションの組み込みツールです。ウェブ検索、text-to-image検索、image-to-image検索は呼び出した各通話ごとに$0.02を追加します。ウェブエクストラクターとコードインタプリターは追加料金なしで動作します。ウェブエクストラクターはウェブ検索を必要とし、ウェブエクストラクターもコードインタプリターも思考が必要です。単一のリクエストでツールを複数回呼び出しることができ、呼び出した呼び出しごとに請求されます。思考トークンは出力トークンとして請求されます。
When this model invokes built-in tools inside a single request, the response carries a normalized usage.tool_usage map alongside the token counts:
"usage": {
"prompt_tokens": 123,
"completion_tokens": 456,
"cost_usd": 0.0042,
"tool_usage": {"web_search": 3, "code_interpreter": 1}
}Tool counts are already factored into cost_usd and are surfaced for transparency so you can audit per-tool billing. The field is omitted when no tools were invoked.
:variant1
テキスト、画像、動画入力もサポートされています。ウェブ検索、ウェブエクストラクター、コードインタプリタ、text-to-image検索、image-to-image検索は、tool_*パラメータを通じて公開されるオプションの組み込みツールです。ウェブ検索、text-to-image検索、image-to-image検索は呼び出した各通話ごとに$0.02を追加します。ウェブエクストラクターとコードインタプリターは追加料金なしで動作します。ウェブエクストラクターはウェブ検索を必要とし、ウェブエクストラクターもコードインタプリターも思考が必要です。単一のリクエストでツールを複数回呼び出しることができ、呼び出した呼び出しごとに請求されます。思考トークンは出力トークンとして請求されます。
バリアントは独自のモデル ID を持つ Qwen3.8 Max の別バージョンです。バリアントによって提供リージョン、料金、対応パラメーターが異なる場合がありますが、それ以外は同じように動作します。
qwen3-8-max:variant1qwen3.8-max:variant1EmpirioLabs では Qwen3.8 Max は従量課金です: パスワード $2.00 1M プロンプトトークンあたり; ソリューション $6.00 1M生成トークンあたり; ウェブ検索 $0.02 呼び出し時呼び出し。このページのライブ料金表は常に API の請求額と一致します。
Qwen3.8 Max は 1M トークンのコンテキストウィンドウに対応しています(1回の応答あたり最大 131,072 出力トークン)。
はい。Qwen3.8 Max は OpenAI 互換の Chat Completions API を提供しているため、既存の OpenAI SDK は base_url を https://api.empiriolabs.ai/v1 に向けてモデル ID を qwen3-8-max に設定するだけで動作します。
Qwen3.8 Max は 2 個のモデル ID で利用できます: デフォルトの qwen3-8-max に加えて qwen3-8-max:variant1 (China)。バリアントは提供リージョン、料金、対応パラメーターが異なる場合があり、それぞれの料金表はこのページにあります。
はい。EmpirioLabs プレイグラウンドでは API と同じパラメーターで Qwen3.8 Max をブラウザ上で実行できるので、コードを書く前にプロンプトを試せます。
EmpirioLabs アカウントを作成し、ダッシュボードの API Keysでキーを生成してください。課金は従量制クレジットなので、実行したリクエストの分だけ支払います。