Qwen3 Max Preview API

2.5シリーズに比べて中国語と英語の理解力、複雑な指示、多言語能力、ツールの使い方において大きな進歩を見せたプレビューリリース。

Alibaba Cloudテキスト生成256K コンテキストリリース 2025年9月5日Singapore独自エンドポイント

Qwen3 Max Preview について

2.5シリーズに比べて中国語と英語の理解力、複雑な指示、多言語能力、ツールの使い方において大きな進歩を見せたプレビューリリース。

別名 Alibaba Cloud Qwen3 Max Preview

reasoningcode interpreterweb search

Qwen3 Max Preview の仕様

モデルID
qwen3-max-preview
開発元
Alibaba Cloud
カテゴリ
テキスト生成
リリース
2025年9月5日
コンテキスト長
256K トークン
最大出力
65,536 トークン
入力
テキスト
出力
テキスト
構造化出力
JSON モード
リージョン
Singapore
エンドポイント
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/qwen3-max-preview:generateContent

Qwen3 Max Preview API の料金最大20%お得

EmpirioLabs カタログのライブ従量課金料金です。使った分だけの支払いで、月額最低料金はありません。

タイプ
仕様
料金
入力
1Mプロンプトトークンあたり
$1.20<=32K $1.08$2.4032K-128K $2.16$3.00128K-256K $2.70
ソリューション
生成された1Mトークンあたり
$6.00<=32K $4.80$12.0032K-128K $9.60$15.00128K-256K $12.00
ウェブ検索
呼び出し時の通話ごと
$0.015
料金ページ全体で比較

Qwen3 Max Preview API の呼び出し方

Qwen3 Max Preview は OpenAI 互換の Chat Completions API を提供します。任意の OpenAI SDK を EmpirioLabs API キーで https://api.empiriolabs.ai/v1 に向け、モデル ID qwen3-max-preview を使ってください。 EmpirioLabs ダッシュボードで API キーを取得してください。

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3-max-preview",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="qwen3-max-preview",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Qwen3 Max Preview API の完全リファレンス

Qwen3 Max Preview API のパラメーター

EmpirioLabs 上の Qwen3 Max Preview API が対応するリクエストパラメーターです。フィールドを省略した場合はデフォルト値が適用されます。

パラメータタイプデフォルト範囲 / 値説明
temperaturenumber0.70 から 2サンプリング温度。0は決定的で、2は最大のランダム性です。
top_pnumber10 から 1原子核サンプリング確率質量。値が低いほど出力がより集中します。
max_tokensnumber40961 から 65536最大出力トークン。
stopstring--最大4つの文字列で、モデルはこれ以上のトークン生成を停止します。
enable_thinkingbooleantrue-答える前に論理を可能にしましょう。
frequency_penaltynumber0-2 から 2トークンが既に出現した回数に基づくペナルティです。
presence_penaltynumber0-2 から 2生成されたテキストに既に表示されたトークンに対するペナルティ。
tool_web_searchbooleanfalse-リアルタイムの情報をウェブで検索しましょう。呼び出しごとにリクエストコストが$0.015増加します。
tool_code_interpreterbooleanfalse-サンドボックスでPythonコードを実行してください。考える必要がある。
response_formatenum--出力を有効なJSONオブジェクト(JSONモード)として返します。プロンプトで使いたいフィールドを説明してください。
disable_formattingbooleanfalse-EmpirioLabs Markdownフォーマット(引用 [[N]](URL)の書き換え + ウェブ検索やツール使用時の参考文献ブロック)は省略してください。単純な[N]引用付きの生の上流回答が返されます。

知っておくと便利

ディープシンキング+コードインタプリターはどちらもオプトイン方式で提供可能です。

Qwen3 Max Preview API: よくある質問

Qwen3 Max Preview API の料金はいくらですか?

EmpirioLabs では Qwen3 Max Preview は従量課金です。このページのライブ料金表は常に API の請求額と一致します。

Qwen3 Max Preview のコンテキストウィンドウはどれくらいですか?

Qwen3 Max Preview は 256K トークンのコンテキストウィンドウに対応しています(1回の応答あたり最大 65,536 出力トークン)。

Qwen3 Max Preview API は OpenAI 互換ですか?

はい。Qwen3 Max Preview は OpenAI 互換の Chat Completions API を提供しているため、既存の OpenAI SDK は base_urlhttps://api.empiriolabs.ai/v1 に向けてモデル ID を qwen3-max-preview に設定するだけで動作します。

統合する前にブラウザで Qwen3 Max Preview を試せますか?

はい。EmpirioLabs プレイグラウンドでは API と同じパラメーターで Qwen3 Max Preview をブラウザ上で実行できるので、コードを書く前にプロンプトを試せます。

Qwen3 Max Preview の API キーはどうやって取得しますか?

EmpirioLabs アカウントを作成し、ダッシュボードの API Keysでキーを生成してください。課金は従量制クレジットなので、実行したリクエストの分だけ支払います。

より良いエンドポイントを使う準備はできていますか?

ご自身のモデルを当社のスタックに展開したい方は、ぜひご価格をご覧ください。