Qwen3.7 Flash API

テキスト、画像、動画、ツール使用、エージェントタスク向けの高速Qwen3.7ビジョン言語モデルで、暗黙的キャッシュと1Mトークンコンテキストを備えています。

Alibaba Cloudテキスト生成1M コンテキストリリース 2026年7月15日Singapore独自エンドポイント新着

Qwen3.7 Flash について

テキスト、画像、動画、ツール使用、エージェントタスク向けの高速Qwen3.7ビジョン言語モデルで、暗黙的キャッシュと1Mトークンコンテキストを備えています。

テキスト、画像、ビデオ入力、思考モード(enable_thinkingおよびthinking_budget、最大131072トークン)、関数呼び出し、構造化出力、ウェブ検索、ウェブエクストラクタ、コードインタープリタ、画像検索ツール、プレフィックス継続、暗黙のコンテキストキャッシュをサポートしています。ウェブ検索および画像検索ツールは呼び出し数ごとに請求されます。思考トークンは出力トークンとして請求されます。

別名 Alibaba Cloud Qwen3.7 Flash, Qwen3.7-Flash, qwen3-7-flash

reasoningvisionvideoweb searchcode interpreterfunction callingprefix continuationcacheagentic coding

Qwen3.7 Flash の仕様

モデルID
qwen3-7-flash
プロバイダー
Alibaba Cloud
カテゴリ
テキスト生成
リリース
2026年7月15日
コンテキスト長
1M トークン
最大出力
65,536 トークン
入力
テキスト画像動画
出力
テキスト
構造化出力
JSON モード
リージョン
Singapore
エンドポイント
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/qwen3-7-flash:generateContent
代替モデルID
qwen3.7-flash

Qwen3.7 Flash API の料金

EmpirioLabs カタログのライブ従量課金料金です。使った分だけの支払いで、月額最低料金はありません。

タイプ
仕様
料金
パスワード
1M プロンプトトークンあたり
<=32K $0.0332K-256K $0.10256K-1M $0.20
ソリューション
1M生成トークンあたり
<=32K $0.1332K-256K $0.40256K-1M $0.80
キャッシュの読み込み
1M キャッシュされた入力トークンあたり
<=32K $0.00632K-256K $0.02256K-1M $0.04
ウェブ検索
呼び出し時呼び出し
$0.03
テキストから画像への検索
呼び出し時呼び出し
$0.03
画像間検索
呼び出し時呼び出し
$0.03
ウェブエクストラクター
呼び出し時呼び出し
$0.00
コードインタプリタ
呼び出し時呼び出し
$0.00
料金ページ全体で比較

Qwen3.7 Flash API の呼び出し方

Qwen3.7 Flash は OpenAI 互換の Chat Completions API を提供します。任意の OpenAI SDK を EmpirioLabs API キーで https://api.empiriolabs.ai/v1 に向け、モデル ID qwen3-7-flash を使ってください。 EmpirioLabs ダッシュボードで API キーを取得してください。

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3-7-flash",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="qwen3-7-flash",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Qwen3.7 Flash API の完全リファレンス

Qwen3.7 Flash API のパラメーター

EmpirioLabs 上の Qwen3.7 Flash API が対応するリクエストパラメーターです。フィールドを省略した場合はデフォルト値が適用されます。

パラメータタイプデフォルト範囲 / 値説明
temperaturenumber0.70 から 2サンプリング温度。0は決定的で、2は最大のランダム性です。
top_pnumber0.90 から 1原子核サンプリング確率質量。値が低いほど出力がより集中します。
max_tokensnumber40961 から 65536最大出力トークン。
stopstring--最大4つの文字列で、モデルはこれ以上のトークン生成を停止します。
enable_thinkingbooleantrue-答える前に論理を可能にしましょう。
reasoning_effortenummediumnone, low, medium, high, max推論の努力レベル。誰も思考を妨げるものではありません。低、中、高、最大は選択したモデルに合わせて限定された思考予算を設定します。
thinking_budgetnumber327681 から 131072思考時に推論のために確保される最大トークンが有効になっています。
vl_high_resolution_imagesbooleantrue-画像入力には高解像度処理を使いましょう。
max_pixelsnumber26214404096 から 16777216高解像度処理を無効にした場合の画像あたりの最大ピクセル数。
video_fpsnumber20.1 から 10映像入力からサンプリングするためのフレーム毎秒です。
treat_images_as_videobooleanfalse-一連の画像をビデオフレームとして扱いましょう。
tool_web_searchbooleantrue-リアルタイムの情報をウェブで検索しましょう。呼び出しごとにリクエストコストが$0.03増加します。
tool_web_extractorbooleantrue-URLからコンテンツを抽出し読み取ること。ウェブ検索と思考が必要です。
tool_code_interpreterbooleantrue-サンドボックスでPythonコードを実行してください。考える必要がある。
ドキュメントにあと4個のパラメーター

知っておくと便利

トークンの価格はプロンプトサイズによって階層化され、32Kを超え、さらに256K以上の入力トークンを上回ります。キャッシュされたプロンプトトークンは、マッチングティアの暗黙のキャッシュレートで請求されます。ウェブ検索、テキストから画像検索、画像検索は、呼び出した場合にのみ請求されます。テキストから画像への検索および画像から画像への検索は、画像検索の料金行を使用します。思考トークンは出力トークンとして請求されます。

Per-tool billing (usage.tool_usage)

When this model invokes built-in tools inside a single request, the response carries a normalized usage.tool_usage map alongside the token counts. Tool counts are already factored into cost_usd and are surfaced for transparency.

:variant1

中国の価格はシンガポールに比べて割引されています。トークンの価格はプロンプトサイズによって階層化され、32Kを超え、さらに256K以上の入力トークンを上回ります。暗黙のキャッシュ入力はキャッシュトークン行を使用します。ウェブ検索、テキストから画像検索、画像検索は、呼び出した場合にのみ請求されます。テキストから画像への検索および画像から画像への検索は、画像検索の料金行を使用します。中国有料ツール通話はそれぞれ$0.01。思考トークンは出力トークンとして請求されます。

Qwen3.7 Flash のバリアント

バリアントは独自のモデル ID を持つ Qwen3.7 Flash の別バージョンです。バリアントによって提供リージョン、料金、対応パラメーターが異なる場合がありますが、それ以外は同じように動作します。

Qwen3.7 Flash :variant1最大18%お得

モデルID
qwen3-7-flash:variant1
リージョン
China
コンテキスト長
1M トークン
構造化出力
JSON モード
タイプ
仕様
料金
パスワード
1M プロンプトトークンあたり
$0.03<=32K $0.028$0.1032K-256K $0.083$0.20256K-1M $0.165
ソリューション
1M生成トークンあたり
$0.13<=32K $0.11$0.4032K-256K $0.33$0.80256K-1M $0.66
キャッシュの読み込み
1M キャッシュされた入力トークンあたり
<=32K $0.006$0.0232K-256K $0.017$0.04256K-1M $0.033
ウェブ検索
呼び出し時呼び出し
$0.01
テキストから画像への検索
呼び出し時呼び出し
$0.01
画像間検索
呼び出し時呼び出し
$0.01
ウェブエクストラクター
呼び出し時呼び出し
$0.00
コードインタプリタ
呼び出し時呼び出し
$0.00
:variant1 をプレイグラウンドで試す

Qwen3.7 Flash API: よくある質問

Qwen3.7 Flash API の料金はいくらですか?

EmpirioLabs では Qwen3.7 Flash は従量課金です。このページのライブ料金表は常に API の請求額と一致します。

Qwen3.7 Flash のコンテキストウィンドウはどれくらいですか?

Qwen3.7 Flash は 1M トークンのコンテキストウィンドウに対応しています(1回の応答あたり最大 65,536 出力トークン)。

Qwen3.7 Flash API は OpenAI 互換ですか?

はい。Qwen3.7 Flash は OpenAI 互換の Chat Completions API を提供しているため、既存の OpenAI SDK は base_urlhttps://api.empiriolabs.ai/v1 に向けてモデル ID を qwen3-7-flash に設定するだけで動作します。

Qwen3.7 Flash にはどんなバリアントがありますか?

Qwen3.7 Flash は 2 個のモデル ID で利用できます: デフォルトの qwen3-7-flash に加えて qwen3-7-flash:variant1 (China)。バリアントは提供リージョン、料金、対応パラメーターが異なる場合があり、それぞれの料金表はこのページにあります。

統合する前にブラウザで Qwen3.7 Flash を試せますか?

はい。EmpirioLabs プレイグラウンドでは API と同じパラメーターで Qwen3.7 Flash をブラウザ上で実行できるので、コードを書く前にプロンプトを試せます。

Qwen3.7 Flash の API キーはどうやって取得しますか?

EmpirioLabs アカウントを作成し、ダッシュボードの API Keysでキーを生成してください。課金は従量制クレジットなので、実行したリクエストの分だけ支払います。

より良いエンドポイントを使う準備はできていますか?

ご自身のモデルを当社のスタックに展開したい方は、ぜひご価格をご覧ください。