Qwen3.5 Flash API

ハイブリッドリニアアテンションとスパースモエ、1Mコンテクスト、高速マルチモーダル text/image /ビデオインフェレンスを備えた Vision-languageモデル。

Alibaba Cloudテキスト生成1M コンテキストリリース 2026年2月24日Singapore独自エンドポイント

Qwen3.5 Flash について

ハイブリッドリニアアテンションとスパースモエ、1Mコンテクスト、高速マルチモーダル text/image /ビデオインフェレンスを備えた Vision-languageモデル。

別名 Alibaba Cloud Qwen3.5 Flash, Qwen3.5-Flash, qwen3-5-flash

visionweb searchcode interpreterfunction callingreasoning

Qwen3.5 Flash の仕様

モデルID
qwen3-5-flash
プロバイダー
Alibaba Cloud
カテゴリ
テキスト生成
リリース
2026年2月24日
コンテキスト長
1M トークン
最大出力
32,768 トークン
入力
テキスト画像動画
出力
テキスト
構造化出力
JSON モード
リージョン
Singapore
エンドポイント
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/qwen3-5-flash:generateContent
代替モデルID
qwen3.5-flash

Qwen3.5 Flash API の料金最大10%お得

EmpirioLabs カタログのライブ従量課金料金です。使った分だけの支払いで、月額最低料金はありません。

タイプ
仕様
料金
パスワード
1M プロンプトトークンあたり
$0.10$0.090
ソリューション
1M生成トークンあたり
$0.40$0.368
ウェブ検索
有効な要求が有効な場合ごとの
$0.015
画像検索
呼び出しごと
$0.012
料金ページ全体で比較

Qwen3.5 Flash API の呼び出し方

Qwen3.5 Flash は OpenAI 互換の Chat Completions API を提供します。任意の OpenAI SDK を EmpirioLabs API キーで https://api.empiriolabs.ai/v1 に向け、モデル ID qwen3-5-flash を使ってください。 EmpirioLabs ダッシュボードで API キーを取得してください。

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3-5-flash",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="qwen3-5-flash",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Qwen3.5 Flash API の完全リファレンス

Qwen3.5 Flash API のパラメーター

EmpirioLabs 上の Qwen3.5 Flash API が対応するリクエストパラメーターです。フィールドを省略した場合はデフォルト値が適用されます。

パラメータタイプデフォルト範囲 / 値説明
temperaturenumber0.70 から 2サンプリング温度。0 = 決定論的、2 = 最大ランダム性。
top_pnumber0.90 から 1原子核サンプリング確率質量。低い方が = より集中しています。
max_tokensnumber40961 から 32768レスポンスには最大トークンを使います。
enable_thinkingbooleantrue-拡張思考モードを有効にしてください。遅いですが、推論重視の作業は改善されます。
vl_high_resolution_imagesbooleantrue-入力画像は高解像度で使いましょう。より詳細なものを高くして。
max_pixelsnumber26214401 から 99999999入力画像あたりの最大ピクセル数。大きいほど詳細は多いですが、遅い/トークン数が多いです。
tool_web_searchbooleanfalse-リアルタイムの情報をウェブで検索しましょう。
tool_web_extractorbooleantrue-URLからコンテンツを抽出し読み取ること。ウェブ検索と思考が必要です。
tool_code_interpreterbooleantrue-サンドボックスでPythonコードを実行してください。考える必要がある。
tool_web_search_imagebooleantrue-テキストの説明から画像をウェブで検索してください。
tool_image_searchbooleantrue-アップロードされた画像から似た画像を見つけてください。
video_fpsnumber20.1 から 10入力映像からサンプル数をサンプリングして解析します。
treat_images_as_videobooleanfalse-入力画像の連続を時間推論のためのビデオとして扱う。
response_formatenum--出力を有効なJSONオブジェクト(JSONモード)として返します。プロンプトで使いたいフィールドを説明してください。
ドキュメントにあと1個のパラメーター

知っておくと便利

ビルトインツール(呼び出されたときのみ) - Web検索: $0.015/call Web抽出器:無料 - コード通訳者:無料 - テキストツー画像検索: $0.012/call 画像への検索: $0.012/call その他 - 思考トークンは、出力トークンとして請求されます テキスト・ツー・イメージ・サーチとイメージ・ツー・イメージ・サーチは、画像検索価格設定行を使用します。 呼び出された各画像の検索は、各々の呼び出し速度で請求されます。

Per-tool billing (usage.tool_usage)

When this model invokes tools (web search, code interpreter, etc.) inside a single request, the response carries a normalized usage.tool_usage map alongside the token counts. The example below shows the shape — exact field names, units, and which tools appear can vary slightly per provider:

"usage": {
  "prompt_tokens": 123,
  "completion_tokens": 456,
  "cost_usd": 0.0042,
  "tool_usage": {"web_search": 3, "code_interpreter": 1}
}

The tool counts are already factored into cost_usd — they are surfaced for transparency so you can audit per-tool billing. The field is omitted when no tools were invoked.

:variant1

テキスト、画像、ビデオ入力をサポートします。 tool_web_search でWeb検索ができます。 トークンは出力トークンとして請求されます。 Explicit キャッシュ コントロールはサポートされていません。

Qwen3.5 Flash のバリアント

バリアントは独自のモデル ID を持つ Qwen3.5 Flash の別バージョンです。バリアントによって提供リージョン、料金、対応パラメーターが異なる場合がありますが、それ以外は同じように動作します。

Qwen3.5 Flash :variant1最大68%お得

モデルID
qwen3-5-flash:variant1
リージョン
China
コンテキスト長
1M トークン
構造化出力
JSON モード
Batch API
利用可能、定価より35%オフ
タイプ
仕様
料金
パスワード
1M プロンプトトークンあたり
$0.090<=128K $0.029128K-256K $0.115256K-1M $0.172
ソリューション
1M生成トークンあたり
$0.368<=128K $0.287128K-256K $1.147256K-1M $1.72
ウェブ検索
有効な場合のクエリ
$0.01
:variant1 をプレイグラウンドで試す

Qwen3.5 Flash API: よくある質問

Qwen3.5 Flash API の料金はいくらですか?

EmpirioLabs では Qwen3.5 Flash は従量課金です。このページのライブ料金表は常に API の請求額と一致します。

Qwen3.5 Flash のコンテキストウィンドウはどれくらいですか?

Qwen3.5 Flash は 1M トークンのコンテキストウィンドウに対応しています(1回の応答あたり最大 32,768 出力トークン)。

Qwen3.5 Flash API は OpenAI 互換ですか?

はい。Qwen3.5 Flash は OpenAI 互換の Chat Completions API を提供しているため、既存の OpenAI SDK は base_urlhttps://api.empiriolabs.ai/v1 に向けてモデル ID を qwen3-5-flash に設定するだけで動作します。

Qwen3.5 Flash にはどんなバリアントがありますか?

Qwen3.5 Flash は 2 個のモデル ID で利用できます: デフォルトの qwen3-5-flash に加えて qwen3-5-flash:variant1 (China)。バリアントは提供リージョン、料金、対応パラメーターが異なる場合があり、それぞれの料金表はこのページにあります。

統合する前にブラウザで Qwen3.5 Flash を試せますか?

はい。EmpirioLabs プレイグラウンドでは API と同じパラメーターで Qwen3.5 Flash をブラウザ上で実行できるので、コードを書く前にプロンプトを試せます。

Qwen3.5 Flash の API キーはどうやって取得しますか?

EmpirioLabs アカウントを作成し、ダッシュボードの API Keysでキーを生成してください。課金は従量制クレジットなので、実行したリクエストの分だけ支払います。

より良いエンドポイントを使う準備はできていますか?

ご自身のモデルを当社のスタックに展開したい方は、ぜひご価格をご覧ください。