Qwen3.5 9B API

Qwen3.5 9Bは、256Kのコンテキスト、画像・映像入力、関数ツール、構造化出力を備えたコンパクトなマルチモーダル推論モデルです。

Alibaba Cloudテキスト生成256K コンテキストリリース 2026年2月23日ネイティブ推論

Qwen3.5 9B について

Qwen3.5 9Bは、256Kのコンテキスト、画像・映像入力、関数ツール、構造化出力を備えたコンパクトなマルチモーダル推論モデルです。

テキスト、画像、ビデオ入力、ストリーミング、ファンクションツール、構造化JSON出力、シード制御、思考モードをデフォルトでサポートしています。有界思考にはreasoning_effortまたはthinking_budget、直接回答にはenable_thinking=falseを使いましょう。自動キャッシュリードは、モデルサービスから報告された際にキャッシュ入力レートで請求されます。明示的なキャッシュ制御はサポートされていません。

別名 Alibaba Cloud Qwen3.5 9B

reasoningvisionvideofunction callingcachemultimodaljson modelogprobs

Qwen3.5 9B の仕様

モデルID
qwen3-5-9b
プロバイダー
Alibaba Cloud
カテゴリ
テキスト生成
リリース
2026年2月23日
コンテキスト長
256K トークン
最大出力
32,768 トークン
入力
テキスト画像動画
出力
テキスト
構造化出力
JSON Schema
エンドポイント
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1/completionsPOST/v1beta/models/qwen3-5-9b:generateContent
代替モデルID
qwen3.5-9b

Qwen3.5 9B API の料金最大13%お得

EmpirioLabs カタログのライブ従量課金料金です。使った分だけの支払いで、月額最低料金はありません。

タイプ
仕様
料金
パスワード
1M プロンプトトークンあたり
$0.10$0.09
ソリューション
1M生成トークンあたり
$0.15$0.13
キャッシュの読み込み
1M キャッシュされた入力トークンあたり
$0.045
ウェブ検索(リンクアップ)
呼び出し時呼び出し
$0.013
料金ページ全体で比較

Qwen3.5 9B API の呼び出し方

Qwen3.5 9B は OpenAI 互換の Chat Completions API を提供します。任意の OpenAI SDK を EmpirioLabs API キーで https://api.empiriolabs.ai/v1 に向け、モデル ID qwen3-5-9b を使ってください。 EmpirioLabs ダッシュボードで API キーを取得してください。

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3-5-9b",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="qwen3-5-9b",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Qwen3.5 9B API の完全リファレンス

Qwen3.5 9B API のパラメーター

EmpirioLabs 上の Qwen3.5 9B API が対応するリクエストパラメーターです。フィールドを省略した場合はデフォルト値が適用されます。

パラメータタイプデフォルト範囲 / 値説明
temperaturenumber0.70 から 2サンプリング温度。0は決定的で、2は最大のランダム性です。
top_pnumber0.950 から 1原子核サンプリング確率質量。値が低いほど出力がより集中します。
max_tokensinteger40961 から 32768最大出力トークン。
stopstring--最大4つの文字列で、モデルはこれ以上のトークン生成を停止します。
enable_thinkingbooleantrue-答える前に論理を可能にしましょう。
reasoning_effortenummediumnone, low, medium, high, max推論の努力レベル。誰も思考を妨げるものではありません。低、中、高、最大は選択したモデルに合わせて限定された思考予算を設定します。
thinking_budgetinteger40961024 から 32768思考時に推論のために確保される最大トークンが有効になっています。
top_kinteger201 から 200対応する場合は、上位K個候補トークンにサンプリングを制限してください。
min_pnumber00 から 1トークンサンプリングの最小確率閾値。
frequency_penaltynumber0-2 から 2トークンが既に出現した回数に基づくペナルティです。
presence_penaltynumber0-2 から 2生成されたテキストに既に表示されたトークンに対するペナルティ。
repetition_penaltynumber10.1 から 2SGLangが繰り返しのテキストを減らすために使用したペナルティ。
seedinteger-0 から 2147483647再現可能なサンプリングのためのオプションランダムシード。
logprobsbooleanfalse-サポートされている場合、トークンログの確率を返します。
ドキュメントにあと8個のパラメーター

知っておくと便利

テキスト、画像、ビデオ入力、ストリーミング、ファンクションツール、構造化JSON出力、シード制御、思考モードをデフォルトでサポートしています。有界思考にはreasoning_effortまたはthinking_budget、直接回答にはenable_thinking=falseを使いましょう。自動キャッシュリードは、モデルサービスから報告された際にキャッシュ入力レートで請求されます。明示的なキャッシュ制御はサポートされていません。

Qwen3.5 9B API: よくある質問

Qwen3.5 9B API の料金はいくらですか?

EmpirioLabs では Qwen3.5 9B は従量課金です。このページのライブ料金表は常に API の請求額と一致します。

Qwen3.5 9B のコンテキストウィンドウはどれくらいですか?

Qwen3.5 9B は 256K トークンのコンテキストウィンドウに対応しています(1回の応答あたり最大 32,768 出力トークン)。

Qwen3.5 9B API は OpenAI 互換ですか?

はい。Qwen3.5 9B は OpenAI 互換の Chat Completions API を提供しているため、既存の OpenAI SDK は base_urlhttps://api.empiriolabs.ai/v1 に向けてモデル ID を qwen3-5-9b に設定するだけで動作します。

統合する前にブラウザで Qwen3.5 9B を試せますか?

はい。EmpirioLabs プレイグラウンドでは API と同じパラメーターで Qwen3.5 9B をブラウザ上で実行できるので、コードを書く前にプロンプトを試せます。

Qwen3.5 9B の API キーはどうやって取得しますか?

EmpirioLabs アカウントを作成し、ダッシュボードの API Keysでキーを生成してください。課金は従量制クレジットなので、実行したリクエストの分だけ支払います。

より良いエンドポイントを使う準備はできていますか?

ご自身のモデルを当社のスタックに展開したい方は、ぜひご価格をご覧ください。