ホーム ブログ

Qwen3.7 Flash APIの使い方

Qwen3.7 API経由のフラッシュ

Jul 28, 2026

EmpirioLabs AI

Qwen3.7 FlashはEmpirioLabsで利用可能です。 これはアリババのQwen3.7ビジョン言語シリーズの高速段階であり、マルチモーダル理解、エージェントツールの使用、長いコンテキスト作業向けに構築されており、100万トークンコンテキストウィンドウ、切り替え可能な思考、テキスト、画像、ビデオ入力を備えています。OpenAI互換API上で動作しているので、フィールドを1つ変更するだけで切り替えられます。

Qwen3.7 Flashが得意とすること

FlashはQwen3.7ファミリーの中でも速度とコストの層であり、ドキュメントやスクリーンショットの理解、ビデオ質問応答、抽出パイプライン、ツールを呼び出すエージェントループなど、実際の推論が欲しい大量作業に適しています。画像や動画を読み込み、標準関数呼び出しでツールを呼び出し、オンデマンドでJSONを返し、ウェブ検索、コード実行、URLの読み込みも内蔵ツールで行えます。シンガポールと中国の両方の展開が用意されているので、レイテンシや価格に合ったものを選べます。

どう呼べばいいか

標準的なチャットの送信:

curl https://api.empiriolabs.ai/v1/chat/completions \ -h "Authorization: Bearer $EMPIRIOLABS_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "qwen3-7-flash", "messages": [ {"role": "user", "content": "この四半期の報告を5箇条書きでまとめる"} ] }'

最終的な答えが戻ってきます 内容、 が の思考 のとき、モデルの推論は に入ります。 理由 内容お問い合わせ.

思考をコントロールする

思考はデフォルトでオンになっています。短時間でレイテンシに敏感な通話ではオフにするか、モデルが論理的に使うトークン数の予算を設定するのも良いでしょう。また、 理由 努力 ノー、ロー、ミディアム、ハイ、またはマックスがあり、これらはこのモデルの予算サイズに対応します:

{ "model": "qwen3-7-flash", "messages": [{"role": "user", "content": "Plan a migration and justify the order."}], "enable_thinking": true, "thinking_budget": 32768 }

推論トークンは出力トークンとして請求されます。

画像と映像

ユーザーメッセージのテキストと一緒に画像や動画をコンテンツの一部として渡し、それらが何を示しているか質問してください。1つのリクエストに複数の入力を付けることができます:

{ "model": "qwen3-7-flash", "messages": [{"role": "user", "content": [ {"type": "text", "text": "この2つのスクリーンショットの間で何が変わった?"}, {"type": "image_url", "image_url": {"url": "https://example.com/before.png"}}, {"type": "image_url", "image_url": {"url": "https://example.com/after.png"}} ]}] }

組み込みツール

Qwen3.7 Flashには、ウェブ検索、URL読み取り用のウェブエクストラクター、コードインタープリタ、text-to-imageおよびimage-to-image検索が搭載されています。それぞれはトグルであり、モデルが実際に呼び出す場合にのみ請求されます。ウェブエクストラクタとコードインタプリターは思考を有効にする必要があります:

{ "model": "qwen3-7-flash", "messages": [{"role": "user", "content": "What sent in the latest release?"}], "tool_web_search": true }

ツールを実行すると、応答は usage.tool_usage トークンカウントの隣にマッピングして、何が呼び出されたか正確に確認できます。

構造化出力と関数呼び出し

使用方法 response_format お問い合わせ {"type": "json_object"} 有効なJSONオブジェクトを強制し、パスを送ります ツール モデルに自分のコードから呼び出せたい標準関数呼び出しのためです。

プロンプトキャッシュ

繰り返しのプロンプトプレフィックスは自動的にキャッシュされ、キャッシュされた入力トークンは新規入力よりもはるかに低い料金で請求されます。もし長い共有システムプロンプトやドキュメントヘッダーを複数のリクエストに送れば、コードを変えずにその割引を受けられます。

地域

デフォルト qwen3-7-flash シンガポールへの展開です。 qwen3-7-flash:variant1 同じモデルを中国でより低く導入しているのです。どちらも同じパラメータを使うので、モデルフィールドだけで切り替えられます。

料金について

Qwen3.7 Flashはトークン単位で請求される「使い古分課金」です。入力・出力の料金は短いプロンプトでは下がり、非常に長いものでは上がる、キャッシュされた入力請求は割引料金で、内蔵ツールは実行時のみ通話1回あたりの少額の料金がかかります。ライブレートは Qwen3.7 Flashモデルページ そして、 プライシングページ、そして プレイグラウンドお問い合わせ.

より良いエンドポイントを使う準備はできていますか?

当社のモデルをご覧いただくか、ビジネスの問い合わせ、カスタム展開、その他何でもご連絡ください。