Qwen3.7 FlashはEmpirioLabsで利用可能です。 これはアリババのQwen3.7ビジョン言語シリーズの高速段階であり、マルチモーダル理解、エージェントツールの使用、長いコンテキスト作業向けに構築されており、100万トークンコンテキストウィンドウ、切り替え可能な思考、テキスト、画像、ビデオ入力を備えています。OpenAI互換API上で動作しているので、フィールドを1つ変更するだけで切り替えられます。
Qwen3.7 Flashが得意とすること
FlashはQwen3.7ファミリーの中でも速度とコストの層であり、ドキュメントやスクリーンショットの理解、ビデオ質問応答、抽出パイプライン、ツールを呼び出すエージェントループなど、実際の推論が欲しい大量作業に適しています。画像や動画を読み込み、標準関数呼び出しでツールを呼び出し、オンデマンドでJSONを返し、ウェブ検索、コード実行、URLの読み込みも内蔵ツールで行えます。シンガポールと中国の両方の展開が用意されているので、レイテンシや価格に合ったものを選べます。
どう呼べばいいか
標準的なチャットの送信:
curl https://api.empiriolabs.ai/v1/chat/completions \ -h "Authorization: Bearer $EMPIRIOLABS_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "qwen3-7-flash", "messages": [ {"role": "user", "content": "この四半期の報告を5箇条書きでまとめる"} ] }'
最終的な答えが戻ってきます 内容、 が の思考 のとき、モデルの推論は に入ります。 理由 内容お問い合わせ.
思考をコントロールする
思考はデフォルトでオンになっています。短時間でレイテンシに敏感な通話ではオフにするか、モデルが論理的に使うトークン数の予算を設定するのも良いでしょう。また、 理由 努力 ノー、ロー、ミディアム、ハイ、またはマックスがあり、これらはこのモデルの予算サイズに対応します:
{ "model": "qwen3-7-flash", "messages": [{"role": "user", "content": "Plan a migration and justify the order."}], "enable_thinking": true, "thinking_budget": 32768 }
推論トークンは出力トークンとして請求されます。
画像と映像
ユーザーメッセージのテキストと一緒に画像や動画をコンテンツの一部として渡し、それらが何を示しているか質問してください。1つのリクエストに複数の入力を付けることができます:
{ "model": "qwen3-7-flash", "messages": [{"role": "user", "content": [ {"type": "text", "text": "この2つのスクリーンショットの間で何が変わった?"}, {"type": "image_url", "image_url": {"url": "https://example.com/before.png"}}, {"type": "image_url", "image_url": {"url": "https://example.com/after.png"}} ]}] }
組み込みツール
Qwen3.7 Flashには、ウェブ検索、URL読み取り用のウェブエクストラクター、コードインタープリタ、text-to-imageおよびimage-to-image検索が搭載されています。それぞれはトグルであり、モデルが実際に呼び出す場合にのみ請求されます。ウェブエクストラクタとコードインタプリターは思考を有効にする必要があります:
{ "model": "qwen3-7-flash", "messages": [{"role": "user", "content": "What sent in the latest release?"}], "tool_web_search": true }
ツールを実行すると、応答は usage.tool_usage トークンカウントの隣にマッピングして、何が呼び出されたか正確に確認できます。
構造化出力と関数呼び出し
使用方法 response_format お問い合わせ {"type": "json_object"} 有効なJSONオブジェクトを強制し、パスを送ります ツール モデルに自分のコードから呼び出せたい標準関数呼び出しのためです。
プロンプトキャッシュ
繰り返しのプロンプトプレフィックスは自動的にキャッシュされ、キャッシュされた入力トークンは新規入力よりもはるかに低い料金で請求されます。もし長い共有システムプロンプトやドキュメントヘッダーを複数のリクエストに送れば、コードを変えずにその割引を受けられます。
地域
デフォルト qwen3-7-flash シンガポールへの展開です。 qwen3-7-flash:variant1 同じモデルを中国でより低く導入しているのです。どちらも同じパラメータを使うので、モデルフィールドだけで切り替えられます。
料金について
Qwen3.7 Flashはトークン単位で請求される「使い古分課金」です。入力・出力の料金は短いプロンプトでは下がり、非常に長いものでは上がる、キャッシュされた入力請求は割引料金で、内蔵ツールは実行時のみ通話1回あたりの少額の料金がかかります。ライブレートは Qwen3.7 Flashモデルページ そして、 プライシングページ、そして プレイグラウンドお問い合わせ.



