ホーム ブログ

Qwen3.8 Flash APIの使い方

Qwen3.8 Flash APIの使い方

Aug 26, 2026

EmpirioLabs AI

Qwen3.8 Flashは、アリババのQwen3.8ファミリーの最新マルチモーダルモデルで、2026年8月26日にリリースされました。高速で低コストのコーディング、エージェント、ビジョン作業のために構築されています。1Mトークンコンテキストとテキスト、画像、動画の理解、デフォルトでオンの深い思考、そしてQwen3.8 Maxと同じ5つの組み込みツールを組み合わせています。

Qwen3.8 Flashは、OpenAI互換APIを通じて本日EmpirioLabsで稼働しており、関数呼び出し、厳格なJSONスキーマ構造化出力、ストリーミング、最大128Kの出力トークンを備えています。試してみて プレイグラウンド または、OpenAI対応のクライアントから呼び出す。 フルスペックと現在のレートは、 Qwen3.8 Flashモデルページ そして、 API ドキュメントお問い合わせ.

料金について

請求は使用量ベースで、各プロンプトサイズごとに1つのフラット入力レートと1つのフラット出力レートが設定されており、別々のキャッシュティアはありません。ウェブ検索、text-to-image検索、image-to-image検索は、通話が実際に行われた場合にのみ適用される少額の通話料金を追加します。ウェブエクストラクタとコードインタプリタは追加料金なしで動作します。現在の料金は常に モデルページ そして、 プライシングページ、あなたが請求したものと同期して滞在する.

クイックスタート

EmpirioLabs ベース URL で OpenAI SDK をポイントし、パス qwen3-8-flash モデルとして:

openaiからインポート OpenAIクライアント = OpenAI(base_url="https://api.empiriolabs.ai/v1", api_key="YOUR_EMPIRIOLABS_API_KEY",) resp = client.chat.completions.create(model="qwen3-8-flash", messages=[ {"role": "user", "content": [ {"type": "text", "text": "このチャートで何が起きている?"}, {"type": "image_url", "image_url": {"url": "https://example.com/chart.png"}}, ]}, ], extra_body={"enable_thinking": True, "thinking_budget": 8192},) print(resp.choices[0].message.content)

同じモデルIDで動作します お問い合わせ、人形をした お問い合わせ、そしてGoogle互換 /v1beta/models/qwen3-8-flash:コンテンツ生成 ルート。別IDについて QWEN3.8-フラッシュ 同じモデルに解決されます。

思考

ディープシンキングはデフォルトでオンで、ストリームバックは 理由 内容 答えとともに。制御は enable thinking を使う および thinking_budget (最大262,144トークン)、または送信 理由 努力 プラットフォームはモデルの予算サイズにマッピングします。思考トークンは出力トークンとして請求されるので、思考を無効にするか、短く遅延に敏感なターン用に小さな予算を設定しましょう。

組み込みツール

5つの内蔵ツールが後ろに並んでいる tool_* トグル: お問い合わせ, tool_web_extractor, tool_code_interpreter, tool_web_search_image、および tool_image_search.ウェブエクストラクタはウェブ検索を必要とし、エクストラクタもコードインタプリタも思考が有効である限り動作します。ツールが動くとき、反応は usage.tool_usage MAPは通話回数を正確に報告するため、ツールごとの請求を監査できます。

構造化出力

正確な応答形状を求めるなら、パスします response_format お問い合わせ {"type": "json_schema",...} および 「厳格」:真モデルはスキーマのキーを正確に返し、余分なものは一切ありません。プレーンJSONモード {"type": "json_object"} また、サポートされています。

最初の電話の前に知っておくべきこと

  • 5つの組み込みツールはすべてデフォルトでオンに設定され、呼び出しされた通話ごとに請求書を検索します。 1つのリクエストでウェブ検索を複数回実行でき、各呼び出しが請求されます。ツール手数料なしで単純にチャットしたいなら、セット お問い合わせ, tool_web_search_image、および tool_image_search から 偽りお問い合わせ.
  • tool_choice:「必須」 考えが続いている間はうまくいきません。 リクエストは明確なエラーで却下されます。キープ tool_choice:「オート」 思考が有効、あるいはセットで enable_thinking:誤り 関数呼び出しを強制する必要がある場合に。
  • JSONモードにはメッセージに「json」という言葉が必要です。 A {"type": "json_object"} 会話のどこかにその単語が出てこない限り、リクエストは拒否されます。JSONスキーマ要求にはそのような要件はありません。

Qwen3.8 Flashは現在、 プレイグラウンド そして EmpirioLabs APIお問い合わせ.

より良いエンドポイントを使う準備はできていますか?

当社のモデルをご覧いただくか、ビジネスの問い合わせ、カスタム展開、その他何でもご連絡ください。