ホーム ブログ

Qwen3.8 Max 0902 APIの使い方

Qwen3.8 Max 0902 API 経由

Sep 2, 2026

EmpirioLabs AI

Qwen3.8 Max 0902は、2026年9月2日にリリースされたアリババの旗艦機であるQwen3.8 Maxのアップグレード版です。このモデルはフラッグシップが知られる1Mトークンのコンテキスト、テキスト、画像、動画の理解、デフォルトでオンになっている深い思考、そして5つの組み込みツールを維持し、実際の作業に必要な部分を研ぎ澄ませています:エンジニアリング規模のプロジェクトでのコーディング、長期的な自律開発、より安定したマルチツールエージェントのオーケストレーション、より信頼性の高いチャート推論とドキュメント解析です。

Qwen3.8 Max 0902は、OpenAI互換APIを通じて本日、関数呼び出し、厳格なJSONスキーマ構造化出力、ストリーミング、最大128K出力トークンを備えたEmpirioLabsで稼働しています。試してみてください プレイグラウンド または、OpenAI対応のクライアントから呼び出す。 フルスペックと現在のレートは、 Qwen3.8 Max 0902モデルページ そして、 API ドキュメントお問い合わせ.

料金について

請求は使用量ベースで、各プロンプトサイズで1つの固定入力レートと1つのフラット出力レートが適用され、Qwen3.8 Maxと同じレートで、別途キャッシュティアはありません。ウェブ検索、text-to-image検索、image-to-image検索は、実際に通話が実行された場合にのみ適用される少額の通話料金を追加します。ウェブエクストラクタとコードインタプリタは追加料金なしで動作します。思考トークンは出力トークンとして請求されます。現在の料金は常に モデルページ そして、 プライシングページ、あなたが請求したものと同期して滞在する.

クイックスタート

EmpirioLabs ベース URL で OpenAI SDK をポイントし、パス qwen3-8-max-0902 モデルとして:

openaiからインポート OpenAIクライアント = OpenAI(base_url="https://api.empiriolabs.ai/v1", api_key="YOUR_EMPIRIOLABS_API_KEY",) resp = client.chat.completions.create(model="qwen3-8-max-0902", messages=[ {"role": "user", "content": [ {"type": "text", "text": "このチャートの傾向をまとめて異常があればフラグ付けしてください."}, {"type": "image_url", "image_url": {"url": "https://example.com/chart.png"}}, ]}, ], extra_body={"enable_thinking": True, "thinking_budget": 8192},) print(resp.choices[0].message.content)

同じモデルIDで動作します お問い合わせ、人形をした お問い合わせ、そしてGoogle互換 /v1beta/models/qwen3-8-max-0902:コンテンツ生成 ルート。代替IDについて qwen3.8-max-0902 および qwen3.8-max-2026-09-02 同じモデルに対処してください。

思考

ディープシンキングはデフォルトでオンで、ストリームバックは 理由 内容 答えとともに。制御は enable thinking を使う および thinking_budget (最大262,144トークン)、または送信 理由 努力 プラットフォームはモデルの予算サイズにマッピングします。思考トークンは出力トークンとして請求されるので、思考を無効にするか、短く遅延に敏感なターン用に小さな予算を設定しましょう。

組み込みツール

5つの内蔵ツールが後ろに並んでいる tool_* トグルとはすべてデフォルトでオフです: お問い合わせ, tool_web_extractor, tool_code_interpreter, tool_web_search_image、および tool_image_search.ウェブエクストラクタはウェブ検索を必要とし、エクストラクタもコードインタプリタも思考が有効である限り動作します。ツールが動くとき、反応は usage.tool_usage MAPは通話回数を正確に報告するため、ツールごとの請求を監査できます。

構造化出力

正確な応答形状を求めるなら、パスします response_format お問い合わせ {"type": "json_schema",...} および 「厳格」:真モデルはスキーマのキーを正確に返し、余分なものは一切ありません。プレーンJSONモード {"type": "json_object"} また、サポートされています。

最初の電話の前に知っておくべきこと

  • 行動が変わってはいけないときは日付付きのIDをピン留めしましょう。 qwen3-8-max アリババの現在のデフォルトのQwen3.8 Maxビルドを踏襲しています。 qwen3-8-max-0902 このスナップショットに留まります。再現可能な出力が必要な評価や生産パイプラインには日付付きIDを使いましょう。
  • tool_choice:「必須」 考えが続いている間はうまくいきません。 リクエストは明確なエラーで却下されます。キープ tool_choice:「オート」 思考が有効、あるいはセットで enable_thinking:誤り 関数呼び出しを強制する必要がある場合に。
  • JSONモードにはメッセージに「json」という言葉が必要です。 A {"type": "json_object"} 会話のどこかにその単語が出てこない限り、リクエストは拒否されます。JSONスキーマ要求にはそのような要件はありません。

Qwen3.8 Max 0902は現在、 プレイグラウンド そして EmpirioLabs APIお問い合わせ.

より良いエンドポイントを使う準備はできていますか?

当社のモデルをご覧いただくか、ビジネスの問い合わせ、カスタム展開、その他何でもご連絡ください。