Qwen Audio 3.1 ASR API

短いクリップや長い録音用の音声入力で、文のセグメント、単語のタイムスタンプ、多言語および中国語の方言認識に対応しています。

Alibaba Cloud転写リリース 2026年9月10日Singapore独自エンドポイント新着

Qwen Audio 3.1 ASR について

短いクリップや長い録音用の音声入力で、文のセグメント、単語のタイムスタンプ、多言語および中国語の方言認識に対応しています。

ファイルをアップロードするか、音声URLを渡す。言語は自動的に検出される。

別名 Qwen Audio ASR, Alibaba Cloud Qwen Audio 3.1 ASR

transcriptionspeech to textmultilingual

Qwen Audio 3.1 ASR の仕様

モデルID
qwen-audio-3-1-asr
開発元
Alibaba Cloud
カテゴリ
転写
リリース
2026年9月10日
入力
音声
出力
テキスト
リージョン
Singapore
エンドポイント
POST/v1/audio/transcriptions
代替モデルID
qwen-audio-3.1-asralibaba/qwen-audio-3-1-asr

Qwen Audio 3.1 ASR API の料金

EmpirioLabs カタログのライブ従量課金料金です。使った分だけの支払いで、月額最低料金はありません。

タイプ
仕様
料金
入力
1Mのオーディオ入力トークンあたり
$0.30
ソリューション
生成された1Mトークンあたり
$0.94
料金ページ全体で比較

Qwen Audio 3.1 ASR API の呼び出し方

Qwen Audio 3.1 ASR は POST /v1/audio/transcriptions で動作します。リクエストはすぐに job_id を返すので、ジョブが完了するまで GET /v1/jobs/{job_id} をポーリングし、結果から出力 URL を読み取ってください。 EmpirioLabs ダッシュボードで API キーを取得してください。

cURL: ジョブを送信
curl https://api.empiriolabs.ai/v1/audio/transcriptions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen-audio-3-1-asr",
    "audio_url": "https://example.com/meeting-recording.mp3"
  }'
cURL: 結果をポーリング
curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY"
Python
import requests

response = requests.post(
    "https://api.empiriolabs.ai/v1/audio/transcriptions",
    headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    json={
        "model": "qwen-audio-3-1-asr",
        "audio_url": "https://example.com/meeting-recording.mp3",
    },
)
job = response.json()

# Generation runs as an async job. Poll until it completes.
import time
while True:
    status = requests.get(
        f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
        headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    ).json()
    if status.get("status") in ("completed", "failed"):
        print(status)
        break
    time.sleep(5)
Qwen Audio 3.1 ASR API の完全リファレンス

知っておくと便利

音声送信 ファイルをマルチパートfile、または一般的な音声形式で、audio_urlまたはaudio_base64のJSONとして送信してください。短いクリップも長い録音も受け入れられます。結果の取得 リクエストはすぐに返job_idとpoll_urlを返します。投票GET /v1/jobs/<job-id>続けてstatusがcompletedされます。短いクリップは数秒で終わります。長い録音は時間がかかります。返ってくるもの 完了した作業の全体書き起こしresultはtext、開始・終了時刻の文のセグメント、単語のタイムスタンプを保持します。言語は自動的に検出され、中国の方言も含まれます。請求 入力トークンと出力トークンは1M単位で価格が設定され、各リクエストはモデルが報告する使用量から請求されます。

Qwen Audio 3.1 ASR API: よくある質問

Qwen Audio 3.1 ASR API の料金はいくらですか?

EmpirioLabs では Qwen Audio 3.1 ASR は従量課金です: 入力 $0.30 1Mのオーディオ入力トークンあたり; ソリューション $0.94 生成された1Mトークンあたり。このページのライブ料金表は常に API の請求額と一致します。

Qwen Audio 3.1 ASR はどのエンドポイントを使いますか?

Qwen Audio 3.1 ASR は api.empiriolabs.ai 上の POST /v1/audio/transcriptions で提供され、標準的な Bearer トークン認証を使用します。

統合する前にブラウザで Qwen Audio 3.1 ASR を試せますか?

はい。EmpirioLabs プレイグラウンドでは API と同じパラメーターで Qwen Audio 3.1 ASR をブラウザ上で実行できるので、コードを書く前にプロンプトを試せます。

Qwen Audio 3.1 ASR の API キーはどうやって取得しますか?

EmpirioLabs アカウントを作成し、ダッシュボードの API Keysでキーを生成してください。課金は従量制クレジットなので、実行したリクエストの分だけ支払います。

より良いエンドポイントを使う準備はできていますか?

ご自身のモデルを当社のスタックに展開したい方は、ぜひご価格をご覧ください。