
Whisper-1 speech-to-text トランスクリプションは、多言語の監視された音声で訓練され、ファイルごとに25 MBのアップロード制限があります。
Whisper-1 speech-to-text トランスクリプションは、多言語の監視された音声で訓練され、ファイルごとに25 MBのアップロード制限があります。
別名 OpenAI-Whisper-1
openai-whisper-1/v1/audio/transcriptionsopenai-whisperwhisper-1EmpirioLabs カタログのライブ従量課金料金です。使った分だけの支払いで、月額最低料金はありません。
OpenAI Whisper 1 は POST /v1/audio/transcriptions で動作します。リクエストはすぐに job_id を返すので、ジョブが完了するまで GET /v1/jobs/{job_id} をポーリングし、結果から出力 URL を読み取ってください。 EmpirioLabs ダッシュボードで API キーを取得してください。
curl https://api.empiriolabs.ai/v1/audio/transcriptions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "openai-whisper-1",
"audio_url": "https://example.com/meeting-recording.mp3"
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/audio/transcriptions",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "openai-whisper-1",
"audio_url": "https://example.com/meeting-recording.mp3",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)EmpirioLabs 上の OpenAI Whisper 1 API が対応するリクエストパラメーターです。フィールドを省略した場合はデフォルト値が適用されます。
| パラメータ | タイプ | デフォルト | 範囲 / 値 | 説明 |
|---|---|---|---|---|
| file | string | - | - | オーディオファイル(マルチパートアップロード)またはJSONパスにfile_urlを使う方法もあります。 |
| file_url | string | - | - | 音声取得用のパブリックURL(ファイルアップロードの代替)。 |
| translate | boolean | false | - | もしそうなら、/audio/translationsにルーティングして英語に翻訳し、元の言語で文字を書き起こすのではなく、 |
| timestamps | boolean | false | - | 便利性の切り替え。もし真の場合、response_format=verbose_json を設定し、単語レベルのtimestamp_granularitiesも含みます。 |
| language | string | - | - | オプションのISO-639-1言語コード。省略の場合は自動検出。translate=trueの場合は無視されます。 |
| prompt | string | - | - | 用語集や事前の文脈を参考にしてモデルに偏りをつけてください。 |
| response_format | enum | json | json, text, srt, verbose_json, vtt | タイムスタンプ=trueのときにverbose_jsonに上書きされます。 |
| temperature | number | 0 | 0 から 1 | サンプリング温度。 |
| timestamp_granularities | string | - | - | カンマ区切りリスト:単語、セグメント。response_format=verbose_jsonの時に使用されます。 |
EmpirioLabs では OpenAI Whisper 1 は従量課金です: オーディオの数分 $0.030 1分あたり。このページのライブ料金表は常に API の請求額と一致します。
OpenAI Whisper 1 は api.empiriolabs.ai 上の POST /v1/audio/transcriptions で提供され、標準的な Bearer トークン認証を使用します。
はい。EmpirioLabs プレイグラウンドでは API と同じパラメーターで OpenAI Whisper 1 をブラウザ上で実行できるので、コードを書く前にプロンプトを試せます。
EmpirioLabs アカウントを作成し、ダッシュボードの API Keysでキーを生成してください。課金は従量制クレジットなので、実行したリクエストの分だけ支払います。