OpenAI Whisper 1 API

Whisper-1 speech-to-text トランスクリプションは、多言語の監視された音声で訓練され、ファイルごとに25 MBのアップロード制限があります。

OpenAIコンテンツリリース 2022年9月21日独自エンドポイント

OpenAI Whisper 1 について

Whisper-1 speech-to-text トランスクリプションは、多言語の監視された音声で訓練され、ファイルごとに25 MBのアップロード制限があります。

別名 OpenAI-Whisper-1

transcriptionspeech to text

OpenAI Whisper 1 の仕様

モデルID
openai-whisper-1
プロバイダー
OpenAI
カテゴリ
コンテンツ
リリース
2022年9月21日
入力
音声
出力
テキスト
エンドポイント
POST/v1/audio/transcriptions
代替モデルID
openai-whisperwhisper-1

OpenAI Whisper 1 API の料金

EmpirioLabs カタログのライブ従量課金料金です。使った分だけの支払いで、月額最低料金はありません。

タイプ
仕様
料金
オーディオの数分
1分あたり
$0.030
料金ページ全体で比較

OpenAI Whisper 1 API の呼び出し方

OpenAI Whisper 1 は POST /v1/audio/transcriptions で動作します。リクエストはすぐに job_id を返すので、ジョブが完了するまで GET /v1/jobs/{job_id} をポーリングし、結果から出力 URL を読み取ってください。 EmpirioLabs ダッシュボードで API キーを取得してください。

cURL: ジョブを送信
curl https://api.empiriolabs.ai/v1/audio/transcriptions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "openai-whisper-1",
    "audio_url": "https://example.com/meeting-recording.mp3"
  }'
cURL: 結果をポーリング
curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY"
Python
import requests

response = requests.post(
    "https://api.empiriolabs.ai/v1/audio/transcriptions",
    headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    json={
        "model": "openai-whisper-1",
        "audio_url": "https://example.com/meeting-recording.mp3",
    },
)
job = response.json()

# Generation runs as an async job. Poll until it completes.
import time
while True:
    status = requests.get(
        f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
        headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    ).json()
    if status.get("status") in ("completed", "failed"):
        print(status)
        break
    time.sleep(5)
OpenAI Whisper 1 API の完全リファレンス

OpenAI Whisper 1 API のパラメーター

EmpirioLabs 上の OpenAI Whisper 1 API が対応するリクエストパラメーターです。フィールドを省略した場合はデフォルト値が適用されます。

パラメータタイプデフォルト範囲 / 値説明
filestring--オーディオファイル(マルチパートアップロード)またはJSONパスにfile_urlを使う方法もあります。
file_urlstring--音声取得用のパブリックURL(ファイルアップロードの代替)。
translatebooleanfalse-もしそうなら、/audio/translationsにルーティングして英語に翻訳し、元の言語で文字を書き起こすのではなく、
timestampsbooleanfalse-便利性の切り替え。もし真の場合、response_format=verbose_json を設定し、単語レベルのtimestamp_granularitiesも含みます。
languagestring--オプションのISO-639-1言語コード。省略の場合は自動検出。translate=trueの場合は無視されます。
promptstring--用語集や事前の文脈を参考にしてモデルに偏りをつけてください。
response_formatenumjsonjson, text, srt, verbose_json, vttタイムスタンプ=trueのときにverbose_jsonに上書きされます。
temperaturenumber00 から 1サンプリング温度。
timestamp_granularitiesstring--カンマ区切りリスト:単語、セグメント。response_format=verbose_jsonの時に使用されます。

OpenAI Whisper 1 API: よくある質問

OpenAI Whisper 1 API の料金はいくらですか?

EmpirioLabs では OpenAI Whisper 1 は従量課金です: オーディオの数分 $0.030 1分あたり。このページのライブ料金表は常に API の請求額と一致します。

OpenAI Whisper 1 はどのエンドポイントを使いますか?

OpenAI Whisper 1 は api.empiriolabs.ai 上の POST /v1/audio/transcriptions で提供され、標準的な Bearer トークン認証を使用します。

統合する前にブラウザで OpenAI Whisper 1 を試せますか?

はい。EmpirioLabs プレイグラウンドでは API と同じパラメーターで OpenAI Whisper 1 をブラウザ上で実行できるので、コードを書く前にプロンプトを試せます。

OpenAI Whisper 1 の API キーはどうやって取得しますか?

EmpirioLabs アカウントを作成し、ダッシュボードの API Keysでキーを生成してください。課金は従量制クレジットなので、実行したリクエストの分だけ支払います。

より良いエンドポイントを使う準備はできていますか?

ご自身のモデルを当社のスタックに展開したい方は、ぜひご価格をご覧ください。