StepAudio 2.5 TTS API

文脈型StepFuntext-to-speech自然な言語による音声指示と表現力のある表現を持つモデルです。

StepFunオーディオ生成リリース 2026年4月21日International独自エンドポイント新着

StepAudio 2.5 TTS について

文脈型StepFuntext-to-speech自然な言語による音声指示と表現力のある表現を持つモデルです。

文字数のカウントはStepFunの料金体系に従い、中国語1文字が1文字、英語の文字2文字が1文字、句読点2文字が1文字としてカウントされます。

別名 StepAudio TTS, StepFun StepAudio 2.5 TTS, StepAudio-2.5-TTS, stepaudio-2-5-tts

text to speechcontextual ttsvoice controlmultilingual

StepAudio 2.5 TTS の仕様

モデルID
stepaudio-2-5-tts
プロバイダー
StepFun
カテゴリ
オーディオ生成
リリース
2026年4月21日
入力
テキスト
出力
音声
リージョン
International
エンドポイント
POST/v1/audio/speech
代替モデルID
stepaudio-2.5-ttsstepfun/stepaudio-2-5-ttsstepfun/stepaudio-2.5-tts

StepAudio 2.5 TTS API の料金

EmpirioLabs カタログのライブ従量課金料金です。使った分だけの支払いで、月額最低料金はありません。

タイプ
仕様
料金
シンセシス
10,000文字あたり
$0.85
料金ページ全体で比較

StepAudio 2.5 TTS API の呼び出し方

StepAudio 2.5 TTS は POST /v1/audio/speech で音声を生成し、再生可能なオーディオを返します。読み上げるテキストを input として、モデル ID stepaudio-2-5-tts と一緒に送信してください。 EmpirioLabs ダッシュボードで API キーを取得してください。

cURL
curl https://api.empiriolabs.ai/v1/audio/speech \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "stepaudio-2-5-tts",
    "input": "Welcome to EmpirioLabs. Your build just finished."
  }' \
  --output speech.mp3
Python
import requests

response = requests.post(
    "https://api.empiriolabs.ai/v1/audio/speech",
    headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    json={"model": "stepaudio-2-5-tts", "input": "Welcome to EmpirioLabs."},
)
with open("speech.mp3", "wb") as f:
    f.write(response.content)
StepAudio 2.5 TTS API の完全リファレンス

StepAudio 2.5 TTS API のパラメーター

EmpirioLabs 上の StepAudio 2.5 TTS API が対応するリクエストパラメーターです。フィールドを省略した場合はデフォルト値が適用されます。

パラメータタイプデフォルト範囲 / 値説明
inputstring-最大 1000テキストを合成する。最大1,000文字。
voiceenumlively-girllively-girl, vibrant-youth, soft-spoken-gentleman, magnetic-v...Official StepFun voice. Custom cloned voice IDs are also accepted via the API.
response_formatenummp3mp3, wav, flac, opus, pcm出力音声フォーマット。
speednumber10.5 から 2話す速度。
volumenumber10.1 から 2出力量。
sample_rateenum240008000, 16000, 22050, 24000出力サンプリングレートはHzで表示されます。
instructionstring-最大 200グローバルな感情やスタイルのガイダンス。StepAudio 2.5 TTSのみがサポートしています。
pronunciation_mapobject--発音マッピングも任意で。
markdown_filterbooleanfalse-合成前にマークダウン構文をフィルタリングしてください。

知っておくと便利

最大入力文字は1,000文字です。括弧内の内容は指示として扱われ、話されることはありません。全体的な感情やスタイルの指導のために指導を活用しましょう。StepAudio 2.5 TTSはvoice_labelをサポートしていません。

StepAudio 2.5 TTS API: よくある質問

StepAudio 2.5 TTS API の料金はいくらですか?

EmpirioLabs では StepAudio 2.5 TTS は従量課金です: シンセシス $0.85 10,000文字あたり。このページのライブ料金表は常に API の請求額と一致します。

StepAudio 2.5 TTS はどのエンドポイントを使いますか?

StepAudio 2.5 TTS は api.empiriolabs.ai 上の POST /v1/audio/speech で提供され、標準的な Bearer トークン認証を使用します。

統合する前にブラウザで StepAudio 2.5 TTS を試せますか?

はい。EmpirioLabs プレイグラウンドでは API と同じパラメーターで StepAudio 2.5 TTS をブラウザ上で実行できるので、コードを書く前にプロンプトを試せます。

StepAudio 2.5 TTS の API キーはどうやって取得しますか?

EmpirioLabs アカウントを作成し、ダッシュボードの API Keysでキーを生成してください。課金は従量制クレジットなので、実行したリクエストの分だけ支払います。

より良いエンドポイントを使う準備はできていますか?

ご自身のモデルを当社のスタックに展開したい方は、ぜひご価格をご覧ください。