
맥락 기반 StepFun text-to-speech 자연어 음성 지시와 표현력 전달을 갖춘 모델입니다.
맥락 기반 StepFun text-to-speech 자연어 음성 지시와 표현력 전달을 갖춘 모델입니다.
글자 수는 StepFun 요금제를 따릅니다: 한자 하나가 한 자, 영어 글자 두 개가 한 글자, 구두점 두 개가 한 글자로 계산됩니다.
다른 이름 StepAudio TTS, StepFun StepAudio 2.5 TTS, StepAudio-2.5-TTS, stepaudio-2-5-tts
stepaudio-2-5-tts/v1/audio/speechstepaudio-2.5-ttsstepfun/stepaudio-2-5-ttsstepfun/stepaudio-2.5-ttsEmpirioLabs 카탈로그의 실시간 종량제 요금입니다. 사용한 만큼만 결제하며 월 최소 요금이 없습니다.
StepAudio 2.5 TTS은(는) POST /v1/audio/speech로 음성을 생성하고 재생 가능한 오디오를 반환합니다. 말할 텍스트를 input으로, 모델 ID stepaudio-2-5-tts와 함께 보내세요. EmpirioLabs 대시보드에서 API 키를 발급받으세요.
curl https://api.empiriolabs.ai/v1/audio/speech \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "stepaudio-2-5-tts",
"input": "Welcome to EmpirioLabs. Your build just finished."
}' \
--output speech.mp3import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/audio/speech",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={"model": "stepaudio-2-5-tts", "input": "Welcome to EmpirioLabs."},
)
with open("speech.mp3", "wb") as f:
f.write(response.content)EmpirioLabs에서 StepAudio 2.5 TTS API가 지원하는 요청 파라미터입니다. 필드를 생략하면 기본값이 적용됩니다.
| 파라미터 | 유형 | 기본값 | 범위 / 값 | 설명 |
|---|---|---|---|---|
| input | string | - | 최대 1000 | 합성할 텍스트. 최대 1,000자 정도. |
| voice | enum | lively-girl | lively-girl, vibrant-youth, soft-spoken-gentleman, magnetic-v... | Official StepFun voice. Custom cloned voice IDs are also accepted via the API. |
| response_format | enum | mp3 | mp3, wav, flac, opus, pcm | 출력 오디오 형식. |
| speed | number | 1 | 0.5 ~ 2 | 말하기 속도. |
| volume | number | 1 | 0.1 ~ 2 | 출력 볼륨. |
| sample_rate | enum | 24000 | 8000, 16000, 22050, 24000 | 출력 샘플링 속도는 Hz 단위입니다. |
| instruction | string | - | 최대 200 | 글로벌 감정 또는 스타일 가이드. StepAudio 2.5 TTS에서만 지원됩니다. |
| pronunciation_map | object | - | - | 발음 매핑 선택. |
| markdown_filter | boolean | false | - | 합성 전에 마크다운 문법을 필터링하세요. |
최대 입력 문자는 1,000자입니다. 괄호 안의 내용은 지시로 간주되며 말로 표현되지 않습니다. 지시는 전반적인 감정이나 스타일 가이드를 활용하세요. StepAudio 2.5 TTS는 voice_label을 지원하지 않습니다.
EmpirioLabs에서 StepAudio 2.5 TTS은(는) 종량제로 청구됩니다: 관련 기사 $0.85 10,000자 단위. 이 페이지의 실시간 요금표는 항상 API 청구 금액과 일치합니다.
StepAudio 2.5 TTS은(는) api.empiriolabs.ai의 POST /v1/audio/speech를 통해 제공되며 표준 Bearer 토큰 인증을 사용합니다.
네. EmpirioLabs 플레이그라운드에서 API와 동일한 파라미터로 StepAudio 2.5 TTS을(를) 브라우저에서 실행하므로 코드를 작성하기 전에 프롬프트를 테스트할 수 있습니다.
EmpirioLabs 계정을 만든 다음 대시보드의 API Keys에서 키를 생성하세요. 요금은 종량제 크레딧이라 실행한 요청에 대해서만 결제합니다.