간단한 답변: StepAudio 3 TTS StepFun의 대표 text-to-speech 모델로, 표준 OpenAI 스타일 음성 엔드포인트를 통해 EmpirioLabs에서 이용할 수 있습니다. 최대 1,000자까지 전송하세요 /v1/audio/speech 이후 이름 * 모델: "stepaudio-3-tts", 12가지 시스템 음성 중 하나를 선택하고, 일반 영어로 원하는 전달 방식을 다음과 같이 설명하세요 교육·.
당신의 첫 번째 요청
curl https://api.empiriolabs.ai/v1/audio/speech \ -h "인증: 베어러 $EMPIRIOLABS_API_KEY" \ -h "콘텐츠-유형: application/json" \ -d '{ "모델": "stepaudio-3-tts", "입력": "귀하의 전화가 연결되고 있습니다. 기다려 주셔서 감사합니다.", "voice": "활기찬-소녀" }'
응답은 생성된 오디오에 서명된 URL을 포함합니다. 기본 형식은 24,000 Hz의 mp3입니다.
목소리 선택
이 모델에는 12개의 시스템 음성이 포함되어 있습니다. 7개의 음성은 StepAudio 2.5에서 이어졌으며, 5개는 새롭게 추가되었습니다: 알피·, 이선·, 매튜·, 칭순성, 그리고 톈룬브셩·.
| 음성 | 성격 | 좋은 |
|---|---|---|
활기찬 소녀 | 밝고 활기찬 여성 | 어시스턴트, 제품 워크스루 |
활기찬 청춘 | 따뜻한 젊은 수컷 | 오디오북, 비디오 더빙 |
soft-spoken-gentleman | 차분하고 온화한 남성 | 장편 내레이션 |
magnetic-voiced-male | 깊고 무거운 남성 | 예고편, 드라마틱한 해석 |
우아하고 온화한 여성 | 진심 어린 여성 | 지원 라인, 교육 |
활기찬 바람-암컷 | 가볍고 설득력 있는 작품 | 마케팅, 짧은 영상 |
쯔신난성 | 자신감 있는 남성 | 오디오북, 교육 |
전체 목록은 모델 참조. 동일한 필드에서 맞춤 복제된 음성 ID가 허용됩니다.
출산 지휘
미리 설정된 감정 태그 대신, 원하는 것을 쓰면 모델이 그것을 수행합니다. 교육 전체 지문의 분위기를 설정하며 최대 500자까지 허용합니다.
{ "모델": "stepaudio-3-tts", "입력": "로그에서 뭔가를 발견했다.", "목소리": "magnetic-voiced-male", "지시": "느리고 신중하게, 마치 트레일러 목소리처럼. 멈춰 두라." }
한 단어나 구절의 경우, 괄호 안에 방향을 적으세요 입력 대신.
언어
설치하기 언어 로 en·, Z·, 네·, 코·, FR, 또는 es. 일본어, 한국어, 프랑스어, 스페인어는 미리보기 중입니다. 빼면 모델이 영어로 표시됩니다.
출력 형식
선택해 MP3·, 와브·, 플락·, 오퍼스, 또는 PCM 이름 * response_format, 그리고 집합 sample_rate 8000, 16000, 22050, 또는 24000까지 가집니다.
사람들을 잡아내는 세 가지 이유
- 괄호는 단어가 아니라 방향을 의미합니다. 안에 있는 어떤 것이든
()in입력전달 신호로 읽히고 절대 말하지 않습니다. 괄호 안의 따돌리기가 필요하면 괄호 없이 다시 쓰세요. - 이 모델에는 48,000 Hz 기능이 없습니다. 일반적인 text-to-speech 문서에는 나오지만, StepAudio 3 TTS에서는 이를 거부합니다. 최고 품질을 위해 24,000 Hz를 유지하세요.
교육그리고voice_label서로 교환할 수 없습니다. StepAudio 3 TTS 테이크교육그리고 거부voice_label. TTS 2단계는 그 반대입니다. 두 단계 간 요청을 포팅하는 것은 해당 필드를 교환하는 것을 의미합니다.
가격 및 한도
요금은 입력 문자당 요금으로 계산되며, 구독료도 없고 최소 요금도 없습니다. 한자 1자는 1자, 영어 글자 2개는 1자로 계산됩니다. 실시간 요금은 모델 페이지 그리고 가격표. 요청 최대 1,000자로 제한되므로, 긴 대본은 문장 단위의 통화로 나누어 직접 오디오에 참여하세요.
코드를 작성하지 않고 시도해 보세요
기타 playground에서 StepAudio 3 TTS 음성과 지시를 오디션한 후, 그 설정을 요청에 복사하세요. 전체 매개변수 참조: docs.empiriolabs.ai/models/stepaudio-3-tts·.



