Step TTS 2 API

StepFun text-to-speech 공식 음성, 맞춤형 복제 음성, 음성 태그 컨트롤이 포함된 모델입니다.

StepFun오디오 생성International독점 엔드포인트신규

Step TTS 2 소개

StepFun text-to-speech 공식 음성, 맞춤형 복제 음성, 음성 태그 컨트롤이 포함된 모델입니다.

글자 수는 StepFun 요금제를 따릅니다: 한자 하나가 한 자, 영어 글자 두 개가 한 글자, 구두점 두 개가 한 글자로 계산됩니다.

다른 이름 StepFun Step TTS 2, Step-TTS-2

text to speechvoice tagsmultilingual

Step TTS 2 사양

모델 ID
step-tts-2
제공자
StepFun
카테고리
오디오 생성
출시
-
입력
텍스트
출력
오디오
리전
International
엔드포인트
POST/v1/audio/speech
대체 모델 ID
stepfun/step-tts-2

Step TTS 2 API 요금

EmpirioLabs 카탈로그의 실시간 종량제 요금입니다. 사용한 만큼만 결제하며 월 최소 요금이 없습니다.

유형
사양
요금
관련 기사
10,000자 단위
$0.40
전체 가격 페이지에서 비교

Step TTS 2 API 호출 방법

Step TTS 2은(는) POST /v1/audio/speech로 음성을 생성하고 재생 가능한 오디오를 반환합니다. 말할 텍스트를 input으로, 모델 ID step-tts-2와 함께 보내세요. EmpirioLabs 대시보드에서 API 키를 발급받으세요.

cURL
curl https://api.empiriolabs.ai/v1/audio/speech \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "step-tts-2",
    "input": "Welcome to EmpirioLabs. Your build just finished."
  }' \
  --output speech.mp3
Python
import requests

response = requests.post(
    "https://api.empiriolabs.ai/v1/audio/speech",
    headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    json={"model": "step-tts-2", "input": "Welcome to EmpirioLabs."},
)
with open("speech.mp3", "wb") as f:
    f.write(response.content)
Step TTS 2 API 전체 레퍼런스

Step TTS 2 API 파라미터

EmpirioLabs에서 Step TTS 2 API가 지원하는 요청 파라미터입니다. 필드를 생략하면 기본값이 적용됩니다.

파라미터유형기본값범위 / 값설명
inputstring-최대 1000합성할 텍스트. 최대 1,000자 정도.
voiceenumlively-girllively-girl, vibrant-youth, soft-spoken-gentleman, magnetic-v...Official StepFun voice. Custom cloned voice IDs are also accepted via the API.
response_formatenummp3mp3, wav, flac, opus, pcm출력 오디오 형식.
speednumber10.5 ~ 2말하기 속도.
volumenumber10.1 ~ 2출력 볼륨.
sample_rateenum240008000, 16000, 22050, 24000출력 샘플링 속도는 Hz 단위입니다.
voice_labelobject--감정과 말하기 스타일 태그를 step-tts-2.
pronunciation_mapobject--발음 매핑 선택.
markdown_filterbooleanfalse-합성 전에 마크다운 문법을 필터링하세요.

알아두면 좋은 점

최대 입력 문자는 1,000자입니다. 공식 음성 ID, 커스텀 복제 음성, voice_label 감정 태그, voice_label 스타일 태그를 지원합니다. 명령어 매개변수는 stepaudio-2.5-tts에만 해당됩니다.

Step TTS 2 API: 자주 묻는 질문

Step TTS 2 API 비용은 얼마인가요?

EmpirioLabs에서 Step TTS 2은(는) 종량제로 청구됩니다: 관련 기사 $0.40 10,000자 단위. 이 페이지의 실시간 요금표는 항상 API 청구 금액과 일치합니다.

Step TTS 2은(는) 어떤 엔드포인트를 사용하나요?

Step TTS 2은(는) api.empiriolabs.aiPOST /v1/audio/speech를 통해 제공되며 표준 Bearer 토큰 인증을 사용합니다.

통합하기 전에 브라우저에서 Step TTS 2을(를) 사용해 볼 수 있나요?

네. EmpirioLabs 플레이그라운드에서 API와 동일한 파라미터로 Step TTS 2을(를) 브라우저에서 실행하므로 코드를 작성하기 전에 프롬프트를 테스트할 수 있습니다.

Step TTS 2 API 키는 어떻게 발급받나요?

EmpirioLabs 계정을 만든 다음 대시보드의 API Keys에서 키를 생성하세요. 요금은 종량제 크레딧이라 실행한 요청에 대해서만 결제합니다.

더 나은 엔드포인트를 사용할 준비가 되셨나요?

저희 가격을 확인하시거나 저희 스택에 자체 모델을 배포하고 싶으시면 연락해 주세요.