SoulX Podcast API

긴 형식을 위한 오픈 소스 음성 모델, 다 스피커 팟 캐스트 대화 with paralinguistic control (웃음, sighs) 및 Zero-shot 음성 복제.

Soul AI Lab오디오 생성출시 2025년 10월 29일네이티브 추론

SoulX Podcast 소개

긴 형식을 위한 오픈 소스 음성 모델, 다 스피커 팟 캐스트 대화 with paralinguistic control (웃음, sighs) 및 Zero-shot 음성 복제.

다른 이름 Soul AI Lab SoulX Podcast

voice cloningmulti speakerdialectpodcast

SoulX Podcast 사양

모델 ID
soulx-podcast
제공자
Soul AI Lab
카테고리
오디오 생성
출시
2025년 10월 29일
입력
텍스트오디오
출력
오디오
엔드포인트
POST/v1/audio/speech
대체 모델 ID
soul-ai-lab/soulx-podcast

SoulX Podcast API 요금

EmpirioLabs 카탈로그의 실시간 종량제 요금입니다. 사용한 만큼만 결제하며 월 최소 요금이 없습니다.

유형
사양
요금
기본 정보
1k 문자
$0.015
채용 정보
1k 문자
$0.015
전체 가격 페이지에서 비교

SoulX Podcast API 호출 방법

SoulX Podcast은(는) POST /v1/audio/speech로 음성을 생성하고 재생 가능한 오디오를 반환합니다. 말할 텍스트를 input으로, 모델 ID soulx-podcast와 함께 보내세요. EmpirioLabs 대시보드에서 API 키를 발급받으세요.

cURL
curl https://api.empiriolabs.ai/v1/audio/speech \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "soulx-podcast",
    "input": "Welcome to EmpirioLabs. Your build just finished."
  }' \
  --output speech.mp3
Python
import requests

response = requests.post(
    "https://api.empiriolabs.ai/v1/audio/speech",
    headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    json={"model": "soulx-podcast", "input": "Welcome to EmpirioLabs."},
)
with open("speech.mp3", "wb") as f:
    f.write(response.content)
SoulX Podcast API 전체 레퍼런스

SoulX Podcast API 파라미터

EmpirioLabs에서 SoulX Podcast API가 지원하는 요청 파라미터입니다. 필드를 생략하면 기본값이 적용됩니다.

파라미터유형기본값범위 / 값설명
inputstring--팟캐스트 대본. 다중 스피커를 위한 경우 [S1] / [S2] / [S3] / [S4] 태그 또는 'Speaker N:' 라인을 사용하세요. 지원된 부언어 태그: <|웃음|>, <|한숨|>, <|호흡|>, <|기침|>.
voice_modelenumbasebase, dialect기본 기준: 영어 + 만다린. 방언: 쓰촨어, 허난어, 광둥어가 추가됩니다.
voice_s1enumarthurarthur, james, lj, xiaomei, zhigang, custom_s1[시즌 1]의 목소리. lj = 엠마. custom_s1 voice_s1_audio_url 필요해.
voice_s2enumljarthur, james, lj, xiaomei, zhigang, custom_s2[시즌 2]의 목소리. lj = 엠마.
voice_s3enumjamesarthur, james, lj, xiaomei, zhigang, custom_s3[시즌 3]의 목소리.
voice_s4enumxiaomeiarthur, james, lj, xiaomei, zhigang, custom_s4[시즌 4]의 목소리.
voice_s1_audio_urlstring--[S1] 맞춤 음성 복제를 위한 참고 오디오 URL. 발언자는 동의 문구를 소리 내어 말해야 합니다.
voice_s2_audio_urlstring--[S2] 맞춤 음성 복제를 위한 참고 오디오 URL.
voice_s3_audio_urlstring--[S3] 맞춤 음성 복제를 위한 참고 오디오 URL.
voice_s4_audio_urlstring--[S4] 맞춤 음성 복제를 위한 참고 오디오 URL.
temperaturenumber0.60.1 ~ 2샘플링 온도.
top_knumber1001 ~ 500탑-k 샘플링 캡.
top_pnumber0.90.1 ~ 1핵 샘플링.
repetition_penaltynumber1.251 ~ 2높은 값은 반복적인 표현을 억제합니다.
문서에 파라미터 3개 더 있음

알아두면 좋은 점

긴 형식, 다 스피커 팟 캐스트 대화를 위한 오픈 소스 음성 모델

SoulX Podcast API: 자주 묻는 질문

SoulX Podcast API 비용은 얼마인가요?

EmpirioLabs에서 SoulX Podcast은(는) 종량제로 청구됩니다: 기본 정보 $0.015 1k 문자; 채용 정보 $0.015 1k 문자. 이 페이지의 실시간 요금표는 항상 API 청구 금액과 일치합니다.

SoulX Podcast은(는) 어떤 엔드포인트를 사용하나요?

SoulX Podcast은(는) api.empiriolabs.aiPOST /v1/audio/speech를 통해 제공되며 표준 Bearer 토큰 인증을 사용합니다.

통합하기 전에 브라우저에서 SoulX Podcast을(를) 사용해 볼 수 있나요?

네. EmpirioLabs 플레이그라운드에서 API와 동일한 파라미터로 SoulX Podcast을(를) 브라우저에서 실행하므로 코드를 작성하기 전에 프롬프트를 테스트할 수 있습니다.

SoulX Podcast API 키는 어떻게 발급받나요?

EmpirioLabs 계정을 만든 다음 대시보드의 API Keys에서 키를 생성하세요. 요금은 종량제 크레딧이라 실행한 요청에 대해서만 결제합니다.

더 나은 엔드포인트를 사용할 준비가 되셨나요?

저희 가격을 확인하시거나 저희 스택에 자체 모델을 배포하고 싶으시면 연락해 주세요.