TTS 1.5 Mini API

15개 언어에서 271+ 음성 처리를 지원하는 130ms 미만의 TTFB 음성 합성, 표현력 있는 운율, 그리고 저지연 음성 에이전트를 위한 실시간 SSE 스트리밍.

Inworld오디오 생성출시 2026년 1월 21일독점 엔드포인트

TTS 1.5 Mini 소개

15개 언어에서 271+ 음성 처리를 지원하는 130ms 미만의 TTFB 음성 합성, 표현력 있는 운율, 그리고 저지연 음성 에이전트를 위한 실시간 SSE 스트리밍.

다른 이름 TTS Mini, Inworld TTS 1.5 Mini

multi speakerreal timelow latencystreamingword timestampscharacter timestampsmultilingualexpressive prosody

TTS 1.5 Mini 사양

모델 ID
tts-1-5-mini
개발사
Inworld
카테고리
오디오 생성
출시
2026년 1월 21일
입력
텍스트
출력
오디오
엔드포인트
POST/v1/audio/speechPOST/v1/audio/speech:streamGET/v1/voices
대체 모델 ID
inworld-tts-1.5-minitts-1.5-mini

TTS 1.5 Mini API 요금최대 30% 절약

EmpirioLabs 카탈로그의 실시간 종량제 요금입니다. 사용한 만큼만 결제하며 월 최소 요금이 없습니다.

유형
사양
요금
합성
100만 자당
$25.00$17.50
전체 가격 페이지에서 비교

TTS 1.5 Mini API 호출 방법

TTS 1.5 Mini은(는) POST /v1/audio/speech로 음성을 생성하고 재생 가능한 오디오를 반환합니다. 말할 텍스트를 input으로, 모델 ID tts-1-5-mini와 함께 보내세요. EmpirioLabs 대시보드에서 API 키를 발급받으세요.

cURL
curl https://api.empiriolabs.ai/v1/audio/speech \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "tts-1-5-mini",
    "input": "Welcome to EmpirioLabs. Your build just finished."
  }' \
  --output speech.mp3
Python
import requests

response = requests.post(
    "https://api.empiriolabs.ai/v1/audio/speech",
    headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    json={"model": "tts-1-5-mini", "input": "Welcome to EmpirioLabs."},
)
with open("speech.mp3", "wb") as f:
    f.write(response.content)
TTS 1.5 Mini API 전체 레퍼런스

TTS 1.5 Mini API 파라미터

EmpirioLabs에서 TTS 1.5 Mini API가 지원하는 요청 파라미터입니다. 필드를 생략하면 기본값이 적용됩니다.

파라미터유형기본값범위 / 값설명
inputstring-최대 2000합성할 텍스트. 요청당 최대 2,000자; 클라이언트의 문장 경계에서 더 긴 카피를 작성하세요.
voiceenumSarahSarah, Olivia, Elizabeth, Ashley, Wendy, Julia, Priya, Pixie,...음성 프리셋. 영어 + 스페인어 + 포르투갈어 + 힌디어 + 다양한 억양을 포함한 20명의 엄선된 목소리. 전체 271음 카탈로그(복제 음성 포함)를 원하시면 voice_id 사용하세요.
voice_idstring--자유 음성 ID. 설정되면 음성 제어를 무시합니다. 이 자료를 활용해 엄선된 20개 프리셋 리스트 밖의 목소리를 다루세요. Inworld TTS 1.5는 15개 언어(지역 억양, 성별 변형)에서 271+개의 이름 있는 목소리를 제공합니다. 예시: 마이테, 올리비아, 또는 GET...
languageenumen-USen-US, en-GB, es-ES, es-MX, fr-FR, de-DE, it-IT, pt-BR, pt-PT...BCP-47 언어 코드. Inworld TTS 1.5는 15개 언어를 지원합니다.
output_formatenumWAVMP3, WAV, OGG, FLAC, PCM, ALAW, MULAW오디오 container/codec. WAV = RIFF 내부에서 LINEAR16 (어디에나 있음). MP3 / OGG = 압축됨. PCM = 헤더 없는 RAW, 청크된 실시간 재생에 유용합니다. FLAC = 무손실.
sample_rateenum240008000, 16000, 22050, 24000, 32000, 44100, 48000출력 샘플레이트는 Hz 기준입니다. 24000은 Inworld의 기본 설정이자 음성 모델이 훈련하는 기준입니다; 방송 품질을 위해 48000으로 올립니다.
speednumber10.5 ~ 1.5말하는 속도 배수. 0.5 = 절반 속도, 1.5 = 50% 더 빠릅니다.
temperaturenumber10.1 ~ 2목소리 표현력/변이성. Lower = 더 일관성 있고 "평평한"; 더 높을수록 = 표현력이 풍부하지만 렌더링 간 차이가 더 큽니다.
bit_ratenumber12800032000 ~ 320000MP3 / OGG_OPUS의 비트레이트는 BPS로 설정해야 합니다. 다른 인코딩은 무시합니다.
apply_text_normalizationenumONON, OFFInworld가 켜지면 숫자 / 약어/날짜를 음성 형태로 확장합니다 ("USD 5" → "5달러").
timestamp_typeenumNONENONE, WORD, CHARACTERNONE이 아닌 경우, 응답에는 단어별 또는 문자당 타임스탬프가 포함된다timestamp_info. 캡션/하이라이트 UI에 유용합니다.

알아두면 좋은 점

제한 - 최대 입력: 요청당 2,000자 (문장 경계에서 더 긴 텍스트) - WebSocket: 20개의 동시 연결, 5contexts/connection - WS당 메시지: 1,000자 지연 - p90 TTFB: 130ms 미만 (Inworld 벤치마크) Voices - 15개 언어에서 271+개의 이름 프리셋 - 드롭다운에 표시된 20개의 수선별 프리셋; 다른 음성 ID는 voice_id로 전달

TTS 1.5 Mini API: 자주 묻는 질문

TTS 1.5 Mini API 비용은 얼마인가요?

EmpirioLabs에서 TTS 1.5 Mini은(는) 종량제로 청구됩니다. 이 페이지의 실시간 요금표는 항상 API 청구 금액과 일치합니다.

TTS 1.5 Mini은(는) 어떤 엔드포인트를 사용하나요?

TTS 1.5 Mini은(는) api.empiriolabs.aiPOST /v1/audio/speech를 통해 제공되며 표준 Bearer 토큰 인증을 사용합니다.

통합하기 전에 브라우저에서 TTS 1.5 Mini을(를) 사용해 볼 수 있나요?

네. EmpirioLabs 플레이그라운드에서 API와 동일한 파라미터로 TTS 1.5 Mini을(를) 브라우저에서 실행하므로 코드를 작성하기 전에 프롬프트를 테스트할 수 있습니다.

TTS 1.5 Mini API 키는 어떻게 발급받나요?

EmpirioLabs 계정을 만든 다음 대시보드의 API Keys에서 키를 생성하세요. 요금은 종량제 크레딧이라 실행한 요청에 대해서만 결제합니다.

더 나은 엔드포인트를 사용할 준비가 되셨나요?

저희 가격을 확인하시거나 저희 스택에 자체 모델을 배포하고 싶으시면 연락해 주세요.