TTS 1.5 Max API

15개 언어의 271개 이상의 음성, 271개 이상의 음성, 실시간 SSE 스트리밍, per-word 타임스탬프와 함께 방송 품질의 음성 합성.

Inworld오디오 생성출시 2026년 1월 21일독점 엔드포인트

TTS 1.5 Max 소개

15개 언어의 271개 이상의 음성, 271개 이상의 음성, 실시간 SSE 스트리밍, per-word 타임스탬프와 함께 방송 품질의 음성 합성.

다른 이름 TTS Max, Inworld TTS 1.5 Max, TTS-1.5-Max, tts-1-5-max

multi speakerreal timestreamingword timestampscharacter timestampsmultilingualexpressive prosodybroadcast quality

TTS 1.5 Max 사양

모델 ID
tts-1-5-max
제공자
Inworld
카테고리
오디오 생성
출시
2026년 1월 21일
입력
텍스트
출력
오디오
엔드포인트
POST/v1/audio/speechPOST/v1/audio/speech:streamGET/v1/voices
대체 모델 ID
inworld-tts-1.5-maxtts-1.5-max

TTS 1.5 Max API 요금최대 15% 절약

EmpirioLabs 카탈로그의 실시간 종량제 요금입니다. 사용한 만큼만 결제하며 월 최소 요금이 없습니다.

유형
사양
요금
관련 기사
1M 문자
$35.00$29.75
전체 가격 페이지에서 비교

TTS 1.5 Max API 호출 방법

TTS 1.5 Max은(는) POST /v1/audio/speech로 음성을 생성하고 재생 가능한 오디오를 반환합니다. 말할 텍스트를 input으로, 모델 ID tts-1-5-max와 함께 보내세요. EmpirioLabs 대시보드에서 API 키를 발급받으세요.

cURL
curl https://api.empiriolabs.ai/v1/audio/speech \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "tts-1-5-max",
    "input": "Welcome to EmpirioLabs. Your build just finished."
  }' \
  --output speech.mp3
Python
import requests

response = requests.post(
    "https://api.empiriolabs.ai/v1/audio/speech",
    headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    json={"model": "tts-1-5-max", "input": "Welcome to EmpirioLabs."},
)
with open("speech.mp3", "wb") as f:
    f.write(response.content)
TTS 1.5 Max API 전체 레퍼런스

TTS 1.5 Max API 파라미터

EmpirioLabs에서 TTS 1.5 Max API가 지원하는 요청 파라미터입니다. 필드를 생략하면 기본값이 적용됩니다.

파라미터유형기본값범위 / 값설명
inputstring-최대 2000합성할 텍스트. 요청당 최대 2,000자; 클라이언트의 문장 경계에서 더 긴 카피를 작성하세요.
voiceenumSarahSarah, Olivia, Elizabeth, Ashley, Wendy, Julia, Priya, Pixie,...음성 프리셋. 영어 + 스페인어 + 포르투갈어 + 힌디어 + 다양한 억양을 포함한 20명의 엄선된 목소리. 전체 271음 카탈로그(복제 음성 포함)를 원하시면 voice_id 사용하세요.
voice_idstring--자유 음성 ID. 설정되면 음성 제어를 무시합니다. 이 자료를 활용해 엄선된 20개 프리셋 리스트 밖의 목소리를 다루세요. Inworld TTS 1.5는 15개 언어(지역 억양, 성별 변형)에서 271+개의 이름 있는 목소리를 제공합니다. 예시: 마이테, 올리비아, 또는 GET...
languageenumen-USen-US, en-GB, es-ES, es-MX, fr-FR, de-DE, it-IT, pt-BR, pt-PT...BCP-47 언어 코드. Inworld TTS 1.5는 15개 언어를 지원합니다.
output_formatenumWAVMP3, WAV, OGG, FLAC, PCM, ALAW, MULAW오디오 container/codec. WAV = RIFF 내부에서 LINEAR16 (어디에나 있음). MP3 / OGG = 압축됨. PCM = 헤더 없는 RAW, 청크된 실시간 재생에 유용합니다. FLAC = 무손실.
sample_rateenum240008000, 16000, 22050, 24000, 32000, 44100, 48000출력 샘플레이트는 Hz 기준입니다. 24000은 Inworld의 기본 설정이자 음성 모델이 훈련하는 기준입니다; 방송 품질을 위해 48000으로 올립니다.
speednumber10.5 ~ 1.5말하는 속도 배수. 0.5 = 절반 속도, 1.5 = 50% 더 빠릅니다.
temperaturenumber10.1 ~ 2목소리 표현력/변이성. Lower = 더 일관성 있고 "평평한"; 더 높을수록 = 표현력이 풍부하지만 렌더링 간 차이가 더 큽니다.
bit_ratenumber12800032000 ~ 320000MP3 / OGG_OPUS의 비트레이트는 BPS로 설정해야 합니다. 다른 인코딩은 무시합니다.
apply_text_normalizationenumONON, OFFInworld가 켜지면 숫자 / 약어/날짜를 음성 형태로 확장합니다 ("USD 5" → "5달러").
timestamp_typeenumNONENONE, WORD, CHARACTERNONE이 아닌 경우, 응답에는 단어별 또는 문자당 타임스탬프가 포함된다timestamp_info. 캡션/하이라이트 UI에 유용합니다.

알아두면 좋은 점

Limits - 최대 입력: 요청 당 2,000 문자 (문자에서 더 긴 텍스트) - WebSocket: 20 동시 연결, 5 contexts/connection Per-WS 메시지: 1,000 문자 - p90 TTFB: 250 ms (Inworld benchmark) - 271 + 15 개 언어의 사전 설정 - 드롭다운에 노출 된 20 개의 핸드 -픽크 프리셋; 다른 ID를 통과 voice_id

TTS 1.5 Max API: 자주 묻는 질문

TTS 1.5 Max API 비용은 얼마인가요?

EmpirioLabs에서 TTS 1.5 Max은(는) 종량제로 청구됩니다. 이 페이지의 실시간 요금표는 항상 API 청구 금액과 일치합니다.

TTS 1.5 Max은(는) 어떤 엔드포인트를 사용하나요?

TTS 1.5 Max은(는) api.empiriolabs.aiPOST /v1/audio/speech를 통해 제공되며 표준 Bearer 토큰 인증을 사용합니다.

통합하기 전에 브라우저에서 TTS 1.5 Max을(를) 사용해 볼 수 있나요?

네. EmpirioLabs 플레이그라운드에서 API와 동일한 파라미터로 TTS 1.5 Max을(를) 브라우저에서 실행하므로 코드를 작성하기 전에 프롬프트를 테스트할 수 있습니다.

TTS 1.5 Max API 키는 어떻게 발급받나요?

EmpirioLabs 계정을 만든 다음 대시보드의 API Keys에서 키를 생성하세요. 요금은 종량제 크레딧이라 실행한 요청에 대해서만 결제합니다.

더 나은 엔드포인트를 사용할 준비가 되셨나요?

저희 가격을 확인하시거나 저희 스택에 자체 모델을 배포하고 싶으시면 연락해 주세요.