/v1/audio/speech

Gemini 2.5 TTS 패밀리의 오디오 생성 모델 2개를 비교하고 지연 시간, 품질, 요금 요구 사항에 맞는 모델을 호출하세요.
EmpirioLabs의 Gemini 2.5 TTS은(는) Google의 오디오 생성 모델 API 2개를 모은 패밀리입니다 (Gemini 2.5 Flash TTS, Gemini 2.5 Pro TTS 포함). 각 모델은 실시간 요금, 파라미터, 문서, 플레이그라운드 접근이 있는 전용 페이지를 유지합니다.
패밀리 전체에서 같은 EmpirioLabs API 키와 엔드포인트 패턴을 사용하고, 요청의 model ID만 바꿔 동작을 전환하세요.
패밀리를 한눈에 비교한 다음, 전체 실시간 요금표와 파라미터는 모델 페이지에서 확인하세요.
/v1/audio/speech/v1/audio/speechGemini 2.5 Flash TTS은(는) POST /v1/audio/speech로 음성을 생성하고 재생 가능한 오디오를 반환합니다. 말할 텍스트를 input으로, 모델 ID gemini-2-5-flash-tts와 함께 보내세요. 이 패밀리에서는 model 값을 지원되는 아무 ID로나 바꿀 수 있습니다: gemini-2-5-flash-tts gemini-2-5-pro-tts. EmpirioLabs 대시보드에서 API 키를 발급받으세요.
curl https://api.empiriolabs.ai/v1/audio/speech \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-2-5-flash-tts",
"input": "Welcome to EmpirioLabs. Your build just finished."
}' \
--output speech.mp3EmpirioLabs의 Gemini 2.5 TTS은(는) Google의 오디오 생성 모델 API 2개로 이루어진 패밀리입니다: Gemini 2.5 Flash TTS, Gemini 2.5 Pro TTS. 하나의 EmpirioLabs API 키로 요청에 맞는 모델 ID를 선택해 사용합니다.
속도, 품질, 요금 요구 사항에 맞는 모델 페이지부터 시작해 EmpirioLabs 플레이그라운드에서 테스트하세요. 위의 비교 카드는 각 모델의 실시간 요금표와 퀵스타트로 연결됩니다.
네. 패밀리는 같은 EmpirioLabs API 패턴으로 설계되어 대부분의 통합은 model 값만 바꾸면 전환됩니다. 모델 전용 파라미터에 의존한다면 배포 전에 모델 페이지를 확인하세요.
요금은 종량제입니다. 이 페이지의 카드는 실시간 카탈로그의 짧은 요약을 보여주고, 각 모델 페이지에는 API 청구와 일치하는 전체 요금표가 있습니다.
네. 이 패밀리의 아무 모델 페이지나 열고 플레이그라운드 링크로 브라우저에서 프롬프트와 파라미터를 테스트한 뒤 API를 통합하세요.