/v1/audio/speech
EmpirioLabs 上的 Gemini 2.5 TTS 汇集了 Google 的 2 个音频生成模型 API(包括 Gemini 2.5 Flash TTS, Gemini 2.5 Pro TTS)。每个模型都有自己的页面,包含实时价格、参数、文档和 Playground 入口。
在整个系列中使用同一个 EmpirioLabs API 密钥和端点模式,只需更改请求中的 model ID 即可切换行为。
先一眼比较整个系列,再打开模型页面查看完整的实时价格表和参数。
/v1/audio/speech/v1/audio/speechGemini 2.5 Flash TTS 通过 POST /v1/audio/speech 生成语音并返回可播放的音频。把要朗读的文本作为 input,连同模型 ID gemini-2-5-flash-tts 一起发送。 在这个系列中,可以把 model 值换成任意受支持的 ID:gemini-2-5-flash-tts gemini-2-5-pro-tts。 在EmpirioLabs 控制台获取 API 密钥。
curl https://api.empiriolabs.ai/v1/audio/speech \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-2-5-flash-tts",
"input": "Welcome to EmpirioLabs. Your build just finished."
}' \
--output speech.mp3EmpirioLabs 上的 Gemini 2.5 TTS 是 Google 的 2 个音频生成模型 API 组成的系列:Gemini 2.5 Flash TTS, Gemini 2.5 Pro TTS。你使用一个 EmpirioLabs API 密钥,并选择适合请求的模型 ID。
从页面最符合你速度、质量和价格需求的模型开始,然后在EmpirioLabs Playground中测试。上面的对比卡片链接到每个模型的实时价格表和快速上手。
可以。这个系列遵循同一个 EmpirioLabs API 模式,大多数集成只需更改 model 值即可切换。如果依赖某个模型特有的参数,上线前请查看模型页面。
按量计费。本页卡片展示实时目录的简短摘要,每个模型页面展示与 API 计费一致的完整价格表。
可以。打开该系列的任意模型页面,使用其 Playground 链接在浏览器中测试提示词和参数,然后再集成 API。