Gemini 2.5 TTS APIs

比较 Gemini 2.5 TTS 系列的 2 个音频生成模型,然后调用符合你延迟、质量和价格需求的那一个。

Google音频生成2 个模型

关于 Gemini 2.5 TTS API

EmpirioLabs 上的 Gemini 2.5 TTS 汇集了 Google 的 2 个音频生成模型 API(包括 Gemini 2.5 Flash TTS, Gemini 2.5 Pro TTS)。每个模型都有自己的页面,包含实时价格、参数、文档和 Playground 入口。

在整个系列中使用同一个 EmpirioLabs API 密钥和端点模式,只需更改请求中的 model ID 即可切换行为。

Gemini 2.5 TTS 模型(2)

Gemini 2.5 TTS API 价格

先一眼比较整个系列,再打开模型页面查看完整的实时价格表和参数。

端点
POST/v1/audio/speech
价格
类型
规格
价格
投入
每1M 提示符
$1.50
产出
每1M个生成的令牌
$30.00
最适合
低纬度 text-to-speech 使用单声道和多声道语音,并具有可控风格,口音,以及制作应用的表达语调.
端点
POST/v1/audio/speech
价格
类型
规格
价格
投入
每1M 提示符
$3.00
产出
每1M个生成的令牌
$60.00
最适合
高质量TTS预览播客,音频书,以及客户支持,具有23+语言的表达式多语言语音.
在完整价格页比较所有模型

如何调用 Gemini 2.5 TTS 模型

Gemini 2.5 Flash TTS 通过 POST /v1/audio/speech 生成语音并返回可播放的音频。把要朗读的文本作为 input,连同模型 ID gemini-2-5-flash-tts 一起发送。 在这个系列中,可以把 model 值换成任意受支持的 ID:gemini-2-5-flash-tts gemini-2-5-pro-tts。 在EmpirioLabs 控制台获取 API 密钥。

cURL
curl https://api.empiriolabs.ai/v1/audio/speech \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-2-5-flash-tts",
    "input": "Welcome to EmpirioLabs. Your build just finished."
  }' \
  --output speech.mp3

Gemini 2.5 TTS API:常见问题

什么是 Gemini 2.5 TTS API?

EmpirioLabs 上的 Gemini 2.5 TTS 是 Google 的 2 个音频生成模型 API 组成的系列:Gemini 2.5 Flash TTS, Gemini 2.5 Pro TTS。你使用一个 EmpirioLabs API 密钥,并选择适合请求的模型 ID。

我该用哪个 Gemini 2.5 TTS 模型?

从页面最符合你速度、质量和价格需求的模型开始,然后在EmpirioLabs Playground中测试。上面的对比卡片链接到每个模型的实时价格表和快速上手。

可以在不重构集成的情况下切换 Gemini 2.5 TTS 模型吗?

可以。这个系列遵循同一个 EmpirioLabs API 模式,大多数集成只需更改 model 值即可切换。如果依赖某个模型特有的参数,上线前请查看模型页面。

Gemini 2.5 TTS 的价格如何展示?

按量计费。本页卡片展示实时目录的简短摘要,每个模型页面展示与 API 计费一致的完整价格表。

可以在浏览器里试用 Gemini 2.5 TTS 吗?

可以。打开该系列的任意模型页面,使用其 Playground 链接在浏览器中测试提示词和参数,然后再集成 API。

准备好使用更好的终端了吗?

查看我们的定价,或者如果你想将自己的模型部署到我们的堆栈中,请联系我们。