Google · 音频

Gemini 2.5 Flash TTS

合成更快、成本更低。适合草稿和短片段。

又名: Gemini 2.5 Flash Text-to-Speech, Gemini 2.5 Flash Preview TTS, gemini-2.5-flash-preview-tts, Gemini-TTS

在 音频生成器 中运行

Gemini 2.5 Flash TTS 能做什么

  • 文本转语音

Pipe2 上的价格

音频生成器 →
每次运行 0.7 积分

查看积分价格 →

由 Gemini 2.5 Flash TTS 生成

使用 Gemini 2.5 Flash TTS 的流水线

音频生成器
0.7-1.3
音频生成器

关于 Gemini 2.5 Flash TTS

功能说明

Gemini 2.5 Flash TTS 是 Gemini 提供方的文本转语音模型。你给它书面文本,它返回语音音频。在 Pipe2 上它运行于音频生成器流水线内,你可以从 70 多种语言的数十种声音中挑选,并附加引导语气、口音和节奏的风格指令。它被定位为更快更便宜的合成选项,面向草稿和短片段,而非长篇最终成品。

使用时机

  • 运行音频生成器,把写好的脚本变成旁白或配音,无需自己录音。
  • 反复打磨措辞:作为合成选项中更快更便宜的一档,它适合脚本仍在修改时的重复试听。
  • 制作短片段(转场音、单句朗读、提示语)且希望快速拿到结果。
  • 在投入更长的成品渲染前,先在 70 多种受支持语言中测试声音与语言的选择。
  • 试用语气、口音和节奏的风格指令,听听表演指示如何改变朗读效果。

运行前须知

计费按生成的输出 token 计量(批发单位以约 1500 个输出 token 报价),因此成本随生成语音量增长。长脚本比短脚本贵,控制花费的实用做法是缩短文本,或把它切成更短的片段分别生成。输入是文本,再加上你在音频生成器中选择的声音和风格指令。更快更便宜这一档的代价是它针对草稿和短片段。若想查看它运行时使用的输入,Pipe2 上发布了一个完整示例。

又名

你可能会看到该模型被称为 Gemini 2.5 Flash Text-to-Speech、Gemini 2.5 Flash Preview TTS 或 gemini-2.5-flash-preview-tts;简称 "Gemini-TTS" 同样指它。

同类模型