Google · 音声
Gemini 2.5 Pro TTS
スタジオ級の抑揚とテンポ。本番のナレーションに。
別名: Gemini 2.5 Pro Text-to-Speech, Gemini 2.5 Pro Preview TTS, gemini-2.5-pro-preview-tts, Gemini-TTS
音声生成で実行Gemini 2.5 Pro TTSでできること
- テキスト→音声
Pipe2での料金
| 1回あたり | 1.3 クレジット |
Gemini 2.5 Pro TTSを使うパイプライン
Gemini 2.5 Pro TTSについて
できること
Gemini 2.5 Pro TTS は書かれたテキストを受け取り、音声を返します。Pipe2 での機能はテキスト読み上げのみで、台本を受け取って声のトラックを作ります。音声の入力、文字起こし、音楽生成は行いません。韻律と話す速さがスタジオ品質と説明されており、短い実用的な通知音よりも制作用のナレーションに向いています。音声生成パイプラインを通じて利用します。
使用するタイミング
- ナレーション台本(動画のボイスオーバー、講座モジュール、解説)に音声生成を実行する場合で、文のリズムと間が言葉と同じくらい効いてくるとき。
- 特定の読み方が必要なとき。音声生成は口調・アクセント・話す速さに独自のスタイル指示を受け付け、このモデルはその両面でスタジオ品質と説明されています。
- 英語以外の言語で制作するとき。音声生成の対象は70以上の言語です。
- 同じ台本の複数の読みを聴き比べたいとき。パイプラインは1つのテキスト入力の背後に数十の声を提供します。
- 短いシステム案内や通知行だけが必要なら見送ってください。1つの節に速度制御は無駄になります。
実行前に知っておくこと
このモデルの卸単位は出力トークンで示され(1単位あたり約1500)、単位が測るのはモデルが生成する音声の量です。このページの最新価格表にパイプラインの現在の料率が表示されます。読みは、音声生成が口調・アクセント・話す速さについて提供するテキストのスタイル指示で導くので、望む読み方に到達するまで数回の試行を見込んでください。このモデルには Pipe2 でまだ公開された作例がないため、台本全体を投入する前に短い抜粋で確認してください。
別名
Gemini 2.5 Pro Text-to-Speech、Gemini 2.5 Pro Preview TTS、Gemini-TTS、またはプレビュー識別子 gemini-2.5-pro-preview-tts と表記されることがあります。いずれもここで Gemini 2.5 Pro TTS として掲載しているものと同じモデルです。