Google · 音声

Gemini 2.5 Pro TTS

スタジオ級の抑揚とテンポ。本番のナレーションに。

別名: Gemini 2.5 Pro Text-to-Speech, Gemini 2.5 Pro Preview TTS, gemini-2.5-pro-preview-tts, Gemini-TTS

音声生成で実行

Gemini 2.5 Pro TTSでできること

  • テキスト→音声

Pipe2での料金

音声生成 →
1回あたり 1.3 クレジット

クレジット料金を見る →

Gemini 2.5 Pro TTSを使うパイプライン

音声生成
0.7-1.3
音声生成

Gemini 2.5 Pro TTSについて

できること

Gemini 2.5 Pro TTS は書かれたテキストを受け取り、音声を返します。Pipe2 での機能はテキスト読み上げのみで、台本を受け取って声のトラックを作ります。音声の入力、文字起こし、音楽生成は行いません。韻律と話す速さがスタジオ品質と説明されており、短い実用的な通知音よりも制作用のナレーションに向いています。音声生成パイプラインを通じて利用します。

使用するタイミング

  • ナレーション台本(動画のボイスオーバー、講座モジュール、解説)に音声生成を実行する場合で、文のリズムと間が言葉と同じくらい効いてくるとき。
  • 特定の読み方が必要なとき。音声生成は口調・アクセント・話す速さに独自のスタイル指示を受け付け、このモデルはその両面でスタジオ品質と説明されています。
  • 英語以外の言語で制作するとき。音声生成の対象は70以上の言語です。
  • 同じ台本の複数の読みを聴き比べたいとき。パイプラインは1つのテキスト入力の背後に数十の声を提供します。
  • 短いシステム案内や通知行だけが必要なら見送ってください。1つの節に速度制御は無駄になります。

実行前に知っておくこと

このモデルの卸単位は出力トークンで示され(1単位あたり約1500)、単位が測るのはモデルが生成する音声の量です。このページの最新価格表にパイプラインの現在の料率が表示されます。読みは、音声生成が口調・アクセント・話す速さについて提供するテキストのスタイル指示で導くので、望む読み方に到達するまで数回の試行を見込んでください。このモデルには Pipe2 でまだ公開された作例がないため、台本全体を投入する前に短い抜粋で確認してください。

別名

Gemini 2.5 Pro Text-to-Speech、Gemini 2.5 Pro Preview TTS、Gemini-TTS、またはプレビュー識別子 gemini-2.5-pro-preview-tts と表記されることがあります。いずれもここで Gemini 2.5 Pro TTS として掲載しているものと同じモデルです。

類似モデル