音声生成
0.002クレジットから
テキストを自然な音声に変換します。30種類の声と73言語に対応し、トーン、アクセント、話す速さを自然な言葉で指定できます。
AI
自動
指示とテキストに基づいてAIが最適な音声を選択します
または特定の音声を選択...
Zephyr
F · Bright, Enthusiastic
Puck
M · Upbeat, Casual
Charon
M · Deep, Calm
Kore
F · Firm, Clear
Fenrir
M · Warm, Friendly
Leda
F · Youthful, Energetic
Orus
M · Firm, Casual
Aoede
F · Breezy, Professional
Callirrhoe
F · Easy-going, Friendly
Autonoe
F · Bright, Warm
Enceladus
M · Breathy, Confident
Iapetus
M · Clear, Professional
Umbriel
M · Easy-going, Resonant
Algieba
M · Smooth, Warm
Despina
F · Smooth, Warm
Erinome
F · Clear, Sophisticated
Algenib
M · Gravelly, Calm
Rasalgethi
M · Informative, Energetic
Laomedeia
F · Upbeat, Approachable
Achernar
F · Soft, Inviting
Alnilam
M · Firm, Optimistic
Schedar
M · Even, Casual
Gacrux
F · Mature, Engaging
Pulcherrima
M · Forward, Youthful
Achird
M · Friendly, Articulate
Zubenelgenubi
M · Casual, Deep
Vindemiatrix
F · Gentle, Smooth
Sadachbia
M · Lively, Resonant
Sadaltager
M · Knowledgeable, Calm
Sulafat
F · Warm, Enthusiastic
使用モデル
例
Pyraのご紹介:ナレーション
Gemini 2.5 Flash TTS。Pyra自身の物語を、あたたかな語り部の声で。どんな動画にもそのまま重ねられるナレーションです。
音声生成 の使い方
このパイプラインをワークフローのどこで使うか判断するための簡潔なガイドです。
最適な用途
- 70以上の言語でのナレーション・ボイスオーバー
- 自然言語によるスタイル制御付きのテキスト読み上げ(例:「温かく話す」「ささやく」「興奮したトーン」)
- 数十種類の表現力豊かな声を使ったマルチボイスコンテンツ
- 多言語台本、言語はテキストから自動検出されます
ヒント
- テンポを整えるため、ナレーションは短く明確な文で書く
- 句読点で間をコントロール:ピリオドで完全な停止、カンマで短い間、三点リーダーで長い間
- 声を自動のままにすればAIがスタイル指示に合うものを選び、繰り返し登場するキャラクターが欲しい場合は特定の声を固定できます
- 自然言語のスタイルヒントを使う:「ゆっくりとドラマチックに話す」「明るく元気に」「落ち着いて安心感を与えるように」
- 個の入力
- 5
- 必須
- 1
- 料金
- 0.002 to 40.0 クレジット
| 入力 | 型 | 既定値 | 説明 |
|---|---|---|---|
text | string | 既定値— | 音声に変換するテキスト。 |
enhance_prompt | boolean | 既定値true | 生成前に選択したモデル向けにプロンプトを改善します。プロンプトを変更せず送信するにはオフにします。 |
instructions | string | 既定値— | トーン、アクセント、テンポ、感情を記述してください。AI が詳細なスタイルプロンプトを生成します。 |
model | enum | 既定値gemini-2-5-flash-tts | 使用する音声モデルです。未指定の場合は、指示内容に合う利用可能な音声をPipe2が選びます。gemini-2-5-flash-tts · gemini-2-5-pro-tts · minimax-speech-2-8-turbo +1gemini-2-5-flash-ttsgemini-2-5-pro-ttsminimax-speech-2-8-turbominimax-speech-2-8-hd |
voice | string | 既定値auto | 数十種類から選べる音声名。auto にすると AI が自動で選択します。 |
任意の MCP クライアントを pipe2 に接続すると、エージェントがこれらのツールを使えるようになります。このパイプラインを見つけ、上と同じスキーマを読み取って実行します。
list_pipelinesget_pipeline_schemarun_pipelineget_pipeline_run_statusrequest_upload
https://mcp.pipe2.ai/mcp {
"mcpServers": {
"pipe2ai": {
"url": "https://mcp.pipe2.ai/mcp",
"headers": { "Authorization": "Bearer YOUR_TOKEN" }
}
}
}このパイプラインを使うレシピ
すべてのレシピを見るよくある質問
どんな声が利用できますか?
明るい、深い、温かい、しっかりした、ドラマチックなキャラクターにわたる数十種類の表現力豊かな声。それぞれがトーンや話し方の平易な言葉によるスタイル指示に応答します。
どの言語に対応していますか?
自動検出付きで70以上の言語に対応。英語、中国語、日本語、スペイン語などの主要言語から、セブアノ語、コンカニ語、ルクセンブルク語といった地域言語まで。
指示はどのように機能しますか?
声にどう聞こえてほしいかを平易な言葉で記述します。例えば:「40歳のイギリス人ジャーナリスト、重要な点ではドラマチックな間を置いてゆっくり話す」。AIがあなたの指示を解釈し、声の演技を作り上げます。
出力の音声フォーマットは何ですか?
MP3形式で、ダウンロードしてすぐに使えるほか、動画リールなどのパイプラインにナレーショントラックとして連結できます。
どのモデルを選べばいいですか?
Flash TTS はより安く速い方法、下書き、短いクリップ、反復作業に最適です。Pro TTS はより高忠実度のモデルで抑揚とテンポが強力、本番のナレーションにはこちらを。どちらも数秒でレンダリングされ、Pro はほんの少し時間がかかります。
何クレジットかかりますか?
モデルによって 0.002 to 40.0 クレジット。Flash TTS は安価な選択肢で、Pro TTS は少し高くなります。結果は数秒で用意できます。
AIテキスト読み上げジェネレーター
あらゆるテキストを、数十種類の声と70以上の言語で自然な音声に変換します。トーン、アクセント、テンポ、感情を平易な言葉の指示でコントロール、数秒でそのまま使える品質のナレーションが完成します。
作成できるもの
- ドキュメンタリーのナレーション: 説得力のあるプロフェッショナルな声
- ポッドキャストのイントロ・アウトロ・対話: 複数キャラクターの掛け合い
- 多言語ナレーション: 同じ台本を70以上の言語でカバー
- オーディオブックのナレーション: 文の途中でも指示できる感情的なテンポ
- アクセシビリティ: テキストコンテンツを音声で利用可能に
使い方
- テキストを貼り付け: 読み上げたい内容を入力
- 声を選ぶ、または自動のまま: 自動ならテキストと指示に基づいて最適な声を選択
- スタイルのヒントを追加(任意),アクセント、テンポ、感情を記述: 「温かみのあるイギリス英語のアクセント、ゆっくりとしたテンポでドラマチックな間を置いて」
- モデルを選ぶ: 素早い下書きには Flash TTS、最終仕上げのスタジオ品質の抑揚には Pro TTS
スタイルのコツ
- テンポを整えるため、ナレーションは短く明確な文で書く
- 句読点で間をコントロール、ピリオドで完全な停止、カンマで短い間、三点リーダーで長い間
- スタイルのヒントは平易な言葉でOK: 「ゆっくりとドラマチックに話す」「明るく元気に」「落ち着いて安心感を与えるように」