ElevenLabs · 音声
Eleven v4
ElevenLabsで最も表現力豊かな音声。20種類の声、90以上の言語、オーディオタグに対応。
~4.1 クレジット 1,000文字あたり
音声生成で実行 テキスト
Eleven v4
音声
- 提供元
- ElevenLabs
- 利用パイプライン
- 音声生成
- 最低料金
- ~4.1 クレジット 1,000文字あたり
対応設定
音声生成 →
- 最大9,000文字
- River · George · Sarah · Daniel · Alice · Brian · Lily · Eric · Matilda · Roger · Bella · Chris · Jessica · Will · Laura · Charlie · Liam · Bill · Callum · Harry
- 最大300文字
Eleven v4でできること
- テキスト→音声
Eleven v4で作った作例
Eleven v4を使うパイプライン
Eleven v4について
できること
Eleven v4は、ElevenLabsの最新かつ最も表現力豊かな音声合成モデルです。音声生成では、ElevenLabsの20種類のプリセット音声のいずれかでテキストを読み上げ、MP3を返します。テキストから言語を判別して90以上の言語を話し、読み方を変えたい位置に置いた [whispers]、[sighs]、[excited] などのオーディオタグに従います。
適した用途
- 感情の幅が求められるナレーション、オーディオブック、キャラクターボイス。
- 話者の少ない言語の台本:どの音声もテキストの言語を自然に話します。
- 笑い、ため息、ささやき、途中で口調が変わるセリフ。
実行前に知っておくこと
音声の指示には、トーン、ペース、感情、アクセントを書きます。「プロンプトを改善」がオンのとき、Pipe2は言葉を変えずにテキストへオーディオタグを加え、音声を選ぶこともできます。オフのときはテキストがそのまま読まれ、指示は冒頭の1つのタグになります。三点リーダーで間を、大文字で強調を加えられます。SSMLには対応していません。テキストは最大9,000文字です。料金は送信される文字数(オーディオタグを含む)に応じて上がり、「プロンプトを改善」がオンのときはその改善ステップの料金も含まれます。ボイスクローン、複数話者の対話、話速の調整はここでは利用できません。
別名
このモデルは ElevenLabs v4、またはAPI名の eleven_v4 で表記されることもあります。