AI 配音生成

0.002 积分起

将文字转换为自然语音。提供数十种音色、支持 70+ 种语言,并可自定义语气、口音和语速。

AI
自动
AI 根据你的指令和文本自动挑选最合适的声音
或选择特定的声音...
Zephyr
F · Bright, Enthusiastic
Puck
M · Upbeat, Casual
Charon
M · Deep, Calm
Kore
F · Firm, Clear
Fenrir
M · Warm, Friendly
Leda
F · Youthful, Energetic
Orus
M · Firm, Casual
Aoede
F · Breezy, Professional
Callirrhoe
F · Easy-going, Friendly
Autonoe
F · Bright, Warm
Enceladus
M · Breathy, Confident
Iapetus
M · Clear, Professional
Umbriel
M · Easy-going, Resonant
Algieba
M · Smooth, Warm
Despina
F · Smooth, Warm
Erinome
F · Clear, Sophisticated
Algenib
M · Gravelly, Calm
Rasalgethi
M · Informative, Energetic
Laomedeia
F · Upbeat, Approachable
Achernar
F · Soft, Inviting
Alnilam
M · Firm, Optimistic
Schedar
M · Even, Casual
Gacrux
F · Mature, Engaging
Pulcherrima
M · Forward, Youthful
Achird
M · Friendly, Articulate
Zubenelgenubi
M · Casual, Deep
Vindemiatrix
F · Gentle, Smooth
Sadachbia
M · Lively, Resonant
Sadaltager
M · Knowledgeable, Calm
Sulafat
F · Warm, Enthusiastic

还需填写:文字

示例

音频Gemini 2.5 Flash TTS

认识 Pyra:配音

Gemini 2.5 Flash TTS。Pyra 自己的故事,用温暖的讲述者嗓音读出:一段可以直接放进任何视频的配音。

复现

如何使用 AI 配音生成

一份简明的决策指南,帮助确定此流水线在工作流中的位置。

最适合

  • 制作 70+ 种语言的旁白和配音
  • 用自然语言控制语气的文本转语音,例如“温暖地说”“耳语”或“兴奋的语气”
  • 使用数十种不同音色制作多角色内容
  • 自动识别文字语言的多语言脚本

提示

  • 旁白尽量使用简短、清晰的句子,让节奏更自然
  • 用标点控制停顿:句号表示完整停顿,逗号表示短暂停顿,省略号表示较长停顿
  • 使用自动音色时,AI 会选择与风格要求匹配的声音;如果同一角色会反复出现,可以固定使用某个音色
  • 可直接描述演绎方式,例如“缓慢而富有戏剧性”“轻快有活力”或“平静、让人安心”

AI 配音生成 API

从你自己的代码调用此流水线。一次请求即可发起运行;模型是一个输入字段,而不是独立的接口。

获取 API 令牌
个输入
5
必填
1
定价
0.002 to 40.0 积分
语言
语言
bun add @pipe2-ai/sdk
运行流水线
import { createClient } from "@pipe2-ai/sdk";

const client = createClient(process.env.PIPE2_TOKEN!);

const { run_pipeline } = await client.RunPipeline({
  pipeline_slug: "audio-generator",
  input: {
    text: "Welcome back to the show. Today we're talking about something a little strange.",
    model: "gemini-2-5-flash-tts",
  },
});

pip install pipe2
运行流水线
import asyncio
import os

from pipe2 import Pipe2Client

client = Pipe2Client(token=os.environ["PIPE2_TOKEN"])

run = asyncio.run(client.run_pipeline(
    pipeline_slug="audio-generator",
    input={
        "text": "Welcome back to the show. Today we're talking about something a little strange.",
        "model": "gemini-2-5-flash-tts",
    },
))

go get github.com/pipe2-ai/sdk-go
运行流水线
client := pipe2.NewClient(os.Getenv("PIPE2_TOKEN"))

input := json.RawMessage(`{
  "text": "Welcome back to the show. Today we're talking about something a little strange.",
  "model": "gemini-2-5-flash-tts"
}`)

run, err := pipe2.RunPipeline(context.Background(), client, "audio-generator", input)
if err != nil {
    log.Fatal(err)
}

brew install pipe2-ai/tap/pipe2
运行流水线
pipe2 pipelines run \
  --pipeline audio-generator \
  --input-json '{"text": "Welcome back to the show. Today we're talking about something a little strange.", "model": "gemini-2-5-flash-tts"}' \
  --wait

完整 API 参考 CLI 参考

常见问题

有哪些音色可用?
提供数十种富有表现力的音色,包括明亮、低沉、温暖、坚定和戏剧化等不同声音气质;每种音色都能根据自然语言指令调整语气与演绎方式。
支持哪些语言?
支持 70+ 种语言并可自动识别,包括英语、中文、日语、西班牙语等主要语言,以及宿务语、孔卡尼语和卢森堡语等地区语言。
如何使用语音指令?
直接用自然语言描述想要的声音,例如:“一位 40 岁的英国记者,语速缓慢,在关键处带有戏剧性停顿。”AI 会按照要求调整演绎。
输出是什么音频格式?
输出为 MP3,可直接下载,也可作为旁白音轨用于 Video Reel 等流程。
应该选择哪个模型?
Flash TTS 价格更低、速度更快,适合草稿、短片段和反复尝试;Pro TTS 的声音保真度、韵律和节奏更好,更适合正式成片。两者都能在数秒内生成,Pro 会稍慢一些。
需要多少积分?
每次生成 0.002 to 40.0 积分,具体取决于模型;Flash TTS 更便宜,Pro TTS 稍贵。通常数秒即可完成。

AI 文本转语音生成器

用数十种音色和 70+ 种语言,将任意文本转换为听感自然的语音。通过自然语言指令控制语气、口音、节奏和情感,数秒即得可直接用于制作的配音。

你可以制作什么

  • 纪录片旁白:沉稳、专业的声音
  • 播客片头、片尾与对话:支持多角色演绎
  • 多语言配音:用 70+ 种语言演绎同一份脚本
  • 有声书旁白:用自然停顿与情绪变化讲好故事
  • 无障碍音频:把文字内容转换成语音

工作原理

  1. 粘贴文字:输入需要朗读的内容
  2. 选择音色或使用自动模式:系统会根据文字和指令挑选合适的音色
  3. 添加风格要求(可选):描述口音、语速和情绪,例如“温暖的英式口音,语速缓慢并带有戏剧性停顿”
  4. 选择模型:Flash TTS 适合快速出稿,Pro TTS 的韵律更接近录音棚成品

风格技巧

  • 用简短、清晰的句子撰写旁白,以获得更好的节奏
  • 用标点控制停顿,句号表示完全停顿,逗号表示短暂停顿,省略号表示较长停顿
  • 用自然语言描述风格,例如:“语速放慢,带一点戏剧感”“轻快有活力”“平静、让人安心”

探索更多流水线

AI 视频生成
from 9.5
AI 视频生成
图像生成器
0.2-6.4
图像生成器
音乐生成器
2.5-22.6
音乐生成器
AI 视频编辑
13.1-33.3
AI 视频编辑