Генератор аудио
Превращайте текст в естественную речь с десятками голосов, поддержкой 70+ языков и настройкой стиля, тона, акцента и темпа.
Или выберите конкретный голос...
Осталось заполнить: Текст
Работает на
APIПримеры
Знакомьтесь, Pyra: закадровый голос
Gemini 2.5 Flash TTS. История самой Pyra, прочитанная тёплым голосом рассказчика: закадровый голос, который можно сразу вставить в любое видео.
Лучше всего для
- •Закадровый текст и озвучка на 70+ языках
- •Синтез речи с управлением стилем на естественном языке (например, «говори тепло», «шёпотом», «взволнованный тон»)
- •Контент с несколькими голосами, десятки выразительных голосов
- •Многоязычные сценарии, язык определяется автоматически по тексту
Советы
- ✓Пишите закадровый текст короткими, ясными предложениями, так лучше темп
- ✓Используйте пунктуацию для управления паузами: точки для полных остановок, запятые для коротких пауз, многоточие для длинных пауз
- ✓Оставьте голос на «Авто», и ИИ подберёт подходящий под инструкции по стилю, либо закрепите конкретный голос, если нужен повторяющийся персонаж
- ✓Используйте подсказки по стилю на естественном языке: «говори медленно и драматично», «бодро и жизнерадостно», «спокойно и убедительно»
Статьи об этом пайплайне
API Генератор аудио
Вызывайте этот пайплайн из своего кода. Один запрос запускает выполнение; модель — это поле ввода, а не отдельный эндпоинт.
bun add @pipe2-ai/sdk import { createClient } from "@pipe2-ai/sdk";
const client = createClient(process.env.PIPE2_TOKEN!);
const { run_pipeline } = await client.RunPipeline({
pipeline_slug: "audio-generator",
input: {
text: "Welcome back to the show. Today we're talking about something a little strange.",
model: "gemini-2-5-flash-tts",
},
});pip install pipe2 import asyncio
import os
from pipe2 import Pipe2Client
client = Pipe2Client(token=os.environ["PIPE2_TOKEN"])
run = asyncio.run(client.run_pipeline(
pipeline_slug="audio-generator",
input={
"text": "Welcome back to the show. Today we're talking about something a little strange.",
"model": "gemini-2-5-flash-tts",
},
))go get github.com/pipe2-ai/sdk-go client := pipe2.NewClient(os.Getenv("PIPE2_TOKEN"))
input := json.RawMessage(`{
"text": "Welcome back to the show. Today we're talking about something a little strange.",
"model": "gemini-2-5-flash-tts"
}`)
run, err := pipe2.RunPipeline(context.Background(), client, "audio-generator", input)
if err != nil {
log.Fatal(err)
}brew install pipe2-ai/tap/pipe2 pipe2 pipelines run \
--pipeline audio-generator \
--input-json '{"text": "Welcome back to the show. Today we're talking about something a little strange.", "model": "gemini-2-5-flash-tts"}' \
--waitПараметры
-
textобязательно -
Текст для озвучивания.
string -
instructions -
Опишите тон, акцент, темп, эмоции. ИИ составит детальный промпт стиля.
string -
model -
Voice engine to use. Leave unset to let Pipe2 pick the best available voice for your instructions.
gemini-2-5-flash-ttsgemini-2-5-pro-ttsпо умолчаниюgemini-2-5-flash-tts
Показать все поля (4)
-
voice -
Имя голоса из десятков доступных или auto, чтобы ИИ выбрал сам.
autoZephyrPuckCharonKoreFenrirLedaOrusAoedeCallirrhoeAutonoeEnceladusIapetusUmbrielAlgiebaDespinaErinomeAlgenibRasalgethiLaomedeiaAchernarAlnilamSchedarGacruxPulcherrimaAchirdZubenelgenubiVindemiatrixSadachbiaSadaltagerSulafatпо умолчаниюauto
Использование из ИИ-агента
Направьте любой MCP-клиент на pipe2, и ваш агент получит эти инструменты. Он найдёт этот пайплайн, прочитает ту же схему выше и запустит его.
- list_pipelines
- get_pipeline_schema
- run_pipeline
- get_pipeline_run_status
- request_upload
https://mcp.pipe2.ai/mcp {
"mcpServers": {
"pipe2ai": {
"url": "https://mcp.pipe2.ai/mcp",
"headers": { "Authorization": "Bearer YOUR_TOKEN" }
}
}
}ИИ-генератор синтеза речи
Превращайте любой текст в естественно звучащую речь с десятками голосов и поддержкой 70+ языков. Управляйте тоном, акцентом, темпом и эмоцией с помощью инструкций на обычном языке, готовая к публикации озвучка за секунды.
Что можно создать
- Закадровый текст для документальных фильмов: авторитетные, профессиональные голоса
- Интро, аутро и диалоги для подкастов: озвучка от нескольких персонажей
- Многоязычная озвучка: один и тот же сценарий на 70+ языках
- Озвучка аудиокниг: эмоциональный темп с указаниями прямо посреди предложения
- Доступность: делайте текстовый контент доступным в виде аудио
Как это работает
- Вставьте текст: то, что нужно озвучить
- Выберите голос или оставьте «Авто»: «Авто» подбирает лучший голос на основе вашего текста и инструкций
- Добавьте подсказку по стилю (необязательно), опишите акцент, темп, эмоцию: «тёплый британский акцент, медленный темп с драматическими паузами»
- Выберите модель: Flash TTS для быстрых черновиков, Pro TTS для студийной просодии в финальной озвучке
Советы по стилю
- Пишите закадровый текст короткими, ясными предложениями, так лучше темп
- Используйте пунктуацию для управления паузами, точки для полных остановок, запятые для коротких пауз, многоточие для длинных пауз
- Подсказки по стилю задаются обычным языком: «говорите медленно и драматично», «бодро и жизнерадостно», «спокойно и убедительно»
Часто задаваемые вопросы
Какие голоса доступны?
Какие языки поддерживаются?
Как работают инструкции?
В каком аудиоформате выдаётся результат?
Какую модель выбрать?
Сколько кредитов это стоит?
Другие пайплайны
Смотреть все →Создавайте ИИ-видео из текстового запроса, изображения или референсного клипа. Кинематографичные кадры, презентации продуктов, лайфстайл-реклама, с синхронизированным звуком и естественным движением.
Создавайте ИИ-изображения из текста или референсных фото. Продуктовые снимки, арт персонажей, постеры с читаемым текстом, фотореалистичные портреты, высокое разрешение за секунды.
Создавайте оригинальную фоновую музыку под любое настроение, жанр и длительность, которые вы опишете. Без роялти, готово за секунды.
Редактируйте готовые видео с помощью ИИ. Меняйте стиль, добавляйте эффекты, изменяйте сцены или полностью преобразуйте вид.