Назад к пайплайнам

Генератор аудио

Превращайте текст в естественную речь с десятками голосов, поддержкой 70+ языков и настройкой стиля, тона, акцента и темпа.

0.7
AI
Авто
ИИ подбирает лучший голос на основе ваших инструкций и текста
Или выберите конкретный голос...
Zephyr
F · Bright, Enthusiastic
Puck
M · Upbeat, Casual
Charon
M · Deep, Calm
Kore
F · Firm, Clear
Fenrir
M · Warm, Friendly
Leda
F · Youthful, Energetic
Orus
M · Firm, Casual
Aoede
F · Breezy, Professional
Callirrhoe
F · Easy-going, Friendly
Autonoe
F · Bright, Warm
Enceladus
M · Breathy, Confident
Iapetus
M · Clear, Professional
Umbriel
M · Easy-going, Resonant
Algieba
M · Smooth, Warm
Despina
F · Smooth, Warm
Erinome
F · Clear, Sophisticated
Algenib
M · Gravelly, Calm
Rasalgethi
M · Informative, Energetic
Laomedeia
F · Upbeat, Approachable
Achernar
F · Soft, Inviting
Alnilam
M · Firm, Optimistic
Schedar
M · Even, Casual
Gacrux
F · Mature, Engaging
Pulcherrima
M · Forward, Youthful
Achird
M · Friendly, Articulate
Zubenelgenubi
M · Casual, Deep
Vindemiatrix
F · Gentle, Smooth
Sadachbia
M · Lively, Resonant
Sadaltager
M · Knowledgeable, Calm
Sulafat
F · Warm, Enthusiastic

Осталось заполнить: Текст

Работает на

API

Примеры

АудиоGemini 2.5 Flash TTS

Знакомьтесь, Pyra: закадровый голос

Gemini 2.5 Flash TTS. История самой Pyra, прочитанная тёплым голосом рассказчика: закадровый голос, который можно сразу вставить в любое видео.

Повторить

Лучше всего для

  • Закадровый текст и озвучка на 70+ языках
  • Синтез речи с управлением стилем на естественном языке (например, «говори тепло», «шёпотом», «взволнованный тон»)
  • Контент с несколькими голосами, десятки выразительных голосов
  • Многоязычные сценарии, язык определяется автоматически по тексту

Советы

  • Пишите закадровый текст короткими, ясными предложениями, так лучше темп
  • Используйте пунктуацию для управления паузами: точки для полных остановок, запятые для коротких пауз, многоточие для длинных пауз
  • Оставьте голос на «Авто», и ИИ подберёт подходящий под инструкции по стилю, либо закрепите конкретный голос, если нужен повторяющийся персонаж
  • Используйте подсказки по стилю на естественном языке: «говори медленно и драматично», «бодро и жизнерадостно», «спокойно и убедительно»

Статьи об этом пайплайне

API Генератор аудио

Вызывайте этот пайплайн из своего кода. Один запрос запускает выполнение; модель — это поле ввода, а не отдельный эндпоинт.

4 полей ввода
1 обязательно
0.7 to 1.3 кредитов
bun add @pipe2-ai/sdk
import { createClient } from "@pipe2-ai/sdk";

const client = createClient(process.env.PIPE2_TOKEN!);

const { run_pipeline } = await client.RunPipeline({
  pipeline_slug: "audio-generator",
  input: {
    text: "Welcome back to the show. Today we're talking about something a little strange.",
    model: "gemini-2-5-flash-tts",
  },
});
pip install pipe2
import asyncio
import os

from pipe2 import Pipe2Client

client = Pipe2Client(token=os.environ["PIPE2_TOKEN"])

run = asyncio.run(client.run_pipeline(
    pipeline_slug="audio-generator",
    input={
        "text": "Welcome back to the show. Today we're talking about something a little strange.",
        "model": "gemini-2-5-flash-tts",
    },
))
go get github.com/pipe2-ai/sdk-go
client := pipe2.NewClient(os.Getenv("PIPE2_TOKEN"))

input := json.RawMessage(`{
  "text": "Welcome back to the show. Today we're talking about something a little strange.",
  "model": "gemini-2-5-flash-tts"
}`)

run, err := pipe2.RunPipeline(context.Background(), client, "audio-generator", input)
if err != nil {
    log.Fatal(err)
}
brew install pipe2-ai/tap/pipe2
pipe2 pipelines run \
  --pipeline audio-generator \
  --input-json '{"text": "Welcome back to the show. Today we're talking about something a little strange.", "model": "gemini-2-5-flash-tts"}' \
  --wait

Получить API-токен →

Параметры

text обязательно

Текст для озвучивания.

string
instructions

Опишите тон, акцент, темп, эмоции. ИИ составит детальный промпт стиля.

string
model

Voice engine to use. Leave unset to let Pipe2 pick the best available voice for your instructions.

gemini-2-5-flash-ttsgemini-2-5-pro-tts по умолчанию gemini-2-5-flash-tts
Показать все поля (4)
voice

Имя голоса из десятков доступных или auto, чтобы ИИ выбрал сам.

autoZephyrPuckCharonKoreFenrirLedaOrusAoedeCallirrhoeAutonoeEnceladusIapetusUmbrielAlgiebaDespinaErinomeAlgenibRasalgethiLaomedeiaAchernarAlnilamSchedarGacruxPulcherrimaAchirdZubenelgenubiVindemiatrixSadachbiaSadaltagerSulafat по умолчанию auto

Использование из ИИ-агента

Направьте любой MCP-клиент на pipe2, и ваш агент получит эти инструменты. Он найдёт этот пайплайн, прочитает ту же схему выше и запустит его.

  • list_pipelines
  • get_pipeline_schema
  • run_pipeline
  • get_pipeline_run_status
  • request_upload
https://mcp.pipe2.ai/mcp
{
  "mcpServers": {
    "pipe2ai": {
      "url": "https://mcp.pipe2.ai/mcp",
      "headers": { "Authorization": "Bearer YOUR_TOKEN" }
    }
  }
}

Полная справка по API Настройка MCP Справочник CLI

ИИ-генератор синтеза речи

Превращайте любой текст в естественно звучащую речь с десятками голосов и поддержкой 70+ языков. Управляйте тоном, акцентом, темпом и эмоцией с помощью инструкций на обычном языке, готовая к публикации озвучка за секунды.

Что можно создать

  • Закадровый текст для документальных фильмов: авторитетные, профессиональные голоса
  • Интро, аутро и диалоги для подкастов: озвучка от нескольких персонажей
  • Многоязычная озвучка: один и тот же сценарий на 70+ языках
  • Озвучка аудиокниг: эмоциональный темп с указаниями прямо посреди предложения
  • Доступность: делайте текстовый контент доступным в виде аудио

Как это работает

  1. Вставьте текст: то, что нужно озвучить
  2. Выберите голос или оставьте «Авто»: «Авто» подбирает лучший голос на основе вашего текста и инструкций
  3. Добавьте подсказку по стилю (необязательно), опишите акцент, темп, эмоцию: «тёплый британский акцент, медленный темп с драматическими паузами»
  4. Выберите модель: Flash TTS для быстрых черновиков, Pro TTS для студийной просодии в финальной озвучке

Советы по стилю

  • Пишите закадровый текст короткими, ясными предложениями, так лучше темп
  • Используйте пунктуацию для управления паузами, точки для полных остановок, запятые для коротких пауз, многоточие для длинных пауз
  • Подсказки по стилю задаются обычным языком: «говорите медленно и драматично», «бодро и жизнерадостно», «спокойно и убедительно»

Часто задаваемые вопросы

Какие голоса доступны?
Десятки выразительных голосов, от звонких и глубоких до тёплых, твёрдых и драматичных. Каждый реагирует на инструкции по стилю на обычном языке, задающие тон и подачу.
Какие языки поддерживаются?
70+ языков с автоматическим определением. От основных языков вроде английского, китайского, японского и испанского до региональных, включая себуано, конкани и люксембургский.
Как работают инструкции?
Опишите обычным языком, как должен звучать голос. Например: «40-летний британский журналист, говорит медленно, с драматическими паузами на ключевых моментах». ИИ интерпретирует ваше указание и создаёт вокальную подачу.
В каком аудиоформате выдаётся результат?
MP3, готовый к скачиванию или к передаче в пайплайны вроде Video Reel в качестве дорожки закадрового текста.
Какую модель выбрать?
Flash TTS, более дешёвый и быстрый вариант, отлично подходит для черновиков, коротких клипов и итераций. Pro TTS использует более точную модель с лучшей просодией и темпом, выбирайте её для финальной озвучки. Обе выдают результат за секунды; Pro занимает чуть дольше.
Сколько кредитов это стоит?
0.7 to 1.3 кредитов в зависимости от модели: Flash TTS дешевле, а Pro TTS стоит чуть больше. Результат готов за секунды.

Другие пайплайны

Смотреть все →
Генератор видео
from 9.5
Генератор видео
Генератор изображений
0.2-6.4
Генератор изображений
Генератор музыки
2.5-45.1
Генератор музыки
Видеоредактор
13.1-29.8
Видеоредактор