Генератор озвучки

От 0.002 кредитов

Озвучивайте текст естественными голосами: 30 голосов, 73 языка и точные указания по тону, акценту и темпу речи.

Создайте свою первую озвучку

Напишите текст для озвучки или послушайте пример.

Gemini 3.8 Flash TTS
Gemini 3.8 Flash-Lite TTS
Eleven v4
Заполните для генерации

Enter the exact words to speak; Gemini reads them as written. Add sounds or pauses where they happen in angle brackets, such as <laugh>, <sigh>, or <short pause>, and capitalize a word to stress it.

Примеры

Знакомьтесь, Pyra: закадровый голос

Gemini 3.8 Flash TTS. История самой Pyra, прочитанная тёплым голосом рассказчика: закадровый голос, который можно сразу вставить в любое видео.

Повторить

Как использовать Генератор озвучки

Краткое руководство, которое поможет определить место этого пайплайна в рабочем процессе.

Лучше всего для

  • Закадровый текст и озвучка на более чем 70 языках
  • Синтез речи с управлением подачей обычными словами, например «говори тепло», «шёпотом» или «взволнованно»
  • Проекты с несколькими голосами
  • Многоязычные сценарии с автоматическим определением языка

Советы

  • Пишите короткими ясными предложениями — так речь звучит естественнее
  • Используйте пунктуацию для пауз: точку для завершения мысли, запятую для короткой паузы, многоточие для более долгой
  • Оставьте Auto для автоматического выбора или закрепите конкретный голос, если персонаж должен звучать одинаково во всех фрагментах
  • Формулируйте указания естественно: «медленно и драматично», «энергично и жизнерадостно», «спокойно и убедительно»

API Генератор озвучки

Вызывайте этот пайплайн из своего кода. Один запрос запускает выполнение; модель — это поле ввода, а не отдельный эндпоинт.

Получить API-токен
полей ввода
5
обязательно
1
Цены
0.002 to 40.0 кредитов
Язык
Язык
bun add @pipe2-ai/sdk
Запустить пайплайн
import { createClient } from "@pipe2-ai/sdk";

const client = createClient(process.env.PIPE2_TOKEN!);

const { run_pipeline } = await client.RunPipeline({
  pipeline_slug: "audio-generator",
  input: {
    text: "Welcome back to the show. Today we're talking about something a little strange.",
    model: "gemini-3-8-flash-tts",
  },
});

pip install pipe2
Запустить пайплайн
import asyncio
import os

from pipe2 import Pipe2Client

client = Pipe2Client(token=os.environ["PIPE2_TOKEN"])

run = asyncio.run(client.run_pipeline(
    pipeline_slug="audio-generator",
    input={
        "text": "Welcome back to the show. Today we're talking about something a little strange.",
        "model": "gemini-3-8-flash-tts",
    },
))

go get github.com/pipe2-ai/sdk-go
Запустить пайплайн
client := pipe2.NewClient(os.Getenv("PIPE2_TOKEN"))

input := json.RawMessage(`{
  "text": "Welcome back to the show. Today we're talking about something a little strange.",
  "model": "gemini-3-8-flash-tts"
}`)

run, err := pipe2.RunPipeline(context.Background(), client, "audio-generator", input)
if err != nil {
    log.Fatal(err)
}

brew install pipe2-ai/tap/pipe2
Запустить пайплайн
pipe2 pipelines run \
  --pipeline audio-generator \
  --input-json '{"text": "Welcome back to the show. Today we're talking about something a little strange.", "model": "gemini-3-8-flash-tts"}' \
  --wait

Полная справка по API Справочник CLI

Часто задаваемые вопросы

Какие голоса доступны?
Доступны десятки выразительных голосов: от светлых и тёплых до глубоких, уверенных и драматичных. Каждый голос учитывает ваши указания по тону и манере речи.
Какие языки поддерживаются?
Поддерживается более 70 языков с автоматическим определением. Среди них английский, китайский, японский и испанский, а также региональные языки, включая себуано, конкани и люксембургский.
Как работают инструкции?
Опишите желаемую подачу обычными словами. Например: «40-летний британский журналист, говорит медленно и делает драматические паузы перед ключевыми тезисами». Эти указания определят тон, темп и интонацию.
В каком формате выдаётся результат?
Вы получите MP3-файл, который можно скачать или сразу использовать в Video Reel как дорожку закадрового текста.
Какую модель выбрать?
Gemini 3.8 Flash-Lite TTS — самая быстрая и недорогая модель, она подходит для черновиков и коротких клипов. Gemini 3.8 Flash TTS создаёт озвучку студийного качества более чем на 130 языках. Eleven v4 — самая выразительная: смеётся, вздыхает или шепчет там, где вы это отметили. MiniMax Speech 2.8 Turbo и HD — быстрая альтернатива и вариант с более высоким качеством. Все модели выдают MP3 за считаные секунды.
Сколько это стоит?
Стоимость зависит от модели и длины текста и составляет 0.002 to 40.0 кредитов. Модели Gemini списывают кредиты только за фактически созданное аудио.

Озвучка текста с помощью ИИ

Создавайте естественно звучащую озвучку на более чем 70 языках. Выберите один из десятков голосов и обычными словами опишите нужный тон, акцент, темп и эмоцию — готовая MP3-дорожка появится за считаные секунды.

Что можно создать

  • Закадровый текст для документальных видео: убедительная профессиональная подача
  • Заставки, концовки и диалоги для подкастов: несколько голосов в одном проекте
  • Многоязычная озвучка: один и тот же сценарий на 70+ языках
  • Аудиокниги: выразительное чтение с управлением темпом и паузами
  • Доступный контент: превращайте письменные материалы в аудиоверсии

Как это работает

  1. Введите текст: добавьте фрагмент, который нужно озвучить
  2. Выберите голос или оставьте Auto: в режиме Auto голос подбирается по тексту и вашим указаниям
  3. При желании опишите манеру речи: например, «тёплый британский акцент, медленный темп, драматические паузы»
  4. Выберите модель: Gemini 3.8 Flash-Lite TTS — для быстрых и недорогих черновиков, Gemini 3.8 Flash TTS — для озвучки студийного качества, Eleven v4 — для самой выразительной подачи, или MiniMax Speech 2.8

Советы по стилю

  • Пишите короткими ясными предложениями — так речь звучит естественнее
  • Управляйте паузами с помощью пунктуации: точка завершает мысль, запятая задаёт короткую паузу, многоточие — более долгую
  • Описывайте подачу обычными словами: «медленно и драматично», «энергично и жизнерадостно», «спокойно и убедительно»
Генератор видео
from 9.5
Генератор видео
Генератор изображений
0.2-6.7
Генератор изображений
Генератор музыки
2.5-22.6
Генератор музыки
Видеоредактор
from 9.5
Видеоредактор