Audio-Generator
Verwandle Text in natürliche Sprache mit Dutzenden Stimmen, mehr als 70 Sprachen und individuellen Stilvorgaben für Tonfall, Akzent und Sprechtempo.
Oder wähle eine bestimmte Stimme...
Noch erforderlich: Text
Läuft mit
APIBeispiele
Das ist Pyra: Voiceover
Gemini 2.5 Flash TTS. Pyras eigene Geschichte, gelesen mit warmer Erzählerstimme: ein Voiceover, das direkt in jedes Video passt.
Am besten für
- •Erzählung und Voiceover in mehr als 70 Sprachen
- •Text-to-Speech mit Stilsteuerung in natürlicher Sprache (z. B. „warm sprechen“, „flüstern“, „aufgeregter Ton“)
- •Inhalte mit mehreren Stimmen und Dutzenden ausdrucksstarken Stimmen
- •Mehrsprachige Skripte, die Sprache wird automatisch aus dem Text erkannt
Tipps
- ✓Schreibe Erzähltexte in kurzen, klaren Sätzen für ein besseres Sprechtempo
- ✓Nutze Satzzeichen, um Pausen zu steuern: Punkte für vollständige Stopps, Kommas für kurze Pausen, Auslassungspunkte für lange Pausen
- ✓Belasse die Stimme auf Auto, und die KI wählt eine passend zu den Stilanweisungen, oder fixiere eine bestimmte Stimme, wenn du einen wiederkehrenden Charakter möchtest
- ✓Nutze Stilhinweise in natürlicher Sprache: „langsam und dramatisch sprechen“, „fröhlich und schwungvoll“, „ruhig und beruhigend“
Artikel zu dieser Pipeline
Audio-Generator API
Rufen Sie diese Pipeline aus Ihrem eigenen Code auf. Eine Anfrage startet einen Lauf; das Modell ist ein Eingabefeld, kein eigener Endpunkt.
bun add @pipe2-ai/sdk import { createClient } from "@pipe2-ai/sdk";
const client = createClient(process.env.PIPE2_TOKEN!);
const { run_pipeline } = await client.RunPipeline({
pipeline_slug: "audio-generator",
input: {
text: "Welcome back to the show. Today we're talking about something a little strange.",
model: "gemini-2-5-flash-tts",
},
});pip install pipe2 import asyncio
import os
from pipe2 import Pipe2Client
client = Pipe2Client(token=os.environ["PIPE2_TOKEN"])
run = asyncio.run(client.run_pipeline(
pipeline_slug="audio-generator",
input={
"text": "Welcome back to the show. Today we're talking about something a little strange.",
"model": "gemini-2-5-flash-tts",
},
))go get github.com/pipe2-ai/sdk-go client := pipe2.NewClient(os.Getenv("PIPE2_TOKEN"))
input := json.RawMessage(`{
"text": "Welcome back to the show. Today we're talking about something a little strange.",
"model": "gemini-2-5-flash-tts"
}`)
run, err := pipe2.RunPipeline(context.Background(), client, "audio-generator", input)
if err != nil {
log.Fatal(err)
}brew install pipe2-ai/tap/pipe2 pipe2 pipelines run \
--pipeline audio-generator \
--input-json '{"text": "Welcome back to the show. Today we're talking about something a little strange.", "model": "gemini-2-5-flash-tts"}' \
--waitParameter
-
texterforderlich -
Text, der in Sprache umgewandelt werden soll.
string -
instructions -
Beschreiben Sie Ton, Akzent, Tempo und Emotion. Die KI erstellt daraus einen ausdrucksstarken Stil-Prompt.
string -
model -
Voice engine to use. Leave unset to let Pipe2 pick the best available voice for your instructions.
gemini-2-5-flash-ttsgemini-2-5-pro-ttsStandardgemini-2-5-flash-tts
Alle 4 Eingaben anzeigen
-
voice -
Stimmenname aus Dutzenden verfügbaren, oder auto, damit die KI wählt.
autoZephyrPuckCharonKoreFenrirLedaOrusAoedeCallirrhoeAutonoeEnceladusIapetusUmbrielAlgiebaDespinaErinomeAlgenibRasalgethiLaomedeiaAchernarAlnilamSchedarGacruxPulcherrimaAchirdZubenelgenubiVindemiatrixSadachbiaSadaltagerSulafatStandardauto
Aus einem KI-Agenten heraus nutzen
Richten Sie einen beliebigen MCP-Client auf pipe2 aus, und Ihr Agent erhält diese Tools. Er findet diese Pipeline, liest dasselbe Schema von oben und führt sie aus.
- list_pipelines
- get_pipeline_schema
- run_pipeline
- get_pipeline_run_status
- request_upload
https://mcp.pipe2.ai/mcp {
"mcpServers": {
"pipe2ai": {
"url": "https://mcp.pipe2.ai/mcp",
"headers": { "Authorization": "Bearer YOUR_TOKEN" }
}
}
}KI-Text-to-Speech-Generator
Verwandle jeden Text in natürlich klingende Sprache mit Dutzenden Stimmen und mehr als 70 Sprachen. Steuere Tonfall, Akzent, Sprechtempo und Emotion über Anweisungen in normaler Sprache, produktionsreifer Voiceover in Sekunden.
Was du erstellen kannst
- Dokumentarische Erzählung: autoritative, professionelle Stimmen
- Podcast-Intros, -Outros, -Dialoge: Wiedergabe mit mehreren Charakteren
- Mehrsprachige Voiceover: dasselbe Skript in mehr als 70 Sprachen abdecken
- Hörbuch-Erzählung: emotionales Sprechtempo mit Regieanweisungen mitten im Satz
- Barrierefreiheit: Textinhalte als Audio verfügbar machen
So funktioniert es
- Füge deinen Text ein: was gesprochen werden soll
- Wähle eine Stimme oder belasse es auf Auto: Auto wählt die beste Stimme anhand deines Texts und deiner Anweisungen
- Füge einen Stilhinweis hinzu (optional), beschreibe Akzent, Tempo, Emotion: „warmer britischer Akzent, langsames Tempo mit dramatischen Pausen“
- Wähle ein Modell: Flash TTS für schnelle Entwürfe, Pro TTS für studiotaugliche Prosodie bei der finalen Ausgabe
Stiltipps
- Schreibe Erzähltexte in kurzen, klaren Sätzen für ein besseres Sprechtempo
- Nutze Satzzeichen, um Pausen zu steuern, Punkte für vollständige Stopps, Kommas für kurze Pausen, Auslassungspunkte für lange Pausen
- Stilhinweise nehmen normale Sprache an: „langsam und dramatisch sprechen“, „fröhlich und schwungvoll“, „ruhig und beruhigend“
Häufig gestellte Fragen
Welche Stimmen sind verfügbar?
Welche Sprachen werden unterstützt?
Wie funktionieren Anweisungen?
In welchem Audioformat wird ausgegeben?
Welches Modell sollte ich wählen?
Wie viele Credits kostet es?
Weitere Pipelines entdecken
Alle ansehen →Erzeuge KI-Videos aus einem Text-Prompt, Bild oder Referenzclip. Filmische Aufnahmen, Produktenthüllungen, Lifestyle-Werbung, mit synchronisiertem Audio und natürlicher Bewegung.
Erzeuge KI-Bilder aus Text oder Referenzfotos. Produktaufnahmen, Charakter-Artworks, Poster mit lesbarem Text, fotorealistische Porträts, hochauflösend in Sekunden.
Erzeuge originale Hintergrundmusik, die zu jeder Stimmung, jedem Genre und jeder Länge passt, die du beschreibst. Lizenzfrei, in Sekunden fertig.
Bearbeite vorhandene Videos mit KI. Ändere den Stil, füge Effekte hinzu, passe Szenen an oder verwandle das gesamte Erscheinungsbild.