Sprachgenerator
Verwandeln Sie Text in natürlich klingende Sprachaufnahmen – mit 30 Stimmen in 73 Sprachen und frei formulierbaren Vorgaben für Tonfall, Akzent und Sprechtempo.
Oder wähle eine bestimmte Stimme...
Läuft mit
Beispiele
Das ist Pyra: Voiceover
Gemini 2.5 Flash TTS. Pyras eigene Geschichte, gelesen mit warmer Erzählerstimme: ein Voiceover, das direkt in jedes Video passt.
So verwendest du Sprachgenerator
Eine kompakte Entscheidungshilfe zur Einordnung dieser Pipeline in einen Workflow.
Am besten für
- Sprechertexte und Voice-overs in mehr als 70 Sprachen
- Text-to-Speech mit frei formulierbaren Stilvorgaben, etwa „warm sprechen“, „flüstern“ oder „aufgeregt klingen“
- Dialoge und andere Inhalte mit mehreren ausdrucksstarken Stimmen
- Mehrsprachige Skripte mit automatischer Spracherkennung
Tipps
- Kurze, klare Sätze sorgen für ein natürlicheres Sprechtempo
- Steuere Pausen mit Satzzeichen: Punkte für deutliche Stopps, Kommas für kurze und Auslassungspunkte für längere Pausen
- Lass die Stimme auf Auto, damit die KI eine passende Stimme auswählt; lege eine bestimmte Stimme fest, wenn eine wiederkehrende Figur immer gleich klingen soll
- Formuliere Stilwünsche ganz normal: „langsam und dramatisch sprechen“, „fröhlich und schwungvoll“, „ruhig und beruhigend“
Sprachgenerator API
Rufen Sie diese Pipeline aus Ihrem eigenen Code auf. Eine Anfrage startet einen Lauf; das Modell ist ein Eingabefeld, kein eigener Endpunkt.
API-Token holen- Eingaben
- 5
- erforderlich
- 1
- Preise
- 0.002 to 40.0 Credits
| Eingabe | Typ | Standard | Beschreibung |
|---|---|---|---|
text | string | Standard— | Text, der vertont werden soll. |
enhance_prompt | boolean | Standardtrue | Verbessert den Prompt vor der Generierung für das ausgewählte Modell. Deaktivieren, um den Prompt unverändert zu senden. |
instructions | string | Standard— | Beschreiben Sie Tonfall, Akzent, Tempo und Emotion. Die KI setzt die Vorgaben in eine ausdrucksstarke Sprechweise um. |
model | enum | Standardgemini-2-5-flash-tts | Sprachmodell für die Ausgabe. Lassen Sie das Feld leer, damit Pipe2 anhand Ihrer Vorgaben die beste verfügbare Stimme auswählt.gemini-2-5-flash-tts · gemini-2-5-pro-tts · minimax-speech-2-8-turbo +1gemini-2-5-flash-ttsgemini-2-5-pro-ttsminimax-speech-2-8-turbominimax-speech-2-8-hd |
voice | string | Standardauto | Wählen Sie eine der verfügbaren Stimmen oder auto für die automatische Auswahl. |
Richten Sie einen beliebigen MCP-Client auf pipe2 aus, und Ihr Agent erhält diese Tools. Er findet diese Pipeline, liest dasselbe Schema von oben und führt sie aus.
list_pipelinesget_pipeline_schemarun_pipelineget_pipeline_run_statusrequest_upload
https://mcp.pipe2.ai/mcp {
"mcpServers": {
"pipe2ai": {
"url": "https://mcp.pipe2.ai/mcp",
"headers": { "Authorization": "Bearer YOUR_TOKEN" }
}
}
}Rezepte mit dieser Pipeline
Alle Rezepte ansehenHäufig gestellte Fragen
Welche Stimmen sind verfügbar?
Welche Sprachen werden unterstützt?
Wie funktionieren die Anweisungen?
In welchem Audioformat wird ausgegeben?
Welches Modell sollte ich wählen?
Wie viele Credits kostet es?
KI-Sprachgenerator für Text-to-Speech
Verwandle beliebige Texte in natürlich klingende Sprache – mit Dutzenden Stimmen und mehr als 70 Sprachen. Tonfall, Akzent, Tempo und Emotion steuerst du mit einfachen Anweisungen. So entsteht in Sekunden ein sendefertiges Voice-over.
Was du erstellen kannst
- Dokumentarische Sprechertexte: souveräne, professionelle Stimmen
- Podcast-Intros, -Outros und Dialoge: verschiedene Stimmen für mehrere Rollen
- Mehrsprachige Voice-overs: dasselbe Skript in mehr als 70 Sprachen vertonen
- Hörbücher: lebendige Betonung und Regiehinweise mitten im Satz
- Barrierefreiheit: Textinhalte als Audio verfügbar machen
So funktioniert es
- Text einfügen: Gib ein, was gesprochen werden soll
- Stimme auswählen oder Auto verwenden: Im Auto-Modus wird passend zu Text und Anweisungen eine Stimme gewählt
- Optional den Stil beschreiben: etwa Akzent, Tempo oder Emotion – „warmer britischer Akzent, langsames Tempo mit dramatischen Pausen“
- Modell auswählen: Flash TTS für schnelle Entwürfe, Pro TTS für besonders natürliche Betonung in der finalen Fassung
Stiltipps
- Kurze, klare Sätze sorgen für ein natürlicheres Sprechtempo
- Steuere Pausen mit Satzzeichen: Punkte für deutliche Stopps, Kommas für kurze und Auslassungspunkte für längere Pausen
- Formuliere Stilwünsche ganz normal: „langsam und dramatisch sprechen“, „fröhlich und schwungvoll“, „ruhig und beruhigend“