Générateur audio
Transformez du texte en voix naturelle grâce à des dizaines de voix, plus de 70 langues et des directions de style personnalisées pour le ton, l'accent et le rythme.
Ou choisissez une voix spécifique...
Encore requis : Texte
Fonctionne avec
APIExemples
Voici Pyra : voix off
Gemini 2.5 Flash TTS. L'histoire de Pyra, lue par une voix de conteur chaleureuse : une voix off à poser directement sur n'importe quelle vidéo.
Idéal pour
- •Narration et voix off en plus de 70 langues
- •Synthèse vocale avec contrôle de style en langage naturel (par ex. « parlez chaleureusement », « chuchotez », « ton excité »)
- •Contenu multi-voix avec des dizaines de voix expressives
- •Scripts multilingues, la langue est détectée automatiquement à partir du texte
Conseils
- ✓Rédigez la narration en phrases courtes et claires pour un meilleur rythme
- ✓Utilisez la ponctuation pour contrôler les pauses : les points pour les arrêts complets, les virgules pour de brèves pauses, les points de suspension pour de longues pauses
- ✓Laissez la voix sur Auto et l'IA en choisit une qui correspond aux instructions de style, ou fixez une voix précise si vous souhaitez un personnage récurrent
- ✓Utilisez des indications de style en langage naturel : « parlez lentement et de façon dramatique », « joyeux et enjoué », « calme et rassurant »
Articles sur ce pipeline
API Générateur audio
Appelez ce pipeline depuis votre propre code. Une requête lance une exécution ; le modèle est un champ d'entrée, pas un endpoint distinct.
bun add @pipe2-ai/sdk import { createClient } from "@pipe2-ai/sdk";
const client = createClient(process.env.PIPE2_TOKEN!);
const { run_pipeline } = await client.RunPipeline({
pipeline_slug: "audio-generator",
input: {
text: "Welcome back to the show. Today we're talking about something a little strange.",
model: "gemini-2-5-flash-tts",
},
});pip install pipe2 import asyncio
import os
from pipe2 import Pipe2Client
client = Pipe2Client(token=os.environ["PIPE2_TOKEN"])
run = asyncio.run(client.run_pipeline(
pipeline_slug="audio-generator",
input={
"text": "Welcome back to the show. Today we're talking about something a little strange.",
"model": "gemini-2-5-flash-tts",
},
))go get github.com/pipe2-ai/sdk-go client := pipe2.NewClient(os.Getenv("PIPE2_TOKEN"))
input := json.RawMessage(`{
"text": "Welcome back to the show. Today we're talking about something a little strange.",
"model": "gemini-2-5-flash-tts"
}`)
run, err := pipe2.RunPipeline(context.Background(), client, "audio-generator", input)
if err != nil {
log.Fatal(err)
}brew install pipe2-ai/tap/pipe2 pipe2 pipelines run \
--pipeline audio-generator \
--input-json '{"text": "Welcome back to the show. Today we're talking about something a little strange.", "model": "gemini-2-5-flash-tts"}' \
--waitParamètres
-
textrequis -
Texte à convertir en parole.
string -
instructions -
Décrivez le ton, l'accent, le rythme, l'émotion. L'IA élabore une consigne de style détaillée.
string -
model -
Voice engine to use. Leave unset to let Pipe2 pick the best available voice for your instructions.
gemini-2-5-flash-ttsgemini-2-5-pro-ttspar défautgemini-2-5-flash-tts
Afficher les 4 entrées
-
voice -
Nom de voix parmi des dizaines disponibles, ou auto pour laisser l'IA choisir.
autoZephyrPuckCharonKoreFenrirLedaOrusAoedeCallirrhoeAutonoeEnceladusIapetusUmbrielAlgiebaDespinaErinomeAlgenibRasalgethiLaomedeiaAchernarAlnilamSchedarGacruxPulcherrimaAchirdZubenelgenubiVindemiatrixSadachbiaSadaltagerSulafatpar défautauto
Utilisez-le depuis un agent IA
Pointez n'importe quel client MCP vers pipe2 et votre agent obtient ces outils. Il trouve ce pipeline, lit le même schéma ci-dessus, puis l'exécute.
- list_pipelines
- get_pipeline_schema
- run_pipeline
- get_pipeline_run_status
- request_upload
https://mcp.pipe2.ai/mcp {
"mcpServers": {
"pipe2ai": {
"url": "https://mcp.pipe2.ai/mcp",
"headers": { "Authorization": "Bearer YOUR_TOKEN" }
}
}
}Référence complète de l'API Configuration MCP Référence de la CLI
Générateur de synthèse vocale par IA
Transformez n'importe quel texte en voix au son naturel avec des dizaines de voix et plus de 70 langues. Contrôlez le ton, l'accent, le rythme et l'émotion grâce à des instructions en langage clair, une voix off prête à la production en quelques secondes.
Ce que vous pouvez créer
- Narration de documentaire: des voix professionnelles et affirmées
- Intros, outros et dialogues de podcast: interprétation à plusieurs personnages
- Voix off multilingues: couvrez le même script en plus de 70 langues
- Narration de livre audio: un rythme émotionnel avec des directions en milieu de phrase
- Accessibilité: rendez le contenu textuel disponible en audio
Comment ça marche
- Collez votre texte: ce que vous voulez faire dire
- Choisissez une voix ou laissez sur Auto: Auto sélectionne la meilleure voix selon votre texte et vos instructions
- Ajoutez une indication de style (facultatif), décrivez l'accent, le rythme, l'émotion : « accent britannique chaleureux, rythme lent avec des pauses dramatiques »
- Choisissez un modèle: Flash TTS pour des brouillons rapides, Pro TTS pour une prosodie de qualité studio sur le rendu final
Conseils de style
- Rédigez la narration en phrases courtes et claires pour un meilleur rythme
- Utilisez la ponctuation pour contrôler les pauses, les points pour les arrêts complets, les virgules pour de brèves pauses, les points de suspension pour de longues pauses
- Les indications de style s'écrivent en langage clair : « parlez lentement et de façon dramatique », « joyeux et enjoué », « calme et rassurant »
Foire aux questions
Quelles voix sont disponibles ?
Quelles langues sont prises en charge ?
Comment fonctionnent les instructions ?
Quel est le format audio de sortie ?
Quel modèle dois-je choisir ?
Combien de crédits cela coûte-t-il ?
Découvrir plus de pipelines
Voir tout →Générez des vidéos par IA à partir d'une invite textuelle, d'une image ou d'un clip de référence. Plans cinématographiques, présentations de produits, publicités lifestyle, avec un audio synchronisé et un mouvement naturel.
Générez des images par IA à partir de texte ou de photos de référence. Photos de produits, illustrations de personnages, affiches avec texte lisible, portraits photoréalistes, haute résolution en quelques secondes.
Générez une musique de fond originale qui correspond à n'importe quelle ambiance, genre et durée que vous décrivez. Libre de droits, prête en quelques secondes.
Modifiez des vidéos existantes grâce à l'IA. Changez le style, ajoutez des effets, modifiez des scènes ou transformez entièrement l'apparence.