Transcription
Transcrivez un fichier vidéo ou audio, avec horodatage, identification facultative des intervenants et prise en charge de 99 langues.
0 – 20
Ajoutez, si nécessaire, des remplacements qui seront appliqués aux fichiers SRT et TXT. Cette option est utile lorsqu'un nom, un acronyme ou un terme spécialisé est systématiquement mal retranscrit. Chaque clé correspond au mot obtenu ; sa valeur indique l'orthographe attendue. La casse est prise en compte et seules les correspondances de mots entiers sont remplacées. Laissez ce champ vide pour conserver la transcription telle quelle.
Fonctionne avec
-
ElevenLabs
API Transcription
Appelez ce pipeline depuis votre propre code. Une requête lance une exécution ; le modèle est un champ d'entrée, pas un endpoint distinct.
Obtenir un jeton d'API- entrées
- 5
- requis
- 1
- Tarifs
- from 0.8 crédits
| Entrée | Type | par défaut | Description |
|---|---|---|---|
source_asset_id | string | par défaut— | Fichier audio ou vidéo à transcrire. Utilisez l’ID de ressource renvoyé lors de l’import. Consultez /docs/api/ pour la procédure d’import. |
corrections | object | par défaut{} | Ajoutez, si nécessaire, des remplacements qui seront appliqués aux fichiers SRT et TXT. Cette option est utile lorsqu'un nom, un acronyme ou un terme spécialisé est systématiquement mal retranscrit. Chaque clé correspond au mot obtenu ; sa valeur indique l'orthographe attendue. La casse est prise en compte et seules les correspondances de mots entiers sont remplacées. Laissez ce champ vide pour conserver la transcription telle quelle. |
diarize | boolean | par défautfalse | Identifie chaque personne qui parle. Activez cette option pour les entretiens et les enregistrements à plusieurs voix. |
language_code | enum | par défautauto | Langue parlée. Laissez ce champ vide pour la détecter automatiquement dans l’audio.auto · en · es +8autoenesptfrdehiarjakozh |
num_speakers | integer | par défaut0 | Nombre de personnes attendues. Laissez ce champ vide pour le détecter automatiquement. |
Pointez n'importe quel client MCP vers pipe2 et votre agent obtient ces outils. Il trouve ce pipeline, lit le même schéma ci-dessus, puis l'exécute.
list_pipelinesget_pipeline_schemarun_pipelineget_pipeline_run_statusrequest_upload
https://mcp.pipe2.ai/mcp {
"mcpServers": {
"pipe2ai": {
"url": "https://mcp.pipe2.ai/mcp",
"headers": { "Authorization": "Bearer YOUR_TOKEN" }
}
}
}Recettes utilisant ce pipeline
Voir toutes les recettes-
Vidéo longue → plusieurs clips sous-titrés en une seule commande
Découpez une vidéo longue en N clips plus courts et sous-titrés. Transcrivez-la une seule fois, laissez l’IA sélectionner les meilleurs passages, puis découpez et sous-titrez chaque clip en parallèle. Vous pouvez aussi passer au format vertical (9:16) pour TikTok, Reels ou Shorts, carré (1:1) pour Instagram ou portrait (4:5) ; la position des sous-titres s’ajuste automatiquement.
-
Question du public → réponse visuelle animée
Transformez votre réponse validée et votre séquence visuelle en une vidéo explicative verticale avec narration, vidéos de stock, schémas temporisés et sous-titres synchronisés.
Foire aux questions
Quels formats de fichiers sont pris en charge ?
Quelle est la précision de la transcription ?
En quoi consiste l'identification des intervenants ?
Quelles langues sont prises en charge ?
Combien de temps faut-il prévoir ?
Transcription vidéo par IA
Importez une vidéo ou un fichier audio pour obtenir une transcription précise, horodatée mot à mot. L'identification des intervenants est facultative. Exportez le résultat au format SRT ou en texte brut, prêt à servir au sous-titrage, au montage ou à la réutilisation du contenu.
Ce que vous pouvez en faire
- Sous-titrer des vidéos : créez un fichier SRT, puis incrustez-le ou ajoutez-le à vos contenus pour les réseaux sociaux
- Décliner un contenu long : utilisez la transcription dans un assistant IA pour produire des résumés, trouver des idées d'extraits et rédiger des publications
- Transcrire des interviews et des podcasts : distinguez automatiquement les différents intervenants
- Améliorer l'accessibilité : rendez les contenus parlés lisibles et consultables
- Préparer une traduction : partez d'un texte propre pour créer des voix off dans d'autres langues
Comment ça marche
- Importez le fichier : vidéo ou audio dans un format courant, comme MP4, MOV, MP3, WAV, M4A ou FLAC
- Indiquez la langue : ou laissez la détection automatique s'en charger
- Activez l'identification des intervenants : chaque segment est attribué à la bonne personne
- Téléchargez le résultat : un SRT horodaté et une transcription en texte brut
Formats de sortie
- SRT : sous-titres horodatés à la milliseconde, directement utilisables dans un logiciel de montage
- Texte brut : transcription claire et lisible pour le montage, le résumé ou la traduction