ElevenLabs Scribe v2
Transcription précise avec identification des locuteurs.
Aussi appelé: ElevenLabs Scribe, Scribe v2 (Batch), scribe_v2
Lance-le dans TranscriptionCe que ElevenLabs Scribe v2 sait faire
- Voix vers texte
Tarifs sur Pipe2
| Par exécution | 3.6 crédits |
Pipelines qui utilisent ElevenLabs Scribe v2
À propos de ElevenLabs Scribe v2
Ce qu'il fait
ElevenLabs Scribe v2 prend de l'audio en entrée et produit du texte en sortie. Vous lui donnez un fichier vidéo ou audio et il renvoie une transcription avec horodatages et étiquettes de locuteur, de sorte que chaque ligne de texte est rattachée à un point de l'enregistrement et à la personne qui parlait. Le pipeline Transcription qu'il alimente couvre plus de 99 langues. Il ne génère ni audio, ni images, ni vidéo. La seule sortie est la transcription et ses métadonnées de temps et de locuteur.
Quand l'utiliser
- Exécuter le pipeline Transcription sur un entretien ou un podcast enregistré quand vous devez savoir qui a dit quelle réplique, et pas seulement ce qui a été dit.
- Transformer un fichier vidéo en texte que vous pouvez rechercher, citer ou éditer. Les horodatages permettent de relier n'importe quelle phrase au moment correspondant dans la source.
- Transcrire des enregistrements non anglophones ou multilingues, puisque le pipeline couvre plus de 99 langues.
- Produire une transcription horodatée et attribuée aux locuteurs, à transmettre à l'étape suivante de votre propre flux de travail.
- Tout travail dont le livrable est du texte issu de la parole, plutôt qu'un contenu à revoixer ou à re-rendre.
À savoir avant de lancer
Le coût évolue avec la durée de l'audio. Les unités de gros sont à la minute, avec des paliers de 30 et 60 minutes : un long enregistrement coûte donc proportionnellement plus qu'un court. Rogner jusqu'à la section réellement utile est votre principal levier. Il n'y a pas de réglage de qualité ou de résolution à arbitrer, ni image de référence ni entrée supplémentaire : vous téléversez un fichier média et récupérez une transcription. Les étiquettes de locuteur viennent du modèle lui-même et non d'un réglage que vous configurez, il n'y a donc rien à ajuster de ce côté. Vérifiez les étiquettes par rapport à votre enregistrement si l'attribution des locuteurs compte pour le livrable. Aucun exemple n'est encore publié pour ce modèle.
Aussi appelé
Vous pourrez voir ce modèle désigné comme ElevenLabs Scribe, Scribe v2 (Batch), ou par l'identifiant scribe_v2. Tous renvoient au même modèle sur Pipe2.