ElevenLabs · Texte

ElevenLabs Scribe v2

Transcription précise avec identification des locuteurs.

Aussi appelé: ElevenLabs Scribe, Scribe v2 (Batch), scribe_v2

Lance-le dans Transcription

Ce que ElevenLabs Scribe v2 sait faire

  • Voix vers texte

Tarifs sur Pipe2

Transcription →
Par exécution 3.6 crédits

Voir les tarifs en crédits →

Pipelines qui utilisent ElevenLabs Scribe v2

Transcription
from 0.8
Transcription

À propos de ElevenLabs Scribe v2

Ce qu'il fait

ElevenLabs Scribe v2 prend de l'audio en entrée et produit du texte en sortie. Vous lui donnez un fichier vidéo ou audio et il renvoie une transcription avec horodatages et étiquettes de locuteur, de sorte que chaque ligne de texte est rattachée à un point de l'enregistrement et à la personne qui parlait. Le pipeline Transcription qu'il alimente couvre plus de 99 langues. Il ne génère ni audio, ni images, ni vidéo. La seule sortie est la transcription et ses métadonnées de temps et de locuteur.

Quand l'utiliser

  • Exécuter le pipeline Transcription sur un entretien ou un podcast enregistré quand vous devez savoir qui a dit quelle réplique, et pas seulement ce qui a été dit.
  • Transformer un fichier vidéo en texte que vous pouvez rechercher, citer ou éditer. Les horodatages permettent de relier n'importe quelle phrase au moment correspondant dans la source.
  • Transcrire des enregistrements non anglophones ou multilingues, puisque le pipeline couvre plus de 99 langues.
  • Produire une transcription horodatée et attribuée aux locuteurs, à transmettre à l'étape suivante de votre propre flux de travail.
  • Tout travail dont le livrable est du texte issu de la parole, plutôt qu'un contenu à revoixer ou à re-rendre.

À savoir avant de lancer

Le coût évolue avec la durée de l'audio. Les unités de gros sont à la minute, avec des paliers de 30 et 60 minutes : un long enregistrement coûte donc proportionnellement plus qu'un court. Rogner jusqu'à la section réellement utile est votre principal levier. Il n'y a pas de réglage de qualité ou de résolution à arbitrer, ni image de référence ni entrée supplémentaire : vous téléversez un fichier média et récupérez une transcription. Les étiquettes de locuteur viennent du modèle lui-même et non d'un réglage que vous configurez, il n'y a donc rien à ajuster de ce côté. Vérifiez les étiquettes par rapport à votre enregistrement si l'attribution des locuteurs compte pour le livrable. Aucun exemple n'est encore publié pour ce modèle.

Aussi appelé

Vous pourrez voir ce modèle désigné comme ElevenLabs Scribe, Scribe v2 (Batch), ou par l'identifiant scribe_v2. Tous renvoient au même modèle sur Pipe2.