ElevenLabs · Testo

ElevenLabs Scribe v2

Trascrizione accurata con etichette dei parlanti.

Conosciuto anche come: ElevenLabs Scribe, Scribe v2 (Batch), scribe_v2

Usalo in Trascrizione

Cosa sa fare ElevenLabs Scribe v2

  • Da voce a testo

Prezzi su Pipe2

Trascrizione →
Per esecuzione 3.6 crediti

Vedi i prezzi in crediti →

Pipeline che usano ElevenLabs Scribe v2

Trascrizione
from 0.8
Trascrizione

Informazioni su ElevenLabs Scribe v2

Cosa fa

ElevenLabs Scribe v2 prende audio in ingresso e produce testo in uscita. Gli fornisci un file video o audio e restituisce una trascrizione con marche temporali ed etichette dei parlanti, così ogni riga di testo è legata a un punto della registrazione e a chi stava parlando. La pipeline Trascrizione che alimenta copre oltre 99 lingue. Non genera audio, immagini o video. L'unico output è la trascrizione con i relativi metadati di tempo e parlante.

Quando usarlo

  • Eseguire la pipeline Trascrizione su un'intervista o un podcast registrato quando devi sapere chi ha detto quale battuta, non solo cosa è stato detto.
  • Trasformare un file video in testo che puoi cercare, citare o modificare. Le marche temporali permettono di riportare qualsiasi frase al momento nella sorgente.
  • Trascrivere registrazioni non in inglese o con più lingue mescolate, dato che la pipeline copre oltre 99 lingue.
  • Produrre una trascrizione con tempi ed etichette dei parlanti da passare al passo successivo del tuo flusso di lavoro.
  • Qualsiasi lavoro il cui risultato sia testo derivato dal parlato, invece di qualcosa da ridoppiare o rigenerare.

Cosa sapere prima di eseguirlo

Il costo scala con la durata dell'audio. Le unità wholesale sono al minuto, con fasce da 30 e 60 minuti, quindi una registrazione lunga costa proporzionalmente più di una breve. Tagliare fino alla sezione che ti serve davvero è la leva principale a disposizione. Non c'è un'impostazione di qualità o risoluzione da bilanciare, né immagine di riferimento o input aggiuntivo: carichi un file multimediale e ricevi una trascrizione. Le etichette dei parlanti provengono dal modello stesso e non da un'impostazione che configuri, quindi lì non c'è nulla da regolare. Verifica le etichette rispetto alla registrazione se l'attribuzione dei parlanti conta per il risultato. Per questo modello non ci sono ancora esempi pubblicati.

Conosciuto anche come

Puoi trovare questo modello indicato come ElevenLabs Scribe, Scribe v2 (Batch), o con l'identificativo scribe_v2. Tutti si riferiscono allo stesso modello su Pipe2.