ElevenLabs · Texto

ElevenLabs Scribe v2

Transcrição de fala precisa com identificação de falantes.

Também conhecido como: ElevenLabs Scribe, Scribe v2 (Batch), scribe_v2

Rode no Transcrição

O que o ElevenLabs Scribe v2 faz

  • Voz para texto

Preços no Pipe2

Transcrição →
Por execução 3.6 créditos

Ver preços em créditos →

Pipelines que usam ElevenLabs Scribe v2

Transcrição
from 0.8
Transcrição

Sobre o ElevenLabs Scribe v2

O que faz

O ElevenLabs Scribe v2 recebe áudio e produz texto. Você fornece um arquivo de vídeo ou áudio e ele devolve uma transcrição com marcações de tempo e rótulos de locutor, de modo que cada linha de texto fica ligada a um ponto da gravação e a quem estava falando. O pipeline Transcrição que ele alimenta cobre mais de 99 idiomas. Ele não gera áudio, imagens nem vídeo. A única saída é a transcrição e seus metadados associados de tempo e locutor.

Quando usar

  • Executar o pipeline Transcrição sobre uma entrevista ou podcast gravado em que você precisa saber quem disse cada fala, não apenas o que foi dito.
  • Transformar um arquivo de vídeo em texto que você possa pesquisar, citar ou editar. As marcações de tempo permitem mapear qualquer frase de volta ao momento na origem.
  • Transcrever gravações que não estão em inglês ou que misturam idiomas, já que o pipeline cobre mais de 99 idiomas.
  • Produzir uma transcrição cronometrada e com locutores identificados que você possa repassar ao próximo passo do seu fluxo de trabalho.
  • Qualquer trabalho cujo entregável seja texto derivado da fala, em vez de algo que precise ser redublado ou renderizado de novo.

O que saber antes de executar

O custo escala com a duração do áudio. As unidades de atacado são por minuto, com faixas de 30 e 60 minutos, então uma gravação longa custa proporcionalmente mais que uma curta. Cortar até o trecho de que você realmente precisa é a principal alavanca disponível. Não há ajuste de qualidade ou resolução a ponderar, nem imagem de referência ou entrada extra: você envia um arquivo de mídia e recebe uma transcrição. Os rótulos de locutor vêm do próprio modelo e não de um ajuste que você configure, então não há nada a calibrar ali. Confira os rótulos contra sua gravação se a atribuição de locutores importar para o entregável. Ainda não há exemplos publicados para este modelo.

Também conhecido como

Você pode ver este modelo referido como ElevenLabs Scribe, Scribe v2 (Batch) ou pelo identificador scribe_v2. Todos se referem ao mesmo modelo no Pipe2.