Transcrição
Transcreva qualquer arquivo de vídeo ou áudio, com marcações de tempo, identificação opcional de falantes e suporte a 99 idiomas.
0 – 20
Substituições opcionais aplicadas aos arquivos SRT e TXT, úteis quando um nome, sigla ou termo técnico é transcrito sempre da mesma forma incorreta. Cada chave é a palavra como transcrita; o valor é a grafia correta. Diferencia maiúsculas de minúsculas; as substituições só são feitas em palavras inteiras. Deixe vazio para entregar a transcrição exatamente como o reconhecedor a escreveu.
Funciona com
-
ElevenLabs
API do Transcrição
Chame este pipeline a partir do seu próprio código. Um pedido lança uma execução; o modelo é um campo de entrada, não um endpoint separado.
Obter um token de API- entradas
- 5
- obrigatório
- 1
- Preços
- from 0.8 créditos
| Entrada | Tipo | predefinição | Descrição |
|---|---|---|---|
source_asset_id | string | predefinição— | Áudio ou vídeo a transcrever. Use o ID do arquivo retornado pelo upload. Consulte /docs/api/ para ver o processo de envio. |
corrections | object | predefinição{} | Substituições opcionais aplicadas aos arquivos SRT e TXT, úteis quando um nome, sigla ou termo técnico é transcrito sempre da mesma forma incorreta. Cada chave é a palavra como transcrita; o valor é a grafia correta. Diferencia maiúsculas de minúsculas; as substituições só são feitas em palavras inteiras. Deixe vazio para entregar a transcrição exatamente como o reconhecedor a escreveu. |
diarize | boolean | predefiniçãofalse | Identifica quem está falando. Ative em entrevistas e gravações com mais de uma pessoa. |
language_code | enum | predefiniçãoauto | Idioma falado. Deixe em branco para detectar automaticamente pelo áudio.auto · en · es +8autoenesptfrdehiarjakozh |
num_speakers | integer | predefinição0 | Número esperado de pessoas falando. Deixe em branco para detectar automaticamente. |
Aponte qualquer cliente MCP para o pipe2 e o seu agente ganha estas ferramentas. Ele encontra este pipeline, lê o mesmo esquema acima e executa-o.
list_pipelinesget_pipeline_schemarun_pipelineget_pipeline_run_statusrequest_upload
https://mcp.pipe2.ai/mcp {
"mcpServers": {
"pipe2ai": {
"url": "https://mcp.pipe2.ai/mcp",
"headers": { "Authorization": "Bearer YOUR_TOKEN" }
}
}
}Receitas que usam este pipeline
Ver todas as receitas-
Vídeo longo → vários clipes com legendas, em um único comando
Transforme qualquer vídeo longo em N clipes menores com legendas. Transcreva uma vez, deixe a IA escolher os melhores momentos e corte e legende cada clipe em paralelo. Se quiser, adapte o resultado para o formato vertical (9:16) do TikTok, Reels e Shorts, o quadrado (1:1) do Instagram ou o retrato (4:5); a posição das legendas se ajusta automaticamente.
-
Pergunta do público → resposta visual animada
Transforme sua resposta aprovada e sua sequência visual em um vídeo explicativo vertical com narração, vídeos de banco, diagramas temporizados e legendas sincronizadas.
Perguntas frequentes
Quais formatos de arquivo são suportados?
Quão precisa é a transcrição?
O que é a detecção de quem fala?
Quais idiomas são suportados?
Quanto tempo leva?
Transcrição de vídeo com IA
Envie um vídeo ou arquivo de áudio e receba uma transcrição precisa, com marcações de tempo por palavra. A identificação de falantes é opcional. Exporte em SRT ou texto simples, pronto para legendagem, edição ou reaproveitamento.
O que você pode fazer com isso
- Legendar vídeos: gere o SRT e depois incorpore-o aos seus conteúdos para redes sociais
- Reaproveitar conteúdo longo: use a transcrição em um assistente de IA para criar resumos, ideias de clipes e textos para redes sociais
- Transcrever entrevistas e podcasts: diferencie automaticamente os vários participantes
- Acessibilidade: torne o conteúdo falado legível e pesquisável
- Preparação para tradução: transcrição limpa como fonte para narrações traduzidas
Como funciona
- Envie: vídeo ou áudio, em qualquer formato comum (MP4, MOV, MP3, WAV, M4A, FLAC)
- Escolha um idioma: ou deixe na detecção automática
- Ative a identificação de falantes: cada segmento é atribuído à pessoa que o pronunciou
- Baixe: SRT com marcações de tempo + transcrição em texto simples
Formatos de saída
- SRT: arquivo de legendas com marcações de tempo precisas em milissegundos, que entra direto nos editores de vídeo
- Texto simples: transcrição limpa e legível para edição, resumo ou tradução