Reenquadramento de Vídeo
Converta automaticamente vídeos horizontais para 9:16, 1:1 ou 4:5, mantendo o assunto ou quem está falando bem enquadrado. Ideal para TikTok, Reels e Shorts.
Como usar Reenquadramento de Vídeo
Um guia de decisão conciso para posicionar este pipeline em um fluxo de trabalho.
Ideal para
- Converter podcasts, entrevistas e documentários em 16:9 para vídeos 9:16 destinados a TikTok, Reels e Shorts
- Manter um assunto específico em destaque quando há vários pontos de interesse
- Criar versões quadradas em 1:1 para o Instagram a partir de vídeos horizontais
- Completar o fluxo de vídeos longos para shorts junto com video-trim e captions
Quando usar
- Depois de video-trim: o primeiro define o momento, e o reenquadramento define a composição
- Antes de captions, para que o texto das legendas seja ajustado à tela 9:16
- De forma independente, quando um vídeo horizontal já editado precisa de versões verticais
Dicas
- Em entrevistas e painéis, envie uma transcrição SRT com identificação de falantes para acompanhar melhor quem está falando
- Compartilhamentos de tela, planos abertos e cenas sem foco único usam letterbox para preservar todo o quadro
- O recorte permanece fixo dentro de cada cena e muda apenas entre tomadas
API do Reenquadramento de Vídeo
Chame este pipeline a partir do seu próprio código. Um pedido lança uma execução; o modelo é um campo de entrada, não um endpoint separado.
Obter um token de API- entradas
- 3
- obrigatório
- 2
- Preços
- 2 to 5 créditos
| Entrada | Tipo | predefinição | Descrição |
|---|---|---|---|
target_aspect_ratio | enum | predefinição9:16 | Proporção final do reenquadramento: vertical para vídeos curtos, quadrada para feeds.9:16 · 1:1 · 4:5 +19:161:14:516:9 |
video_url | string | predefinição— | URL pública do vídeo a reenquadrar. |
transcript_url | string | predefinição— | URL pública de uma transcrição, usada para manter a pessoa que está falando no enquadramento. |
Aponte qualquer cliente MCP para o pipe2 e o seu agente ganha estas ferramentas. Ele encontra este pipeline, lê o mesmo esquema acima e executa-o.
list_pipelinesget_pipeline_schemarun_pipelineget_pipeline_run_statusrequest_upload
https://mcp.pipe2.ai/mcp {
"mcpServers": {
"pipe2ai": {
"url": "https://mcp.pipe2.ai/mcp",
"headers": { "Authorization": "Bearer YOUR_TOKEN" }
}
}
}Receitas que usam este pipeline
Ver todas as receitasArtigos sobre este pipeline
Ver todos os artigosPerguntas frequentes
Quais proporções de tela são aceitas?
O que acontece se o vídeo já estiver no formato desejado?
Como o sistema escolhe quem acompanhar?
O enquadramento faz panorâmicas ou zooms?
Quanto custa?
Posso combinar com video-trim?
Reenquadramento de Vídeo: do Horizontal ao Vertical
A maior parte dos vídeos para TikTok, Reels e Shorts usa 9:16, mas muitas gravações são feitas em 16:9. O Reenquadramento de Vídeo adapta cada cena ao formato desejado, mantém o assunto principal em destaque e preserva o áudio. Quando não há um foco claro, o quadro inteiro é mantido com letterbox para evitar cortes inadequados.
Como funciona
- Identifica cada cena: o vídeo é dividido pelas mudanças de tomada para que o enquadramento permaneça estável dentro de cada trecho.
- Encontra as pessoas em destaque: os rostos são acompanhados entre os quadros de cada cena.
- Escolhe quem deve ficar em foco: uma transcrição com identificação de falantes indica quem está falando; sem ela, a escolha é feita a partir do que aparece na imagem. Cenas ambíguas mantêm o quadro inteiro.
- Define um enquadramento estável: cada cena recebe um recorte fixo, sem panorâmicas ou zooms que desviem a atenção.
- Entrega o vídeo: os enquadramentos são aplicados cena a cena, com o áudio original preservado.
Use uma transcrição em vídeos com vários participantes
Em entrevistas e painéis, envie uma transcrição SRT com identificação de falantes e o mesmo intervalo de tempo do vídeo. As mudanças de fala orientam o enquadramento, para que uma cena com duas pessoas acompanhe quem está falando, e não apenas o maior rosto na tela. Sem transcrição, o reenquadramento continua disponível com base nos rostos visíveis em cada cena.