Reencuadre de vídeo
Adapta automáticamente vídeos horizontales al formato vertical. La IA mantiene al hablante activo dentro del plano y cambia el encuadre con cortes limpios para obtener un resultado listo para TikTok.
Cómo usar Reencuadre de vídeo
Una guía de decisión concisa para ubicar este pipeline en un flujo de trabajo.
Ideal para
- Convertir material 16:9 de pódcasts, entrevistas o documentales al formato 9:16 de TikTok, Reels y Shorts
- Seguir a un sujeto concreto, como un presentador, un producto o una pantalla, cuando hay varios focos de atención
- Crear publicaciones cuadradas 1:1 para Instagram a partir de originales horizontales con seguimiento del hablante activo
- Completar el proceso de vídeo largo a corto junto con video-trim y captions
Cuándo usarlo
- Después de video-trim: primero eliges el momento y después adaptas el encuadre
- Antes de captions, para que el texto se ajuste al lienzo 9:16 definitivo
- De forma independiente cuando ya tienes clips horizontales editados y necesitas versiones verticales
Consejos
- En entrevistas y mesas redondas, aporta una transcripción con etiquetas de hablante para encuadrar con mayor fiabilidad a quien está hablando
- Las tomas sin un único protagonista claro, como pantallas compartidas o planos generales, se muestran completas con barras; es la opción más segura, no un error
- No hay ajustes de paneo, zoom o suavizado: cada plano mantiene un encuadre fijo y cambia limpiamente en los cortes
API de Reencuadre de vídeo
Llama a este pipeline desde tu propio código. Una petición lanza una ejecución; el modelo es un campo de entrada, no un endpoint aparte.
Obtener un token de API- entradas
- 3
- obligatorio
- 2
- Precios
- 2 to 5 créditos
| Entrada | Tipo | por defecto | Descripción |
|---|---|---|---|
target_aspect_ratio | enum | por defecto9:16 | Relación de aspecto de destino: vertical para vídeos cortos o cuadrada para el feed.9:16 · 1:1 · 4:5 +19:161:14:516:9 |
video_url | string | por defecto— | URL pública del vídeo cuya relación de aspecto quieres adaptar. |
transcript_url | string | por defecto— | URL pública de una transcripción. Se utiliza para mantener a la persona que habla dentro del encuadre. |
Apunta cualquier cliente MCP a pipe2 y tu agente obtiene estas herramientas. Encuentra este pipeline, lee el mismo esquema de arriba y lo ejecuta.
list_pipelinesget_pipeline_schemarun_pipelineget_pipeline_run_statusrequest_upload
https://mcp.pipe2.ai/mcp {
"mcpServers": {
"pipe2ai": {
"url": "https://mcp.pipe2.ai/mcp",
"headers": { "Authorization": "Bearer YOUR_TOKEN" }
}
}
}Recetas que usan este pipeline
Ver todas las recetasArtículos sobre este pipeline
Ver todos los artículosPreguntas frecuentes
¿Qué relaciones de aspecto son compatibles?
¿Qué ocurre si el vídeo ya es vertical?
¿Cómo elige a quién seguir?
¿Hace paneos o zoom?
¿Cuánto cuesta?
¿Puedo combinarlo con video-trim?
Reencuadre de vídeo: de horizontal a vertical con seguimiento del hablante
La mayoría de los vídeos virales se publican en 9:16 para TikTok, Reels o Shorts, aunque el material original suele grabarse en 16:9. Reencuadre de vídeo identifica al hablante activo en cada plano y crea un recorte vertical limpio que se mantiene fijo hasta el siguiente corte. Sin edición manual ni ajustes de cámara.
Cómo funciona
- Detecta los cambios de plano: divide el vídeo en tomas independientes para mantener un encuadre estable dentro de cada una.
- Identifica a las personas: localiza y agrupa los rostros de cada plano para reconocer de forma coherente a cada participante.
- Decide a quién seguir: si aportas una transcripción con etiquetas de hablante, utiliza los turnos de voz; si no, se guía por los rostros visibles. Cuando no hay un único protagonista claro, conserva el plano completo con barras en lugar de adivinar.
- Fija el encuadre: cada plano recibe un recorte estático y los cambios solo se producen en los cortes del original. Los planos muy breves se unen con los contiguos. No hay paneos, deriva ni movimientos artificiales.
- Genera el vídeo: aplica el recorte elegido en cada plano, o mantiene la imagen completa con barras, y conserva el audio.
Aporta una transcripción para el seguimiento de varios hablantes
En entrevistas y mesas redondas, aporta una transcripción SRT con etiquetas de hablante que cubra el mismo intervalo que el vídeo. Sus turnos determinan quién ocupa el encuadre, de modo que un plano con dos personas sigue a quien realmente está hablando y no solo al rostro más grande. Sin transcripción, el reencuadre sigue funcionando a partir de los rostros visibles.