자막
전사본이나 SRT로 어떤 영상에든 스타일이 입혀진 자막을 삽입합니다. 프리셋을 골라 바로 게시할 수 있는 MP4를 완성하세요.
입력이 필요합니다: 비디오 파일, 전사본 (SRT)
이 파이프라인을 사용하는 레시피
이 파이프라인 관련 기사
자막 API
직접 작성한 코드에서 이 파이프라인을 호출하세요. 요청 한 번으로 실행이 시작되며, 모델은 별도의 엔드포인트가 아니라 입력 필드입니다.
bun add @pipe2-ai/sdk import { createClient } from "@pipe2-ai/sdk";
const client = createClient(process.env.PIPE2_TOKEN!);
const { run_pipeline } = await client.RunPipeline({
pipeline_slug: "captions",
input: {
source_asset_id: "a1b2c3d4-0000-4000-8000-000000000001",
transcript_asset_id: "a1b2c3d4-0000-4000-8000-000000000002",
},
});pip install pipe2 import asyncio
import os
from pipe2 import Pipe2Client
client = Pipe2Client(token=os.environ["PIPE2_TOKEN"])
run = asyncio.run(client.run_pipeline(
pipeline_slug="captions",
input={
"source_asset_id": "a1b2c3d4-0000-4000-8000-000000000001",
"transcript_asset_id": "a1b2c3d4-0000-4000-8000-000000000002",
},
))go get github.com/pipe2-ai/sdk-go client := pipe2.NewClient(os.Getenv("PIPE2_TOKEN"))
input := json.RawMessage(`{
"source_asset_id": "a1b2c3d4-0000-4000-8000-000000000001",
"transcript_asset_id": "a1b2c3d4-0000-4000-8000-000000000002"
}`)
run, err := pipe2.RunPipeline(context.Background(), client, "captions", input)
if err != nil {
log.Fatal(err)
}brew install pipe2-ai/tap/pipe2 pipe2 pipelines run \
--pipeline captions \
--input-json '{"source_asset_id": "a1b2c3d4-0000-4000-8000-000000000001", "transcript_asset_id": "a1b2c3d4-0000-4000-8000-000000000002"}' \
--wait매개변수
-
source_asset_id필수 -
Video to burn captions into. Asset id returned by an upload. See /docs/api/ for the upload flow.
string -
transcript_asset_id필수 -
Transcript to caption from, produced by the transcription pipeline. Asset id returned by an upload. See /docs/api/ for the upload flow.
string -
position -
삽입되는 텍스트의 수직 기준 위치입니다. "Auto"는 상위 리프레임 단계가 힌트를 제공하면 피사체 반대쪽 절반을 선택하고(그렇지 않으면 "bottom"으로 처리) 자동 배치합니다. "Bottom"은 표준 TikTok 배치이며, 피사체가 프레임 하단 절반을 채우는 경우 "top"을 선택하세요.
autobottomtopmiddle기본값auto
입력 4개 모두 보기
-
preset_name -
Caption style preset — controls font, size, colour and placement of the burned-in captions.
tiktok-bold-yellowminimal-whitesubtle-dropkaraoke-gradientbig-serifserif-editorial기본값serif-editorial
AI 에이전트에서 사용하기
MCP 클라이언트를 pipe2에 연결하면 에이전트가 이 도구들을 사용할 수 있습니다. 이 파이프라인을 찾아 위와 동일한 스키마를 읽고 실행합니다.
- list_pipelines
- get_pipeline_schema
- run_pipeline
- get_pipeline_run_status
- request_upload
https://mcp.pipe2.ai/mcp {
"mcpServers": {
"pipe2ai": {
"url": "https://mcp.pipe2.ai/mcp",
"headers": { "Authorization": "Bearer YOUR_TOKEN" }
}
}
}자막: 어떤 영상에든 스타일이 입혀진 자막 삽입
영상과 SRT 전사본을 첨부하고 스타일을 고르면, 자막이 픽셀에 직접 새겨진 MP4를 받습니다. CapCut도, Premiere도, 설치할 자막 확장 프로그램도 필요 없습니다, TikTok, Reels, Shorts에 맞는 크기로 게시 준비가 끝난 파일입니다.
전사본이 먼저 필요하신가요? 어떤 영상이나 오디오에든 Transcription 파이프라인을 실행하세요, 결과 SRT가 라이브러리에 저장되어 이 단계에 바로 연결됩니다. 삽입하기 전에 수정할 부분이 있으면 그곳에서 편집하세요.
작동 방식
- 영상 첨부: 기기에서 업로드하거나 라이브러리에서 선택하세요.
- SRT 전사본 첨부: Transcription 파이프라인으로 생성하거나, 어떤 출처의 기존 .srt든 업로드하세요.
- 자막 스타일 선택: 다양한 시청자층에 맞춰 조정된 5가지 프로덕션급 프리셋.
- 결과 다운로드: 자막이 삽입된 새 MP4와 썸네일용 포스터 프레임.
자막 스타일 프리셋
- TikTok Bold Yellow: 굵은 두께, 검은 외곽선, TikTok에 안전한 배치. 모두가 따라 하는 기본값.
- Minimal White: 부드러운 그림자가 곁들여진 깔끔한 산세리프. 토킹헤드 팟캐스트와 인터뷰에 잘 어울립니다.
- Subtle Drop Shadow: 영상미가 장면을 이끄는 시네마틱 편집을 위한 저대비 자막.
- Karaoke Gradient: 말하는 순간의 단어가 보라색→분홍색 그라데이션으로 강조됩니다. 숏폼에서 높은 시청 유지율.
- Big Serif: 브랜드 문서, 사례 연구, 롱폼 교육 클립을 위한 편집 감각의 세리프.
두 단계 흐름을 두는 이유
- 삽입 전에 전사본 편집: STT가 내놓은 결과를 그대로 감수하는 대신, SRT에서 이름, 전문 용어, 화자 라벨을 바로잡으세요.
- 하나의 전사본을 여러 스타일에 재사용: 다시 전사하지 않고 동일한 SRT를 5가지 다른 프리셋으로 삽입해 A/B 테스트를 하세요.
- 직접 만든 SRT 사용: 다른 도구로 만든 전사본이 이미 있다면, 그것을 첨부해 전사 비용을 완전히 건너뛰세요.
- TikTok에 안전한 배치: 자막이 모든 주요 플랫폼의 하단 3분의 1 UI 오버레이를 피해 배치됩니다.
이런 분에게 좋습니다
- 매일 Reels / Shorts / TikTok을 내보내는 숏폼 크리에이터
- 롱폼 에피소드를 공유용 클립으로 재가공하는 팟캐스터
- 튜토리얼에 접근성을 더하는 강좌 제작자와 교육자
- 브랜드 소셜 콘텐츠를 대규모로 제작하는 에이전시
- 이미 SRT가 있고 그저 영상에 깔끔하게 렌더링하고 싶은 모든 분
완전한 게시 준비 흐름을 원하면 Transcription 파이프라인 뒤에 이어 붙이거나, 여러 클립을 편집하는 Video Reel 파이프라인에 출력을 바로 넣으세요.
자주 묻는 질문
어떤 파일 형식을 지원하나요?
SRT 전사본은 어디서 얻나요?
자막이 픽셀에 새겨지나요, 아니면 위에 덧입혀지나요?
삽입하기 전에 전사본을 편집할 수 있나요?
하나의 전사본을 여러 자막 스타일에 재사용할 수 있나요?
자막 삽입은 얼마나 걸리나요?
더 많은 파이프라인 살펴보기
전체 보기 →텍스트 프롬프트, 이미지, 또는 참조 클립으로 AI 영상을 생성합니다. 시네마틱 샷, 제품 공개, 라이프스타일 광고, 동기화된 오디오와 자연스러운 모션과 함께.
텍스트나 참조 사진에서 AI 이미지를 생성하세요. 제품 사진, 캐릭터 아트, 읽기 쉬운 텍스트가 담긴 포스터, 사실적인 인물 사진, 몇 초 만에 고해상도로.
수십 가지 음성, 70개 이상의 언어, 그리고 톤·억양·속도를 위한 맞춤 스타일 지시로 텍스트를 자연스러운 음성으로 바꿉니다.
원하는 분위기, 장르, 길이에 맞는 오리지널 배경 음악을 생성하세요. 로열티 프리, 몇 초 만에 준비됩니다.