파이프라인으로 돌아가기

자막

전사본이나 SRT로 어떤 영상에든 스타일이 입혀진 자막을 삽입합니다. 프리셋을 골라 바로 게시할 수 있는 MP4를 완성하세요.

0.2

입력이 필요합니다: 비디오 파일, 전사본 (SRT)

이 파이프라인을 사용하는 레시피

이 파이프라인 관련 기사

자막 API

직접 작성한 코드에서 이 파이프라인을 호출하세요. 요청 한 번으로 실행이 시작되며, 모델은 별도의 엔드포인트가 아니라 입력 필드입니다.

4 개 입력
2 필수
from 0.2 크레딧
bun add @pipe2-ai/sdk
import { createClient } from "@pipe2-ai/sdk";

const client = createClient(process.env.PIPE2_TOKEN!);

const { run_pipeline } = await client.RunPipeline({
  pipeline_slug: "captions",
  input: {
    source_asset_id: "a1b2c3d4-0000-4000-8000-000000000001",
    transcript_asset_id: "a1b2c3d4-0000-4000-8000-000000000002",
  },
});
pip install pipe2
import asyncio
import os

from pipe2 import Pipe2Client

client = Pipe2Client(token=os.environ["PIPE2_TOKEN"])

run = asyncio.run(client.run_pipeline(
    pipeline_slug="captions",
    input={
        "source_asset_id": "a1b2c3d4-0000-4000-8000-000000000001",
        "transcript_asset_id": "a1b2c3d4-0000-4000-8000-000000000002",
    },
))
go get github.com/pipe2-ai/sdk-go
client := pipe2.NewClient(os.Getenv("PIPE2_TOKEN"))

input := json.RawMessage(`{
  "source_asset_id": "a1b2c3d4-0000-4000-8000-000000000001",
  "transcript_asset_id": "a1b2c3d4-0000-4000-8000-000000000002"
}`)

run, err := pipe2.RunPipeline(context.Background(), client, "captions", input)
if err != nil {
    log.Fatal(err)
}
brew install pipe2-ai/tap/pipe2
pipe2 pipelines run \
  --pipeline captions \
  --input-json '{"source_asset_id": "a1b2c3d4-0000-4000-8000-000000000001", "transcript_asset_id": "a1b2c3d4-0000-4000-8000-000000000002"}' \
  --wait

API 토큰 발급 →

매개변수

source_asset_id 필수

Video to burn captions into. Asset id returned by an upload. See /docs/api/ for the upload flow.

string
transcript_asset_id 필수

Transcript to caption from, produced by the transcription pipeline. Asset id returned by an upload. See /docs/api/ for the upload flow.

string
position

삽입되는 텍스트의 수직 기준 위치입니다. "Auto"는 상위 리프레임 단계가 힌트를 제공하면 피사체 반대쪽 절반을 선택하고(그렇지 않으면 "bottom"으로 처리) 자동 배치합니다. "Bottom"은 표준 TikTok 배치이며, 피사체가 프레임 하단 절반을 채우는 경우 "top"을 선택하세요.

autobottomtopmiddle 기본값 auto
입력 4개 모두 보기
preset_name

Caption style preset — controls font, size, colour and placement of the burned-in captions.

tiktok-bold-yellowminimal-whitesubtle-dropkaraoke-gradientbig-serifserif-editorial 기본값 serif-editorial

AI 에이전트에서 사용하기

MCP 클라이언트를 pipe2에 연결하면 에이전트가 이 도구들을 사용할 수 있습니다. 이 파이프라인을 찾아 위와 동일한 스키마를 읽고 실행합니다.

  • list_pipelines
  • get_pipeline_schema
  • run_pipeline
  • get_pipeline_run_status
  • request_upload
https://mcp.pipe2.ai/mcp
{
  "mcpServers": {
    "pipe2ai": {
      "url": "https://mcp.pipe2.ai/mcp",
      "headers": { "Authorization": "Bearer YOUR_TOKEN" }
    }
  }
}

전체 API 레퍼런스 MCP 설정 CLI 레퍼런스

자막: 어떤 영상에든 스타일이 입혀진 자막 삽입

영상과 SRT 전사본을 첨부하고 스타일을 고르면, 자막이 픽셀에 직접 새겨진 MP4를 받습니다. CapCut도, Premiere도, 설치할 자막 확장 프로그램도 필요 없습니다, TikTok, Reels, Shorts에 맞는 크기로 게시 준비가 끝난 파일입니다.

전사본이 먼저 필요하신가요? 어떤 영상이나 오디오에든 Transcription 파이프라인을 실행하세요, 결과 SRT가 라이브러리에 저장되어 이 단계에 바로 연결됩니다. 삽입하기 전에 수정할 부분이 있으면 그곳에서 편집하세요.

작동 방식

  1. 영상 첨부: 기기에서 업로드하거나 라이브러리에서 선택하세요.
  2. SRT 전사본 첨부: Transcription 파이프라인으로 생성하거나, 어떤 출처의 기존 .srt든 업로드하세요.
  3. 자막 스타일 선택: 다양한 시청자층에 맞춰 조정된 5가지 프로덕션급 프리셋.
  4. 결과 다운로드: 자막이 삽입된 새 MP4와 썸네일용 포스터 프레임.

자막 스타일 프리셋

  • TikTok Bold Yellow: 굵은 두께, 검은 외곽선, TikTok에 안전한 배치. 모두가 따라 하는 기본값.
  • Minimal White: 부드러운 그림자가 곁들여진 깔끔한 산세리프. 토킹헤드 팟캐스트와 인터뷰에 잘 어울립니다.
  • Subtle Drop Shadow: 영상미가 장면을 이끄는 시네마틱 편집을 위한 저대비 자막.
  • Karaoke Gradient: 말하는 순간의 단어가 보라색→분홍색 그라데이션으로 강조됩니다. 숏폼에서 높은 시청 유지율.
  • Big Serif: 브랜드 문서, 사례 연구, 롱폼 교육 클립을 위한 편집 감각의 세리프.

두 단계 흐름을 두는 이유

  • 삽입 전에 전사본 편집: STT가 내놓은 결과를 그대로 감수하는 대신, SRT에서 이름, 전문 용어, 화자 라벨을 바로잡으세요.
  • 하나의 전사본을 여러 스타일에 재사용: 다시 전사하지 않고 동일한 SRT를 5가지 다른 프리셋으로 삽입해 A/B 테스트를 하세요.
  • 직접 만든 SRT 사용: 다른 도구로 만든 전사본이 이미 있다면, 그것을 첨부해 전사 비용을 완전히 건너뛰세요.
  • TikTok에 안전한 배치: 자막이 모든 주요 플랫폼의 하단 3분의 1 UI 오버레이를 피해 배치됩니다.

이런 분에게 좋습니다

  • 매일 Reels / Shorts / TikTok을 내보내는 숏폼 크리에이터
  • 롱폼 에피소드를 공유용 클립으로 재가공하는 팟캐스터
  • 튜토리얼에 접근성을 더하는 강좌 제작자와 교육자
  • 브랜드 소셜 콘텐츠를 대규모로 제작하는 에이전시
  • 이미 SRT가 있고 그저 영상에 깔끔하게 렌더링하고 싶은 모든 분

완전한 게시 준비 흐름을 원하면 Transcription 파이프라인 뒤에 이어 붙이거나, 여러 클립을 편집하는 Video Reel 파이프라인에 출력을 바로 넣으세요.

자주 묻는 질문

어떤 파일 형식을 지원하나요?
영상: MP4, MOV, WebM, AVI, MKV 등. 전사본: .srt(타임스탬프가 있는 표준 자막 형식). 출력은 보편적인 플랫폼 호환성을 위해 항상 MP4입니다.
SRT 전사본은 어디서 얻나요?
어떤 영상이나 오디오에든 Transcription 파이프라인을 실행하세요, 라이브러리에 여기서 첨부할 수 있는 SRT 자산이 생성됩니다. 또는 다른 전사 도구로 만든 기존 .srt를 업로드하세요.
자막이 픽셀에 새겨지나요, 아니면 위에 덧입혀지나요?
픽셀에 새겨집니다. 자막은 어디에 업로드하든 영상과 함께 이동합니다, 이후 따로 관리할 .srt가 없고, 플랫폼이 자막을 제거하거나 스타일을 바꿀 위험도 없습니다.
삽입하기 전에 전사본을 편집할 수 있나요?
네, 이것이 두 단계 흐름을 두는 주된 이유입니다. Transcription을 실행하고, 라이브러리에서 SRT를 열어 필요한 부분을 바로잡은 뒤 여기에 첨부하세요. 편집한 .srt를 직접 업로드할 수도 있습니다.
하나의 전사본을 여러 자막 스타일에 재사용할 수 있나요?
네. 매번 동일한 SRT를 첨부하고 다른 프리셋을 고르세요, 전사를 다시 실행하는 것보다 훨씬 저렴하며, 숏폼에서 자막을 A/B 테스트하는 데 유용합니다.
자막 삽입은 얼마나 걸리나요?
일반적으로 원본 길이의 30~60%입니다. 1분 클립은 20~40초, 10분 클립은 3~6분이 걸립니다. 전사 시간은 별도입니다.

더 많은 파이프라인 살펴보기

전체 보기 →
영상 생성
from 9.5
영상 생성
이미지 생성
0.2-6.4
이미지 생성
음성 생성
0.7-1.3
음성 생성
음악 생성
2.5-45.1
음악 생성