视频字幕

0.2 积分起

根据你提供的 SRT 为任意视频添加带样式的硬字幕。选择预设,即可获得可直接发布的 MP4。

还需填写:视频文件, 字幕文件(SRT)

视频字幕 API

从你自己的代码调用此流水线。一次请求即可发起运行;模型是一个输入字段,而不是独立的接口。

获取 API 令牌
个输入
4
必填
2
定价
from 0.2 积分
语言
语言
bun add @pipe2-ai/sdk
运行流水线
import { createClient } from "@pipe2-ai/sdk";

const client = createClient(process.env.PIPE2_TOKEN!);

const { run_pipeline } = await client.RunPipeline({
  pipeline_slug: "captions",
  input: {
    source_asset_id: "a1b2c3d4-0000-4000-8000-000000000001",
    transcript_asset_id: "a1b2c3d4-0000-4000-8000-000000000002",
  },
});

pip install pipe2
运行流水线
import asyncio
import os

from pipe2 import Pipe2Client

client = Pipe2Client(token=os.environ["PIPE2_TOKEN"])

run = asyncio.run(client.run_pipeline(
    pipeline_slug="captions",
    input={
        "source_asset_id": "a1b2c3d4-0000-4000-8000-000000000001",
        "transcript_asset_id": "a1b2c3d4-0000-4000-8000-000000000002",
    },
))

go get github.com/pipe2-ai/sdk-go
运行流水线
client := pipe2.NewClient(os.Getenv("PIPE2_TOKEN"))

input := json.RawMessage(`{
  "source_asset_id": "a1b2c3d4-0000-4000-8000-000000000001",
  "transcript_asset_id": "a1b2c3d4-0000-4000-8000-000000000002"
}`)

run, err := pipe2.RunPipeline(context.Background(), client, "captions", input)
if err != nil {
    log.Fatal(err)
}

brew install pipe2-ai/tap/pipe2
运行流水线
pipe2 pipelines run \
  --pipeline captions \
  --input-json '{"source_asset_id": "a1b2c3d4-0000-4000-8000-000000000001", "transcript_asset_id": "a1b2c3d4-0000-4000-8000-000000000002"}' \
  --wait

完整 API 参考 CLI 参考

常见问题

支持哪些文件格式?
视频支持 MP4、MOV、WebM、AVI、MKV 等常见格式;字幕文件须为带时间戳的标准 .srt。输出统一为 MP4,便于在各平台播放和发布。
如何获得 SRT 字幕文件?
先用 Transcription 处理任意视频或音频,生成的 SRT 会保存到素材库,可直接在这里选用。你也可以上传其他转录工具导出的 .srt 文件。
字幕会嵌入画面吗?
字幕会直接嵌入画面,因此无论上传到哪个平台都能保留原有样式,也不需要另外管理 .srt 文件。
可以先编辑字幕内容吗?
可以。先生成并打开 SRT,修正人名、术语或其他错误,再将编辑后的文件用于字幕制作;也可以直接上传已经校对过的 .srt。
同一份 SRT 可以套用不同样式吗?
可以。重复使用同一份 SRT,并在每次运行时选择不同预设,即可低成本比较多种字幕样式。
添加字幕需要多长时间?
通常需要源视频时长的 30%–60%。1 分钟视频约需 20–40 秒,10 分钟视频约需 3–6 分钟;转录时间另计。

为视频添加带样式的硬字幕

上传视频和 SRT 字幕文件,选择样式,即可获得字幕已嵌入画面的 MP4。无需打开 CapCut 或 Premiere,也不用安装字幕插件,成片可直接发布到 TikTok、Reels 和 Shorts。

还没有 SRT?先用 Transcription 处理视频或音频。生成的 SRT 会保存到素材库,可在检查和修正后直接用于这一步。

工作原理

  1. 选择视频:从设备上传,或从素材库中选取
  2. 添加 SRT:可用 Transcription 生成,也可上传其他工具导出的 .srt 文件
  3. 选择字幕样式:六套面向不同内容场景的成品级预设
  4. 下载成片:获得带硬字幕的 MP4,以及可作缩略图的封面帧

字幕样式预设

  • TikTok Bold Yellow:粗字重、黑色描边,并避开 TikTok 界面遮挡,是最常见的短视频字幕风格。
  • Minimal White:简洁的无衬线字体配柔和阴影。适合口播播客和访谈。
  • Subtle Drop Shadow:低对比度字幕,适合以画面为主导的电影感剪辑。
  • Karaoke Gradient:当前朗读的词以紫→粉渐变高亮显示。在短视频上留存率高。
  • Big Serif:富有编辑质感的衬线字体,适合品牌纪录、案例研究和长篇教育短片。
  • Serif Editorial:克制的衬线字体搭配半透明底板,适合播客、知识讲解和观点类短片。

为何采用两步流程

  • 烧录前编辑转录文本:在 SRT 中修正人名、术语或说话人标签,而不必将就 STT 给出的原始结果。
  • 一份字幕复用于多种样式:用六种预设处理同一份 SRT,方便做 A/B 测试,无需重新转录
  • 自带 SRT:如果你已有来自其他工具的转录文本,直接附上即可,完全省去转录成本。
  • TikTok 安全区定位:字幕避开各大主流平台底部三分之一的 UI 遮挡。

适合谁

  • 每天产出 Reels / Shorts / TikTok 的短视频创作者
  • 将长篇节目改制成可分享短片的播客主
  • 为教程增加无障碍能力的课程创作者和教育者
  • 规模化产出品牌社媒内容的代理机构
  • 任何已有 SRT、只想把字幕清晰嵌入视频的人

它通常接在 Transcription 之后,形成完整的字幕制作流程;也可将结果送入 Video Reel,与其他片段合成。

探索更多流水线

AI 视频生成
from 9.5
AI 视频生成
图像生成器
0.2-6.4
图像生成器
AI 配音生成
0.002-40.0
AI 配音生成
音乐生成器
2.5-22.6
音乐生成器