음성 생성
수십 가지 음성, 70개 이상의 언어, 그리고 톤·억양·속도를 위한 맞춤 스타일 지시로 텍스트를 자연스러운 음성으로 바꿉니다.
또는 특정 음성을 선택하세요...
입력이 필요합니다: 텍스트
사용 모델
API예시
Pyra 소개: 보이스오버
Gemini 2.5 Flash TTS. Pyra 자신의 이야기를 따뜻한 이야기꾼 목소리로. 어떤 영상에도 바로 얹을 수 있는 보이스오버입니다.
가장 적합한 용도
- •70개 이상의 언어로 된 내레이션과 보이스오버
- •자연어 스타일 제어를 활용한 텍스트 음성 변환(예: '따뜻하게 말하기', '속삭이기', '들뜬 톤')
- •수십 가지 표현력 있는 음성으로 만드는 멀티보이스 콘텐츠
- •다국어 대본, 텍스트에서 언어가 자동으로 감지됩니다
팁
- ✓더 나은 속도감을 위해 내레이션은 짧고 명확한 문장으로 작성하세요
- ✓구두점으로 멈춤을 제어하세요: 마침표는 완전한 멈춤, 쉼표는 짧은 멈춤, 말줄임표는 긴 멈춤
- ✓음성을 자동으로 두면 AI가 스타일 지시에 맞는 음성을 고르고, 반복 등장하는 캐릭터가 필요하면 특정 음성을 고정하세요
- ✓자연어 스타일 힌트를 사용하세요: '느리고 극적으로 말하기', '밝고 경쾌하게', '차분하고 안심시키듯이'
이 파이프라인 관련 기사
음성 생성 API
직접 작성한 코드에서 이 파이프라인을 호출하세요. 요청 한 번으로 실행이 시작되며, 모델은 별도의 엔드포인트가 아니라 입력 필드입니다.
bun add @pipe2-ai/sdk import { createClient } from "@pipe2-ai/sdk";
const client = createClient(process.env.PIPE2_TOKEN!);
const { run_pipeline } = await client.RunPipeline({
pipeline_slug: "audio-generator",
input: {
text: "Welcome back to the show. Today we're talking about something a little strange.",
model: "gemini-2-5-flash-tts",
},
});pip install pipe2 import asyncio
import os
from pipe2 import Pipe2Client
client = Pipe2Client(token=os.environ["PIPE2_TOKEN"])
run = asyncio.run(client.run_pipeline(
pipeline_slug="audio-generator",
input={
"text": "Welcome back to the show. Today we're talking about something a little strange.",
"model": "gemini-2-5-flash-tts",
},
))go get github.com/pipe2-ai/sdk-go client := pipe2.NewClient(os.Getenv("PIPE2_TOKEN"))
input := json.RawMessage(`{
"text": "Welcome back to the show. Today we're talking about something a little strange.",
"model": "gemini-2-5-flash-tts"
}`)
run, err := pipe2.RunPipeline(context.Background(), client, "audio-generator", input)
if err != nil {
log.Fatal(err)
}brew install pipe2-ai/tap/pipe2 pipe2 pipelines run \
--pipeline audio-generator \
--input-json '{"text": "Welcome back to the show. Today we're talking about something a little strange.", "model": "gemini-2-5-flash-tts"}' \
--wait매개변수
-
text필수 -
음성으로 변환할 텍스트입니다.
string -
instructions -
톤, 억양, 속도, 감정을 설명하세요. AI가 풍부한 스타일 프롬프트를 만듭니다.
string -
model -
Voice engine to use. Leave unset to let Pipe2 pick the best available voice for your instructions.
gemini-2-5-flash-ttsgemini-2-5-pro-tts기본값gemini-2-5-flash-tts
입력 4개 모두 보기
-
voice -
수십 가지 음성 중 하나를 선택하거나, auto로 AI가 고르도록 할 수 있습니다.
autoZephyrPuckCharonKoreFenrirLedaOrusAoedeCallirrhoeAutonoeEnceladusIapetusUmbrielAlgiebaDespinaErinomeAlgenibRasalgethiLaomedeiaAchernarAlnilamSchedarGacruxPulcherrimaAchirdZubenelgenubiVindemiatrixSadachbiaSadaltagerSulafat기본값auto
AI 에이전트에서 사용하기
MCP 클라이언트를 pipe2에 연결하면 에이전트가 이 도구들을 사용할 수 있습니다. 이 파이프라인을 찾아 위와 동일한 스키마를 읽고 실행합니다.
- list_pipelines
- get_pipeline_schema
- run_pipeline
- get_pipeline_run_status
- request_upload
https://mcp.pipe2.ai/mcp {
"mcpServers": {
"pipe2ai": {
"url": "https://mcp.pipe2.ai/mcp",
"headers": { "Authorization": "Bearer YOUR_TOKEN" }
}
}
}AI 텍스트 음성 변환(TTS) 제너레이터
어떤 텍스트든 수십 가지 음성과 70개 이상의 언어로 자연스러운 음성으로 바꿉니다. 평이한 지시문으로 톤, 억양, 속도, 감정을 제어하세요, 프로덕션에 바로 쓸 수 있는 보이스오버를 몇 초 만에 완성합니다.
만들 수 있는 것
- 다큐멘터리 내레이션: 권위 있고 전문적인 음성
- 팟캐스트 인트로, 아웃트로, 대화: 여러 캐릭터의 연기
- 다국어 보이스오버: 동일한 대본을 70개 이상의 언어로 커버
- 오디오북 내레이션: 문장 중간 지시로 감정을 살린 속도 조절
- 접근성: 텍스트 콘텐츠를 오디오로 제공
작동 방식
- 텍스트 붙여넣기: 읽어줄 내용을 입력하세요
- 음성 선택 또는 자동으로 두기: 자동 모드는 텍스트와 지시에 맞춰 최적의 음성을 골라줍니다
- 스타일 힌트 추가(선택), 억양, 속도, 감정을 묘사하세요: "따뜻한 영국식 억양, 느린 속도에 극적인 멈춤"
- 모델 선택: 빠른 초안에는 Flash TTS, 최종 결과물의 스튜디오급 억양에는 Pro TTS
스타일 팁
- 더 나은 속도감을 위해 내레이션은 짧고 명확한 문장으로 작성하세요
- 구두점으로 멈춤을 제어하세요, 마침표는 완전한 멈춤, 쉼표는 짧은 멈춤, 말줄임표는 긴 멈춤
- 스타일 힌트는 평이한 표현으로 받습니다: "느리고 극적으로 말하기", "밝고 경쾌하게", "차분하고 안심시키듯이"
자주 묻는 질문
어떤 음성을 사용할 수 있나요?
어떤 언어를 지원하나요?
지시는 어떻게 작동하나요?
출력 오디오 형식은 무엇인가요?
어떤 모델을 선택해야 하나요?
크레딧이 얼마나 드나요?
더 많은 파이프라인 살펴보기
전체 보기 →텍스트 프롬프트, 이미지, 또는 참조 클립으로 AI 영상을 생성합니다. 시네마틱 샷, 제품 공개, 라이프스타일 광고, 동기화된 오디오와 자연스러운 모션과 함께.
텍스트나 참조 사진에서 AI 이미지를 생성하세요. 제품 사진, 캐릭터 아트, 읽기 쉬운 텍스트가 담긴 포스터, 사실적인 인물 사진, 몇 초 만에 고해상도로.
원하는 분위기, 장르, 길이에 맞는 오리지널 배경 음악을 생성하세요. 로열티 프리, 몇 초 만에 준비됩니다.
AI로 기존 영상을 편집하세요. 스타일 변경, 효과 추가, 장면 수정, 또는 전체 룩 변환.