파이프라인으로 돌아가기

음성 생성

수십 가지 음성, 70개 이상의 언어, 그리고 톤·억양·속도를 위한 맞춤 스타일 지시로 텍스트를 자연스러운 음성으로 바꿉니다.

0.7
AI
자동
AI가 지시 사항과 텍스트를 바탕으로 가장 적합한 음성을 선택합니다
또는 특정 음성을 선택하세요...
Zephyr
F · Bright, Enthusiastic
Puck
M · Upbeat, Casual
Charon
M · Deep, Calm
Kore
F · Firm, Clear
Fenrir
M · Warm, Friendly
Leda
F · Youthful, Energetic
Orus
M · Firm, Casual
Aoede
F · Breezy, Professional
Callirrhoe
F · Easy-going, Friendly
Autonoe
F · Bright, Warm
Enceladus
M · Breathy, Confident
Iapetus
M · Clear, Professional
Umbriel
M · Easy-going, Resonant
Algieba
M · Smooth, Warm
Despina
F · Smooth, Warm
Erinome
F · Clear, Sophisticated
Algenib
M · Gravelly, Calm
Rasalgethi
M · Informative, Energetic
Laomedeia
F · Upbeat, Approachable
Achernar
F · Soft, Inviting
Alnilam
M · Firm, Optimistic
Schedar
M · Even, Casual
Gacrux
F · Mature, Engaging
Pulcherrima
M · Forward, Youthful
Achird
M · Friendly, Articulate
Zubenelgenubi
M · Casual, Deep
Vindemiatrix
F · Gentle, Smooth
Sadachbia
M · Lively, Resonant
Sadaltager
M · Knowledgeable, Calm
Sulafat
F · Warm, Enthusiastic

입력이 필요합니다: 텍스트

사용 모델

API

예시

오디오Gemini 2.5 Flash TTS

Pyra 소개: 보이스오버

Gemini 2.5 Flash TTS. Pyra 자신의 이야기를 따뜻한 이야기꾼 목소리로. 어떤 영상에도 바로 얹을 수 있는 보이스오버입니다.

가장 적합한 용도

  • 70개 이상의 언어로 된 내레이션과 보이스오버
  • 자연어 스타일 제어를 활용한 텍스트 음성 변환(예: '따뜻하게 말하기', '속삭이기', '들뜬 톤')
  • 수십 가지 표현력 있는 음성으로 만드는 멀티보이스 콘텐츠
  • 다국어 대본, 텍스트에서 언어가 자동으로 감지됩니다

  • 더 나은 속도감을 위해 내레이션은 짧고 명확한 문장으로 작성하세요
  • 구두점으로 멈춤을 제어하세요: 마침표는 완전한 멈춤, 쉼표는 짧은 멈춤, 말줄임표는 긴 멈춤
  • 음성을 자동으로 두면 AI가 스타일 지시에 맞는 음성을 고르고, 반복 등장하는 캐릭터가 필요하면 특정 음성을 고정하세요
  • 자연어 스타일 힌트를 사용하세요: '느리고 극적으로 말하기', '밝고 경쾌하게', '차분하고 안심시키듯이'

이 파이프라인 관련 기사

음성 생성 API

직접 작성한 코드에서 이 파이프라인을 호출하세요. 요청 한 번으로 실행이 시작되며, 모델은 별도의 엔드포인트가 아니라 입력 필드입니다.

4 개 입력
1 필수
0.7 to 1.3 크레딧
bun add @pipe2-ai/sdk
import { createClient } from "@pipe2-ai/sdk";

const client = createClient(process.env.PIPE2_TOKEN!);

const { run_pipeline } = await client.RunPipeline({
  pipeline_slug: "audio-generator",
  input: {
    text: "Welcome back to the show. Today we're talking about something a little strange.",
    model: "gemini-2-5-flash-tts",
  },
});
pip install pipe2
import asyncio
import os

from pipe2 import Pipe2Client

client = Pipe2Client(token=os.environ["PIPE2_TOKEN"])

run = asyncio.run(client.run_pipeline(
    pipeline_slug="audio-generator",
    input={
        "text": "Welcome back to the show. Today we're talking about something a little strange.",
        "model": "gemini-2-5-flash-tts",
    },
))
go get github.com/pipe2-ai/sdk-go
client := pipe2.NewClient(os.Getenv("PIPE2_TOKEN"))

input := json.RawMessage(`{
  "text": "Welcome back to the show. Today we're talking about something a little strange.",
  "model": "gemini-2-5-flash-tts"
}`)

run, err := pipe2.RunPipeline(context.Background(), client, "audio-generator", input)
if err != nil {
    log.Fatal(err)
}
brew install pipe2-ai/tap/pipe2
pipe2 pipelines run \
  --pipeline audio-generator \
  --input-json '{"text": "Welcome back to the show. Today we're talking about something a little strange.", "model": "gemini-2-5-flash-tts"}' \
  --wait

API 토큰 발급 →

매개변수

text 필수

음성으로 변환할 텍스트입니다.

string
instructions

톤, 억양, 속도, 감정을 설명하세요. AI가 풍부한 스타일 프롬프트를 만듭니다.

string
model

Voice engine to use. Leave unset to let Pipe2 pick the best available voice for your instructions.

gemini-2-5-flash-ttsgemini-2-5-pro-tts 기본값 gemini-2-5-flash-tts
입력 4개 모두 보기
voice

수십 가지 음성 중 하나를 선택하거나, auto로 AI가 고르도록 할 수 있습니다.

autoZephyrPuckCharonKoreFenrirLedaOrusAoedeCallirrhoeAutonoeEnceladusIapetusUmbrielAlgiebaDespinaErinomeAlgenibRasalgethiLaomedeiaAchernarAlnilamSchedarGacruxPulcherrimaAchirdZubenelgenubiVindemiatrixSadachbiaSadaltagerSulafat 기본값 auto

AI 에이전트에서 사용하기

MCP 클라이언트를 pipe2에 연결하면 에이전트가 이 도구들을 사용할 수 있습니다. 이 파이프라인을 찾아 위와 동일한 스키마를 읽고 실행합니다.

  • list_pipelines
  • get_pipeline_schema
  • run_pipeline
  • get_pipeline_run_status
  • request_upload
https://mcp.pipe2.ai/mcp
{
  "mcpServers": {
    "pipe2ai": {
      "url": "https://mcp.pipe2.ai/mcp",
      "headers": { "Authorization": "Bearer YOUR_TOKEN" }
    }
  }
}

전체 API 레퍼런스 MCP 설정 CLI 레퍼런스

AI 텍스트 음성 변환(TTS) 제너레이터

어떤 텍스트든 수십 가지 음성과 70개 이상의 언어로 자연스러운 음성으로 바꿉니다. 평이한 지시문으로 톤, 억양, 속도, 감정을 제어하세요, 프로덕션에 바로 쓸 수 있는 보이스오버를 몇 초 만에 완성합니다.

만들 수 있는 것

  • 다큐멘터리 내레이션: 권위 있고 전문적인 음성
  • 팟캐스트 인트로, 아웃트로, 대화: 여러 캐릭터의 연기
  • 다국어 보이스오버: 동일한 대본을 70개 이상의 언어로 커버
  • 오디오북 내레이션: 문장 중간 지시로 감정을 살린 속도 조절
  • 접근성: 텍스트 콘텐츠를 오디오로 제공

작동 방식

  1. 텍스트 붙여넣기: 읽어줄 내용을 입력하세요
  2. 음성 선택 또는 자동으로 두기: 자동 모드는 텍스트와 지시에 맞춰 최적의 음성을 골라줍니다
  3. 스타일 힌트 추가(선택), 억양, 속도, 감정을 묘사하세요: "따뜻한 영국식 억양, 느린 속도에 극적인 멈춤"
  4. 모델 선택: 빠른 초안에는 Flash TTS, 최종 결과물의 스튜디오급 억양에는 Pro TTS

스타일 팁

  • 더 나은 속도감을 위해 내레이션은 짧고 명확한 문장으로 작성하세요
  • 구두점으로 멈춤을 제어하세요, 마침표는 완전한 멈춤, 쉼표는 짧은 멈춤, 말줄임표는 긴 멈춤
  • 스타일 힌트는 평이한 표현으로 받습니다: "느리고 극적으로 말하기", "밝고 경쾌하게", "차분하고 안심시키듯이"

자주 묻는 질문

어떤 음성을 사용할 수 있나요?
밝고, 깊고, 따뜻하고, 단호하고, 극적인 캐릭터를 아우르는 수십 가지 표현력 있는 음성이 있습니다. 각 음성은 톤과 전달 방식에 대한 평이한 스타일 지시에 반응합니다.
어떤 언어를 지원하나요?
자동 감지가 포함된 70개 이상의 언어입니다. 영어, 중국어, 일본어, 스페인어 같은 주요 언어부터 세부아노어, 콘칸어, 룩셈부르크어 같은 지역 언어까지 지원합니다.
지시는 어떻게 작동하나요?
음성이 어떻게 들렸으면 하는지를 평이한 표현으로 묘사하세요. 예: '40세 영국인 저널리스트가 핵심 지점마다 극적인 멈춤을 두며 느리게 말하듯이.' AI가 당신의 지시를 해석해 음성 연기를 만들어냅니다.
출력 오디오 형식은 무엇인가요?
MP3 형식으로, 바로 다운로드하거나 Video Reel 같은 파이프라인에 내레이션 트랙으로 연결할 수 있습니다.
어떤 모델을 선택해야 하나요?
Flash TTS는 더 저렴하고 빠른 경로로, 초안, 짧은 클립, 반복 작업에 적합합니다. Pro TTS는 더 강한 억양과 속도감을 지닌 고충실도 모델을 사용하므로 프로덕션 내레이션에 선택하세요. 둘 다 몇 초 만에 렌더링되며, Pro가 아주 약간 더 걸립니다.
크레딧이 얼마나 드나요?
모델에 따라 0.7 to 1.3 크레딧이며, Flash TTS가 더 저렴하고 Pro TTS는 조금 더 비쌉니다. 결과는 몇 초 만에 준비됩니다.

더 많은 파이프라인 살펴보기

전체 보기 →
영상 생성
from 9.5
영상 생성
이미지 생성
0.2-6.4
이미지 생성
음악 생성
2.5-45.1
음악 생성
영상 편집
13.1-29.8
영상 편집