Gemini 2.5 Pro TTS
스튜디오급 억양과 속도감. 프로덕션 내레이션용.
다른 이름: Gemini 2.5 Pro Text-to-Speech, Gemini 2.5 Pro Preview TTS, gemini-2.5-pro-preview-tts, Gemini-TTS
음성 생성에서 실행Gemini 2.5 Pro TTS로 할 수 있는 것
- 텍스트 → 음성
Pipe2 가격
| 실행당 | 1.3 크레딧 |
Gemini 2.5 Pro TTS을 사용하는 파이프라인
Gemini 2.5 Pro TTS 소개
기능
Gemini 2.5 Pro TTS는 글로 된 텍스트를 받아 음성 오디오를 돌려줍니다. Pipe2에서의 유일한 기능은 텍스트 음성 변환이므로, 대본을 받아 음성 트랙을 만듭니다. 오디오를 입력받지 않고, 전사하지 않으며, 음악도 생성하지 않습니다. 운율과 속도에서 스튜디오급으로 설명되어 있어, 짧은 기능성 안내음보다 제작용 내레이션에 적합합니다. 음성 생성 파이프라인을 통해 사용합니다.
사용 시점
- 내레이션 대본(영상 보이스오버, 강의 모듈, 설명 영상)에 음성 생성을 실행할 때. 문장의 리듬과 쉼이 단어만큼 중요한 경우입니다.
- 특정한 전달 방식이 필요할 때. 음성 생성은 어조·억양·속도에 대한 맞춤 스타일 지시를 받으며, 이 모델은 두 가지 모두에서 스튜디오급으로 설명됩니다.
- 영어가 아닌 언어로 제작할 때. 음성 생성 화면은 70개 이상 언어를 다룹니다.
- 같은 대본의 여러 낭독을 들어보고 싶을 때. 파이프라인은 하나의 텍스트 입력 뒤에 수십 가지 음성을 제공합니다.
- 짧은 시스템 안내나 알림 한 줄만 필요하다면 건너뛰세요. 한 절에 속도 제어는 낭비입니다.
실행 전 알아둘 점
이 모델의 도매 단위는 출력 토큰으로 표시되며(단위당 약 1500개), 따라서 단위가 재는 것은 모델이 생성하는 음성의 양입니다. 이 페이지의 실시간 가격표에 해당 파이프라인의 현재 요율이 표시됩니다. 낭독은 음성 생성이 어조·억양·속도에 대해 제공하는 텍스트 스타일 지시로 이끌게 되므로, 원하는 전달에 도달하려면 몇 차례 시도를 예상하세요. 이 모델은 아직 Pipe2에 공개된 예시가 없으므로, 전체 대본을 넣기 전에 짧은 발췌로 미리 확인하세요.
다른 이름
Gemini 2.5 Pro Text-to-Speech, Gemini 2.5 Pro Preview TTS, Gemini-TTS, 또는 프리뷰 식별자 gemini-2.5-pro-preview-tts로 표기될 수 있습니다. 모두 여기에 Gemini 2.5 Pro TTS로 등재된 동일한 모델을 가리킵니다.