Google · Áudio

Gemini 2.5 Pro TTS

Prosódia e ritmo de nível de estúdio. Narração para produção.

Também conhecido como: Gemini 2.5 Pro Text-to-Speech, Gemini 2.5 Pro Preview TTS, gemini-2.5-pro-preview-tts, Gemini-TTS

Rode no Gerador de Áudio

O que o Gemini 2.5 Pro TTS faz

  • Texto para voz

Preços no Pipe2

Gerador de Áudio →
Por execução 1.3 créditos

Ver preços em créditos →

Pipelines que usam Gemini 2.5 Pro TTS

Gerador de Áudio
0.7-1.3
Gerador de Áudio

Sobre o Gemini 2.5 Pro TTS

O que faz

O Gemini 2.5 Pro TTS recebe texto escrito e devolve áudio falado. Sua única capacidade no Pipe2 é texto para fala: aceita um roteiro e produz uma faixa de voz. Não recebe áudio, não transcreve e não gera música. É descrito como de nível de estúdio em prosódia e ritmo, o que o direciona à narração de produção em vez de avisos curtos utilitários. Você o alcança pelo pipeline Gerador de Áudio.

Quando usar

  • Executar o Gerador de Áudio em um roteiro de narração (locução para vídeo, módulo de curso, explicativo) em que o ritmo das frases e as pausas pesam tanto quanto as palavras.
  • Você precisa de uma interpretação específica: o Gerador de Áudio aceita direções de estilo personalizadas para tom, acento e ritmo, e este modelo é descrito como de nível de estúdio em ambos.
  • Você está produzindo em um idioma diferente do inglês; a superfície do Gerador de Áudio cobre mais de 70 idiomas.
  • Você quer testar várias leituras do mesmo roteiro, já que o pipeline expõe dezenas de vozes atrás de uma única entrada de texto.
  • Dispense-o se você só precisa de um aviso de sistema curto ou uma linha de notificação. O controle de ritmo é desperdiçado em uma única oração.

O que saber antes de executar

A unidade de atacado deste modelo é cotada em tokens de saída (cerca de 1500 por unidade), então o que a unidade mede é a quantidade de fala que o modelo produz. A tabela de preços ao vivo desta página mostra a tarifa atual do pipeline. Você guia a leitura com as direções de estilo de texto que o Gerador de Áudio expõe para tom, acento e ritmo, então conte com algumas passagens para acertar a interpretação desejada. Este modelo ainda não tem exemplos publicados no Pipe2, então pré-visualize um trecho curto antes de comprometer um roteiro completo.

Também conhecido como

Você pode vê-lo escrito como Gemini 2.5 Pro Text-to-Speech, Gemini 2.5 Pro Preview TTS, Gemini-TTS ou sob o identificador de prévia gemini-2.5-pro-preview-tts. Todos se referem ao mesmo modelo listado aqui como Gemini 2.5 Pro TTS.

Modelos parecidos