Gerador de Voz
Transforme textos em fala natural com 30 vozes em 73 idiomas. Defina tom, sotaque, ritmo e emoção com instruções simples.
Ou escolha uma voz específica...
Funciona com
Exemplos
Conheça a Pyra: locução
Gemini 2.5 Flash TTS. A própria história da Pyra, lida com uma voz calorosa de narrador: uma locução pronta para entrar em qualquer vídeo.
Como usar Gerador de Voz
Um guia de decisão conciso para posicionar este pipeline em um fluxo de trabalho.
Ideal para
- Narração e locução em mais de 70 idiomas
- Conversão de texto em fala com controle de estilo em linguagem natural (ex.: 'fale com acolhimento', 'sussurre', 'tom animado')
- Conteúdo com várias vozes, usando dezenas de vozes expressivas
- Roteiros multilíngues, o idioma é detectado automaticamente a partir do texto
Dicas
- Escreva a narração em frases curtas e claras para um ritmo melhor
- Use a pontuação para controlar as pausas: pontos finais para paradas completas, vírgulas para pausas breves, reticências para pausas longas
- Deixe a voz em Automático e a IA escolhe uma que combine com as instruções de estilo, ou fixe uma voz específica se quiser um personagem recorrente
- Use dicas de estilo em linguagem natural: 'fale devagar e de forma dramática', 'alegre e animado', 'calmo e tranquilizador'
API do Gerador de Voz
Chame este pipeline a partir do seu próprio código. Um pedido lança uma execução; o modelo é um campo de entrada, não um endpoint separado.
Obter um token de API- entradas
- 5
- obrigatório
- 1
- Preços
- 0.002 to 40.0 créditos
| Entrada | Tipo | predefinição | Descrição |
|---|---|---|---|
text | string | predefinição— | Texto a converter em fala. |
enhance_prompt | boolean | predefiniçãotrue | Melhora o prompt para o modelo selecionado antes da geração. Desative para enviar o prompt sem alterações. |
instructions | string | predefinição— | Descreva tom, sotaque, ritmo e emoção. A IA transforma essas orientações em instruções detalhadas de interpretação. |
model | enum | predefiniçãogemini-2-5-flash-tts | Modelo de voz a usar. Deixe em branco para que a Pipe2 escolha a voz disponível mais adequada às suas instruções.gemini-2-5-flash-tts · gemini-2-5-pro-tts · minimax-speech-2-8-turbo +1gemini-2-5-flash-ttsgemini-2-5-pro-ttsminimax-speech-2-8-turbominimax-speech-2-8-hd |
voice | string | predefiniçãoauto | Nome da voz entre dezenas disponíveis, ou auto para a IA escolher. |
Aponte qualquer cliente MCP para o pipe2 e o seu agente ganha estas ferramentas. Ele encontra este pipeline, lê o mesmo esquema acima e executa-o.
list_pipelinesget_pipeline_schemarun_pipelineget_pipeline_run_statusrequest_upload
https://mcp.pipe2.ai/mcp {
"mcpServers": {
"pipe2ai": {
"url": "https://mcp.pipe2.ai/mcp",
"headers": { "Authorization": "Bearer YOUR_TOKEN" }
}
}
}Receitas que usam este pipeline
Ver todas as receitasPerguntas frequentes
Quais vozes estão disponíveis?
Quais idiomas são suportados?
Como funcionam as instruções?
Qual é o formato de áudio do resultado?
Qual modelo devo escolher?
Quantos créditos custa?
Gerador de voz por IA
Converta qualquer texto em uma fala natural, escolhendo entre dezenas de vozes e mais de 70 idiomas. Descreva em linguagem simples o tom, o sotaque, o ritmo e a emoção para receber uma narração pronta para uso em poucos segundos.
O que você pode criar
- Narração de documentários: vozes profissionais e cheias de autoridade
- Introduções, encerramentos e diálogos de podcast: interpretação com vários personagens
- Narrações multilíngues: produza o mesmo roteiro em mais de 70 idiomas
- Narração de audiolivros: controle o ritmo e as nuances emocionais ao longo de cada frase
- Acessibilidade: disponibilize conteúdo de texto em áudio
Como funciona
- Cole o seu texto: o que você quer que seja falado
- Escolha uma voz ou deixe em Automático: o modo Automático escolhe a melhor voz com base no seu texto e nas instruções
- Adicione uma instrução de estilo (opcional): descreva o sotaque, o ritmo e a emoção, por exemplo "sotaque britânico acolhedor, ritmo lento com pausas dramáticas"
- Escolha um modelo: Flash TTS para rascunhos rápidos, Pro TTS para prosódia de estúdio na entrega final
Dicas de estilo
- Escreva a narração em frases curtas e claras para um ritmo melhor
- Use a pontuação para controlar as pausas: ponto-final para uma parada completa, vírgula para uma pausa breve e reticências para uma pausa mais longa
- Escreva as instruções em linguagem comum: "fale devagar e de forma dramática", "alegre e animado", "calmo e tranquilizador"