Generador de audio
Convierte texto en una locución natural. Elige entre decenas de voces y más de 70 idiomas, y da indicaciones sobre el tono, el acento y el ritmo.
O elige una voz específica...
Funciona con
Ejemplos
Conoce a Pyra: voz en off
Gemini 2.5 Flash TTS. La propia historia de Pyra, leída con una cálida voz de narrador: una voz en off lista para colocar en cualquier video.
Cómo usar Generador de audio
Una guía de decisión concisa para ubicar este pipeline en un flujo de trabajo.
Ideal para
- Narraciones y locuciones en más de 70 idiomas
- Texto a voz con control de estilo mediante lenguaje natural (p. ej. «habla con calidez», «susurra», «tono entusiasmado»)
- Contenido con varias voces y decenas de timbres expresivos
- Guiones multilingües cuyo idioma se detecta automáticamente a partir del texto
Consejos
- Escribe la narración con frases cortas y claras para conseguir un ritmo más natural
- Usa la puntuación para marcar las pausas: punto para una pausa completa, coma para una pausa breve y puntos suspensivos para una pausa más larga
- Deja la voz en Auto para que la IA elija la que mejor encaje con el estilo, o selecciona una voz concreta si quieres mantener un personaje recurrente
- Describe el estilo con naturalidad: «habla despacio y con dramatismo», «tono alegre y dinámico», «voz tranquila y reconfortante»
API de Generador de audio
Llama a este pipeline desde tu propio código. Una petición lanza una ejecución; el modelo es un campo de entrada, no un endpoint aparte.
Obtener un token de API- entradas
- 5
- obligatorio
- 1
- Precios
- 0.002 to 40.0 créditos
| Entrada | Tipo | por defecto | Descripción |
|---|---|---|---|
text | string | por defecto— | Texto que se convertirá en voz. |
enhance_prompt | boolean | por defectotrue | Mejora el prompt para el modelo seleccionado antes de generar. Desactívalo para enviar el prompt sin cambios. |
instructions | string | por defecto— | Describe el tono, el acento, el ritmo y la emoción. La IA convertirá estas indicaciones en una descripción de estilo detallada. |
model | enum | por defectogemini-2-5-flash-tts | Motor de voz que se utilizará. Déjalo en Auto para que Pipe2 elija el mejor disponible según tus indicaciones.gemini-2-5-flash-tts · gemini-2-5-pro-tts · minimax-speech-2-8-turbo +1gemini-2-5-flash-ttsgemini-2-5-pro-ttsminimax-speech-2-8-turbominimax-speech-2-8-hd |
voice | string | por defectoauto | Elige una de las voces disponibles o usa auto para que la IA decida. |
Apunta cualquier cliente MCP a pipe2 y tu agente obtiene estas herramientas. Encuentra este pipeline, lee el mismo esquema de arriba y lo ejecuta.
list_pipelinesget_pipeline_schemarun_pipelineget_pipeline_run_statusrequest_upload
https://mcp.pipe2.ai/mcp {
"mcpServers": {
"pipe2ai": {
"url": "https://mcp.pipe2.ai/mcp",
"headers": { "Authorization": "Bearer YOUR_TOKEN" }
}
}
}Recetas que usan este pipeline
Ver todas las recetasPreguntas frecuentes
¿Qué voces están disponibles?
¿Qué idiomas son compatibles?
¿Cómo funcionan las instrucciones?
¿En qué formato de audio se genera el resultado?
¿Qué modelo debería elegir?
¿Cuántos créditos cuesta?
Generador de texto a voz con IA
Convierte cualquier texto en una locución natural con decenas de voces y más de 70 idiomas. Describe con tus propias palabras el tono, el acento, el ritmo y la emoción, y obtén en segundos una voz lista para producción.
Lo que puedes crear
- Narración de documentales: voces profesionales y convincentes
- Intros, cierres y diálogos de pódcast: interpretación con varias voces
- Locuciones multilingües: el mismo guion en más de 70 idiomas
- Narración de audiolibros: ritmo expresivo con indicaciones dentro de cada frase
- Accesibilidad: ofrece tus contenidos de texto también en audio
Cómo funciona
- Pega el texto: escribe exactamente lo que quieres que se diga
- Elige una voz o deja la opción en Auto: Auto busca la voz que mejor encaje con el texto y tus indicaciones
- Añade una indicación de estilo (opcional): describe el acento, el ritmo y la emoción, por ejemplo «acento británico cálido, ritmo pausado y pausas dramáticas»
- Elige un modelo: Flash TTS para borradores rápidos y Pro TTS para una prosodia con calidad de estudio en la versión final
Consejos de estilo
- Escribe la narración con frases cortas y claras para conseguir un ritmo más natural
- Usa la puntuación para marcar las pausas: punto para una pausa completa, coma para una pausa breve y puntos suspensivos para una pausa más larga
- Expresa el estilo con naturalidad: «habla despacio y con dramatismo», «tono alegre y dinámico», «voz tranquila y reconfortante»