Google · Audio

Gemini 2.5 Flash TTS

Synthèse plus rapide et économique. Brouillons et clips courts.

Aussi appelé: Gemini 2.5 Flash Text-to-Speech, Gemini 2.5 Flash Preview TTS, gemini-2.5-flash-preview-tts, Gemini-TTS

Lance-le dans Générateur audio

Ce que Gemini 2.5 Flash TTS sait faire

  • Texte vers voix

Tarifs sur Pipe2

Générateur audio →
Par exécution 0.7 crédits

Voir les tarifs en crédits →

Créé avec Gemini 2.5 Flash TTS

Pipelines qui utilisent Gemini 2.5 Flash TTS

Générateur audio
0.7-1.3
Générateur audio

À propos de Gemini 2.5 Flash TTS

Ce qu'il fait

Gemini 2.5 Flash TTS est un modèle de synthèse vocale du fournisseur Gemini. Vous lui donnez du texte écrit et il renvoie de l'audio parlé. Sur Pipe2, il s'exécute dans le pipeline Générateur audio, où vous choisissez parmi des dizaines de voix dans plus de 70 langues et pouvez joindre des consignes de style qui orientent le ton, l'accent et le débit. Il est positionné comme l'option de synthèse la plus rapide et la moins chère, destinée aux brouillons et aux clips courts plutôt qu'aux rendus finaux longs.

Quand l'utiliser

  • Exécuter le Générateur audio pour transformer un script écrit en narration ou voix off sans rien enregistrer vous-même.
  • Itérer sur la formulation : étant la plus rapide et la moins chère des options de synthèse, elle convient aux prises répétées pendant que vous éditez encore le script.
  • Produire des clips courts (stingers, lectures de réplique, invites) quand vous voulez le résultat rapidement.
  • Tester des choix de voix et de langue parmi les 70+ langues prises en charge avant de vous engager sur un rendu plus long.
  • Essayer des consignes de style pour le ton, l'accent et le débit afin d'entendre comment une instruction d'interprétation change la lecture.

À savoir avant de lancer

La facturation est mesurée sur les tokens de sortie générés (l'unité de gros est cotée par environ 1500 tokens de sortie), le coût évolue donc avec la quantité de parole générée. Un long script coûte plus qu'un court, et le moyen pratique de maîtriser la dépense est de raccourcir le texte ou de le découper en segments plus courts générés séparément. L'entrée est du texte, plus la voix et la consigne de style que vous choisissez dans le Générateur audio. La contrepartie du palier plus rapide et moins cher est qu'il visedes brouillons et des clips courts. Un exemple détaillé est publié sur Pipe2 si vous voulez voir les entrées utilisées.

Aussi appelé

Vous pourrez voir ce modèle désigné comme Gemini 2.5 Flash Text-to-Speech, Gemini 2.5 Flash Preview TTS ou gemini-2.5-flash-preview-tts ; l'abréviation "Gemini-TTS" y renvoie également.

Modèles similaires