Google · Audio

Gemini 2.5 Pro TTS

Studioreife Prosodie und Sprechtempo. Produktionsreife Erzählstimme.

Auch bekannt als: Gemini 2.5 Pro Text-to-Speech, Gemini 2.5 Pro Preview TTS, gemini-2.5-pro-preview-tts, Gemini-TTS

In Audio-Generator ausführen

Was Gemini 2.5 Pro TTS kann

  • Text zu Sprache

Preise auf Pipe2

Audio-Generator →
Pro Lauf 1.3 Credits

Credit-Preise ansehen →

Pipelines mit Gemini 2.5 Pro TTS

Audio-Generator
0.7-1.3
Audio-Generator

Über Gemini 2.5 Pro TTS

Was es macht

Gemini 2.5 Pro TTS nimmt geschriebenen Text und liefert gesprochenes Audio. Seine einzige Fähigkeit auf Pipe2 ist Text-zu-Sprache: Es nimmt ein Skript und erzeugt eine Sprachspur. Es nimmt kein Audio auf, transkribiert nicht und erzeugt keine Musik. Es wird bei Prosodie und Sprechtempo als studioreif beschrieben, was es auf produktionsreife Erzählung ausrichtet statt auf kurze Zweckhinweise. Sie erreichen es über die Pipeline Audio-Generator.

Wann zu verwenden

  • Den Audio-Generator auf ein Erzählskript anwenden (Voiceover für ein Video, ein Kursmodul, ein Erklärstück), bei dem Satzrhythmus und Pausen so viel tragen wie die Worte.
  • Sie brauchen einen bestimmten Vortrag: Der Audio-Generator nimmt eigene Stilanweisungen für Tonfall, Akzent und Sprechtempo an, und dieses Modell wird bei beidem als studioreif beschrieben.
  • Sie produzieren in einer anderen Sprache als Englisch; die Oberfläche des Audio-Generators deckt über 70 Sprachen ab.
  • Sie wollen mehrere Lesungen desselben Skripts anhören, da die Pipeline Dutzende Stimmen hinter einer Texteingabe bereitstellt.
  • Lassen Sie es weg, wenn Sie nur einen kurzen Systemhinweis oder eine Benachrichtigungszeile brauchen. Die Tempokontrolle ist an einem Satzteil verschwendet.

Was Sie vor dem Start wissen sollten

Die Großhandelseinheit dieses Modells ist in Ausgabe-Tokens angegeben (rund 1500 je Einheit), gemessen wird also die Menge Sprache, die das Modell erzeugt. Die Live-Preistabelle auf dieser Seite zeigt den aktuellen Satz für die Pipeline. Sie steuern die Lesung über die Textstil-Anweisungen, die der Audio-Generator für Tonfall, Akzent und Sprechtempo bereitstellt — rechnen Sie mit ein paar Durchläufen, bis der gewünschte Vortrag sitzt. Für dieses Modell sind auf Pipe2 noch keine Beispiele veröffentlicht; hören Sie daher einen kurzen Auszug ab, bevor Sie ein ganzes Skript einsetzen.

Auch bekannt als

Sie sehen es möglicherweise als Gemini 2.5 Pro Text-to-Speech, Gemini 2.5 Pro Preview TTS, Gemini-TTS oder unter der Vorschau-Kennung gemini-2.5-pro-preview-tts. Alle bezeichnen dasselbe Modell, das hier als Gemini 2.5 Pro TTS geführt wird.

Ähnliche Modelle