Gemini 3.8 Flash TTS
Googles Sprachgenerierungsmodell für ausdrucksstarke Erzählungen, Charakterstimmen und Dialoge in 130 Sprachen.
Googles Sprachgenerierungsmodell für ausdrucksstarke Erzählungen, Charakterstimmen und Dialoge in 130 Sprachen.
Übersicht in einfacher englischer Sprache
Wandeln Sie ein Skript in Audio um, wählen Sie eine Stimme und bestimmen Sie den Klang jeder Zeile. Flash TTS ist die kreative Variante dieses Modellpaars für Erzählungen, Akzente und Charakterdarstellungen.
Beide Modelle unterstützen eigene Stimmgestaltung und Skripte mit zwei Sprechern. Sie erzeugen Sprache, keine Antworten: Ein Gesprächsassistent benötigt weiterhin separate Komponenten zum Zuhören und Schlussfolgern. Sie verwenden nicht die Gemini Live API.
Kategorievergleich
Hierbei handelt es sich um vom Anbieter veröffentlichte Spezifikationen, nicht um Cody-Benchmark-Ergebnisse. Folgen Sie den verlinkten Quellen für aktuelle Grenzwerte und endpunktspezifische Ausnahmen.
API- und Provider-Zugriff
Verfügbarkeit
Über die Gemini API und Google AI Studio in unterstützten Regionen verfügbar.
Die Stimmreplikation in AI Studio ist in Illinois, Texas, im EWR, im Vereinigten Königreich, in der Schweiz und in Indien nicht verfügbar. Das ist kein generelles TTS-Verbot in diesen Regionen.
Überprüfen Sie die Live-VerfügbarkeitDaten und Schulung
Laut Google werden bezahlte Gemini API-Eingabeaufforderungen und -Antworten nicht zur Verbesserung seiner Produkte verwendet. Unbezahlte Dienstinhalte können im Allgemeinen verwendet werden, mit unterschiedlicher Behandlung für Nutzer im EWR, im Vereinigten Königreich und in der Schweiz; Überprüfen Sie die aktuellen Bedingungen für Ihr Konto und Ihre Region.
Hierbei handelt es sich um eine prägnante Lektüre des zitierten Anbietermaterials und nicht um eine Rechtsberatung. Ein Drittanbieter-Gateway kann andere Speicher-, Routing-, Schulungs- und Residenzbedingungen haben als die direkte API des Modellherstellers.
Lesen Sie die Richtlinien des AnbietersHäufig gestellte Fragen
Googles Sprachgenerierungsmodell für ausdrucksstarke Erzählungen, Charakterstimmen und Dialoge in 130 Sprachen. Wandeln Sie ein Skript in Audio um, wählen Sie eine Stimme und bestimmen Sie den Klang jeder Zeile. Flash TTS ist die kreative Variante dieses Modellpaars für Erzählungen, Akzente und Charakterdarstellungen.
Gemini 3.8 Flash TTS wurde gemäß den zitierten Anbietermaterialien auf 23. September 2026 veröffentlicht.
Über die Gemini API und Google AI Studio in unterstützten Regionen verfügbar. Die in diesem Handbuch aufgeführten Zugriffsrouten sind Google.
0,50 $ Texteingabe · 9 $ Audioausgabe / 1 Mio. Tokens. Standard-Einführungspreise bis zum 31. Dezember 2026; beide Preise verdoppeln sich am 1. Januar 2027. Audio verwendet 25 Tokens pro Sekunde. Für Caching und andere Servicestufen gelten andere Preise.
Über die Gemini API und Google AI Studio in unterstützten Regionen verfügbar. Die Stimmreplikation in AI Studio ist in Illinois, Texas, im EWR, im Vereinigten Königreich, in der Schweiz und in Indien nicht verfügbar. Das ist kein generelles TTS-Verbot in diesen Regionen.
Laut Google werden bezahlte Gemini API-Eingabeaufforderungen und -Antworten nicht zur Verbesserung seiner Produkte verwendet. Unbezahlte Dienstinhalte können im Allgemeinen verwendet werden, mit unterschiedlicher Behandlung für Nutzer im EWR, im Vereinigten Königreich und in der Schweiz; Überprüfen Sie die aktuellen Bedingungen für Ihr Konto und Ihre Region. Die Richtlinie gehört zu den Routen- und Kontobedingungen des Anbieters. Überprüfen Sie sie daher vor der produktiven Nutzung erneut.
Verwandte Vergleiche
Googles günstigeres Sprachgenerierungsmodell für Vorlesefunktionen und große Audiomengen in 101 Sprachen.
Vollständigen Vergleich öffnenElevenLabs‘ ausdrucksstarkes Echtzeit-Text-to-Speech-Modell für natürliche Dialoge, emotionale Übermittlung, Audio-Tags und mehr als 70 Sprachen.
Vollständigen Vergleich öffnenDas neueste ausdrucksstarke Echtzeit-Text-to-Speech-Modell von Inworld, das darauf ausgelegt ist, sich die gesprochene Sprache zu merken und in mehr als 100 Sprachen zu sprechen.
Vollständigen Vergleich öffnen