Gemini 3.1 Flash Live Preview
Das Vorschau-Audio-zu-Audio-Modell von Google für Dialoge mit geringer Latenz mit multimodalem Bewusstsein, Denken, Sucherdung und Funktionsaufruf.
Das Vorschau-Audio-zu-Audio-Modell von Google für Dialoge mit geringer Latenz mit multimodalem Bewusstsein, Denken, Sucherdung und Funktionsaufruf.
Übersicht in einfacher englischer Sprache
Gemini 3.1 Flash Live akzeptiert Live-Audio neben Text, Bildern und Video und gibt dann Text und Audio zurück. Es richtet sich an Gespräche, die von akustischen Nuancen und visuellem Kontext profitieren und nicht von einer einfachen Text-zu-Sprache-Wiedergabe.
Google veröffentlicht sowohl Token-Raten als auch Audioäquivalente pro Minute. Dies erleichtert die frühzeitige Budgetierung, aber Sucherdung und multimodale Eingaben können dennoch eine separate Nutzung ermöglichen.
Kategorievergleich
Hierbei handelt es sich um vom Anbieter veröffentlichte Spezifikationen, nicht um Cody-Benchmark-Ergebnisse. Folgen Sie den verlinkten Quellen für aktuelle Grenzwerte und endpunktspezifische Ausnahmen.
API- und Provider-Zugriff
Verfügbarkeit
Vorschauzugriff über die Gemini Live API und Google AI Studio in unterstützten Regionen.
Verwenden Sie die Live-Regionsliste Gemini API von Google und bestätigen Sie die Vorschauberechtigung.
Überprüfen Sie die Live-VerfügbarkeitDaten und Schulung
Laut Google werden bezahlte Gemini API-Inhalte nicht zur Verbesserung seiner Produkte verwendet. unbezahlte Dienstdaten können grundsätzlich sein. Bestätigen Sie den Rechnungsstatus und die aktuellen Bedingungen, bevor Sie vertrauliche Gespräche senden.
Hierbei handelt es sich um eine prägnante Lektüre des zitierten Anbietermaterials und nicht um eine Rechtsberatung. Ein Drittanbieter-Gateway kann andere Speicher-, Routing-, Schulungs- und Residenzbedingungen haben als die direkte API des Modellherstellers.
Lesen Sie die Richtlinien des AnbietersHäufig gestellte Fragen
Das Vorschau-Audio-zu-Audio-Modell von Google für Dialoge mit geringer Latenz mit multimodalem Bewusstsein, Denken, Sucherdung und Funktionsaufruf. Gemini 3.1 Flash Live akzeptiert Live-Audio neben Text, Bildern und Video und gibt dann Text und Audio zurück. Es richtet sich an Gespräche, die von akustischen Nuancen und visuellem Kontext profitieren und nicht von einer einfachen Text-zu-Sprache-Wiedergabe.
Gemini 3.1 Flash Live Preview wurde gemäß den zitierten Anbietermaterialien auf 1. März 2026 veröffentlicht.
Vorschauzugriff über die Gemini Live API und Google AI Studio in unterstützten Regionen. Die in diesem Handbuch aufgeführten Zugriffsrouten sind Google.
0,005 $/Min. Audioeingang · 0,018 $/Min. Audioausgang. Die kostenpflichtigen Äquivalente von Google; Die Texteingabe/-ausgabe kostet 0,75/4,50 US-Dollar pro Million Token und die Bild-/Videoeingabe kostet 0,002 US-Dollar pro Minute.
Vorschauzugriff über die Gemini Live API und Google AI Studio in unterstützten Regionen. Verwenden Sie die Live-Regionsliste Gemini API von Google und bestätigen Sie die Vorschauberechtigung.
Laut Google werden bezahlte Gemini API-Inhalte nicht zur Verbesserung seiner Produkte verwendet. unbezahlte Dienstdaten können grundsätzlich sein. Bestätigen Sie den Rechnungsstatus und die aktuellen Bedingungen, bevor Sie vertrauliche Gespräche senden. Die Richtlinie gehört zu den Routen- und Kontobedingungen des Anbieters. Überprüfen Sie sie daher vor der produktiven Nutzung erneut.
Verwandte Vergleiche
Das Echtzeit-Speech-to-Speech-Argumentationsmodell von OpenAI für Tool-verwendende Sprachagenten, die auch Text- und Bildkontext benötigen.
Vollständigen Vergleich öffnenElevenLabs‘ ausdrucksstarkes Echtzeit-Text-to-Speech-Modell für natürliche Dialoge, emotionale Übermittlung, Audio-Tags und mehr als 70 Sprachen.
Vollständigen Vergleich öffnenDas neueste ausdrucksstarke Echtzeit-Text-to-Speech-Modell von Inworld, das darauf ausgelegt ist, sich die gesprochene Sprache zu merken und in mehr als 100 Sprachen zu sprechen.
Vollständigen Vergleich öffnenDas aktuelle Echtzeit-Speech-to-Speech-Modell von SpaceXAI für Sub-Sekunden-Konversationsagenten mit Tool-Zugriff.
Vollständigen Vergleich öffnen