Alle Modelle
Google

Gemini 3.1 Flash Live Preview

Das Vorschau-Audio-zu-Audio-Modell von Google für Dialoge mit geringer Latenz mit multimodalem Bewusstsein, Denken, Sucherdung und Funktionsaufruf.

Übersicht in einfacher englischer Sprache

Was Gemini 3.1 Flash Live Preview eigentlich ist

Gemini 3.1 Flash Live akzeptiert Live-Audio neben Text, Bildern und Video und gibt dann Text und Audio zurück. Es richtet sich an Gespräche, die von akustischen Nuancen und visuellem Kontext profitieren und nicht von einer einfachen Text-zu-Sprache-Wiedergabe.

Google veröffentlicht sowohl Token-Raten als auch Audioäquivalente pro Minute. Dies erleichtert die frühzeitige Budgetierung, aber Sucherdung und multimodale Eingaben können dennoch eine separate Nutzung ermöglichen.

Gute Passform für

  • Multimodale Sprachassistenten
  • Google suchbasierte Live-Erlebnisse
  • Kostengünstige Audioexperimente

Kategorievergleich

Die Fakten, die für die stimme-Modelle wichtig sind

Hierbei handelt es sich um vom Anbieter veröffentlichte Spezifikationen, nicht um Cody-Benchmark-Ergebnisse. Folgen Sie den verlinkten Quellen für aktuelle Grenzwerte und endpunktspezifische Ausnahmen.

Preisbasis
Audio: 0,005 $/Min. eingehend, 0,018 $/Min. ausgehendToken-, zeichen- oder minutenbasierter Preis für die aufgeführte Zugangsroute.
Interaktionsmodus
Echtzeit-Audio-zu-Audio, multimodale EingabeSpeech-to-Speech-, Audio-to-Audio- oder gestreamtes Text-to-Speech-Verhalten.
Veröffentlichte Latenz
Nicht veröffentlichtVom Anbieter veröffentlichte Messung mit den angegebenen Ausschlüssen; kein Cody-Test.
Sprachen
Mehrsprachig; Überprüfen Sie die aktuelle Live-API-UnterstützungVom Anbieter dokumentierte Sprachabdeckung oder ein eindeutiger unveröffentlichter Marker.
Werkzeuge und Steuerung
Funktionsaufruf und SucherdungNative Funktionsaufruf-, Argumentations- oder Sprachsteuerungsfunktionen.
Kontext oder Eingabelimit
131.072 Input · 65.536 OutputDokumentiertes Token oder Zeichenlimit, wo es sinnvoll ist.

API- und Provider-Zugriff

Wo bekomme ich Gemini 3.1 Flash Live Preview?

Verfügbarkeit

Regionen und Zugriffsphase

Vorschauzugriff über die Gemini Live API und Google AI Studio in unterstützten Regionen.

Verwenden Sie die Live-Regionsliste Gemini API von Google und bestätigen Sie die Vorschauberechtigung.

Überprüfen Sie die Live-Verfügbarkeit

Daten und Schulung

Die Route ist wichtig.

Laut Google werden bezahlte Gemini API-Inhalte nicht zur Verbesserung seiner Produkte verwendet. unbezahlte Dienstdaten können grundsätzlich sein. Bestätigen Sie den Rechnungsstatus und die aktuellen Bedingungen, bevor Sie vertrauliche Gespräche senden.

Hierbei handelt es sich um eine prägnante Lektüre des zitierten Anbietermaterials und nicht um eine Rechtsberatung. Ein Drittanbieter-Gateway kann andere Speicher-, Routing-, Schulungs- und Residenzbedingungen haben als die direkte API des Modellherstellers.

Lesen Sie die Richtlinien des Anbieters

Häufig gestellte Fragen

Gemini 3.1 Flash Live Preview FAQ

Was ist Gemini 3.1 Flash Live Preview?

Das Vorschau-Audio-zu-Audio-Modell von Google für Dialoge mit geringer Latenz mit multimodalem Bewusstsein, Denken, Sucherdung und Funktionsaufruf. Gemini 3.1 Flash Live akzeptiert Live-Audio neben Text, Bildern und Video und gibt dann Text und Audio zurück. Es richtet sich an Gespräche, die von akustischen Nuancen und visuellem Kontext profitieren und nicht von einer einfachen Text-zu-Sprache-Wiedergabe.

Wann wurde Gemini 3.1 Flash Live Preview veröffentlicht?

Gemini 3.1 Flash Live Preview wurde gemäß den zitierten Anbietermaterialien auf 1. März 2026 veröffentlicht.

Wo kann ich auf Gemini 3.1 Flash Live Preview zugreifen?

Vorschauzugriff über die Gemini Live API und Google AI Studio in unterstützten Regionen. Die in diesem Handbuch aufgeführten Zugriffsrouten sind Google.

Wie viel kostet Gemini 3.1 Flash Live Preview?

0,005 $/Min. Audioeingang · 0,018 $/Min. Audioausgang. Die kostenpflichtigen Äquivalente von Google; Die Texteingabe/-ausgabe kostet 0,75/4,50 US-Dollar pro Million Token und die Bild-/Videoeingabe kostet 0,002 US-Dollar pro Minute.

Wo ist Gemini 3.1 Flash Live Preview erhältlich?

Vorschauzugriff über die Gemini Live API und Google AI Studio in unterstützten Regionen. Verwenden Sie die Live-Regionsliste Gemini API von Google und bestätigen Sie die Vorschauberechtigung.

Werden meine Gemini 3.1 Flash Live Preview-API-Daten für das Training verwendet?

Laut Google werden bezahlte Gemini API-Inhalte nicht zur Verbesserung seiner Produkte verwendet. unbezahlte Dienstdaten können grundsätzlich sein. Bestätigen Sie den Rechnungsstatus und die aktuellen Bedingungen, bevor Sie vertrauliche Gespräche senden. Die Richtlinie gehört zu den Routen- und Kontobedingungen des Anbieters. Überprüfen Sie sie daher vor der produktiven Nutzung erneut.

Verwandte Vergleiche

Direktvergleiche

  1. Gemini 3.1 Flash Live Preview vs GPT-Live 1

    Das Vollduplex-Sprach-Frontend von OpenAI für natürliche Konversation, das tiefergehende Überlegungen und Aktionen an einen separaten Backend-Agenten delegiert.

    Vollständigen Vergleich öffnen
  2. Gemini 3.1 Flash Live Preview vs Gemini 3.8 Live

    Googles Echtzeit-Sprachmodell für flüssige Gespräche mit Audio, Text und visuellem Kontext.

    Vollständigen Vergleich öffnen
  3. Gemini 3.1 Flash Live Preview vs Gemini 3.8 Live Extended Thinking

    Ein separates Gemini-Sprachmodell, das komplexe Anfragen im Hintergrund bearbeitet und das Gespräch dabei fortsetzt.

    Vollständigen Vergleich öffnen
  4. Gemini 3.1 Flash Live Preview vs GPT-Realtime-2.1

    Das Echtzeit-Speech-to-Speech-Argumentationsmodell von OpenAI für Tool-verwendende Sprachagenten, die auch Text- und Bildkontext benötigen.

    Vollständigen Vergleich öffnen
  5. Gemini 3.1 Flash Live Preview vs Eleven v3 Conversational

    ElevenLabs‘ ausdrucksstarkes Echtzeit-Text-to-Speech-Modell für natürliche Dialoge, emotionale Übermittlung, Audio-Tags und mehr als 70 Sprachen.

    Vollständigen Vergleich öffnen
  6. Gemini 3.1 Flash Live Preview vs Inworld Realtime TTS-2

    Das neueste ausdrucksstarke Echtzeit-Text-to-Speech-Modell von Inworld, das darauf ausgelegt ist, sich die gesprochene Sprache zu merken und in mehr als 100 Sprachen zu sprechen.

    Vollständigen Vergleich öffnen
  7. Gemini 3.1 Flash Live Preview vs Grok Voice Think Fast 2.0

    Das aktuelle Echtzeit-Speech-to-Speech-Modell von SpaceXAI für Sub-Sekunden-Konversationsagenten mit Tool-Zugriff.

    Vollständigen Vergleich öffnen