Alle Modelle
Google

Gemini 3.8 Live

Googles Echtzeit-Sprachmodell für flüssige Gespräche mit Audio, Text und visuellem Kontext.

Übersicht in einfacher englischer Sprache

Was Gemini 3.8 Live eigentlich ist

Gemini 3.8 Live kann besprechen, was Nutzer sagen oder vor der Kamera zeigen, und während des Gesprächs Werkzeuge aufrufen. Anders als Gemini 3.8 Flash, das Text ausgibt, ist Live für gesprochene Interaktionen ausgelegt.

Diese Version eignet sich für Sprachassistenten im Alltag. Das Reasoning ist mit dem Gespräch verzahnt, ohne einstellbare Denktiefe. Extended Thinking ist ein separates Modell für anspruchsvollere Aufgaben.

Gute Passform für

  • Dialogorientierter Kundensupport
  • Sprachassistenten mit Kamerakontext
  • Alltägliche Sprachagenten mit Werkzeugnutzung

Kategorievergleich

Die Fakten, die für die stimme-Modelle wichtig sind

Hierbei handelt es sich um vom Anbieter veröffentlichte Spezifikationen, nicht um Cody-Benchmark-Ergebnisse. Folgen Sie den verlinkten Quellen für aktuelle Grenzwerte und endpunktspezifische Ausnahmen.

Preisbasis
Audio: 0,005 $/Min. eingehend, 0,018 $/Min. ausgehendToken-, zeichen- oder minutenbasierter Preis für die aufgeführte Zugangsroute.
Interaktionsmodus
Sprache-zu-Sprache mit visueller Eingabe und verzahntem ReasoningSpeech-to-Speech-, Audio-to-Audio- oder gestreamtes Text-to-Speech-Verhalten.
Veröffentlichte Latenz
Nicht veröffentlichtVom Anbieter veröffentlichte Messung mit den angegebenen Ausschlüssen; kein Cody-Test.
Sprachen
97 Sprachen (laut Googles Ankündigung)Vom Anbieter dokumentierte Sprachabdeckung oder ein eindeutiger unveröffentlichter Marker.
Werkzeuge und Steuerung
Funktionen (standardmäßig asynchron), Such-GroundingNative Funktionsaufruf-, Argumentations- oder Sprachsteuerungsfunktionen.
Kontext oder Eingabelimit
131.072 Input · 65.536 OutputDokumentiertes Token oder Zeichenlimit, wo es sinnvoll ist.

API- und Provider-Zugriff

Wo bekomme ich Gemini 3.8 Live?

Verfügbarkeit

Regionen und Zugriffsphase

Über die Gemini Live API und Google AI Studio in unterstützten Regionen verfügbar.

Verwenden Sie die Live-Liste der verfügbaren Regionen von Google und überprüfen Sie Funktionseinschränkungen für die ausgewählte Route.

Überprüfen Sie die Live-Verfügbarkeit

Daten und Schulung

Die Route ist wichtig.

Laut Google werden bezahlte Gemini API-Eingabeaufforderungen und -Antworten nicht zur Verbesserung seiner Produkte verwendet. Unbezahlte Dienstinhalte können im Allgemeinen verwendet werden, mit unterschiedlicher Behandlung für Nutzer im EWR, im Vereinigten Königreich und in der Schweiz; Überprüfen Sie die aktuellen Bedingungen für Ihr Konto und Ihre Region.

Hierbei handelt es sich um eine prägnante Lektüre des zitierten Anbietermaterials und nicht um eine Rechtsberatung. Ein Drittanbieter-Gateway kann andere Speicher-, Routing-, Schulungs- und Residenzbedingungen haben als die direkte API des Modellherstellers.

Lesen Sie die Richtlinien des Anbieters

Häufig gestellte Fragen

Gemini 3.8 Live FAQ

Was ist Gemini 3.8 Live?

Googles Echtzeit-Sprachmodell für flüssige Gespräche mit Audio, Text und visuellem Kontext. Gemini 3.8 Live kann besprechen, was Nutzer sagen oder vor der Kamera zeigen, und während des Gesprächs Werkzeuge aufrufen. Anders als Gemini 3.8 Flash, das Text ausgibt, ist Live für gesprochene Interaktionen ausgelegt.

Wann wurde Gemini 3.8 Live veröffentlicht?

Gemini 3.8 Live wurde gemäß den zitierten Anbietermaterialien auf 15. September 2026 veröffentlicht.

Wo kann ich auf Gemini 3.8 Live zugreifen?

Über die Gemini Live API und Google AI Studio in unterstützten Regionen verfügbar. Die in diesem Handbuch aufgeführten Zugriffsrouten sind Google.

Wie viel kostet Gemini 3.8 Live?

0,005 $/Min. Audioeingang · 0,018 $/Min. Audioausgang. Tarife im kostenpflichtigen Kontingent: 3 USD für Audioeingabe und 12 USD für Audioausgabe pro Million Tokens. Text kostet 0,75 USD für Eingabe und 4,50 USD für Ausgabe; Bild-/Videoeingabe kostet 1 USD pro Million Tokens. Reasoning und kostenpflichtige Suche können Zusatzkosten verursachen.

Wo ist Gemini 3.8 Live erhältlich?

Über die Gemini Live API und Google AI Studio in unterstützten Regionen verfügbar. Verwenden Sie die Live-Liste der verfügbaren Regionen von Google und überprüfen Sie Funktionseinschränkungen für die ausgewählte Route.

Werden meine Gemini 3.8 Live-API-Daten für das Training verwendet?

Laut Google werden bezahlte Gemini API-Eingabeaufforderungen und -Antworten nicht zur Verbesserung seiner Produkte verwendet. Unbezahlte Dienstinhalte können im Allgemeinen verwendet werden, mit unterschiedlicher Behandlung für Nutzer im EWR, im Vereinigten Königreich und in der Schweiz; Überprüfen Sie die aktuellen Bedingungen für Ihr Konto und Ihre Region. Die Richtlinie gehört zu den Routen- und Kontobedingungen des Anbieters. Überprüfen Sie sie daher vor der produktiven Nutzung erneut.

Verwandte Vergleiche

Direktvergleiche

  1. Gemini 3.8 Live vs GPT-Live 1

    Das Vollduplex-Sprach-Frontend von OpenAI für natürliche Konversation, das tiefergehende Überlegungen und Aktionen an einen separaten Backend-Agenten delegiert.

    Vollständigen Vergleich öffnen
  2. Gemini 3.8 Live vs Gemini 3.8 Live Extended Thinking

    Ein separates Gemini-Sprachmodell, das komplexe Anfragen im Hintergrund bearbeitet und das Gespräch dabei fortsetzt.

    Vollständigen Vergleich öffnen
  3. Gemini 3.8 Live vs GPT-Realtime-2.1

    Das Echtzeit-Speech-to-Speech-Argumentationsmodell von OpenAI für Tool-verwendende Sprachagenten, die auch Text- und Bildkontext benötigen.

    Vollständigen Vergleich öffnen
  4. Gemini 3.8 Live vs Gemini 3.1 Flash Live Preview

    Das Vorschau-Audio-zu-Audio-Modell von Google für Dialoge mit geringer Latenz mit multimodalem Bewusstsein, Denken, Sucherdung und Funktionsaufruf.

    Vollständigen Vergleich öffnen
  5. Gemini 3.8 Live vs Eleven v3 Conversational

    ElevenLabs‘ ausdrucksstarkes Echtzeit-Text-to-Speech-Modell für natürliche Dialoge, emotionale Übermittlung, Audio-Tags und mehr als 70 Sprachen.

    Vollständigen Vergleich öffnen
  6. Gemini 3.8 Live vs Inworld Realtime TTS-2

    Das neueste ausdrucksstarke Echtzeit-Text-to-Speech-Modell von Inworld, das darauf ausgelegt ist, sich die gesprochene Sprache zu merken und in mehr als 100 Sprachen zu sprechen.

    Vollständigen Vergleich öffnen
  7. Gemini 3.8 Live vs Grok Voice Think Fast 2.0

    Das aktuelle Echtzeit-Speech-to-Speech-Modell von SpaceXAI für Sub-Sekunden-Konversationsagenten mit Tool-Zugriff.

    Vollständigen Vergleich öffnen