Alle Modelle
Google

Gemini 3.8 Flash

Das stabile, hocheffiziente multimodale Modell von Google für Agenten, Softwarearbeit und große Mixed-Media-Eingaben zum Einführungspreis der Flash-Stufe.

Übersicht in einfacher englischer Sprache

Was Gemini 3.8 Flash eigentlich ist

Gemini 3.8 Flash kombiniert ein Millionen-Token-Eingabefenster mit Text-, Bild-, Video-, Audio- und PDF-Verständnis. Zu den nativen API-Funktionen gehören Funktionsaufrufe, Codeausführung, Sucherdung, Dateisuche und strukturierte Ausgabe.

Der aktuelle Preis ist Aktionspreis. Teams, die die jährlichen Kosten vergleichen, sollten sowohl den Einführungssatz als auch den veröffentlichten höheren Satz ab 2027 sowie etwaige Such- oder Sperraufrufe berücksichtigen.

Gute Passform für

  • Multimodale Agenten mit hohem Volumen
  • Lange Video-, Audio-, PDF- und Code-Eingaben
  • Teams optimieren die Fähigkeit pro Token-Kosten

Kategorievergleich

Die Fakten, die für die text-Modelle wichtig sind

Hierbei handelt es sich um vom Anbieter veröffentlichte Spezifikationen, nicht um Cody-Benchmark-Ergebnisse. Folgen Sie den verlinkten Quellen für aktuelle Grenzwerte und endpunktspezifische Ausnahmen.

Kontextfenster
1.048.576 TokenMaximaler kombinierter Eingabeaufforderungs- und Arbeitskontext, der vom Anbieter dokumentiert wird.
Maximale Leistung
65.536 TokenVom Anbieter veröffentlichtes Antwortlimit, sofern verfügbar.
Wissensabbruch
März 2026; Einige Domains können bis Januar 2025 zurückbleibenNeuestes verlässliches Wissensdatum, das ausdrücklich vom Modellanbieter veröffentlicht wird. Such- und verbundene Tools können neuere Informationen abrufen, ändern jedoch nicht den integrierten Cutoff des Modells.
Eingabepreis
0,75 $ / 1 Mio. AktionAktueller Standardlistenpreis pro Million Input-Token, sofern nicht anders angegeben.
Ausgabepreis
3,75 $ / 1 Mio. AktionAktueller Standardlistenpreis pro Million ausgegebener Token, sofern nicht anders angegeben.
Eingaben
Text, Bild, Video, Audio, PDFMedientypen, die vom aufgelisteten Modellendpunkt akzeptiert werden.
Tools und Agenten
Funktionen, Suche, Codeausführung, DateisucheAusgewählte native Tools und Funktionen zur Agentenerstellung, keine erschöpfende Liste.

Preise und Vergleiche

Kosten schätzen

Geben Sie Ihre Nutzung ein. Die Schätzung wird sofort aktualisiert.

Beispiel: 6.000 Eingabe-Tokens für 10 Seiten und 500 für die Zusammenfassung. Seitenlängen variieren; passen Sie die Werte an.

Ein Durchlauf sendet Ihre Eingabe einmal an das Modell und erhält eine Antwort. Tokens sind Textbausteine: Eingabe ist, was Sie senden; Ausgabe ist die erhaltene Antwort.

Erweiterte Optionen

Gemini 3.8 Flash

Google

Geschätzte Summe (USD)

0,0064 $

Für die angegebene Nutzung · USD · API-Preis, kein Abonnement

Eingabe-Tokens
0,75 $ pro 1 Mio. Tokens
Ausgabe-Tokens
3,75 $ pro 1 Mio. Tokens
So funktioniert die Schätzung

Schätzungen ohne Steuern, Tools, Cache-Speicherung/-Schreiben, Freikontingente und individuelle Rabatte. Bei Bildern zählt nur die Ausgabe, nicht Prompt oder Referenzbilder. Qualitätsmodi unterscheiden sich. Nicht aufgeführte Einstellungen gelten nicht als kostenlos.

API- und Provider-Zugriff

Wo bekomme ich Gemini 3.8 Flash?

Verfügbarkeit

Regionen und Zugriffsphase

Verfügbar über Gemini API und Google AI Studio in unterstützten Regionen, wobei auch Vertex- und Gateway-Routen verfügbar sind.

Verwenden Sie die Live-Liste der verfügbaren Regionen von Google und überprüfen Sie Funktionseinschränkungen für die ausgewählte Route.

Überprüfen Sie die Live-Verfügbarkeit

Daten und Schulung

Die Route ist wichtig.

Laut Google werden bezahlte Gemini API-Eingabeaufforderungen und -Antworten nicht zur Verbesserung seiner Produkte verwendet. Unbezahlte Dienstinhalte können im Allgemeinen verwendet werden, mit unterschiedlicher Behandlung für Nutzer im EWR, im Vereinigten Königreich und in der Schweiz; Überprüfen Sie die aktuellen Bedingungen für Ihr Konto und Ihre Region.

Hierbei handelt es sich um eine prägnante Lektüre des zitierten Anbietermaterials und nicht um eine Rechtsberatung. Ein Drittanbieter-Gateway kann andere Speicher-, Routing-, Schulungs- und Residenzbedingungen haben als die direkte API des Modellherstellers.

Lesen Sie die Richtlinien des Anbieters

Häufig gestellte Fragen

Gemini 3.8 Flash FAQ

Was ist Gemini 3.8 Flash?

Das stabile, hocheffiziente multimodale Modell von Google für Agenten, Softwarearbeit und große Mixed-Media-Eingaben zum Einführungspreis der Flash-Stufe. Gemini 3.8 Flash kombiniert ein Millionen-Token-Eingabefenster mit Text-, Bild-, Video-, Audio- und PDF-Verständnis. Zu den nativen API-Funktionen gehören Funktionsaufrufe, Codeausführung, Sucherdung, Dateisuche und strukturierte Ausgabe.

Wann wurde Gemini 3.8 Flash veröffentlicht?

Gemini 3.8 Flash wurde gemäß den zitierten Anbietermaterialien auf 2. September 2026 veröffentlicht.

Wo kann ich auf Gemini 3.8 Flash zugreifen?

Verfügbar über Gemini API und Google AI Studio in unterstützten Regionen, wobei auch Vertex- und Gateway-Routen verfügbar sind. Die in diesem Handbuch aufgeführten Zugriffsrouten sind Google und OpenRouter.

Wie viel kostet Gemini 3.8 Flash?

0,75 $ Input · 3,75 $ Output / 1 Mio. Token. Einführungspreis der kostenpflichtigen Stufe bis 31. Dezember 2026; Google listet ab dem 1. Januar 2027 einen Input von 1,50 $ und einen Output von 7,50 $ auf.

Wo ist Gemini 3.8 Flash erhältlich?

Verfügbar über Gemini API und Google AI Studio in unterstützten Regionen, wobei auch Vertex- und Gateway-Routen verfügbar sind. Verwenden Sie die Live-Liste der verfügbaren Regionen von Google und überprüfen Sie Funktionseinschränkungen für die ausgewählte Route.

Werden meine Gemini 3.8 Flash-API-Daten für das Training verwendet?

Laut Google werden bezahlte Gemini API-Eingabeaufforderungen und -Antworten nicht zur Verbesserung seiner Produkte verwendet. Unbezahlte Dienstinhalte können im Allgemeinen verwendet werden, mit unterschiedlicher Behandlung für Nutzer im EWR, im Vereinigten Königreich und in der Schweiz; Überprüfen Sie die aktuellen Bedingungen für Ihr Konto und Ihre Region. Die Richtlinie gehört zu den Routen- und Kontobedingungen des Anbieters. Überprüfen Sie sie daher vor der produktiven Nutzung erneut.

Preisvergleich

Ein Preis je Modell bei gleichem Eingabe-/Ausgabeverhältnis. Jeder API-Tarif wird nach seinem Anteil an insgesamt einer Million Tokens gewichtet; verwendet wird der günstigste passende geprüfte Zugang. Dies ist ein Vergleichstarif, kein Aufgabenpreis oder Qualitätswert. Tokenisierung, Caching, Reasoning und langer Kontext können die tatsächlichen Kosten ändern.

Gemischte Tokenkostenpro 1 Mio. Tokens insgesamt · USD

75 % Eingabe + 25 % Ausgabe · ohne Cache-Rabatte

  1. 0,20 $
    GPT-6 Luna

    OpenAI

  2. 0,2625 $
    Mistral Small 4

    Mistral AI

  3. 0,45 $
    GPT-5.6 Luna

    OpenAI

  4. 1,50 $
    Gemini 3.8 Flash

    Google

    Dieses Modell

  5. 2,00 $
    Claude Haiku 4.5

    Anthropic

  6. 4,00 $
    GPT-6 Sol

    OpenAI

  7. 4,00 $
    Claude Sonnet 5

    Anthropic

  8. 4,50 $
    GPT-5.6 Terra

    OpenAI

  9. 8,00 $
    Daybreak Blue

    OpenAI

  10. 8,00 $
    Claude Opus 5.5

    Anthropic

  11. 8,00 $
    GPT-5.6 Sol

    OpenAI

  12. 10,00 $
    Claude Opus 5

    Anthropic

  13. 20,00 $
    Claude Fable 5

    Anthropic

  14. 20,00 $
    GPT-6 Astra

    OpenAI

  15. 20,00 $
    Claude Fable 5.1

    Anthropic

Verwandte Vergleiche

Direktvergleiche

  1. Gemini 3.8 Flash vs GPT-6 Sol

    Ein OpenAI-Modell für Programmierprojekte und Assistenten, die mit Werkzeugen mehrere Arbeitsschritte ausführen.

    Vollständigen Vergleich öffnen
  2. Gemini 3.8 Flash vs GPT-6 Luna

    Ein kostengünstiges OpenAI-Modell für klar abgegrenzte Aufgaben in großen Mengen, etwa Extraktion, Klassifizierung und kurze Antworten.

    Vollständigen Vergleich öffnen
  3. Gemini 3.8 Flash vs Claude Opus 5.5

    Ein Claude-Modell für umfangreiche Codeänderungen, gründliche Recherchen und mehrstufige Geschäftsaufgaben.

    Vollständigen Vergleich öffnen
  4. Gemini 3.8 Flash vs GPT-5.6 Terra

    Eine günstigere GPT-5.6-Option für Programmierung, Analyse und Assistenten mit Werkzeugnutzung.

    Vollständigen Vergleich öffnen
  5. Gemini 3.8 Flash vs GPT-5.6 Luna

    Die günstige GPT-5.6-Klasse für viele kurze, wiederkehrende Aufgaben.

    Vollständigen Vergleich öffnen
  6. Gemini 3.8 Flash vs Claude Fable 5

    Das ursprüngliche Fable-Modell für komplexe Programmierung und mehrstufige Arbeit, weiterhin für bestehende Integrationen verfügbar.

    Vollständigen Vergleich öffnen
  7. Gemini 3.8 Flash vs Claude Opus 5

    Ein Claude-Modell für umfangreiche Codeänderungen, Reasoning und mehrstufige Geschäftsabläufe.

    Vollständigen Vergleich öffnen
  8. Gemini 3.8 Flash vs Claude Sonnet 5

    Eine günstigere Claude-Option für alltägliche Programmierung, Texte und werkzeuggestützte Arbeit.

    Vollständigen Vergleich öffnen
  9. Gemini 3.8 Flash vs Claude Haiku 4.5

    Ein kompaktes Claude-Modell für schnelle Antworten, Klassifizierung und klar begrenzte Assistenten.

    Vollständigen Vergleich öffnen
  10. Gemini 3.8 Flash vs GPT-6 Astra

    Das leistungsfähigste Modell von OpenAI für schwierige End-to-End-Arbeiten, das Grenzüberlegungen mit einem Millionen-Token-Kontextfenster und einer breiten Palette von Agententools kombiniert.

    Vollständigen Vergleich öffnen
  11. Gemini 3.8 Flash vs GPT-5.6 Sol

    Das Flaggschiff-Allgemeinmodell von OpenAI für schwierige Codierung, Analyse und professionelle Arbeit, mit einem sehr großen Kontextfenster und einem breiten nativen Toolset.

    Vollständigen Vergleich öffnen
  12. Gemini 3.8 Flash vs Claude Fable 5.1

    Das Grenzmodell von Anthropic für ehrgeizige, langwierige Agenten- und Codierungsarbeiten mit starker Vision und Verfügbarkeit auf dem Unternehmensmarkt.

    Vollständigen Vergleich öffnen
  13. Gemini 3.8 Flash vs Grok 4.6

    SpaceXAIs grenzüberschreitendes Text- und Bildmodell für Codierung, Agentenaufgaben und Wissensarbeit mit direkten Web-, X- und Code-Tools.

    Vollständigen Vergleich öffnen
  14. Gemini 3.8 Flash vs Grok 4.20 Multi-Agent Beta

    Ein spezialisiertes Grok-Modell, das mehrere KI-Agenten parallel zur Untersuchung einer schwierigen Frage entsendet und ihre Arbeit dann zu einer recherchierten Antwort zusammenfasst.

    Vollständigen Vergleich öffnen
  15. Gemini 3.8 Flash vs Inkling

    Das große Open-Weights-Modell von Thinking Machines Lab für anpassbare Argumentations-, Codierungs-, Tools-, Vision- und Audio-Workflows.

    Vollständigen Vergleich öffnen
  16. Gemini 3.8 Flash vs Mistral Medium 3.5

    Mistrals Open-Weight-Frontier-Modell für anspruchsvolle multimodale Codierungs-, Argumentations- und Agenten-Workflows mit einem 256K-Kontextfenster.

    Vollständigen Vergleich öffnen
  17. Gemini 3.8 Flash vs Mistral Small 4

    Das kostengünstigere offene Modell von Mistral, das normale Anweisungen, Argumentation, Kodierung, Vision und Agenten-Tools in einem Endpunkt vereint.

    Vollständigen Vergleich öffnen
  18. Gemini 3.8 Flash vs Qwen3.8 Max

    Das Grenzmodell

    Vollständigen Vergleich öffnen
  19. Gemini 3.8 Flash vs MiniMax M3

    Das Millionen-Token-multimodale Modell von MiniMax für Codierung, Agenten, Computernutzung und lange Projekte zu einem niedrigen direkten API-Preis.

    Vollständigen Vergleich öffnen
  20. Gemini 3.8 Flash vs GLM-5.3

    Das offene Argumentationsmodell mit langem Kontext von Z.ai für Codierung, Tools und Agentenarbeit auf selbst gehosteten und verwalteten Routen.

    Vollständigen Vergleich öffnen
  21. Gemini 3.8 Flash vs Kimi K3

    Moonshot AIs multimodales Grenzmodell für Millionen-Token-Codierung, Argumentation, Wissensarbeit und werkzeuggesteuerte Agenten.

    Vollständigen Vergleich öffnen
  22. Gemini 3.8 Flash vs Falcon-H1R-7B

    Das kompakte offene Argumentationsmodell von TII für Textaufgaben, lange Kontexte und selbstgehostete Funktionsaufruf-Workflows.

    Vollständigen Vergleich öffnen
  23. Gemini 3.8 Flash vs Falcon-H1-34B-Instruct

    Das offene 34B-Instruktionsmodell von TII für mehrsprachigen Text, Codierung und kontrollierte selbst gehostete Anwendungen.

    Vollständigen Vergleich öffnen
  24. Gemini 3.8 Flash vs Muse Spark 1.3

    Metas neuestes multimodales Argumentationsmodell für lang laufende Agenten, Codierung, Tools und komplexe Benutzerzusammenarbeit.

    Vollständigen Vergleich öffnen
  25. Gemini 3.8 Flash vs Celeris-1 Magnus

    Das agentenorientierte Diffusionssprachmodell von Celeris für schnelles Denken, Tool-Schleifen, strukturierte Aktionen und OpenAI-kompatible Integration.

    Vollständigen Vergleich öffnen
  26. Gemini 3.8 Flash vs NVIDIA Nemotron 3 Ultra

    NVIDIAs größtes Nemotron 3-Argumentationsmodell für komplexe Agenten, Codierung, Planung, Tools, RAG und Millionen-Token-Analyse.

    Vollständigen Vergleich öffnen
  27. Gemini 3.8 Flash vs NVIDIA Nemotron 3.5 Lightning

    Das kompakte 30B-Expertenmodell von NVIDIA für effiziente Spezialagenten und Text-Workflows mit hohem Volumen.

    Vollständigen Vergleich öffnen
  28. Gemini 3.8 Flash vs Qwen3.8-Flash

    Das effiziente multimodale Millionen-Kontext-Modell von Alibaba für schnelle Agenten, Codierung, Dokumentenarbeit, Vision, Videoverständnis und Werkzeugnutzung.

    Vollständigen Vergleich öffnen
  29. Gemini 3.8 Flash vs DeepSeek-V4-Pro

    DeepSeeks Flaggschiff-Millionen-Kontext-Textmodell für schwierige Argumentation, Codierung, lang laufende Agenten, Tools und sehr große Ausgaben.

    Vollständigen Vergleich öffnen
  30. Gemini 3.8 Flash vs DeepSeek-V4-Flash

    Das kostengünstigere V4-Modell von DeepSeek für umfangreiche Argumentations-, Codierungs-, Agenten- und Millionen-Token-Text-Workloads.

    Vollständigen Vergleich öffnen