Alle Modelle
DeepSeek

DeepSeek-V4-Flash

Das kostengünstigere V4-Modell von DeepSeek für umfangreiche Argumentations-, Codierungs-, Agenten- und Millionen-Token-Text-Workloads.

Übersicht in einfacher englischer Sprache

Was DeepSeek-V4-Flash eigentlich ist

DeepSeek-V4-Flash behält den Kerntext, die Argumentation und die Werkzeugoberfläche der V4-Familie bei, aktiviert jedoch ein kleineres Modell und kostet wesentlich weniger als Pro. Es ist der praktische erste Test für Routine-Codierungsagenten, Extraktion, Langkontextanalyse und wiederholte Tool-Schleifen.

Der Standard-Flash-Endpunkt ist nur Text; DeepSeek bietet ein separates experimentelles Flash Vision-Modell für die Bildeingabe. Die Benennung dieser Unterscheidung verhindert ausdrücklich, dass eine Anwendung davon ausgeht, dass die stabile Textroute Medien akzeptieren kann, die sie nicht unterstützt.

Gute Passform für

  • Kosteneffiziente Codierung und Agenten-Workloads
  • Textanalyse mit großem Kontext
  • Anwendungen mit hoher Parallelität, die bekannte API-Formate verwenden

Kategorievergleich

Die Fakten, die für die text-Modelle wichtig sind

Hierbei handelt es sich um vom Anbieter veröffentlichte Spezifikationen, nicht um Cody-Benchmark-Ergebnisse. Folgen Sie den verlinkten Quellen für aktuelle Grenzwerte und endpunktspezifische Ausnahmen.

Kontextfenster
1 Mio. TokenMaximaler kombinierter Eingabeaufforderungs- und Arbeitskontext, der vom Anbieter dokumentiert wird.
Maximale Leistung
Bis zu 384.000 TokenVom Anbieter veröffentlichtes Antwortlimit, sofern verfügbar.
Wissensabbruch
Nicht veröffentlichtNeuestes verlässliches Wissensdatum, das ausdrücklich vom Modellanbieter veröffentlicht wird. Such- und verbundene Tools können neuere Informationen abrufen, ändern jedoch nicht den integrierten Cutoff des Modells.
Eingabepreis
0,44 $/1 Mio. Höchstwert nicht zwischengespeichert; 0,22 $ außerhalb der HauptverkehrszeitAktueller Standardlistenpreis pro Million Input-Token, sofern nicht anders angegeben.
Ausgabepreis
1,32 $/1 Mio. Höchstwert; 0,66 $ außerhalb der HauptverkehrszeitAktueller Standardlistenpreis pro Million ausgegebener Token, sofern nicht anders angegeben.
Eingaben
Text; separater Flash-Vision-Exp akzeptiert BilderMedientypen, die vom aufgelisteten Modellendpunkt akzeptiert werden.
Tools und Agenten
Tools, JSON-Ausgabe, Antwort-API, Denkaufwand, FIM-BetaAusgewählte native Tools und Funktionen zur Agentenerstellung, keine erschöpfende Liste.

Preise und Vergleiche

Kosten schätzen

Geben Sie Ihre Nutzung ein. Die Schätzung wird sofort aktualisiert.

Beispiel: 6.000 Eingabe-Tokens für 10 Seiten und 500 für die Zusammenfassung. Seitenlängen variieren; passen Sie die Werte an.

Ein Durchlauf sendet Ihre Eingabe einmal an das Modell und erhält eine Antwort. Tokens sind Textbausteine: Eingabe ist, was Sie senden; Ausgabe ist die erhaltene Antwort.

Erweiterte Optionen

DeepSeek-V4-Flash

DeepSeek

Geschätzte Summe (USD)

Kein geprüfter Preis

Für die angegebene Nutzung · USD · API-Preis, kein Abonnement

So funktioniert die Schätzung

Schätzungen ohne Steuern, Tools, Cache-Speicherung/-Schreiben, Freikontingente und individuelle Rabatte. Bei Bildern zählt nur die Ausgabe, nicht Prompt oder Referenzbilder. Qualitätsmodi unterscheiden sich. Nicht aufgeführte Einstellungen gelten nicht als kostenlos.

API- und Provider-Zugriff

Wo bekomme ich DeepSeek-V4-Flash?

Verfügbarkeit

Regionen und Zugriffsphase

Verfügbar in den Formaten DeepSeek API bis OpenAI, Anthropic und Responses; Die aktuelle API-Version ist V4-Flash-0731.

Die öffentlichen Modellseiten von DeepSeek enthalten keine globale, modellspezifische Länder- oder Verarbeitungsregionsliste. Bestätigen Sie die Berechtigung zum Konto und das geltende Recht.

Überprüfen Sie die Live-Verfügbarkeit

Daten und Schulung

Die Route ist wichtig.

DeepSeek dokumentiert seine Antwort-API als zustandslos und gibt an, dass Antworten und Konversationen von diesem Endpunkt nicht gespeichert werden. Hierbei handelt es sich nicht um ein vollständiges Account-weites Aufbewahrungs- oder Schulungsnutzungsversprechen; Überprüfen Sie die aktuellen Plattformbedingungen und das automatische Cache-Verhalten für sensible Daten.

Hierbei handelt es sich um eine prägnante Lektüre des zitierten Anbietermaterials und nicht um eine Rechtsberatung. Ein Drittanbieter-Gateway kann andere Speicher-, Routing-, Schulungs- und Residenzbedingungen haben als die direkte API des Modellherstellers.

Lesen Sie die Richtlinien des Anbieters

Häufig gestellte Fragen

DeepSeek-V4-Flash FAQ

Was ist DeepSeek-V4-Flash?

Das kostengünstigere V4-Modell von DeepSeek für umfangreiche Argumentations-, Codierungs-, Agenten- und Millionen-Token-Text-Workloads. DeepSeek-V4-Flash behält den Kerntext, die Argumentation und die Werkzeugoberfläche der V4-Familie bei, aktiviert jedoch ein kleineres Modell und kostet wesentlich weniger als Pro. Es ist der praktische erste Test für Routine-Codierungsagenten, Extraktion, Langkontextanalyse und wiederholte Tool-Schleifen.

Wann wurde DeepSeek-V4-Flash veröffentlicht?

DeepSeek-V4-Flash wurde gemäß den zitierten Anbietermaterialien auf 31. Juli 2026 veröffentlicht.

Wo kann ich auf DeepSeek-V4-Flash zugreifen?

Verfügbar in den Formaten DeepSeek API bis OpenAI, Anthropic und Responses; Die aktuelle API-Version ist V4-Flash-0731. Die in diesem Handbuch aufgeführten Zugriffsrouten sind DeepSeek API und DeepSeek.

Wie viel kostet DeepSeek-V4-Flash?

Höchstwert: 0,44 $ Input · 1,32 $ Output / 1 Mio. Token. Außerhalb der Spitzenzeiten liegen die nicht zwischengespeicherten Ein- und Ausgänge bei 0,22 und 0,66 US-Dollar pro Million. Zwischengespeicherte Eingaben sind günstiger und die separate experimentelle Vision-Route nutzt Flash-Token-Preise.

Wo ist DeepSeek-V4-Flash erhältlich?

Verfügbar in den Formaten DeepSeek API bis OpenAI, Anthropic und Responses; Die aktuelle API-Version ist V4-Flash-0731. Die öffentlichen Modellseiten von DeepSeek enthalten keine globale, modellspezifische Länder- oder Verarbeitungsregionsliste. Bestätigen Sie die Berechtigung zum Konto und das geltende Recht.

Werden meine DeepSeek-V4-Flash-API-Daten für das Training verwendet?

DeepSeek dokumentiert seine Antwort-API als zustandslos und gibt an, dass Antworten und Konversationen von diesem Endpunkt nicht gespeichert werden. Hierbei handelt es sich nicht um ein vollständiges Account-weites Aufbewahrungs- oder Schulungsnutzungsversprechen; Überprüfen Sie die aktuellen Plattformbedingungen und das automatische Cache-Verhalten für sensible Daten. Die Richtlinie gehört zu den Routen- und Kontobedingungen des Anbieters. Überprüfen Sie sie daher vor der produktiven Nutzung erneut.

Preisvergleich

USD pro Million Tokens für die gezeigten API-Zugänge bei Standardkontext. Cache- und Langkontextpreise können abweichen. Modelle ohne passende geprüfte Preise fehlen; günstigere Kosten bedeuten keine bessere Qualität.

Kosten für Eingabe-Tokenspro 1 Mio. Tokens · USD
  1. 0,15 $
    Mistral Small 4

    Mistral AI

  2. 0,75 $
    Gemini 3.8 Flash

    Google

  3. 4,00 $
    GPT-5.6 Sol

    OpenAI

  4. 10,00 $
    GPT-6 Astra

    OpenAI

  5. 10,00 $
    Claude Fable 5.1

    Anthropic

Kosten für Ausgabe-Tokenspro 1 Mio. Tokens · USD
  1. 0,60 $
    Mistral Small 4

    Mistral AI

  2. 3,75 $
    Gemini 3.8 Flash

    Google

  3. 20,00 $
    GPT-5.6 Sol

    OpenAI

  4. 50,00 $
    GPT-6 Astra

    OpenAI

  5. 50,00 $
    Claude Fable 5.1

    Anthropic

Verwandte Vergleiche

Direktvergleiche

  1. DeepSeek-V4-Flash vs GPT-6 Astra

    Das leistungsfähigste Modell von OpenAI für schwierige End-to-End-Arbeiten, das Grenzüberlegungen mit einem Millionen-Token-Kontextfenster und einer breiten Palette von Agententools kombiniert.

    Vollständigen Vergleich öffnen
  2. DeepSeek-V4-Flash vs GPT-5.6 Sol

    Das Flaggschiff-Allgemeinmodell von OpenAI für schwierige Codierung, Analyse und professionelle Arbeit, mit einem sehr großen Kontextfenster und einem breiten nativen Toolset.

    Vollständigen Vergleich öffnen
  3. DeepSeek-V4-Flash vs Claude Fable 5.1

    Das Grenzmodell von Anthropic für ehrgeizige, langwierige Agenten- und Codierungsarbeiten mit starker Vision und Verfügbarkeit auf dem Unternehmensmarkt.

    Vollständigen Vergleich öffnen
  4. DeepSeek-V4-Flash vs Gemini 3.8 Flash

    Das stabile, hocheffiziente multimodale Modell von Google für Agenten, Softwarearbeit und große Mixed-Media-Eingaben zum Einführungspreis der Flash-Stufe.

    Vollständigen Vergleich öffnen
  5. DeepSeek-V4-Flash vs Grok 4.6

    SpaceXAIs grenzüberschreitendes Text- und Bildmodell für Codierung, Agentenaufgaben und Wissensarbeit mit direkten Web-, X- und Code-Tools.

    Vollständigen Vergleich öffnen
  6. DeepSeek-V4-Flash vs Grok 4.20 Multi-Agent Beta

    Ein spezialisiertes Grok-Modell, das mehrere KI-Agenten parallel zur Untersuchung einer schwierigen Frage entsendet und ihre Arbeit dann zu einer recherchierten Antwort zusammenfasst.

    Vollständigen Vergleich öffnen
  7. DeepSeek-V4-Flash vs Inkling

    Das große Open-Weights-Modell von Thinking Machines Lab für anpassbare Argumentations-, Codierungs-, Tools-, Vision- und Audio-Workflows.

    Vollständigen Vergleich öffnen
  8. DeepSeek-V4-Flash vs Mistral Medium 3.5

    Mistrals Open-Weight-Frontier-Modell für anspruchsvolle multimodale Codierungs-, Argumentations- und Agenten-Workflows mit einem 256K-Kontextfenster.

    Vollständigen Vergleich öffnen
  9. DeepSeek-V4-Flash vs Mistral Small 4

    Das kostengünstigere offene Modell von Mistral, das normale Anweisungen, Argumentation, Kodierung, Vision und Agenten-Tools in einem Endpunkt vereint.

    Vollständigen Vergleich öffnen
  10. DeepSeek-V4-Flash vs Qwen3.8 Max

    Das Grenzmodell

    Vollständigen Vergleich öffnen
  11. DeepSeek-V4-Flash vs MiniMax M3

    Das Millionen-Token-multimodale Modell von MiniMax für Codierung, Agenten, Computernutzung und lange Projekte zu einem niedrigen direkten API-Preis.

    Vollständigen Vergleich öffnen
  12. DeepSeek-V4-Flash vs GLM-5.3

    Das offene Argumentationsmodell mit langem Kontext von Z.ai für Codierung, Tools und Agentenarbeit auf selbst gehosteten und verwalteten Routen.

    Vollständigen Vergleich öffnen
  13. DeepSeek-V4-Flash vs Kimi K3

    Moonshot AIs multimodales Grenzmodell für Millionen-Token-Codierung, Argumentation, Wissensarbeit und werkzeuggesteuerte Agenten.

    Vollständigen Vergleich öffnen
  14. DeepSeek-V4-Flash vs Falcon-H1R-7B

    Das kompakte offene Argumentationsmodell von TII für Textaufgaben, lange Kontexte und selbstgehostete Funktionsaufruf-Workflows.

    Vollständigen Vergleich öffnen
  15. DeepSeek-V4-Flash vs Falcon-H1-34B-Instruct

    Das offene 34B-Instruktionsmodell von TII für mehrsprachigen Text, Codierung und kontrollierte selbst gehostete Anwendungen.

    Vollständigen Vergleich öffnen
  16. DeepSeek-V4-Flash vs Muse Spark 1.3

    Metas neuestes multimodales Argumentationsmodell für lang laufende Agenten, Codierung, Tools und komplexe Benutzerzusammenarbeit.

    Vollständigen Vergleich öffnen
  17. DeepSeek-V4-Flash vs Celeris-1 Magnus

    Das agentenorientierte Diffusionssprachmodell von Celeris für schnelles Denken, Tool-Schleifen, strukturierte Aktionen und OpenAI-kompatible Integration.

    Vollständigen Vergleich öffnen
  18. DeepSeek-V4-Flash vs NVIDIA Nemotron 3 Ultra

    NVIDIAs größtes Nemotron 3-Argumentationsmodell für komplexe Agenten, Codierung, Planung, Tools, RAG und Millionen-Token-Analyse.

    Vollständigen Vergleich öffnen
  19. DeepSeek-V4-Flash vs NVIDIA Nemotron 3.5 Lightning

    Das kompakte 30B-Expertenmodell von NVIDIA für effiziente Spezialagenten und Text-Workflows mit hohem Volumen.

    Vollständigen Vergleich öffnen
  20. DeepSeek-V4-Flash vs Qwen3.8-Flash

    Das effiziente multimodale Millionen-Kontext-Modell von Alibaba für schnelle Agenten, Codierung, Dokumentenarbeit, Vision, Videoverständnis und Werkzeugnutzung.

    Vollständigen Vergleich öffnen
  21. DeepSeek-V4-Flash vs DeepSeek-V4-Pro

    DeepSeeks Flaggschiff-Millionen-Kontext-Textmodell für schwierige Argumentation, Codierung, lang laufende Agenten, Tools und sehr große Ausgaben.

    Vollständigen Vergleich öffnen