DeepSeek-V4-Pro
DeepSeeks Flaggschiff-Millionen-Kontext-Textmodell für schwierige Argumentation, Codierung, lang laufende Agenten, Tools und sehr große Ausgaben.
DeepSeeks Flaggschiff-Millionen-Kontext-Textmodell für schwierige Argumentation, Codierung, lang laufende Agenten, Tools und sehr große Ausgaben.
Übersicht in einfacher englischer Sprache
DeepSeek-V4-Pro ist die größere V4-Option und wurde für Aufgaben entwickelt, bei denen die Zuverlässigkeit der Agenten und tiefergehende Überlegungen wichtiger sind als der niedrigste Token-Preis. Es unterstützt Denksteuerungen, Toolaufrufe, strukturiertes JSON, eine Responses-kompatible Schnittstelle und eine maximale Ausgabe, die groß genug für umfangreichen Code oder Dokumente ist.
DeepSeek veröffentlicht separate Spitzen-, Neben-, zwischengespeicherte und nicht zwischengespeicherte Raten. Diese Preisgestaltung kann geplante oder sich wiederholende Arbeitsbelastungen belohnen, führt jedoch dazu, dass ein einzelner Token-Preis in der Schlagzeile irreführend ist. Schätzen Sie das Cache-Trefferverhältnis, die Ausgabelänge und den Tageszeitmix für die reale Anwendung.
Kategorievergleich
Hierbei handelt es sich um vom Anbieter veröffentlichte Spezifikationen, nicht um Cody-Benchmark-Ergebnisse. Folgen Sie den verlinkten Quellen für aktuelle Grenzwerte und endpunktspezifische Ausnahmen.
Preise und Vergleiche
Geben Sie Ihre Nutzung ein. Die Schätzung wird sofort aktualisiert.
Beispiel: 6.000 Eingabe-Tokens für 10 Seiten und 500 für die Zusammenfassung. Seitenlängen variieren; passen Sie die Werte an.
Ein Durchlauf sendet Ihre Eingabe einmal an das Modell und erhält eine Antwort. Tokens sind Textbausteine: Eingabe ist, was Sie senden; Ausgabe ist die erhaltene Antwort.
DeepSeek-V4-Pro
DeepSeek
Geschätzte Summe (USD)
Für die angegebene Nutzung · USD · API-Preis, kein Abonnement
Schätzungen ohne Steuern, Tools, Cache-Speicherung/-Schreiben, Freikontingente und individuelle Rabatte. Bei Bildern zählt nur die Ausgabe, nicht Prompt oder Referenzbilder. Qualitätsmodi unterscheiden sich. Nicht aufgeführte Einstellungen gelten nicht als kostenlos.
API- und Provider-Zugriff
Verfügbarkeit
Allgemein verfügbar in der DeepSeek-Web-App und über OpenAI-, Anthropic- und Responses-kompatible APIs.
Die öffentlichen Modellseiten von DeepSeek enthalten keine globale, modellspezifische Länder- oder Verarbeitungsregionsliste. Bestätigen Sie die Berechtigung zum Konto und das geltende Recht.
Überprüfen Sie die Live-VerfügbarkeitDaten und Schulung
DeepSeek dokumentiert seine Antwort-API als zustandslos und gibt an, dass Antworten und Konversationen von diesem Endpunkt nicht gespeichert werden. Hierbei handelt es sich nicht um ein vollständiges Account-weites Aufbewahrungs- oder Schulungsnutzungsversprechen; Überprüfen Sie die aktuellen Plattformbedingungen und das automatische Cache-Verhalten für sensible Daten.
Hierbei handelt es sich um eine prägnante Lektüre des zitierten Anbietermaterials und nicht um eine Rechtsberatung. Ein Drittanbieter-Gateway kann andere Speicher-, Routing-, Schulungs- und Residenzbedingungen haben als die direkte API des Modellherstellers.
Lesen Sie die Richtlinien des AnbietersHäufig gestellte Fragen
DeepSeeks Flaggschiff-Millionen-Kontext-Textmodell für schwierige Argumentation, Codierung, lang laufende Agenten, Tools und sehr große Ausgaben. DeepSeek-V4-Pro ist die größere V4-Option und wurde für Aufgaben entwickelt, bei denen die Zuverlässigkeit der Agenten und tiefergehende Überlegungen wichtiger sind als der niedrigste Token-Preis. Es unterstützt Denksteuerungen, Toolaufrufe, strukturiertes JSON, eine Responses-kompatible Schnittstelle und eine maximale Ausgabe, die groß genug für umfangreichen Code oder Dokumente ist.
DeepSeek-V4-Pro wurde gemäß den zitierten Anbietermaterialien auf 13. August 2026 veröffentlicht.
Allgemein verfügbar in der DeepSeek-Web-App und über OpenAI-, Anthropic- und Responses-kompatible APIs. Die in diesem Handbuch aufgeführten Zugriffsrouten sind DeepSeek API und DeepSeek.
Höchstwert: 1,32 $ Input · 3,96 $ Output / 1 Mio. Token. Außerhalb der Spitzenzeiten liegen die nicht zwischengespeicherten Ein- und Ausgänge bei 0,66 $ und 1,98 $ pro Million. Zwischengespeicherte Eingaben sind günstiger und DeepSeek kann den Spitzenzeitplan und die Preise ändern.
Allgemein verfügbar in der DeepSeek-Web-App und über OpenAI-, Anthropic- und Responses-kompatible APIs. Die öffentlichen Modellseiten von DeepSeek enthalten keine globale, modellspezifische Länder- oder Verarbeitungsregionsliste. Bestätigen Sie die Berechtigung zum Konto und das geltende Recht.
DeepSeek dokumentiert seine Antwort-API als zustandslos und gibt an, dass Antworten und Konversationen von diesem Endpunkt nicht gespeichert werden. Hierbei handelt es sich nicht um ein vollständiges Account-weites Aufbewahrungs- oder Schulungsnutzungsversprechen; Überprüfen Sie die aktuellen Plattformbedingungen und das automatische Cache-Verhalten für sensible Daten. Die Richtlinie gehört zu den Routen- und Kontobedingungen des Anbieters. Überprüfen Sie sie daher vor der produktiven Nutzung erneut.
Ein Preis je Modell bei gleichem Eingabe-/Ausgabeverhältnis. Jeder API-Tarif wird nach seinem Anteil an insgesamt einer Million Tokens gewichtet; verwendet wird der günstigste passende geprüfte Zugang. Dies ist ein Vergleichstarif, kein Aufgabenpreis oder Qualitätswert. Tokenisierung, Caching, Reasoning und langer Kontext können die tatsächlichen Kosten ändern.
75 % Eingabe + 25 % Ausgabe · ohne Cache-Rabatte
OpenAI
Mistral AI
OpenAI
Anthropic
OpenAI
Anthropic
OpenAI
OpenAI
Anthropic
OpenAI
Anthropic
Anthropic
OpenAI
Anthropic
Verwandte Vergleiche
Ein Claude-Modell für umfangreiche Codeänderungen, gründliche Recherchen und mehrstufige Geschäftsaufgaben.
Vollständigen Vergleich öffnenEine günstigere GPT-5.6-Option für Programmierung, Analyse und Assistenten mit Werkzeugnutzung.
Vollständigen Vergleich öffnenDie günstige GPT-5.6-Klasse für viele kurze, wiederkehrende Aufgaben.
Vollständigen Vergleich öffnenDas ursprüngliche Fable-Modell für komplexe Programmierung und mehrstufige Arbeit, weiterhin für bestehende Integrationen verfügbar.
Vollständigen Vergleich öffnenEin Claude-Modell für umfangreiche Codeänderungen, Reasoning und mehrstufige Geschäftsabläufe.
Vollständigen Vergleich öffnenEine günstigere Claude-Option für alltägliche Programmierung, Texte und werkzeuggestützte Arbeit.
Vollständigen Vergleich öffnenEin kompaktes Claude-Modell für schnelle Antworten, Klassifizierung und klar begrenzte Assistenten.
Vollständigen Vergleich öffnenDas leistungsfähigste Modell von OpenAI für schwierige End-to-End-Arbeiten, das Grenzüberlegungen mit einem Millionen-Token-Kontextfenster und einer breiten Palette von Agententools kombiniert.
Vollständigen Vergleich öffnenDas Flaggschiff-Allgemeinmodell von OpenAI für schwierige Codierung, Analyse und professionelle Arbeit, mit einem sehr großen Kontextfenster und einem breiten nativen Toolset.
Vollständigen Vergleich öffnenDas Grenzmodell von Anthropic für ehrgeizige, langwierige Agenten- und Codierungsarbeiten mit starker Vision und Verfügbarkeit auf dem Unternehmensmarkt.
Vollständigen Vergleich öffnenDas stabile, hocheffiziente multimodale Modell von Google für Agenten, Softwarearbeit und große Mixed-Media-Eingaben zum Einführungspreis der Flash-Stufe.
Vollständigen Vergleich öffnenSpaceXAIs grenzüberschreitendes Text- und Bildmodell für Codierung, Agentenaufgaben und Wissensarbeit mit direkten Web-, X- und Code-Tools.
Vollständigen Vergleich öffnenEin spezialisiertes Grok-Modell, das mehrere KI-Agenten parallel zur Untersuchung einer schwierigen Frage entsendet und ihre Arbeit dann zu einer recherchierten Antwort zusammenfasst.
Vollständigen Vergleich öffnenDas große Open-Weights-Modell von Thinking Machines Lab für anpassbare Argumentations-, Codierungs-, Tools-, Vision- und Audio-Workflows.
Vollständigen Vergleich öffnenMistrals Open-Weight-Frontier-Modell für anspruchsvolle multimodale Codierungs-, Argumentations- und Agenten-Workflows mit einem 256K-Kontextfenster.
Vollständigen Vergleich öffnenDas kostengünstigere offene Modell von Mistral, das normale Anweisungen, Argumentation, Kodierung, Vision und Agenten-Tools in einem Endpunkt vereint.
Vollständigen Vergleich öffnenDas Grenzmodell
Vollständigen Vergleich öffnenDas Millionen-Token-multimodale Modell von MiniMax für Codierung, Agenten, Computernutzung und lange Projekte zu einem niedrigen direkten API-Preis.
Vollständigen Vergleich öffnenDas offene Argumentationsmodell mit langem Kontext von Z.ai für Codierung, Tools und Agentenarbeit auf selbst gehosteten und verwalteten Routen.
Vollständigen Vergleich öffnenMoonshot AIs multimodales Grenzmodell für Millionen-Token-Codierung, Argumentation, Wissensarbeit und werkzeuggesteuerte Agenten.
Vollständigen Vergleich öffnenDas kompakte offene Argumentationsmodell von TII für Textaufgaben, lange Kontexte und selbstgehostete Funktionsaufruf-Workflows.
Vollständigen Vergleich öffnenDas offene 34B-Instruktionsmodell von TII für mehrsprachigen Text, Codierung und kontrollierte selbst gehostete Anwendungen.
Vollständigen Vergleich öffnenMetas neuestes multimodales Argumentationsmodell für lang laufende Agenten, Codierung, Tools und komplexe Benutzerzusammenarbeit.
Vollständigen Vergleich öffnenDas agentenorientierte Diffusionssprachmodell von Celeris für schnelles Denken, Tool-Schleifen, strukturierte Aktionen und OpenAI-kompatible Integration.
Vollständigen Vergleich öffnenNVIDIAs größtes Nemotron 3-Argumentationsmodell für komplexe Agenten, Codierung, Planung, Tools, RAG und Millionen-Token-Analyse.
Vollständigen Vergleich öffnenDas kompakte 30B-Expertenmodell von NVIDIA für effiziente Spezialagenten und Text-Workflows mit hohem Volumen.
Vollständigen Vergleich öffnenDas effiziente multimodale Millionen-Kontext-Modell von Alibaba für schnelle Agenten, Codierung, Dokumentenarbeit, Vision, Videoverständnis und Werkzeugnutzung.
Vollständigen Vergleich öffnenDas kostengünstigere V4-Modell von DeepSeek für umfangreiche Argumentations-, Codierungs-, Agenten- und Millionen-Token-Text-Workloads.
Vollständigen Vergleich öffnen