Zum Inhalt springen
Alle Modelle im Vergleich

Platz 4 im Vergleich

DeepSeek V4 Pro

DeepSeek · China · veröffentlicht 24. April 2026

92 % Gesamtbewertung

Das leistungsstärkste offene Allround-Modell, mit 1,6 Billionen Parametern das mit Abstand größte im Vergleich. Die Variante V4-Flash senkt die Hardware-Hürde deutlich.

Modell auf Hugging Face ansehen

Bewertung im Detail

Gesamtnote aus 3 gewichteten Dimensionen. Wie wir bewerten

Leistung (55 %) 95 %
DSGVO- und EU-Eignung (30 %) 82 %
Lizenz-Offenheit (15 %) 100 %

Fähigkeitsprofil

Wo DeepSeek V4 Pro stark ist, über 6 Säulen auf einer Skala von 0 bis 100. Die gestrichelte Linie ist der Median aller 32 Modelle im Vergleich. Wie die Säulen entstehen

Coding 94 Mathe & Logik 92* Wissen 95 Deutsch 84* Agentik 88* Kontext 92
DeepSeek V4 Pro Median aller Modelle * redaktionelle Einschätzung (kein belegter Benchmark)
Fähigkeitsprofil von DeepSeek V4 Pro, Werte von 0 bis 100
SäuleWertGrundlage
Programmierung94benchmarkbelegt
Mathematik & Logik92redaktionelle Einschätzung
Wissen95benchmarkbelegt
Deutsch & Sprache84redaktionelle Einschätzung
Agentik & Werkzeuge88redaktionelle Einschätzung
Langer Kontext92benchmarkbelegt
Wissen 95
Fach- und Allgemeinwissen über viele Domänen hinweg
Programmierung 94
Code schreiben und debuggen, ganze Repositories über viele Schritte bearbeiten
Mathematik & Logik · Einschätzung 92
mehrstufiges Rechnen und logisches Schließen mit prüfbarer Lösung
Langer Kontext 92
nutzbare Leistung über sehr lange Eingaben, nicht nur die Fenstergröße
Agentik & Werkzeuge · Einschätzung 88
Werkzeuge selbständig aufrufen und mehrstufige Abläufe steuern
Deutsch & Sprache · Einschätzung 84
Sprachverständnis und Mehrsprachigkeit, mit Blick auf Deutsch

Stärkste Säule: Wissen. Belegte Werte stammen aus den dokumentierten Benchmarks unten (baseline-korrigiert normalisiert), mit "Einschätzung" markierte Säulen sind eine redaktionelle Einordnung, weil kein vergleichbarer Benchmark vorlag. Details zur Methodik stehen auf der Übersichtsseite.

Steckbrief

Architektur
Mixture-of-Experts
Parameter
1,6 Bio. gesamt, 49 Mrd. aktiv je Token
Kontextfenster
1 Mio. Token
Lizenz
MIT
Eingabe
Text
Lokaler Betrieb
Mehrere RTX PRO 6000, Rechenzentrum (H200/B200)
Bei EU-Hostern
SeltenKein EU-Hoster bestätigt, nur Betrieb auf dem eigenen Server
Cloud-API (Richtwert)
0,40 € Eingabe / 0,80 € Ausgabe je Mio. TokenDeepSeek-API, Richtwert, umgerechnet aus USD

Benchmarks

Die folgenden Werte sind Hersteller-Angaben. Eine unabhängige Verifikation lag zum Stand dieser Seite nicht vor.

80,6 SWE-bench Verified
93,5 LiveCodeBench
87,5 MMLU-Pro
83,5 MRCR 1M (Long Context)

DeepSeek V4 Pro ist mit 1,6 Billionen Parametern (49 Milliarden aktiv) das mit Abstand größte Modell im Vergleich und liefert die höchste Allround-Leistung unter den offenen Modellen. Die Hersteller-Benchmarks sind durchweg sehr hoch: 80,6 bei SWE-bench Verified, 93,5 bei LiveCodeBench, 87,5 bei MMLU-Pro. Eine unabhängige Verifikation dieser Werte liegt bisher nicht vor.

Die Pro-Variante läuft praktisch nur im Rechenzentrum mit mehreren Blackwell- oder H200-Grafikkarten. Für kleinere Hardware gibt es DeepSeek V4 Flash, das hier als eigener Eintrag geführt wird und seit dem Nachtraining vom 31. Juli 2026 bei agentischen Aufgaben sogar besser abschneidet als die Pro-Variante. Beide stehen unter der MIT-Lizenz. Für die Pro-Variante ist kein europäischer Hoster bestätigt, die DSGVO-Konformität entsteht hier also nur über den Betrieb auf eigener Infrastruktur. Das Modell verarbeitet ausschließlich Text.

Wofür es taugt

  • Höchste Allround-Leistung unter den offenen Modellen
  • MIT-Lizenz ohne Nutzungsbeschränkung
  • Variante V4-Flash (284 Mrd. / 13 Mrd. aktiv) für kleinere Hardware

Wo es hakt

  • Die Pro-Variante läuft praktisch nur im Rechenzentrum
  • Kein europäischer Hoster bestätigt, DSGVO-konform nur auf eigener Hardware
  • Benchmarks nur vom Hersteller gemeldet, keine unabhängige Verifikation

Quelle: Offizielle HF-Modellkarte deepseek-ai/DeepSeek-V4-Pro, April 2026 · Stand der Recherche 21. August 2026 · die Bewertung ist eine redaktionelle Einschätzung von gewusst:KI