Platz 3 im Vergleich
DeepSeek V4 Pro
DeepSeek · China · veröffentlicht 24. April 2026
Mit 1,6 Billionen Parametern das mit Abstand größte offene Modell im Vergleich. Nach den Zahlen des Herstellers hat es der kleinere Nachfolger V4.1 Flash bei den meisten Aufgaben überholt. DeepSeek nimmt die Pro-API am 14. September 2026 vom Netz.
Modell auf Hugging Face ansehenBewertung im Detail
Gesamtnote aus 3 gewichteten Dimensionen. Wie wir bewerten
Fähigkeitsprofil
Wo DeepSeek V4 Pro stark ist, über 6 Säulen auf einer Skala von 0 bis 100. Die gestrichelte Linie ist der Median aller 25 Modelle im Vergleich. Wie die Säulen entstehen
| Säule | Wert | Grundlage |
|---|---|---|
| Programmierung | 94 | benchmarkbelegt |
| Mathematik & Logik | 92 | redaktionelle Einschätzung |
| Wissen | 95 | benchmarkbelegt |
| Deutsch & Sprache | 84 | redaktionelle Einschätzung |
| Agentik & Werkzeuge | 88 | redaktionelle Einschätzung |
| Langer Kontext | 92 | benchmarkbelegt |
Stärkste Säule: Wissen. Belegte Werte stammen aus den dokumentierten Benchmarks unten (baseline-korrigiert normalisiert), mit "Einschätzung" markierte Säulen sind eine redaktionelle Einordnung, weil kein vergleichbarer Benchmark vorlag. Details zur Methodik stehen auf der Übersichtsseite.
Steckbrief
- Architektur
- Mixture-of-Experts
- Parameter
- 1,6 Bio. gesamt, 49 Mrd. aktiv je Token
- Kontextfenster
- 1 Mio. Token
- Lizenz
- MIT
- Eingabe
- Text
- Lokaler Betrieb
- Mehrere RTX PRO 6000, Rechenzentrum (H200/B200)
- Bei EU-Hostern
- SeltenKein EU-Hoster bestätigt, nur Betrieb auf dem eigenen Server
Benchmarks
Die folgenden Werte sind Hersteller-Angaben. Eine unabhängige Verifikation lag zum Stand dieser Seite nicht vor.
DeepSeek V4 Pro ist mit 1,6 Billionen Parametern (49 Milliarden aktiv) das mit Abstand größte Modell im Vergleich und liefert die höchste Allround-Leistung unter den offenen Modellen. Die Hersteller-Benchmarks sind durchweg sehr hoch: 80,6 bei SWE-bench Verified, 93,5 bei LiveCodeBench, 87,5 bei MMLU-Pro. Eine unabhängige Verifikation dieser Werte liegt bisher nicht vor.
Die Pro-Variante läuft praktisch nur im Rechenzentrum mit mehreren Blackwell- oder H200-Grafikkarten. Für kleinere Hardware gibt es die Flash-Linie, seit dem 10. September 2026 als DeepSeek V4.1 Flash mit eigenem Eintrag. In der Vergleichstabelle des Herstellers liegt der Nachfolger bei Terminal-Bench 2.1 mit 90,6 gegenüber 87,9 vorn, bei DeepSWE v1.1 mit 74,2 gegenüber 62,7. Bei Wissensfragen und langen Eingaben bleibt die Pro-Variante stärker. Über die eigene API bietet DeepSeek das Pro-Modell nur noch bis zum 14. September 2026 an, danach landen Anfragen bei V4.1 Flash. Beide stehen unter der MIT-Lizenz. Für die Pro-Variante ist kein europäischer Hoster bestätigt, die DSGVO-Konformität entsteht hier also nur über den Betrieb auf eigener Infrastruktur. Das Modell verarbeitet ausschließlich Text.
Wofür es taugt
- Bei Wissensfragen weiter vorn, 55,2 bei SimpleQA-Verified gegenüber 42,3 beim Nachfolger V4.1 Flash (Basismodelle, Herstellerangabe)
- MIT-Lizenz ohne Nutzungsbeschränkung
- Die Flash-Linie läuft mit rund einem Drittel des Speichers, seit dem 10. September 2026 als V4.1 Flash mit eigenem Eintrag
Wo es hakt
- Die Pro-Variante läuft praktisch nur im Rechenzentrum
- Kein europäischer Hoster bestätigt, DSGVO-konform nur auf eigener Hardware
- Benchmarks nur vom Hersteller gemeldet, keine unabhängige Verifikation
- DeepSeek leitet Anfragen an die Pro-API ab dem 14. September 2026 auf V4.1 Flash um, über die Cloud gibt es das Modell danach nicht mehr
Quelle: Offizielle HF-Modellkarte deepseek-ai/DeepSeek-V4-Pro, April 2026, sowie Änderungsprotokoll der DeepSeek-API, September 2026 · Stand der Recherche 16. September 2026 · die Bewertung ist eine redaktionelle Einschätzung von neuost