DeepSeek V4-Pro ist da: Stärkere KI-Agenten, flexibles Reasoning und neue API-Preise
Veröffentlicht am 16.08.2026
DeepSeek hat mit DeepSeek V4-Pro die neue Version seines leistungsstärkeren V4-Modells offiziell veröffentlicht. Im Mittelpunkt stehen dabei weniger klassische Chat-Funktionen als vielmehr KI-Agenten, Programmierung und komplexe Arbeitsabläufe. Gleichzeitig führt das Unternehmen ein flexibles Reasoning-System sowie ein neues Preismodell für seine API ein.
Besonders interessant ist der Leistungssprung gegenüber der bisherigen Preview-Version. DeepSeek positioniert V4-Pro damit deutlich stärker als Modell für produktive Agenten-Anwendungen.
Deutlich größere Fortschritte bei Agenten-Aufgaben
Die größten Verbesserungen will DeepSeek bei sogenannten Agent-Workflows erreicht haben. Dabei handelt es sich um Aufgaben, bei denen ein KI-Modell nicht nur eine einzelne Antwort erzeugt, sondern beispielsweise Werkzeuge verwendet, Code schreibt, Aufgaben plant oder mehrere Arbeitsschritte selbstständig miteinander kombiniert.
Die von DeepSeek veröffentlichten Benchmarks zeigen teilweise deutliche Fortschritte gegenüber DeepSeek V4-Pro Preview.
Beim Terminal Bench 2.1 steigt das Ergebnis beispielsweise von 72,1 auf 87,9 Punkte. Im Programmier-Benchmark DeepSWE fällt der Sprung noch wesentlich größer aus: von 12,8 auf 62,7 Punkte.
Auch bei AutomationBench verbessert sich V4-Pro von 12,8 auf 31,8 Punkte. Beim schwierigeren DSBench-Hard steigt das Ergebnis von 31,1 auf 67,2 Punkte.
Damit ist vor allem eines erkennbar: DeepSeek hat die finale V4-Pro-Version gegenüber der Preview offenbar erheblich auf Agenten- und Entwickleraufgaben optimiert.
Ein pauschaler Benchmark-Sieg über alle Konkurrenten ist damit allerdings nicht verbunden. In mehreren Tests liegen Modelle wie Kimi-K3, Opus-4.8 oder das in der DeepSeek-Tabelle aufgeführte Fable 5 weiterhin vor V4-Pro. Der entscheidende Punkt des Updates ist daher weniger die Spitzenposition in jedem einzelnen Benchmark als vielmehr der große Fortschritt gegenüber DeepSeeks eigener vorheriger Version.
Reasoning lässt sich an die Aufgabe anpassen
Eine weitere Neuerung betrifft den Reasoning Effort. Sowohl bei V4-Pro als auch V4-Flash kann der Denkaufwand an die jeweilige Aufgabe angepasst werden.
DeepSeek unterscheidet dabei zwischen verschiedenen Stufen:
- Low für einfache Aufgaben
- High für typische Agent-Workflows
- Max für besonders komplexe Probleme
Das Prinzip ist für Entwickler interessant. Nicht jede Anfrage benötigt eine lange und rechenintensive Verarbeitung. Einfache Aufgaben können mit geringerem Aufwand erledigt werden, während komplexe Programmier-, Planungs- oder Analyseaufgaben mehr Rechenzeit erhalten.
Damit lässt sich möglicherweise ein besseres Verhältnis zwischen Geschwindigkeit, Kosten und Qualität erreichen.
Unterstützung für die OpenAI Responses API
Für Entwickler gibt es noch eine weitere bemerkenswerte Neuerung: DeepSeek V4-Pro bietet native Unterstützung für die OpenAI Responses API.
DeepSeek nennt außerdem ausdrücklich eine Optimierung für Codex und spricht von einer Einrichtung mit nur einem Klick.
Das dürfte insbesondere für Entwickler interessant sein, die bereits Anwendungen oder Agenten auf Basis entsprechender API-Strukturen aufgebaut haben. Eine ähnliche Schnittstelle kann den Wechsel beziehungsweise die Integration zusätzlicher Modelle vereinfachen.
V4-Pro steht sowohl über die DeepSeek-App und die Weboberfläche als auch über die API zur Verfügung. In App und Web lässt sich das Modell über den sogenannten „Expert Mode“ verwenden.
Die bisherigen API-Modellnamen sollen laut DeepSeek unverändert bleiben.
Neues Peak- und Off-Peak-Preismodell
Parallel zum V4-Release verändert DeepSeek auch seine API-Preise. Neu ist eine Unterscheidung zwischen Peak Hours und Off-Peak Hours.
Die Off-Peak-Preise liegen laut DeepSeek 50 Prozent unter den Peak-Preisen.
Für DeepSeek V4-Pro nennt das Unternehmen beispielsweise folgende Werte:
| V4-Pro | Off-Peak | Peak |
|---|---|---|
| Input bei Cache-Treffer | $0,022 | $0,044 |
| Input ohne Cache-Treffer | $0,66 | $1,32 |
| Output | $1,98 | $3,96 |
Für das günstigere DeepSeek V4-Flash liegen die veröffentlichten Werte entsprechend niedriger. Beim Output werden beispielsweise $0,66 außerhalb der Spitzenzeiten und $1,32 während der Peak-Zeiten genannt.
Als Peak-Zeiten definiert DeepSeek 01:00 bis 04:00 Uhr sowie 06:00 bis 10:00 Uhr UTC. Alle anderen Zeiten gelten als Off-Peak.
Das neue Preismodell tritt laut Veröffentlichung am 16. August 2026 um 16:00 Uhr UTC in Kraft.
Für Unternehmen und Entwickler mit zeitlich flexibel planbaren Aufgaben könnte das durchaus interessant werden. Batch-Verarbeitung, automatische Auswertungen oder andere nicht zeitkritische KI-Aufgaben könnten gezielt in die günstigeren Zeitfenster verschoben werden.
Fazit
Mit DeepSeek V4-Pro legt DeepSeek den Schwerpunkt klar auf anspruchsvollere Agenten- und Entwickleraufgaben. Besonders auffällig sind die teilweise erheblichen Verbesserungen gegenüber der vorherigen V4-Pro-Preview.
Hinzu kommen ein flexibel einstellbarer Reasoning-Aufwand, Unterstützung für die OpenAI Responses API und eine stärkere Ausrichtung auf Codex-Workflows.
Gleichzeitig versucht DeepSeek mit seinem neuen Peak-/Off-Peak-Modell, auch bei den API-Kosten neue Anreize zu setzen. Wer seine Rechenjobs zeitlich flexibel ausführen kann, zahlt außerhalb der Spitzenzeiten nur die Hälfte.
V4-Pro ist damit weniger ein gewöhnliches Modell-Update als vielmehr ein weiterer Schritt DeepSeeks in Richtung KI-Agenten, Coding und produktiver Automatisierung.
Quellen
- DeepSeek V4-Pro Release – DeepSeek