Stille nächtliche Freigabe der Vollversion
Am 13. August 2026 um 23:00 Uhr wurde die Modellseite in der offiziellen API-Dokumentation von DeepSeek stillschweigend aktualisiert und die Modellkennung auf DeepSeek-V4-Pro-0813 geändert. DeepSeek veranstaltete weder ein Online-Launchevent noch gab es eine Vorab-Kampagne in den sozialen Medien. Dennoch stieg das Update rasch an die Spitze von Hacker News auf und sammelte 692 Upvotes sowie 246 Community-Kommentare.
Diese Strategie eines stillen Upgrades minimiert den Migrationsaufwand für bestehende Integrationen. Entwickler müssen bei API-Aufrufen keine Anwendungslogik anpassen, da Anfragen automatisch auf die neueste Version 0813 geroutet werden. Ältere Modellbezeichnungen wie deepseek-chat und deepseek-reasoner wurden bereits Ende Juli entfernt und jeweils den Nicht-Denk- und Denkmodi der Flash-Architektur zugeordnet. Diese ruhige Veröffentlichung zeigt, dass die API-Infrastruktur die Reife für eine hohe Verfügbarkeit erreicht hat, ohne die Systemelastizität erst durch plötzliche Marketing-Traffic-Spitzen testen zu müssen.
Abbildung: Offizielle DeepSeek „Modelle & Preise“-Seite mit der auf DeepSeek-V4-Pro-0813 aktualisierten Modellversion. Quelle: DeepSeek Open Platform
Agent-Benchmarks übertreffen die Leichtgewicht-Variante
Blickt man auf die Meilensteine der V4-Serie zurück: Bei der Vorstellung der Preview-Phase im April 2026 kündigte das Unternehmen sowohl die Pro-Version mit 1,6 Billionen Parametern als auch die Flash-Version mit 284 Milliarden Parametern an. Nachdem jedoch V4-Flash-0731 am 31. Juli als Erstes den GA-Status erreichte, übertraf die Leichtgewicht-Variante die Preview-Version auf Benchmarks wie dem Terminal Bench vorübergehend mit 82,7 gegenüber 61.8 Punkten. Die Veröffentlichung der 0813-GA-Version stellt die Leistungsführung der Pro-Version innerhalb der Produktreihe nun wieder her.
| Benchmark | V4 Pro 0813 | V4 Pro Preview | Fable 5 |
|---|---|---|---|
| HLE (Ohne Werkzeuge / Mit Werkzeugen) | 42.7 / 60.0 | 37.7 / 48.2 | 53.3 / 63.0 |
| Terminal Bench 2.1 | 87.9 | 72.1 | 88.0 |
| Cybergym | 83.3 | 52.7 | 83.1 |
| DeepSWE | 62.7 | 12.8 | 70.0 |
| DSBench-FullStack | 71.1 | 41.8 | — |
Die offiziell veröffentlichten Benchmark-Daten unterstreichen die erheblichen Fortschritte von V4 Pro 0813 bei der Ausführung komplexer Agenten-Aufgaben. Besonders hervorzuheben ist das DeepSWE-Ergebnis, das von 12,8 in der Preview-Phase auf 62,7 melonierte. Terminal Bench 2.1 stieg von 72,1 auf 87,9, und Cybergym übertraf mit 83,3 Punkten sogar Fable 5. Der fast fünffache Sprung bei DeepSWE belegt die effektive Generalisierungsfähigkeit des Modells in mehrstufigen, langlaufenden Code-Reparatur-Szenarien.
Abbildung: Offizielle Benchmarks von DeepSeek V4 Pro 0813 (Agenten-Evaluierung). Quelle: Offizielle DeepSeek-Veröffentlichung / zusammengestellt von deepseekv4pro.com
Selbstverständlich basieren diese Kennzahlen auf Selbsttests des Herstellers. Bei der Agenten-Bewertung beeinflussen die Harness-Umgebung, das Prompt-Format und die Anzahl der Denk-Schritte die Endergebnisse maßgeblich. Bei werkzeuglosen Aufgaben wie HLE oder tiefgehender Repository-Logik bleibt weiterhin ein objektiver Abstand zu Opus 4.8 bestehen, was unabhängige Tests durch die Community erforderlich macht.
Architektonische Vervollständigung und offene Ausführungsfragen
In Bezug auf die technischen Spezifikationen behält V4 Pro 0813 eine Mixture-of-Experts (MoE)-Architektur bei, mit einer Gesamtparameterzahl von 1,6T, von denen 49B Parameter pro Inferenzschritt aktiviert werden. Das Modell unterstützt nativ ein Kontextfenster von 1M Tokens bei einer maximalen Einzelausgabe von 384K Tokens. Auf der Funktionsseite schließt die GA-Version Lücken durch die Unterstützung der Responses-API, der Anthropic-API-Kompatibilitätsschicht, der Dialog-Präfix-Fortsetzung sowie der FIM-Codevervollständigung.
Trotz des vollständigen API-Funktionsumfangs bleiben Lücken im offiziellen Werkzeug-Ökosystem. Das von der Entwickler-Community erwartete hauseigene Agenten-Framework „DeepSeek Harness“ wurde nicht zusammen mit der GA-Version veröffentlicht. Die offizielle Dokumentation empfiehlt weiterhin die Nutzung von Drittanbieter-Agenten wie OpenAI Codex, Claude Code oder OpenClaw. Zudem machte die Ankündigung keine klaren Angaben darüber, ob die Open-Source-Gewichte der Version 0813 unter der MIT-Lizenz veröffentlicht werden.
Ein Kontextvolumen von 1M in Kombination mit dem Ausgabelimit von 384K ermöglicht die vollständige Indizierung großer Unternehmens-Codebasen. Allerdings zwingt das Fehlen eines passenden offiziellen Ausführungs-Frameworks Entwickler dazu, eigene Mechanismen für Kontextbeschneidung und Zustandsverwaltung zu entwerfen. Dass die offizielle Harness-Architektur nicht zeitgleich bereitgestellt wurde, bedeutet, dass Unternehmenskunden weiterhin Sicherheits-Sandboxes und Kontext-Orchestrierung in Eigenregie aufbauen müssen.
Kommerzielle Segmentierung hinter der dreifachen Preisdifferenz
Parallel zur Produktfreigabe wurde auch die gestaffelte Preisstruktur angepasst. Laut der offiziellen Preisübersicht liegen die Preise für Cache-Fehlschläge bei der Eingabe sowie für die Ausgabe bei V4 Pro 0813 bei 3,00 RMB ($0,435) bzw. 6,00 RMB ($0,87) pro Million Tokens. Im Vergleich zu Flash 0731 (1,00 RMB bzw. 2,00 RMB) entsprechen diese Basistarife einer genauen Verdreifachung.
| Abrechnungsposition | V4-Pro-0813 | V4-Flash-0731 |
|---|---|---|
| Eingabe · Cache-Treffer | 0,025 RMB ($0,003625) | 0,02 RMB ($0,0028) |
| Eingabe · Cache-Fehlschlag | 3,00 RMB ($0,435) | 1,00 RMB ($0,14) |
| Ausgabe | 6,00 RMB ($0,87) | 2,00 RMB ($0,28) |
| Einzelmandanten-Gleichzeitigkeitslimit | 500 | 2500 |
Neben höheren Token-Kosten wurde das Gleichzeitigkeitslimit deutlich eingeschränkt. Das Limit pro Mandant für die Pro-Version liegt bei 500 – nur ein Fünftel des Limits von 2.500 bei der Flash-Version. Zu Stoßzeiten gilt weiterhin ein Preisaufschlag um den Faktor 2. Die Kombination aus Gleichzeitigkeitsbegrenzung und dreifachem Preisabstand etabliert eine klare Zwei-Klassen-Strategie: Flash bedient hochfrequente Skalierungsaufrufe, während Pro auf hochpreisige, komplexe Logik ausgerichtet ist.
Ein noch deutlicheres Signal verbirgt sich in den englischen Fußnoten der offiziellen Preisübersicht. Dort wird explizit darauf hingewiesen, dass eine Erhöhung der API-Gesamttarife in naher Zukunft geplant ist und ein spürbarer Preisanstieg bevorsteht. Bereits Anfang August hatten Branchenmedien über entsprechende Preiserhöhungspläne berichtet, die nun offiziell bestätigt wurden. Die Ankündigung künftiger Preiserhöhungen zusammen mit den Concurrency-Limits markiert das endgültige Ende der Phase, in der hoher Durchsatz durch extrem niedrige API-Preise subventioniert wurde.
Ende der Billig-API-Ära und neue Regeln im Spitzenwettbewerb
Die GA-Veröffentlichung von DeepSeek V4 Pro 0813 demonstriert das hohe Tempo der technischen Iteration von Open-Source-Spitzenmodellen in Agenten-Benchmarks. Dies ist jedoch weit mehr als eine reine Funktionserweiterung – es stellt einen zentralen Wendepunkt dar, an dem DeepSeek die kommerzielle Monetarisierung beschleunigt.
Mit steigenden F&E-Kosten und immensem Rechenressourcen-Verbrauch endet die frühere Strategie, Marktanteile über billige Token-Mengen zu gewinnen. Durch die Preisstaffelung zwischen Flash und Pro lenkt der Anbieter kostensensitive, hochparallele Anfragen auf Leichtgewicht-Modelle und reserviert das Flaggschiff-Modell für wertschöpfende, komplexe Szenarien. Die angekündigten allgemeinen Preiserhöhungen werden Unternehmenskunden dazu zwingen, den tatsächlichen ROI ihrer API-Nutzung neu zu bewerten.
In dieser neuen Phase, in der sich API-Preise auf ein nachhaltiges Niveau einpendeln, verlieren reine Preiskämpfe um Token ihre Zugkraft. Die Gesamtlieferqualität, die Erfolgsquote bei langlaufenden Agenten-Aufgaben sowie die Effizienz der Kontextoptimierung werden anstelle billiger Preise zum neuen Maßstab für die Bewertung von Modell-Anbietern.
Referenz-Links:
- DeepSeek API Docs: Models & Pricing
- DeepSeek V4 Hub: V4 Pro 0813 Arrives With Strong Agent Scores
- Chao News: DeepSeek V4 Pro GA veröffentlicht: 1M Kontext + 384K Ausgabe, 3x teurer als Flash
- HN Diskussion (49274600): DeepSeek V4 Pro 0813