DeepSeek V4 Pro 0813 ist ein historischer Wendepunkt
Kurz zur Hauptsache (BLUF)
DeepSeek veröffentlichte die endgültige Version von V4 Pro – Revision 0813: Das Update kam automatisch bis API, ohne Präsentationen oder Countdowns. Wir schauen uns anhand von Benchmarks an, was genau gestiegen ist, berechnen ehrlich die Differenz mit Claude und GPT und erklären, warum sich der Preis noch nicht geändert hat.
Heute DeepSeek wurde die endgültige Version von V4 Pro herausgebracht – Revision 0813. Keine Konferenzen und Countdown-Zähler: nur aktualisiert API. Wer bereits mit „deepseek-v4-pro“ gearbeitet hat, erhielt automatisch ein neues Modell, ohne etwas am Code zu ändern. Das April-Modell war eine Vorschau, dieses ist GA, und der Unterschied macht sich vor allem dort bemerkbar, wo vom Modell erwartet wird, dass es nicht in einem Chat antwortet, sondern kohärent arbeitet.

Heute ist der Tag, an dem Codierung auf Opus-Ebene wirklich zugänglich wird. Dieser Vorschlag wäre morgens der Traum eines jeden Vermarkters gewesen, und abends wäre er mit Benchmarks eine Tatsache geworden.
In NeuralSpace steht das Modell bereits: im Chat, V Abschnitt „Code“. und hinein API. Sie müssen nicht darauf warten, dass es auf den Markt kommt – Sie öffnen es und verwenden es.
Welches Modell
Technisch gesehen ist dies das gleiche Biest wie im April: Mixture-of-Experts mit 1,6 Billionen Parametern, von denen 49 Milliarden bei jedem Schritt aktiv sind. Der Kontext umfasst eine Million Token, und das Modell ist in der Lage, bis zu 384.000 Token in einer Antwort zu produzieren. Zum Vergleich: Das ist etwa zwanzigmal mehr als bei den meisten Modellen in den benachbarten Tabs.
Das Modell kann in zwei Modi denken – denkend und nicht denkend – und reasoning_effort verfügt jetzt über drei Ebenen: maximal, hoch, niedrig. In der Praxis bedeutet dies, dass ein kleines Problem kostengünstig gelöst werden kann und eine komplexe Kette mit maximaler Überlegung gelöst werden kann, ohne das Modell zu ändern.
Benchmarks: Was genau ist gewachsen

Artificial Analysis hat die endgültige Version erneut gemessen. Der Intelligenzindex stieg von 43,7 auf 45,3. Kodierungsindex – von 58,7 bis 59,4. Am stärksten stieg jedoch der Agentic Index: von 35,3 auf 37,8. Dies ist kein Zufall – Revision 0813 wurde speziell für agentenbasierte Szenarios korrigiert, bei denen das Modell nicht in einer Sitzung reagiert, sondern hin und her geht: Dateien liest, Tools aufruft, sich das Ergebnis ansieht und sich selbst korrigiert.
Von der Geschwindigkeit her liegt alles auf dem Niveau der Vorgängerversion: etwa 76 Token pro Sekunde am Ausgang, der erste Token kommt in etwa eineinhalb bis zwei Sekunden an. Das ist schnell für ein Modell dieser Größe. Ehrlicher Nachteil: Das Modell ist gesprächig. Bei AA-Messungen werden anderthalb bis zwei Mal mehr Token ausgegeben als der Marktdurchschnitt. Bedenken Sie zur genaueren Begründung, dass Sie sowohl mit zusätzlichen Token als auch mit zusätzlichen Sekunden Wartezeit bezahlen.
Gegen Claude und GPT: faire Arithmetik
Das Auffälligste in der neuesten Tabelle ist die Linie mit Claude Opus 4.8, dem ehemaligen Flaggschiff Anthropic. DeepSeek V4 Pro 0813 schlug es in Coding-Benchmarks auf beiden Seiten: Terminal-Bench 2,1 – 87,9 gegenüber 85,0, DeepSWE – 62,7 gegenüber 58,0. Gleichzeitig kostet Opus 4.8 5 US-Dollar pro Million Input-Tokens und 25 US-Dollar pro Million Output-Tokens – 11- bzw. 29-mal teurer. Hier ist die Tabelle:

Die endgültige Version kam Claude Fable 5 am nächsten: 87,9 gegenüber 88,0 im Terminal-Bench – ein Unterschied von einem Zehntel. Laut DeepSWE liegt Fable deutlicher vorne: 70,0 gegenüber 62,7. Zählt man alle zehn agentenbasierten Benchmarks aus der Tabelle DeepSeek zusammen, liegt Fable durchschnittlich um 5,3 % vorne – aber bei zwei von zehn DeepSeek-Siegen und ohne den einzigen Ausreißer (Humanity's Last Exam ohne Tools: 42,7 vs. 53,3) schrumpft der durchschnittliche Vorsprung auf 2,8 %.
Der Preis unterscheidet sich nicht prozentual, sondern um ein Vielfaches. Fable 5 kostet 10 $ pro Million Input- und 50 $ pro Million Output-Token; für V4 Pro – 0,435 $ und 0,87 $. Beim gemischten Kurs beträgt der Betrag etwa 30 US-Dollar gegenüber 0,65 US-Dollar. Das heißt, für eine Differenz von ein paar Prozent bei Tests verlangt Anthropic etwa das 46-fache mehr. Ehrlichkeitsvorbehalte: Ich habe die Vergleichstabelle DeepSeek selbst gemessen, auf meiner eigenen unveröffentlichten Infrastruktur, zwei von zehn Tests sind intern und es gibt noch keine unabhängigen Messungen von 0813 – das Modell wurde erst heute veröffentlicht.
Um die Skala zu verstehen, denken Sie an Kimi K3. Vor einem Monat überholte sie als erstes chinesisches Model Claude Opus – eine Sensation. Aber Kimi K3 ist ein Modell mit Billionen von Parametern, es erfordert einen teuren Server zum Betrieb, sodass es im Einzelhandel nur dreimal günstiger ist als Claude Fable und nur 40 % günstiger als Claude Opus. Beeindruckend, aber darin liegt keine Demokratisierung.
Aber DeepSeek V4 Pro ist ein wahrhaft historischer Moment. In puncto Codierung schließt es mit Opus deutlich mit, es kostet 30-mal weniger als Opus und 60-mal weniger als Fable. Heute ist Vibecoding für jedermann zugänglich – nicht im Werbesinn von „verfügbar“, sondern um den Preis des Einstiegs.
Ab GPT ist die Situation komplizierter. GPT-5.5 erreicht im Index der künstlichen Analyse einen Wert von 56,3 gegenüber 45,3 für DeepSeek – der Abstand ist ehrlich gesagt deutlich zu erkennen. Aber die Tarife sind nicht vergleichbar: 5 $/30 $ pro Million gegenüber 0,435 $/0,87 $. Aber das günstigere GPT-5.6 Luna kostet bereits 0,10 $/0,60 $ – also günstiger als DeepSeek – und erreicht einen Wert von 52,3. Es stellt sich heraus, dass der „Billigste der Großen“ nicht mehr der Einzige ist: Preislich konkurriert V4 Pro mit Luna, punktuell verliert er sowohl gegen Terra als auch gegen Sol.
Ich füge noch ein nüchternes Zitat von außen hinzu: Eine aktuelle Einschätzung des amerikanischen NIST (CAISI) ergab, dass V4 Pro etwa acht Monate hinter den Marktführern zurückbleibt. Es stimmt, sie haben eine Vorschauversion gemessen. Ob 0813 diesen Abstand verringert hat, werden unabhängige Benchmarks zeigen, die es aber noch nicht gibt.
Der Preis hat sich nicht geändert. Tschüss
Eintritt – 0,435 $ pro Million Token, Ausstieg – 0,87 $. Cash Hit ist immer noch fast kostenlos: 0,003625 $ pro Million, 120-mal günstiger als der reguläre Eintritt. Bei Agentenketten ist dies der Hauptpunkt: Der Projektkontext wird immer wieder gelesen und es ist der Cache, der darüber entscheidet, wie viel eine Stunde Agentenarbeit kostet.
Eine Einschränkung: DeepSeek hat in der Dokumentation bereits davor gewarnt, dass es die Preise für sein API insgesamt erhöhen wird. Wann und wie lange wird nicht gesagt. Die April-Tarife sind weiterhin in Kraft, und diese sind deutlich niedriger als bei westlichen Pendants einer vergleichbaren Klasse.
Wo kann man es jetzt ausprobieren?
- Chat: offen Modellseite — Die endgültige 0813 ist bereits die Standardeinstellung.
- Code: V Abschnitt „Code“. Das Modell stellt eine Verbindung zum Projekt her und arbeitet mit dem Repository, den Dateien und dem Terminal.
- API: Der Schlüssel wird im Abschnitt ausgegeben API-Tasten NeuralSpace, Format kompatibel mit OpenAI.
Zahlung - in Rubel aus dem Gesamtguthaben, ohne Abonnement, VPN oder ausländische Karte. Es wird die tatsächliche Nutzung abgeschrieben, nicht das „Monat im Voraus“-Paket.
Was das Modell nicht kann, ist Bilder anzusehen: Die Eingabe besteht nur aus Text. Wenn Sie eine Analyse eines Screenshots oder Fotos benötigen, ist dies für andere Modelle der Fall. Aber für Text-, Code- und lange Agentenaufgaben ist das finale V4 Pro mittlerweile eines der fairsten Angebote, was Leistung und Preisverhältnis angeht. Sie können es im Chat überprüfen, und wenn Sie es in Ihr Produkt integrieren müssen – Der Schlüssel wird von der Seite API-Tasten übernommen.
Häufig gestellte Fragen (FAQ)
Frage: Wie fange ich an? Antwort: Registrieren Sie sich auf der Plattform und erhalten Sie kostenlose Token zum Testen.
Frage: Sind die generierten Materialien für eine kommerzielle Nutzung geeignet? Antwort: Ja, Sie erhalten die vollen kommerziellen Rechte an allen erstellten Inhalten.