← Alle Artikel

DeepSeek V4 Pro 0813 ist ein historischer Wendepunkt

Leuchtender digitaler Wal – DeepSeek V4 Pro in der finalen Version

Kurz zur Hauptsache (BLUF)

DeepSeek veröffentlichte die endgültige Version V4 Pro – Revision 0813: Das Update kam automatisch über die API, ohne Präsentationen oder Referenzen. Wir schauen uns anhand von Benchmarks an, was genau gestiegen ist, berechnen ehrlich den Unterschied zu Claude und GPT und erklären, warum sich der Preis noch nicht geändert hat.

Heute DeepSeek wurde die endgültige Version V4 Pro herausgebracht – Revision 0813. Keine Konferenzen oder Countdown-Zähler: Ich habe gerade die API aktualisiert. Wer bereits mit „deepseek-v4-pro“ gearbeitet hat, erhielt automatisch ein neues Modell, ohne etwas am Code zu ändern. Das April-Modell war eine Vorschau, dieses ist GA, und der Unterschied macht sich vor allem dort bemerkbar, wo vom Modell erwartet wird, dass es nicht in einem Chat antwortet, sondern kohärent arbeitet.

Leuchtender digitaler Wal – DeepSeek V4 Pro in der endgültigen Version

Heute ist der Tag, an dem Codierung auf Opus-Ebene wirklich zugänglich wird. Dieser Vorschlag wäre morgens der Traum eines jeden Vermarkters gewesen, und abends wäre er mit Benchmarks eine Tatsache geworden.

In NeuralSpace steht das Modell bereits: im Chat, V Abschnitt „Code“. und hinein API. Sie müssen nicht darauf warten, dass es auf den Markt kommt – Sie öffnen es und verwenden es.

Welches Modell

Technisch gesehen ist dies das gleiche Biest wie im April: Mixture-of-Experts mit 1,6 Billionen Parametern, von denen 49 Milliarden bei jedem Schritt aktiv sind. Der Kontext umfasst eine Million Token, und das Modell ist in der Lage, bis zu 384.000 Token in einer Antwort zu produzieren. Zum Vergleich: Das ist etwa zwanzigmal mehr als bei den meisten Modellen in den benachbarten Tabs.

Das Modell kann in zwei Modi denken – denkend und nicht denkend – und reasoning_effort verfügt jetzt über drei Ebenen: maximal, hoch, niedrig. In der Praxis bedeutet dies, dass ein kleines Problem kostengünstig gelöst werden kann und eine komplexe Kette mit maximaler Überlegung gelöst werden kann, ohne das Modell zu ändern.

Benchmarks: Was genau ist gewachsen

Wachstum der Benchmarks DeepSeek V4 Pro nach der Veröffentlichung der endgültigen Version

Artificial Analysis hat die endgültige Version erneut gemessen. Der Intelligenzindex stieg von 43,7 auf 45,3. Kodierungsindex – von 58,7 bis 59,4. Am stärksten stieg jedoch der Agentic Index: von 35,3 auf 37,8. Dies ist kein Zufall – Revision 0813 wurde speziell für agentenbasierte Szenarios korrigiert, bei denen das Modell nicht in einer Sitzung reagiert, sondern hin und her geht: Dateien liest, Tools aufruft, sich das Ergebnis ansieht und sich selbst korrigiert.

Von der Geschwindigkeit her liegt alles auf dem Niveau der Vorgängerversion: etwa 76 Token pro Sekunde am Ausgang, der erste Token kommt in etwa eineinhalb bis zwei Sekunden an. Das ist schnell für ein Modell dieser Größe. Ehrlicher Nachteil: Das Modell ist gesprächig. Bei AA-Messungen werden anderthalb bis zwei Mal mehr Token ausgegeben als der Marktdurchschnitt. Bedenken Sie zur genaueren Begründung, dass Sie sowohl mit zusätzlichen Token als auch mit zusätzlichen Sekunden Wartezeit bezahlen.

Gegen Claude und GPT: faire Arithmetik

Das Auffälligste in der neuesten Tabelle ist die Linie mit Claude Opus 4.8, dem ehemaligen Flaggschiff von Anthropic. DeepSeek V4 Pro 0813 schlug es in Coding-Benchmarks auf beiden Seiten: Terminal-Bench 2,1 – 87,9 gegenüber 85,0, DeepSWE – 62,7 gegenüber 58,0. Gleichzeitig kostet Opus 4.8 5 US-Dollar pro Million Input-Tokens und 25 US-Dollar pro Million Output-Tokens – 11- bzw. 29-mal teurer. Hier ist die Tabelle:

Codierungs-Benchmark-Tabelle: DeepSeek V4 Pro 0813 schlägt Claude Opus 4,8 in Terminal-Bench 2.1 und DeepSWE

Die endgültige Version kam Claude Fable 5 am nächsten: 87,9 gegenüber 88,0 im Terminal-Bench – ein Zehntel Unterschied. Laut DeepSWE liegt Fable deutlicher vorne: 70,0 gegenüber 62,7. Zählt man alle zehn agentenbasierten Benchmarks aus der Tabelle DeepSeek zusammen, liegt Fable durchschnittlich um 5,3 % vorne – doch bei zwei von zehn DeepSeek Siegen und ohne den einzigen Ausreißer (Humanity's Last Exam without tools: 42,7 vs. 53,3) schrumpft der durchschnittliche Vorsprung auf 2,8 %.

Der Preis unterscheidet sich nicht prozentual, sondern um ein Vielfaches. Fable 5 kostet 10 US-Dollar pro Million Input- und 50 US-Dollar pro Million Output-Token; V4 Pro hat 0,435 $ und 0,87 $. Beim gemischten Kurs beträgt der Betrag etwa 30 US-Dollar gegenüber 0,65 US-Dollar. Das heißt, für eine Differenz von ein paar Prozent in den Tests verlangt Anthropic etwa das 46-fache mehr. Ehrlichkeitsvorbehalte: Ich habe die Vergleichstabelle DeepSeek selbst gemessen, auf meiner eigenen unveröffentlichten Infrastruktur, zwei von zehn Tests sind intern und es gibt noch keine unabhängigen Messungen von 0813 – das Modell wurde erst heute veröffentlicht.

Um die Größenordnung zu verstehen, denken Sie an den Kimi K3. Vor einem Monat überholte sie als erstes chinesisches Model Claude Opus – eine Sensation. Aber Kimi K3 ist ein Modell mit Billionen von Parametern, für dessen Betrieb ein teurer Server erforderlich ist, sodass es im Einzelhandel nur dreimal günstiger ist als Claude Fable und nur 40 % günstiger als Claude Opus. Beeindruckend, aber darin liegt keine Demokratisierung.

Aber DeepSeek V4 Pro ist ein wahrhaft historischer Moment. In puncto Codierung schließt es mit Opus deutlich mit, es kostet 30-mal weniger als Opus und 60-mal weniger als Fable. Heute ist Vibecoding für jedermann zugänglich – nicht im Werbesinn von „verfügbar“, sondern um den Preis des Einstiegs.

Bei GPT ist die Situation komplizierter. GPT-5.5 erreicht im Artificial Analysis-Index einen Wert von 56,3 gegenüber 45,3 für DeepSeek – der Abstand ist ehrlich gesagt spürbar. Aber die Tarife sind nicht vergleichbar: 5 $/30 $ pro Million gegenüber 0,435 $/0,87 $. Aber das günstigere GPT-5.6 Luna kostet bereits 0,10 $/0,60 $ – also günstiger als DeepSeek – und erreicht einen Wert von 52,3. Es stellt sich heraus, dass der „Billigste der Großen“ nicht mehr der Einzige ist: Mit einem Preis von V4 Pro konkurriert er mit Luna und verliert hinsichtlich der Punkte sowohl gegen Terra als auch gegen Sol.

Ich füge noch ein nüchternes Zitat von außen hinzu: Eine aktuelle Einschätzung des amerikanischen NIST (CAISI) ergab, dass V4 Pro etwa acht Monate hinter den Marktführern zurückbleibt. Es stimmt, sie haben eine Vorschauversion gemessen. Ob 0813 diesen Abstand verringert hat, werden unabhängige Benchmarks zeigen, die es aber noch nicht gibt.

Der Preis hat sich nicht geändert. Tschüss

Eintritt – 0,435 $ pro Million Token, Ausstieg – 0,87 $. Cash Hit ist immer noch fast kostenlos: 0,003625 $ pro Million, 120-mal günstiger als der reguläre Eintritt. Bei Agentenketten ist dies der Hauptpunkt: Der Projektkontext wird immer wieder gelesen und es ist der Cache, der darüber entscheidet, wie viel eine Stunde Agentenarbeit kostet.

Eine Einschränkung: DeepSeek hat in der Dokumentation bereits davor gewarnt, dass es die Preise für seine API insgesamt erhöhen wird. Wann und wie lange wird nicht gesagt. Die April-Tarife sind weiterhin in Kraft, und diese sind deutlich niedriger als bei westlichen Pendants einer vergleichbaren Klasse.

Wo kann man es jetzt ausprobieren?

  • Chat: offen Modellseite — Die endgültige 0813 ist bereits die Standardeinstellung.
  • Code: V Abschnitt „Code“. Das Modell stellt eine Verbindung zum Projekt her und arbeitet mit dem Repository, den Dateien und dem Terminal.
  • API: Der Schlüssel wird im Abschnitt ausgegeben API-Schlüssel NeuralSpace, Format kompatibel mit OpenAI.

Zahlung - in Rubel aus dem Gesamtguthaben, ohne Abonnement, VPN oder ausländische Karte. Es wird die tatsächliche Nutzung abgeschrieben, nicht das „Monat im Voraus“-Paket.

Was das Modell nicht kann, ist Bilder anzusehen: Die Eingabe besteht nur aus Text. Wenn Sie eine Analyse eines Screenshots oder Fotos benötigen, ist dies für andere Modelle der Fall. Aber für Text-, Code- und lange Agentenaufgaben ist der endgültige V4 Pro jetzt einer der ehrlichsten Vorschläge in Bezug auf Leistung und Preisverhältnis. Sie können es im Chat überprüfen, und wenn Sie es in Ihr Produkt integrieren müssen – Der Schlüssel wird von der Seite „API-Schlüssel“ übernommen.

Häufig gestellte Fragen (FAQ)

Frage: Wie fange ich an? Antwort: Registrieren Sie sich auf der Plattform und erhalten Sie kostenlose Token zum Testen.

Frage: Sind die generierten Materialien für eine kommerzielle Nutzung geeignet? Antwort: Ja, Sie erhalten die vollen kommerziellen Rechte an allen erstellten Inhalten.