← Все статьи

DeepSeek V4 Pro 0813 je historickým zlomom

DeepSeek V4 Pro 0813 je historickým zlomom

Stručne o hlavnej veci (BLUF)

DeepSeek vydal finálnu verziu V4 Pro - revízia 0813: aktualizácia prišla automaticky cez API, bez prezentácií alebo referencií. Pozeráme sa na to, čo presne sa zvýšilo pomocou benchmarkov, poctivo vypočítame rozdiel s Claudom a GPT a vysvetlíme, prečo sa cena zatiaľ nezmenila.

Dnes DeepSeek predstavil finálnu verziu V4 Pro - revízia 0813. Žiadne konferencie ani odpočítavacie počítadlá: len aktualizované API. Tí, ktorí už s `deepseek-v4-pro` pracovali, automaticky dostali nový model bez toho, aby čokoľvek menili v kóde. Ten aprílový bol preview, tento je GA a rozdiel je badateľný predovšetkým tam, kde sa od modelu očakáva, že nebude reagovať v chate, ale bude fungovať súvisle.

Glowing digital whale - DeepSeek V4 Pro in the final version

Dnes je deň, kedy sa kódovanie na úrovni Opus stalo skutočne dostupným.Tento návrh by bol ráno snom obchodníka a večer by bol realitou s referenčnými hodnotami.

V NeuralSpace model už stojí:v chate, V Sekcia "Kód".a vAPI. Neexistuje žiadne „čakanie, kým sa rozbehne“ – otvoríte ho a použijete.

Aký model

Technicky ide o tú istú šelmu ako v apríli: Mixture-of-Experts s 1,6 bilióna parametrov, z ktorých 49 miliárd je aktívnych na každom kroku. Kontext je milión tokenov a model je schopný vyprodukovať až 384 tisíc tokenov v jednej odpovedi. Pre porovnanie: to je asi dvadsaťkrát viac ako väčšina modelov v susedných kartách.

Model môže myslieť v dvoch režimoch – myslenie a nemyslenie a uvažovanie_úsilie má teraz tri úrovne: max, high, low. V praxi to znamená, že malý problém sa dá vyriešiť lacno a zložitý reťazec sa dá vyriešiť maximálne premyslene, bez zmeny modelu.

Referenčné hodnoty: čo presne vyrástlo

Growth of benchmarks DeepSeek V4 Pro after the release of the final version

Umelá analýza premerala konečnú verziu. Intelligence Index sa zvýšil zo 43,7 na 45,3. Index kódovania - od 58,7 do 59,4. Najviac však vyskočil Agentic Index: z 35,3 na 37,8. Toto nie je náhoda - revízia 0813 bola opravená špeciálne pre scenáre založené na agentoch, kde model nereaguje na jedno sedenie, ale ide tam a späť: číta súbory, volá nástroje, pozerá sa na výsledok a opravuje sa.

Z hľadiska rýchlosti je všetko na úrovni predchádzajúcej verzie: približne 76 tokenov za sekundu na výstupe, prvý token dorazí za približne jeden a pol až dve sekundy. To je na model tejto veľkosti rýchle. Úprimná nevýhoda: model je zhovorčivý. Pri meraniach AA vyžaruje jeden a pol až dvakrát viac tokenov, ako je priemer na trhu – zvážte, že za podrobné zdôvodnenie platíte extra tokenmi aj sekundami čakania navyše.

Proti Claudovi a GPT: spravodlivá aritmetika

Najpozoruhodnejšia vec v najnovšej tabuľke je riadok s Claude Opus 4.8, bývalou vlajkovou loďou Anthropic. DeepSeek V4 Pro 0813 ju porazil v testoch kódovania na oboch stranách: Terminal-Bench 2.1 – 87,9 oproti 85,0, DeepSWE – 62,7 oproti 58,0. Opus 4.8 zároveň stojí 5 dolárov za milión vstupných tokenov a 25 dolárov za milión výstupných tokenov – 11- a 29-krát drahšie. Tu je tabuľka:

Coding benchmark table: DeepSeek V4 Pro 0813 beats Claude Opus 4.8 in Terminal-Bench 2.1 and DeepSWE

Konečná verzia sa najviac priblížila Claude Fable 5: 87,9 oproti 88,0 v Terminal-Bench – rozdiel jednej desatiny. Podľa DeepSWE je Fable výraznejšie vpredu: 70,0 oproti 62,7. Ak spočítate všetkých desať benchmarkov založených na agentoch z tabuľky DeepSeek, Fable vedie v priemere o 5,3 % – ale pri dvoch z desiatich víťazstiev DeepSeek a bez jedinej mimoriadnej hodnoty (Humanity's Last Exam bez nástrojov: 42,7 vs 53,3) sa priemerný náskok zníži na 2,8 %.

Cena sa nelíši percentuálne, ale niekoľkonásobne. Fable 5 stojí 10 dolárov za milión vstupných a 50 dolárov za milión výstupných tokenov; V4 Pro má 0,435 USD a 0,87 USD. Pri zmiešanom kurze to vychádza na približne 30 USD oproti 0,65 USD. To znamená, že za rozdiel niekoľkých percent v testoch si Anthropic pýta približne 46-krát viac. Úprimné upozornenia: porovnávaciu tabuľku DeepSeek som meral sám na vlastnej nepublikovanej infraštruktúre, dva z desiatich testov sú interné a zatiaľ neexistujú žiadne nezávislé merania 0813 - model bol vydaný len dnes.

Aby ste pochopili mierku, zamyslite sa nad Kimi K3. Pred mesiacom ako prvá čínska modelka predbehla Clauda Opusa – bola to senzácia. Kimi K3 je ale model s biliónmi parametrov, vyžaduje na svoj chod drahý server, takže v maloobchode je len trikrát lacnejší ako Claude Fable a len o 40 % lacnejší ako Claude Opus. Pôsobivé, ale v tomto nejde o žiadnu demokratizáciu.

DeepSeek V4 Pro je však skutočne historickým momentom. Čo sa týka kódovania, naozaj dobieha Opus, stojí 30-krát menej ako Opus a 60-krát menej ako Fable. Dnes sa vibecoding stal dostupným pre každého – nie v reklamnom zmysle „dostupný“, ale za cenu vstupu do neho.

S GPT je situácia komplikovanejšia. GPT-5.5 má skóre 56,3 v indexe umelej analýzy oproti 45,3 pre DeepSeek – rozdiel je úprimne viditeľný. Ale tarify nie sú porovnateľné: 5 USD/30 USD za milión oproti 0,435 USD/0,87 USD. Ale lacnejší GPT-5.6 Luna už stojí 0,10 $/0,60 $ – teda lacnejšie ako DeepSeek – a má skóre 52,3. Ukazuje sa, že „najlacnejší z veľkých“ už nie je jediný: cenou V4 ​​Pro konkuruje Lune a bodovo stráca na Terra aj Sol.

Pridám triezvy citát zvonku: nedávne hodnotenie amerického NIST (CAISI) uviedlo, že V4 Pro zaostáva za lídrami na trhu približne o osem mesiacov. Pravda, merali preview verziu. Či 0813 zúžil túto medzeru, ukážu nezávislé benchmarky, ktoré však zatiaľ neexistujú.

Cena sa nezmenila. dovidenia

Vstup – 0,435 USD za milión tokenov, výstup – 0,87 USD. Hotovosť je stále takmer zadarmo: 0,003625 $ za milión, 120-krát lacnejšie ako bežný vstup. Pre reťazce agentov je to hlavný bod: kontext projektu sa číta znova a znova a je to vyrovnávacia pamäť, ktorá rozhoduje o tom, koľko stojí hodina práce agenta.

Jedno upozornenie: DeepSeek už v dokumentácii varoval, že sa chystá zvýšiť ceny za svoje API ako celok. Kedy a na ako dlho sa nehovorí. Aprílové tarify sú stále v platnosti a sú výrazne nižšie ako západné náprotivky porovnateľnej triedy.

Kde to hneď vyskúšať

Platba - v rubľoch zo všeobecného zostatku, bez predplatného, ​​VPN alebo zahraničnej karty. Odpisuje sa skutočné používanie, nie balík „mesiac vopred“.

Čo model nemôže urobiť, je pozerať sa na obrázky: vstup je iba text. Ak potrebujete analýzu snímky obrazovky alebo fotografie, je to pre iné modely. Ale pre textové, kódové a dlhé úlohy agentov je teraz konečný V4 Pro jedným z najčestnejších návrhov, pokiaľ ide o pomer výkonu a ceny.Môžete si to overiť v chatea ak ho potrebujete zabudovať do svojho produktu -kľúč je prevzatý zo stránky kľúčov API.

Často kladené otázky (FAQ)

Otázka: Ako začať?Odpoveď: Zaregistrujte sa na platforme a získajte bezplatné žetóny na testovanie.

Otázka: Sú vytvorené materiály vhodné na komerčné použitie?Odpoveď: Áno, získavate plné komerčné práva na všetok vytvorený obsah.