← Все статьи

DeepSeek V4 Pro 0813 este un punct de cotitură istoric

Balenă digitală strălucitoare - DeepSeek V4 Pro în versiunea finală

Pe scurt despre principalul lucru (BLUF)

DeepSeek a lansat versiunea finală V4 Pro - revizuirea 0813: actualizarea a sosit automat prin API, fără prezentări sau referințe. Ne uităm la ce anume a crescut folosind benchmark-uri, calculăm sincer diferența cu Claude și GPT și explicăm de ce prețul nu s-a schimbat încă.

Astăzi DeepSeek a lansat versiunea finală V4 Pro - revizuirea 0813. Fără conferințe sau numărătoare inversă: tocmai am actualizat API-ul. Cei care au lucrat deja cu `deepseek-v4-pro` au primit automat un nou model fără a modifica nimic din cod. Cel din aprilie a fost o previzualizare, acesta este GA, iar diferența se observă în primul rând acolo unde se așteaptă ca modelul să nu răspundă într-un chat, ci să funcționeze coerent.

Balenă digitală strălucitoare - DeepSeek V4 Pro în versiunea finală

Astăzi este ziua în care codificarea la nivel de Opus a devenit cu adevărat accesibilă. Această propunere ar fi fost visul unui marketer dimineața, iar seara ar fi fost un fapt cu repere de început.

În NeuralSpace modelul este deja în picioare: în chat, V Secțiunea „Cod”. si in API. Nu există „să aștepți să se lanseze” – îl deschideți și îl utilizați.

Ce model

Din punct de vedere tehnic, aceasta este aceeași bestie ca în aprilie: Mixture-of-Experts cu 1,6 trilioane de parametri, dintre care 49 de miliarde sunt activi la fiecare pas. Contextul este de un milion de jetoane, iar modelul este capabil să producă până la 384 de mii de jetoane într-un singur răspuns. Pentru comparație: aceasta este de aproximativ douăzeci de ori mai mult decât majoritatea modelelor din filele învecinate.

Modelul poate gândi în două moduri - gândire și non-gândire, iar raționamentul_efort are acum trei niveluri: maxim, ridicat, scăzut. În practică, aceasta înseamnă că o mică problemă poate fi rezolvată ieftin, iar un lanț complex poate fi rezolvat cu maximă gândire, fără a schimba modelul.

Benchmarks: ce anume a crescut

Creșterea benchmark-urilor DeepSeek V4 Pro după lansarea versiunii finale

Artificial Analysis a remăsurat versiunea finală. Indicele de inteligență a crescut de la 43,7 la 45,3. Index de codificare - de la 58,7 la 59,4. Dar Indicele Agentic a sărit cel mai mult: de la 35,3 la 37,8. Acesta nu este un accident - revizuirea 0813 a fost corectată special pentru scenariile bazate pe agenți, în care modelul nu răspunde într-o singură ședință, ci merge înainte și înapoi: citește fișiere, apelează instrumente, se uită la rezultat și se corectează.

În ceea ce privește viteza, totul este la nivelul versiunii anterioare: aproximativ 76 de jetoane pe secundă la ieșire, primul jetoane ajunge în aproximativ o secundă și jumătate până la două secunde. Este rapid pentru un model de această dimensiune. Dezavantajul sincer: modelul este vorbăreț. La măsurătorile AA, împrăștie de una și jumătate până la două ori mai multe jetoane decât media pieței - luați în considerare că, pentru o rațiune detaliată, plătiți atât cu jetoane suplimentare, cât și cu secunde suplimentare de așteptare.

Împotriva lui Claude și GPT: aritmetică corectă

Cel mai remarcabil lucru din ultimul tabel este linia cu Claude Opus 4.8, fostul flagship al Anthropic. DeepSeek V4 Pro 0813 a depășit-o în benchmark-uri de codare pe ambele părți: Terminal-Bench 2.1 - 87.9 față de 85.0, DeepSWE - 62.7 față de 58.0. În același timp, Opus 4.8 costă 5 USD per milion de jetoane de intrare și 25 USD per milion de jetoane de ieșire - de 11 și 29 de ori mai scumpe. Iată tabelul:

Tabel de referință de codare: DeepSeek V4 Pro 0813 îl învinge pe Claude Opus 4.8 în Terminal-Bench 2.1 și DeepSWE

Versiunea finală s-a apropiat cel mai mult de Claude Fable 5: 87,9 față de 88,0 în Terminal-Bench — o diferență de o zecime. Potrivit DeepSWE, Fable este mai vizibil în față: 70,0 față de 62,7. Dacă numărați toate cele zece benchmark-uri bazate pe agenți din tabelul DeepSeek, Fable este în avans cu o medie de 5,3% - dar pentru două din zece DeepSeek victorii și fără singurul punct aberant (Ultimul examen al umanității fără instrumente: 42,7 față de 53,3) lead-ul mediu scade cu 2,8%.

Prețul diferă nu în procente, ci de mai multe ori. Fable 5 costă 10 USD per milion de intrare și 50 USD per milion de jetoane de ieșire; V4 Pro are 0,435 USD și 0,87 USD. La rata mixtă, se ridică la aproximativ 30 USD față de 0,65 USD. Adică pentru o diferență de câteva procente la teste, Anthropic cere să plătească de aproximativ 46 de ori mai mult. Avertismente de onestitate: eu însumi am măsurat tabelul de comparație DeepSeek, pe propria infrastructură nepublicată, două din zece teste sunt interne și nu există încă măsurători independente ale 0813 - modelul a fost lansat abia astăzi.

Pentru a înțelege scara, gândiți-vă la Kimi K3. Acum o lună, ea a fost primul model chinez care l-a depășit pe Claude Opus - a fost o senzație. Dar Kimi K3 este un model cu trilioane de parametri, necesită un server scump pentru a rula, așa că la retail este doar de trei ori mai ieftin decât Claude Fable și cu doar 40% mai ieftin decât Claude Opus. Impresionant, dar nu există democratizare în asta.

Dar DeepSeek V4 Pro este un moment cu adevărat istoric. Într-adevăr, ajungând din urmă cu Opus în ceea ce privește codificarea, costă de 30 de ori mai puțin decât Opus și de 60 de ori mai puțin decât Fable. Astăzi, codificarea vibrațiilor a devenit accesibilă tuturor – nu în sensul publicitar de „disponibil”, ci la prețul intrării în ea.

Cu GPT situația este mai complicată. GPT-5.5 are 56,3 în indicele de analiză artificială față de 45,3 pentru DeepSeek - decalajul este sincer vizibil. Dar tarifele nu sunt comparabile: 5 USD/30 USD per milion față de 0,435 USD/0,87 USD. Dar mai ieftin GPT-5.6 Luna costă deja 0,10 USD/0,60 USD - adică mai ieftin decât DeepSeek - și are 52,3. Se dovedește că „cel mai ieftin dintre cei mari” nu mai este singurul: la un preț de V4 Pro concurează cu Luna, iar la puncte pierde atât Terra, cât și Sol.

Voi adăuga un citat sobru din exterior: o evaluare recentă a NIST american (CAISI) a spus că V4 Pro rămâne în urmă cu aproximativ opt luni în urma liderilor de piață. Adevărat, au măsurat o versiune de previzualizare. Dacă 0813 a redus acest decalaj va fi arătat de repere independente, dar nu există încă.

Pretul nu s-a schimbat. la revedere

Intrare – 0,435 USD per milion de jetoane, ieșire – 0,87 USD. Cash-ul este încă aproape gratuit: 0,003625 USD per milion, de 120 de ori mai ieftin decât intrarea obișnuită. Pentru lanțurile de agenți, acesta este punctul principal: contextul proiectului este citit din nou și din nou, iar memoria cache este cea care decide cât costă o oră de lucru de agent.

Un avertisment: DeepSeek a avertizat deja în documentație că va crește prețurile pentru API-ul său în ansamblu. Când și pentru cât timp nu se spune. Tarifele din aprilie sunt încă în vigoare, iar acestea sunt considerabil mai mici decât analogii occidentali dintr-o clasă comparabilă.

Unde să-l încerci chiar acum

Plata - în ruble din soldul general, fără abonament, VPN sau card străin. Utilizarea efectivă este anulată, nu pachetul „lună în avans”.

Ceea ce modelul nu poate face este să se uite la imagini: intrarea este doar text. Dacă aveți nevoie de analiza unei capturi de ecran sau a unei fotografii, aceasta este pentru alte modele. Dar pentru text, cod și sarcini de agent lung, V4 Pro final este acum una dintre cele mai oneste propuneri în ceea ce privește puterea și raportul preț. O poți verifica în chat, iar dacă trebuie să îl integrați în produsul dvs. - cheia este preluată din pagina de chei API.

Întrebări frecvente (FAQ)

Întrebare: Cum să încep? Răspuns: Înregistrați-vă pe platformă și primiți jetoane gratuite pentru testare.

Întrebare: Materialele generate sunt adecvate utilizării comerciale? Răspuns: Da, primiți drepturi comerciale complete asupra întregului conținut creat.