← Все статьи

DeepSeek V4 Pro 0813 - acesta este un punct de cotitură istoric

DeepSeek V4 Pro 0813 - acesta este un punct de cotitură istoric

Versiunea scurtă (BLUF)

DeepSeek a livrat versiunea finală V4 Pro – revizuirea 0813 – și fiecare utilizator existent deepseek-v4-pro a primit-o automat prin API, fără eveniment de lansare atașat. Benchmark-urile s-au apropiat de teritoriul Claude și GPT, în timp ce prețul rămâne neschimbat, deocamdată. Mai jos: ce anume s-a îmbunătățit, aritmetică sinceră față de concurență și unde să o încerci.

Astăzi, DeepSeek a livrat versiunea finală a V4 Pro — revizuirea 0813. Fără eveniment de lansare și numărătoare inversă: API-ul pur și simplu a fost actualizat. Oricine lucrează deja cu deepseek-v4-pro a primit noul model automat, fără modificări de cod. Versiunea din aprilie a fost o previzualizare; aceasta este versiunea GA, iar diferența arată cel mai clar unde se așteaptă ca un model să facă o muncă susținută, mai degrabă decât să răspundă la un mesaj de chat.

A glowing digital whale — DeepSeek V4 Pro in its final release

Aceasta este ziua în care codificarea la nivelul Opus a devenit cu adevărat accesibilă.Acea propoziție ar fi fost o iluzie de marketing în această dimineață; până seara este un fapt cu repere atașate.

Modelul este deja live pe NeuralSpace:în chat, înSecțiunea de codiar înAPI. Fără „așteptați lansarea” – deschideți-l și utilizați-l.

Care este modelul

Din punct de vedere tehnic, este aceeași bestie ca în aprilie: un Mixture-of-Experts cu 1,6 trilioane de parametri, dintre care 49 de miliarde activi la orice pas. Contextul este de un milion de jetoane, iar modelul poate emite până la 384 de mii de jetoane într-un singur răspuns. Pentru comparație, aceasta este de aproximativ douăzeci de ori mai mult decât majoritatea modelelor din filele învecinate.

Modelul poate gândi în două moduri – gândire și non-gândire – iar raționamentul_efort are acum trei pași: maxim, ridicat, scăzut. În practică, o mică întrebare poate fi rulată ieftin, în timp ce un lanț complex poate fi tratat la un raționament maxim fără a schimba modelele.

Benchmarks: ce sa îmbunătățit de fapt

Benchmark gains for DeepSeek V4 Pro after the final release

Artificial Analysis a remăsurat versiunea finală. Indicele de inteligență a crescut de la 43,7 la 45,3. Indicele de codificare a trecut de la 58,7 la 59,4. Dar Indexul Agentic a sărit cel mai mult: de la 35,3 la 37,8. Aceasta nu este o coincidență – revizuirea 0813 a fost reglată special pentru scenarii agentice, în care un model nu răspunde dintr-o singură lovitură, ci merge înainte și înapoi: citește fișiere, apelează instrumente, inspectează rezultatul și se corectează singur.

Viteza este aproximativ aceeași ca și versiunea anterioară: aproximativ 76 de jetoane pe secundă la ieșire, primul jetoane în aproximativ o secundă și jumătate până la două secunde. Este rapid pentru un model de această dimensiune. Dezavantajul sincer: modelul este verbos. Pe măsurătorile AA, emite de una și jumătate până la două ori mai multe jetoane decât media pieței - contați pe plata pentru jetoane suplimentare și secunde suplimentare de așteptare atunci când motivează îndelung.

Împotriva lui Claude și GPT: aritmetică sinceră

Cel mai izbitor rând din tabelul proaspăt este Claude Opus 4.8, precedentul flagship al Anthropic. DeepSeek V4 Pro 0813 a depășit-o în benchmark-uri de codare de ambele părți: Terminal-Bench 2.1 — 87.9 față de 85.0, DeepSWE — 62.7 față de 58.0. Iar Opus 4.8 costă 5 USD per milion de jetoane de intrare și 25 USD per milion de jetoane de ieșire - de 11 și 29 de ori mai mult. Iată tabelul:

Coding benchmark table: DeepSeek V4 Pro 0813 passes Claude Opus 4.8 in Terminal-Bench 2.1 and DeepSWE

Versiunea finală s-a apropiat cel mai mult de Claude Fable 5: 87,9 față de 88,0 în Terminal-Bench — o diferență de o zecime de punct. În DeepSWE, Fable este mai în față: 70,0 față de 62,7. Făcând o medie a tuturor celor zece benchmark-uri agentice din tabelul lui DeepSeek, Fable conduce cu 5,3% în medie - dar DeepSeek câștigă cu două din zece, iar fără unic valori aberante (Ultimul examen al umanității fără instrumente: 42,7 față de 53,3) diferența medie se micșorează la 2,8%.

Între timp, prețul diferă nu în puncte procentuale, ci în ordine de mărime. Fable 5 costă 10 USD per milion de intrare și 50 USD per milion de jetoane de ieșire; V4 Pro costă 0,435 USD și 0,87 USD. La o rată mixtă de aproximativ 30 USD față de 0,65 USD. Deci, pentru o diferență de câteva puncte procentuale la teste, Anthropic cere de aproximativ 46 de ori mai mulți bani. Avertismente de onestitate: DeepSeek și-a măsurat propriul tabel de comparație pe propria infrastructură nepublicată, două dintre cele zece teste sunt interne și nu există încă măsurători independente ale 0813 - modelul a apărut astăzi.

Pentru scară, amintiți-vă de Kimi K3. Acum o lună, a devenit primul model chinez care l-a învins pe Claude Opus - asta a fost o senzație. Dar Kimi K3 este un model cu un trilion de parametri care are nevoie de un server scump pentru a rula, așa că la retail este doar de trei ori mai ieftin decât Claude Fable și cu doar 40% mai ieftin decât Claude Opus. Impresionant, dar nu tocmai democratizarea.

DeepSeek V4 Pro este un moment cu adevărat istoric. Apropiindu-se cu adevărat de Opus în codificare, costă de 30 de ori mai puțin decât Opus și de 60 de ori mai puțin decât Fable. Codarea Vibe tocmai a devenit disponibilă pentru toată lumea – nu în sensul publicitar de „disponibil”, ci la prețul de intrare.

Cu GPT imaginea este mai nuanțată. GPT-5.5 are 56,3 la indicele de analiză artificială față de 45,3 pentru DeepSeek - un decalaj sincer vizibil. Dar tarifele sunt incomparabile: 5 USD/30 USD per milion față de 0,435 USD/0,87 USD. Cu toate acestea, GPT-5.6 Luna, mai ieftin, costă 0,10 USD/0,60 USD - mai puțin decât DeepSeek - și are 52,3. Așa că „cel mai ieftin dintre cei mari” nu mai este unic: la preț V4 Pro concurează cu Luna, în timp ce la scor pierde atât în ​​fața Terra cât și în fața Solului.

Adăugați un citat îngrăditor din exterior: într-o evaluare recentă a US NIST (CAISI), se spunea că V4 Pro ar urma liderii pieței cu aproximativ opt luni. Totuși, au măsurat versiunea de previzualizare. Dacă 0813 a redus acest decalaj, rămâne pentru benchmark-uri independente - și încă nu există.

Pretul nu s-a schimbat. Pentru acum

Intrarea este de 0,435 USD per milion de jetoane, iar producția este de 0,87 USD. Accesările în cache sunt încă aproape gratuite: 0,003625 USD per milion, de 120 de ori mai ieftin decât o intrare normală. Pentru lanțurile de agenți, acesta este punctul principal: contextul proiectului este recitit din nou și din nou și cache-ul este cel care decide cât costă o oră de lucru de agent.

Un avertisment: DeepSeek a avertizat deja în documentele sale că intenționează să crească prețurile API în general. Când și cu cât — nu a fost spus. Tarifele din aprilie încă se aplică deocamdată și sunt considerabil mai mici decât modelele occidentale comparabile.

Unde să-l încerci chiar acum

Plata se face în ruble dintr-un sold comun, fără abonament, fără VPN și fără card străin. Sunteți taxat pentru utilizarea efectivă, nu pentru un pachet „lună înainte”.

Ceea ce nu poate face modelul este să se uite la imagini: intrarea este doar text. Dacă trebuie să disecați o captură de ecran sau o fotografie, aceasta este pentru alte modele. Însă pentru text, cod și sarcini agentice lungi, finalul V4 Pro este una dintre cele mai sincere oferte de preț la preț.Încearcă în chat, sauluați o cheie de pe pagina cheilor APIpentru a o integra în produsul dvs.

Întrebări frecvente (FAQ)

Î: Cum încep?
R: Înscrieți-vă pe platformă și obțineți jetoane gratuite pentru testare.

Î: Pot folosi conținutul generat în scopuri comerciale?
R: Da, obțineți drepturi comerciale complete pentru tot ceea ce creați.