DeepSeek V4 Pro 0813 - dette er et historisk vendepunkt
Kortversjonen (BLUF)
DeepSeek har sendt den endelige V4 Pro-bygningen – revisjon 0813 – og hver eksisterende deepseek-v4-pro-bruker fikk den automatisk gjennom API-en, ingen lanseringshendelse vedlagt. Benchmarks flyttet nærmere Claude og GPT-territoriet mens prisen forblir uendret foreløpig. Nedenfor: hva forbedret, ærlig aritmetikk mot konkurrentene, og hvor du kan prøve det.
I dag sendte DeepSeek den endelige versjonen av V4 Pro — revisjon 0813. Ingen lanseringshendelse og ingen nedtelling: API-en ble bare oppdatert. Alle som allerede jobber med deepseek-v4-pro fikk den nye modellen automatisk, uten kodeendringer. April-bygget var en forhåndsvisning; denne er GA-utgivelsen, og forskjellen viser tydeligst hvor en modell forventes å utføre vedvarende arbeid i stedet for å svare på en chat-melding.

Dette er dagen koding på Opus-nivå ble genuint rimelig.Den setningen ville vært markedsføringsønsketenkning denne morgenen; om kvelden er det et faktum med vedlagte benchmarks.
Modellen er allerede live på NeuralSpace:i chat, iKodeseksjonog iAPI. Ingen "venter på utrulling" - bare åpne den og bruk den.
Hva er modellen
Teknisk sett er det det samme beistet som i april: en blanding av eksperter med 1,6 billioner parametere, 49 milliarder av dem aktive på alle trinn. Kontekst er én million tokens, og modellen kan sende ut opptil 384 tusen tokens i ett enkelt svar. Til sammenligning er det omtrent tjue ganger mer enn de fleste modellene i de nærliggende fanene.
Modellen kan tenke i to moduser – tenke og ikke tenke – og reasoning_effort har nå tre trinn: maks, høy, lav. I praksis kan et lite spørsmål kjøres billig, mens en kompleks kjede kan håndteres med maksimal resonnement uten å bytte modell.
Benchmarks: hva som faktisk ble bedre

Kunstig analyse målte den endelige versjonen på nytt. Intelligence Index steg fra 43,7 til 45,3. Kodeindeks gikk fra 58,7 til 59,4. Men Agentic Index hoppet mest: fra 35,3 til 37,8. Det er ikke en tilfeldighet – revisjon 0813 ble justert spesifikt for agentscenarier, der en modell ikke svarer i ett skudd, men går frem og tilbake: leser filer, kaller verktøy, inspiserer resultatet og korrigerer seg selv.
Hastigheten er omtrent den samme som den forrige versjonen: rundt 76 tokens per sekund ved utgang, første token på omtrent ett og et halvt til to sekunder. Det er raskt for en modell av denne størrelsen. Den ærlige ulempen: modellen er detaljert. På AA-målinger avgir den halvannen til to ganger flere tokens enn markedsgjennomsnittet – regn med å betale for ekstra tokens og ekstra sekunders venting når den resonnerer lenge.
Mot Claude og GPT: ærlig aritmetikk
Den mest slående rekken i den ferske tabellen er Claude Opus 4.8, Anthropics forrige flaggskip. DeepSeek V4 Pro 0813 slo det i kodingsstandarder på begge sider: Terminal-Bench 2.1 — 87.9 mot 85.0, DeepSWE — 62.7 mot 58.0. Og Opus 4.8 koster $5 per million input-tokens og $25 per million output tokens - 11 og 29 ganger mer. Her er tabellen:

Den endelige versjonen kom nærmest Claude Fable 5: 87,9 mot 88,0 i Terminal-Bench - en forskjell på en tiendedel av et poeng. I DeepSWE er Fable lenger fremme: 70,0 mot 62,7. Ved å snitte alle ti agenter fra DeepSeeks tabell, leder Fable med 5,3 % i gjennomsnitt – men DeepSeek vinner på to av ti, og uten den eneste uteliggeren (Humanity's Last Exam uten verktøy: 42,7 mot 53,3) krymper gjennomsnittsgapet til 2,8 %.
Prisen skiller seg i mellomtiden ikke med prosentpoeng, men etter størrelsesordener. Fabel 5 koster $10 per million input og $50 per million output tokens; V4 Pro koster $0,435 og $0,87. På en blandet rate som er omtrent $30 mot $0,65. Så for en forskjell på noen få prosentpoeng på tester, ber Anthropic om omtrent 46 ganger mer penger. Forbehold om ærlighet: DeepSeek målte sin egen sammenligningstabell på sin egen upubliserte infrastruktur, to av de ti testene er interne, og det er ingen uavhengige målinger av 0813 ennå - modellen kom ut i dag.
For skala, husk Kimi K3. For en måned siden ble den den første kinesiske modellen som slo Claude Opus - det var en sensasjon. Men Kimi K3 er en trillion-parameter modell som trenger en dyr server for å kjøre, så i detaljhandelen er den bare tre ganger billigere enn Claude Fable og bare 40 % billigere enn Claude Opus. Imponerende, men ikke akkurat demokratisering.
DeepSeek V4 Pro er et genuint historisk øyeblikk. Nærmer seg Opus i koding, det koster 30 ganger mindre enn Opus og 60 ganger mindre enn Fable. Vibe-koding ble akkurat tilgjengelig for alle - ikke i reklameforstanden "tilgjengelig", men til prisen for inngang.
Med GPT er bildet mer nyansert. GPT-5.5 skårer 56,3 på Artificial Analysis-indeksen mot 45,3 for DeepSeek - et ærlig merkbart gap. Men prisene er uforlignelige: $5/$30 per million mot $0,435/$0,87. Den billigere GPT-5.6 Luna koster imidlertid $0,10/$0,60 — mindre enn DeepSeek — og får 52,3. Så "den billigste av de store" er ikke lenger unik: på pris konkurrerer V4 Pro med Luna, mens den på poengsum taper mot både Terra og Sol.
Legg til ett nøkternt sitat utenfra: i en nylig vurdering fra US NIST (CAISI) ble det sagt at V4 Pro var etter markedslederne med omtrent åtte måneder. De målte imidlertid forhåndsversjonen. Hvorvidt 0813 reduserte det gapet gjenstår for uavhengige benchmarks - og det er ingen ennå.
Prisen endret seg ikke. Foreløpig
Inndata er $0,435 per million tokens, produksjonen er $0,87. Cache-treff er fortsatt nesten gratis: $0,003625 per million, 120 ganger billigere enn en vanlig inngang. For agentkjeder er dette hovedpoenget: prosjektkontekst leses igjen og igjen, og det er cachen som bestemmer hvor mye en time agentarbeid koster.
En advarsel: DeepSeek har allerede advart i sine dokumenter om at de planlegger å øke API-prisene generelt. Når og hvor mye - ikke sagt. Prisene for april gjelder fortsatt, og de er merkbart lavere enn sammenlignbare vestlige modeller.
Hvor du kan prøve det akkurat nå
- Chat:åpnemodellside— den siste 0813 er allerede standard.
- Kode:iKodeseksjonmodellen kobles til et prosjekt og fungerer med et depot, filer og en terminal.
- API:nøkkelen utstedes iNeuralSpace API-nøkler, OpenAI-kompatibelt format.
Betalingen er i rubler fra én delt saldo, uten abonnement, uten VPN og uten utenlandsk kort. Du belastes for faktisk bruk, ikke en "måned fremover"-pakke.
Det modellen ikke kan gjøre er å se på bilder: input er kun tekst. Hvis du trenger å dissekere et skjermbilde eller et bilde, er det for andre modeller. Men for tekst, kode og lange agentoppgaver er den endelige V4 Pro en av de mest ærlige styrke-til-pris-avtalene som finnes.Prøv det i chatten, ellerta en nøkkel på API-nøkler-sidenå bygge det inn i produktet ditt.
Ofte stilte spørsmål (FAQ)
Spørsmål: Hvordan kommer jeg i gang?
A: Registrer deg på plattformen og få gratis tokens for testing.
Spørsmål: Kan jeg bruke generert innhold kommersielt?
A: Ja, du får fulle kommersielle rettigheter til alt du lager.