← Alla artiklar

DeepSeek V4 Pro 0813 - det här är en historisk vändpunkt

DeepSeek V4 Pro 0813 - det här är en historisk vändpunkt

Den korta versionen (BLUF)

DeepSeek har skickat den slutliga V4 Pro-versionen – revision 0813 – och alla befintliga deepseek-v4-pro-användare fick den automatiskt via API:et, ingen lanseringshändelse bifogad. Riktmärken flyttade sig närmare Claude och GPTs territorium medan priset förblir oförändrat tills vidare. Nedan: exakt vad som förbättrades, ärlig aritmetik mot konkurrenterna och var man kan prova det.

Idag skickade DeepSeek den slutliga versionen av V4 Pro — revision 0813. Ingen lanseringshändelse och ingen nedräkning: API:et uppdaterades helt enkelt. Alla som redan arbetar med deepseek-v4-pro fick den nya modellen automatiskt, utan kodändringar. Aprilbygget var en förhandstitt; den här är GA-utgåvan, och skillnaden visar tydligast var en modell förväntas utföra ihållande arbete snarare än att svara på ett chattmeddelande.

A glowing digital whale — DeepSeek V4 Pro in its final release

Det här är dagen som kodning på Opus-nivå blev genuint prisvärd.Den meningen skulle ha varit marknadsförings önsketänkande i morse; på kvällen är det ett faktum med bifogade riktmärken.

Modellen är redan live på NeuralSpace:i chatten, iKodavsnittoch iAPI. Ingen "väntar på lansering" - bara öppna den och använd den.

Vad är modellen

Tekniskt sett är det samma best som i april: en blandning av experter med 1,6 biljoner parametrar, 49 miljarder av dem aktiva i vilket steg som helst. Kontext är en miljon tokens, och modellen kan sända ut upp till 384 tusen tokens i ett enda svar. Som jämförelse är det ungefär tjugo gånger mer än de flesta modeller på de närliggande flikarna.

Modellen kan tänka i två lägen — tänkande och icke-tänkande — och resonemang_ansträngning har nu tre steg: max, högt, lågt. I praktiken kan en liten fråga köras billigt, medan en komplex kedja kan hanteras på maximalt resonemang utan att byta modell.

Riktmärken: vad som faktiskt förbättrades

Benchmark gains for DeepSeek V4 Pro after the final release

Artificiell analys mätte om den slutliga versionen. Intelligence Index steg från 43,7 till 45,3. Coding Index gick från 58,7 till 59,4. Men Agentic Index hoppade mest: från 35,3 till 37,8. Det är inte en slump – revision 0813 har anpassats specifikt för agentscenarier, där en modell inte svarar i ett slag utan går fram och tillbaka: läser filer, anropar verktyg, inspekterar resultatet och korrigerar sig själv.

Hastigheten är ungefär densamma som den tidigare versionen: runt 76 tokens per sekund vid utgång, första token på ungefär en och en halv till två sekunder. Det är snabbt för en modell i denna storlek. Den ärliga nackdelen: modellen är mångsidig. På AA-mätningar avger den en och en halv till två gånger fler tokens än marknadsgenomsnittet - räkna med att betala för extra tokens och extra sekunders väntan när den resonerar länge.

Mot Claude och GPT: ärlig aritmetik

Den mest slående raden i den färska tabellen är Claude Opus 4.8, Anthropics tidigare flaggskepp. DeepSeek V4 Pro 0813 slog det i kodningsbenchmarks på båda sidor: Terminal-Bench 2.1 — 87.9 mot 85.0, DeepSWE — 62.7 mot 58.0. Och Opus 4.8 kostar 5 USD per miljon inmatade tokens och 25 USD per miljon output-tokens – 11 och 29 gånger mer. Här är tabellen:

Coding benchmark table: DeepSeek V4 Pro 0813 passes Claude Opus 4.8 in Terminal-Bench 2.1 and DeepSWE

Den slutliga versionen kom närmast Claude Fable 5: 87,9 mot 88,0 i Terminal-Bench - en skillnad på en tiondels poäng. I DeepSWE är Fable längre fram: 70,0 mot 62,7. Med ett genomsnitt av alla tio agentiska riktmärken från DeepSeeks tabell leder Fable med 5,3 % i snitt — men DeepSeek vinner på två av tio, och utan den enda avvikaren (Humanity's Last Exam utan verktyg: 42,7 mot 53,3) krymper det genomsnittliga gapet till 2,8%.

Priset skiljer sig inte med procentenheter utan med storleksordningar. Fabel 5 kostar $10 per miljon input och $50 per million output tokens; V4 Pro kostar $0,435 och $0,87. Till en blandad kurs som är cirka 30 USD mot 0,65 USD. Så för en skillnad på några procentenheter på tester, ber Anthropic om ungefär 46 gånger mer pengar. Varningar för ärlighet: DeepSeek mätte sin egen jämförelsetabell på sin egen opublicerade infrastruktur, två av de tio testerna är interna, och det finns inga oberoende mätningar av 0813 ännu - modellen kom ut idag.

För skala, kom ihåg Kimi K3. För en månad sedan blev den den första kinesiska modellen att slå Claude Opus - det var en sensation. Men Kimi K3 är en biljonparametermodell som behöver en dyr server för att köra, så i detaljhandeln är den bara tre gånger billigare än Claude Fable och bara 40 % billigare än Claude Opus. Imponerande, men inte precis demokratisering.

DeepSeek V4 Pro är ett genuint historiskt ögonblick. Närmar sig genuint Opus i kodning, det kostar 30 gånger mindre än Opus och 60 gånger mindre än Fable. Vibe-kodning blev precis tillgänglig för alla — inte i reklambemärkelsen "tillgänglig", utan till inträdespriset.

Med GPT blir bilden mer nyanserad. GPT-5.5 får 56,3 på indexet för artificiell analys jämfört med 45,3 för DeepSeek - en ärligt talat märkbar lucka. Men priserna är ojämförliga: $5/$30 per miljon mot $0,435/$0,87. Den billigare GPT-5.6 Luna kostar dock $0,10/$0,60 — mindre än DeepSeek — och får 52,3. Så "den billigaste av de stora" är inte längre unik: på pris konkurrerar V4 Pro med Luna, medan den på poäng förlorar mot både Terra och Sol.

Lägg till ett nykter citat utifrån: i en nyligen genomförd bedömning av amerikanska NIST (CAISI) sades V4 Pro ligga efter marknadsledarna med cirka åtta månader. De mätte dock förhandsversionen. Huruvida 0813 minskade det gapet kvarstår för oberoende riktmärken - och det finns inga ännu.

Priset ändrades inte. För nu

Ingången är $0,435 per miljon tokens, produktionen är $0,87. Cacheträffar är fortfarande nästan gratis: 0,003625 USD per miljon, 120 gånger billigare än en normal ingång. För agentkedjor är detta huvudpoängen: projektkontext läses om och om igen, och det är cachen som avgör hur mycket en timmes agentarbete kostar.

En varning: DeepSeek har redan varnat i sina dokument att de planerar att höja API-priserna i allmänhet. När och hur mycket – inte sagt. Aprilpriserna gäller fortfarande för närvarande, och de är märkbart lägre än jämförbara västerländska modeller.

Var man kan prova det just nu

  • Chatta:öppnamodellsida— den sista 0813 är redan standard.
  • Koda:iKodavsnittmodellen ansluter till ett projekt och fungerar med ett arkiv, filer och en terminal.
  • API:nyckeln utfärdas iNeuralSpace API-nycklar, OpenAI-kompatibelt format.

Betalning sker i rubel från ett delat saldo, utan prenumeration, utan VPN och inget utländskt kort. Du debiteras för faktisk användning, inte en "månad framåt"-paket.

Vad modellen inte kan göra är att titta på bilder: input är endast text. Om du behöver dissekera en skärmdump eller ett foto, så är det för andra modeller. Men för text, kod och långa agentuppgifter är den slutliga V4 Pro en av de mest ärliga styrka-till-pris-affärerna som finns.Testa det i chatten, ellerta en nyckel på sidan för API-nycklaratt bygga in det i din produkt.

Vanliga frågor (FAQ)

F: Hur kommer jag igång?
S: Registrera dig på plattformen och få gratis tokens för testning.

F: Kan jag använda genererat innehåll kommersiellt?
S: Ja, du får fullständiga kommersiella rättigheter till allt du skapar.