← Alla artiklar

DeepSeek V4 Pro 0813 är en historisk vändpunkt

Glödande digitalval - DeepSeek V4 Pro i den slutliga versionen

Kort om det viktigaste (BLUF)

DeepSeek släppte den slutliga versionen V4 Pro - revision 0813: uppdateringen kom automatiskt via API:et, utan presentationer eller referenser. Vi tittar på exakt vad som har ökat med hjälp av riktmärken, beräknar ärligt skillnaden med Claude och GPT och förklarar varför priset inte har ändrats ännu.

Idag rullade DeepSeek ut den slutliga versionen V4 Pro - revision 0813. Inga konferenser eller nedräkningsräknare: har precis uppdaterat API:et. De som redan har arbetat med `deepseek-v4-pro` fick automatiskt en ny modell utan att ändra något i koden. Den i april var en förhandstitt, den här är GA, och skillnaden märks främst där modellen förväntas inte svara i en chatt, utan fungera sammanhängande.

Glödande digitalval - DeepSeek V4 Pro i den slutliga versionen

Idag är dagen då kodning på Opus-nivå verkligen blev tillgänglig. Detta förslag skulle ha varit en marknadsförares dröm på morgonen, och på kvällen skulle det ha varit ett faktum med riktmärken att starta.

I NeuralSpace står modellen redan: i chatten, V avsnittet "Kod". och in API. Det finns ingen "vänta på att den ska rulla ut" - du öppnar den och använder den.

Vilken modell

Tekniskt sett är detta samma best som i april: Mixture-of-Experts med 1,6 biljoner parametrar, varav 49 miljarder är aktiva i varje steg. Kontexten är en miljon tokens, och modellen kan producera upp till 384 tusen tokens i ett svar. Som jämförelse: detta är ungefär tjugo gånger mer än de flesta modeller i de närliggande flikarna.

Modellen kan tänka i två lägen - tänkande och icke-tänkande, och resonemang_ansträngning har nu tre nivåer: max, hög, låg. I praktiken innebär det att en liten fråga kan lösas billigt, och en komplex kedja kan lösas med maximal eftertanke, utan att modellen ändras.

Riktmärken: vad exakt har växt

Tillväxt av riktmärken DeepSeek V4 Pro efter lanseringen av den slutliga versionen

Artificiell analys mätte om den slutliga versionen. Intelligence Index ökade från 43,7 till 45,3. Kodningsindex - från 58,7 till 59,4. Men Agentic Index hoppade mest: från 35,3 till 37,8. Det här är ingen olycka - revision 0813 korrigerades specifikt för agentbaserade scenarier, där modellen inte svarar i ett tillfälle, utan går fram och tillbaka: läser filer, anropar verktyg, tittar på resultatet och korrigerar sig själv.

När det gäller hastighet är allt på samma nivå som den tidigare versionen: cirka 76 tokens per sekund vid utgången, den första token anländer på ungefär en och en halv till två sekunder. Det är snabbt för en modell av den här storleken. Ärlig nackdel: modellen är pratsam. Vid AA-mätningar stänker den ut en och en halv till två gånger fler tokens än marknadsgenomsnittet – tänk på att du för detaljerade resonemang betalar med både extra polletter och extra sekunders väntan.

Mot Claude och GPT: rättvis aritmetik

Det mest märkbara i den senaste tabellen är linjen med Claude Opus 4.8, Anthropics tidigare flaggskepp. DeepSeek V4 Pro 0813 slog det i kodningsbenchmarks på båda sidor: Terminal-Bench 2.1 - 87.9 mot 85.0, DeepSWE - 62.7 mot 58.0. Samtidigt kostar Opus 4.8 5 USD per miljon inmatade tokens och 25 USD per miljon output-tokens – 11 och 29 gånger dyrare. Här är tabellen:

Benchmarktabell för kodning: DeepSeek V4 Pro 0813 slår Claude Opus 4.8 i Terminal-Bench 2.1 och DeepSWE

Den slutliga versionen kom närmast Claude Fable 5: 87,9 mot 88,0 i Terminal-Bench - en tiondels skillnad. Enligt DeepSWE ligger Fable mer märkbart före: 70,0 mot 62,7. Om du räknar alla tio agentbaserade riktmärken från tabellen DeepSeek, ligger Fable före med i snitt 5,3 % – men på två av tio DeepSeek-vinster, och utan den enda utstickaren (Humanity's Last Exam utan verktyg: 42,7 vs 53,3) krymper den genomsnittliga ledningen 2,8 %.

Priset skiljer sig inte med procent, utan med flera gånger. Fabel 5 kostar $10 per miljon input och $50 per million output tokens; V4 Pro har $0,435 och $0,87. I blandad takt blir det cirka 30 USD mot 0,65 USD. Det vill säga, för en skillnad på några procent i tester, ber Anthropic att betala ungefär 46 gånger mer. Varningar för ärlighet: Jag mätte jämförelsetabellen DeepSeek själv, på min egen opublicerade infrastruktur, två av tio tester är interna, och det finns inga oberoende mätningar av 0813 ännu - modellen släpptes först idag.

För att förstå skalan, tänk på Kimi K3. För en månad sedan var hon den första kinesiska modellen att köra om Claude Opus – det var en sensation. Men Kimi K3 är en modell med biljoner parametrar, den kräver en dyr server att köra, så i detaljhandeln är den bara tre gånger billigare än Claude Fable och bara 40% billigare än Claude Opus. Imponerande, men det finns ingen demokratisering i detta.

Men DeepSeek V4 Pro är ett verkligt historiskt ögonblick. Har verkligen kommit ikapp Opus när det gäller kodning, det kostar 30 gånger mindre än Opus och 60 gånger mindre än Fable. Idag har vibecoding blivit tillgänglig för alla – inte i reklambemärkelsen "tillgänglig", utan till priset av inträde i den.

Med GPT är situationen mer komplicerad. GPT-5.5 får 56,3 i indexet för artificiell analys jämfört med 45,3 för DeepSeek - skillnaden är ärligt talat märkbar. Men tarifferna är inte jämförbara: $5/$30 per miljon mot $0,435/$0,87. Men den billigare GPT-5.6 Luna kostar redan $0,10/$0,60 - det vill säga billigare än DeepSeek - och får 52,3. Det visar sig att den "billigaste av de stora" inte längre är den enda: till ett pris av V4 Pro konkurrerar den med Luna, och poängmässigt förlorar den mot både Terra och Sol.

Jag lägger till ett nyktert citat från utsidan: en nyligen genomförd bedömning av amerikanska NIST (CAISI) sa att V4 Pro släpar efter marknadsledare med cirka åtta månader. Det är sant att de mätte en förhandsversion. Huruvida 0813 har minskat detta gap kommer att visas av oberoende riktmärken, men de finns inte ännu.

Priset har inte förändrats. Hejdå

Inträde – 0,435 USD per miljon tokens, utgång – 0,87 USD. Cash hit är fortfarande nästan gratis: $0,003625 per miljon, 120 gånger billigare än vanligt inträde. För agentkedjor är detta huvudpoängen: projektkontexten läses om och om igen, och det är cachen som avgör hur mycket en timmes agentarbete kostar.

En varning: DeepSeek har redan varnat i dokumentationen för att den kommer att höja priserna för dess API som helhet. När och hur länge sägs inte. Apriltullarna är fortfarande i kraft, och det är märkbart lägre än västerländska analoger av jämförbar klass.

Var man kan prova det just nu

  • Chatta: öppna modellsida — den sista 0813 är redan standard.
  • Koda: V avsnittet "Kod". modellen ansluter till projektet och fungerar med arkivet, filerna och terminalen.
  • API: nyckeln utfärdas i avsnittet API-nycklar NeuralSpace, format kompatibelt med OpenAI.

Betalning - i rubel från det allmänna saldot, utan abonnemang, VPN eller utländskt kort. Faktisk användning skrivs av, inte paketet "månad i förväg".

Vad modellen inte kan göra är att titta på bilder: inmatningen är endast text. Om du behöver analysera en skärmdump eller foto, är detta för andra modeller. Men för text, kod och långa agentuppgifter är den slutliga V4 Pro nu ett av de mest ärliga förslagen när det gäller kraft och prisförhållande. Du kan kolla det i chatten, och om du behöver bygga in det i din produkt - nyckeln är hämtad från sidan för API-nycklar.

Vanliga frågor (FAQ)

Fråga: Hur kommer man igång? Svar: Registrera dig på plattformen och få gratis tokens för testning.

Fråga: Är de genererade materialen lämpliga för kommersiellt bruk? Svar: Ja, du får fullständiga kommersiella rättigheter till allt innehåll som skapas.