← Kaikki artikkelit

DeepSeek V4 Pro 0813 - tämä on historiallinen käännekohta

DeepSeek V4 Pro 0813 - tämä on historiallinen käännekohta

Lyhyt versio (BLUF)

DeepSeek on toimittanut viimeisen V4 Pro -version – versio 0813 – ja jokainen olemassa oleva deepseek-v4-pro -käyttäjä sai sen automaattisesti API:n kautta ilman käynnistystapahtumaa. Vertailuindeksit siirtyivät lähemmäs Clauden ja GPT:n aluetta, vaikka hinta pysyy toistaiseksi ennallaan. Alla: mikä tarkalleen paransi, rehellinen aritmetiikka kilpailijoihin verrattuna ja missä sitä voi kokeilla.

Tänään DeepSeek toimitti V4 Pron lopullisen version – versio 0813. Ei käynnistystapahtumaa eikä lähtölaskentaa: API yksinkertaisesti päivitettiin. Kaikki deepseek-v4-pro:n kanssa jo työskentelevät saivat uuden mallin automaattisesti ilman koodimuutoksia. Huhtikuun rakentaminen oli esikatselu; Tämä on GA-julkaisu, ja ero osoittaa selkeimmin, missä mallin odotetaan tekevän jatkuvaa työtä chat-viestiin vastaamisen sijaan.

A glowing digital whale — DeepSeek V4 Pro in its final release

Tänä päivänä Opus-tason koodauksesta tuli todella edullista.Tämä lause olisi ollut markkinointia toiveajattelua tänä aamuna; iltaan mennessä se on tosiasia ja vertailuarvot on liitetty.

Malli on jo julkaistu NeuralSpacessa:chatissa, sisälläKoodiosioja sisälläAPI. Ei "julkaisun odottamista" - avaa se ja käytä sitä.

Mikä malli on

Teknisesti se on sama peto kuin huhtikuussa: Mixture of-Experts, jolla on 1,6 biljoonaa parametria, joista 49 miljardia on aktiivisia missä tahansa vaiheessa. Konteksti on miljoona tokenia, ja malli voi lähettää jopa 384 tuhatta merkkiä yhdessä vastauksessa. Vertailun vuoksi, se on noin kaksikymmentä kertaa enemmän kuin useimmat viereisten välilehtien mallit.

Malli voi ajatella kahdessa tilassa - ajattelu ja ajattelemattomuus - ja päättelyponnistuksessa on nyt kolme vaihetta: max, high, low. Käytännössä pieni kysymys voidaan ajaa halvalla, kun taas monimutkainen ketju voidaan käsitellä maksimaalisella päättelyllä ilman mallien vaihtamista.

Vertailuarvot: mikä itse asiassa parani

Benchmark gains for DeepSeek V4 Pro after the final release

Keinotekoinen analyysi mittasi lopullisen version uudelleen. Älykkyysindeksi nousi 43,7:stä 45,3:een. Koodausindeksi nousi 58,7:stä 59,4:ään. Mutta Agentin indeksi hyppäsi eniten: 35,3:sta 37,8:aan. Se ei ole sattumaa – versio 0813 on viritetty nimenomaan agenttiskenaarioihin, joissa malli ei vastaa yhdellä kertaa, vaan liikkuu edestakaisin: lukee tiedostoja, kutsuu työkaluja, tarkastaa tuloksen ja korjaa itsensä.

Nopeus on suunnilleen sama kuin edellisessä versiossa: noin 76 merkkiä sekunnissa ulostulossa, ensimmäinen merkki noin puolessatoista tai kahdessa sekunnissa. Se on nopea tämän kokoiselle mallille. Rehellinen haittapuoli: malli on monisanainen. AA-mittauksissa se lähettää puolitoista-kaksi kertaa enemmän tokeneita kuin markkinoiden keskiarvo – voit laskea ylimääräisistä rahakkeista ja ylimääräisistä odotussekunneista, kun se perustelee pitkään.

Claudea ja GPT:tä vastaan: rehellinen aritmetiikka

Tuoreen taulukon silmiinpistävin rivi on Claude Opus 4.8, Anthropicin edellinen lippulaiva. DeepSeek V4 Pro 0813 päihitti sen koodausvertailuissa molemmilla puolilla: Terminal-Bench 2.1 – 87.9 vs. 85.0, DeepSWE – 62.7 vs. 58.0. Ja Opus 4.8 maksaa 5 dollaria miljoonalta syöttötunnisteelta ja 25 dollaria miljoonalta lähtötunnisteelta – 11 ja 29 kertaa enemmän. Tässä on taulukko:

Coding benchmark table: DeepSeek V4 Pro 0813 passes Claude Opus 4.8 in Terminal-Bench 2.1 and DeepSWE

Lopullinen versio oli lähinnä Claude Fable 5:tä: 87,9 vs. 88,0 Terminal-Benchissä - ero on pisteen kymmenesosa. DeepSWE:ssä Fable on edelleen edellä: 70,0 vs. 62,7. Kaikkien DeepSeekin taulukon kymmenen agenttivertailun keskiarvolla Fable johtaa keskimäärin 5,3 % – mutta DeepSeek voittaa kahdella kymmenestä, ja ilman yksittäistä poikkeavaa (Humanity's Last Exam ilman työkaluja: 42,7 vs. 53,3) keskimääräinen ero kutistuu 2,8 prosenttiin.

Hinta puolestaan ​​ei eroa prosenttiyksiköillä, vaan suuruusluokilla. Fable 5 maksaa 10 dollaria miljoonaa syöttöä kohden ja 50 dollaria miljoonaa lähtömerkkiä kohden; V4 Pro maksaa 0,435 dollaria ja 0,87 dollaria. Sekakorolla, joka on noin 30 dollaria vs. 0,65 dollaria. Joten muutaman prosenttiyksikön erosta testeissä Anthropic pyytää noin 46 kertaa enemmän rahaa. Rehelliset varoitukset: DeepSeek mittasi oman vertailutaulukkonsa omalla julkaisemattomalla infrastruktuurillaan, kaksi kymmenestä testistä on sisäisiä, eikä 0813:sta ole vielä riippumattomia mittauksia - malli julkaistiin tänään.

Muista mittakaavassa Kimi K3. Kuukausi sitten siitä tuli ensimmäinen kiinalainen malli, joka voitti Claude Opuksen – se oli sensaatio. Mutta Kimi K3 on biljoonaparametrinen malli, joka tarvitsee kalliin palvelimen toimiakseen, joten vähittäiskaupassa se on vain kolme kertaa halvempi kuin Claude Fable ja vain 40 % halvempi kuin Claude Opus. Vaikuttavaa, mutta ei varsinaisesti demokratisoitumista.

DeepSeek V4 Pro on aidosti historiallinen hetki. Koodauksessa aidosti Opusta lähestyvä se maksaa 30 kertaa vähemmän kuin Opus ja 60 kertaa vähemmän kuin Fable. Vibe-koodaus tuli juuri kaikkien saataville - ei "saatavilla" mainonnan merkityksessä, vaan sisäänpääsyhinnalla.

GPT:llä kuva on vivahteikampi. GPT-5.5:n keinotekoisen analyysin pistemäärä on 56,3 ja DeepSeek 45,3 – rehellisesti havaittava ero. Mutta hinnat ovat vertaansa vailla: $5/$30/miljoona verrattuna $0.435/$0.87. Halvempi GPT-5.6 Luna maksaa kuitenkin 0,10 dollaria / 0,60 dollaria - vähemmän kuin DeepSeek - ja pisteet 52,3. Joten "halvin suurista" ei ole enää ainutlaatuinen: hinnalla V4 Pro kilpailee Lunan kanssa, kun taas pistemäärässä se häviää sekä Terralle että Solille.

Lisää yksi järkyttävä lainaus ulkopuolelta: US NIST:n (CAISI) tuoreessa arvioinnissa V4 Pron sanottiin jättävän markkinajohtajia noin kahdeksan kuukautta jäljessä. He kuitenkin mittasivat esikatseluversion. Kaventiko 0813 tätä eroa riippumattomien vertailuarvojen suhteen – ja niitä ei ole vielä.

Hinta ei muuttunut. Toistaiseksi

Syöttö on 0,435 dollaria miljoonaa merkkiä kohden, tulos 0,87 dollaria. Välimuistin osumat ovat edelleen lähes ilmaisia: 0,003625 dollaria miljoonalta, 120 kertaa halvempaa kuin normaali syöttö. Agenttiketjuille tämä on pääasia: projektikonteksti luetaan uudelleen ja uudelleen, ja välimuisti päättää, kuinka paljon agenttityötunti maksaa.

Yksi varoitus: DeepSeek on jo varoittanut asiakirjoissaan, että se aikoo nostaa API-hintoja yleensä. Milloin ja kuinka paljon - ei kerrottu. Huhtikuun hinnat ovat edelleen voimassa toistaiseksi, ja ne ovat huomattavasti alhaisemmat kuin vastaavat länsimaiset mallit.

Mistä kannattaa kokeilla juuri nyt

  • Chat:avaamallisivu— lopullinen 0813 on jo oletusarvo.
  • Koodi:inKoodiosiomalli muodostaa yhteyden projektiin ja toimii arkiston, tiedostojen ja päätteen kanssa.
  • API:avain myönnetäänNeuralSpace API -avaimet, OpenAI-yhteensopiva muoto.

Maksu tapahtuu ruplissa yhdeltä jaetulta saldolta, ilman tilausta, ei VPN:ää tai ulkomaista korttia. Sinua veloitetaan todellisesta käytöstä, ei "kuukausi eteenpäin" -paketista.

Malli ei voi katsoa kuvia: syöttö on vain tekstiä. Jos sinun on leikattava kuvakaappaus tai valokuva, se on tarkoitettu muille malleille. Mutta teksti-, koodi- ja pitkiä agenttitehtäviä varten lopullinen V4 Pro on yksi rehellisimmistä hinta-laatusuhteeltaan tarjouksista.Kokeile chatissa, taiTartu avaimeen API-avaimet-sivullarakentaaksesi sen tuotteeksi.

Usein kysytyt kysymykset (FAQ)

K: Miten pääsen alkuun?
V: Rekisteröidy alustalle ja hanki ilmaisia ​​tokeneja testausta varten.

K: Voinko käyttää luotua sisältöä kaupallisesti?
V: Kyllä, saat täydet kaupalliset oikeudet kaikkeen luomaasi.