← Kaikki artikkelit

DeepSeek V4 Pro 0813 on historiallinen käännekohta

DeepSeek V4 Pro 0813 on historiallinen käännekohta

Lyhyesti pääasiasta (BLUF)

DeepSeek julkaisi lopullisen version V4 Pro - versio 0813: päivitys saapui automaattisesti API:n kautta, ilman esityksiä tai viittauksia. Katsomme, mikä tarkalleen on kasvanut vertailuarvojen avulla, laskemme rehellisesti eron Clauden ja GPT:n kanssa ja selitämme, miksi hinta ei ole vielä muuttunut.

Tänään DeepSeek julkaisi lopullisen version V4 Pro - versio 0813. Ei konferensseja tai lähtölaskentalaskuria: vain päivitetty API. Ne, jotka ovat jo työskennelleet "deepseek-v4-pron" kanssa, saivat automaattisesti uuden mallin muuttamatta mitään koodissa. Huhtikuun ensimmäinen oli esikatselu, tämä on GA, ja ero on havaittavissa ensisijaisesti siinä, että mallin ei odoteta reagoivan chatissa, vaan toimivan johdonmukaisesti.

Glowing digital whale - DeepSeek V4 Pro in the final version

Tänään on päivä, jolloin Opus-tason koodauksesta tuli todella saatavilla.Tämä ehdotus olisi ollut markkinoijan unelma aamulla, ja illalla se olisi ollut tosiasia, jossa on benchmarks käynnistyä.

NeuralSpacessa malli on jo pystyssä:chatissa, V "Koodi" -osioja sisäänAPI. Ei ole mitään "odota sen ilmestymistä" - avaat sen ja käytät sitä.

Mikä malli

Teknisesti tämä on sama peto kuin huhtikuussa: Mixture of-Experts, jolla on 1,6 biljoonaa parametria, joista 49 miljardia on aktiivisia jokaisessa vaiheessa. Konteksti on miljoona tokenia, ja malli pystyy tuottamaan jopa 384 tuhatta merkkiä yhdellä vastauksella. Vertailun vuoksi: tämä on noin kaksikymmentä kertaa enemmän kuin useimmissa viereisten välilehtien malleissa.

Malli voi ajatella kahdessa tilassa - ajattelevassa ja ei-ajattelussa, ja järkeilyn_ponnistuksessa on nyt kolme tasoa: max, high, low. Käytännössä tämä tarkoittaa, että pieni ongelma voidaan ratkaista halvalla ja monimutkainen ketju voidaan ratkaista mahdollisimman harkiten, mallia muuttamatta.

Vertailuarvot: mikä tarkalleen on kasvanut

Growth of benchmarks DeepSeek V4 Pro after the release of the final version

Keinotekoinen analyysi mittasi lopullisen version uudelleen. Älykkyysindeksi nousi 43,7:stä 45,3:een. Koodausindeksi - 58,7 - 59,4. Mutta agenttiindeksi hyppäsi eniten: 35,3:sta 37,8:aan. Tämä ei ole sattumaa - versio 0813 on korjattu nimenomaan agenttipohjaisiin skenaarioihin, joissa malli ei vastaa yhdellä istumalla, vaan liikkuu edestakaisin: lukee tiedostoja, kutsuu työkaluja, katsoo tulosta ja korjaa itsensä.

Nopeudessa kaikki on edellisen version tasolla: noin 76 merkkiä sekunnissa lähdössä, ensimmäinen token saapuu noin puolessatoista kahdessa sekunnissa. Se on nopea tämän kokoiselle mallille. Rehellinen haittapuoli: malli on puhelias. AA-mittauksissa se roiskuu puolitoista-kaksi kertaa enemmän tokeneita kuin markkinoiden keskiarvo - ota huomioon, että yksityiskohtaisesta päättelystä maksat sekä ylimääräisillä rahakkeilla että ylimääräisillä odotussekunneilla.

Claudea ja GPT:tä vastaan: reilu aritmetiikka

Huomattavin asia uusimmassa taulukossa on linja Claude Opus 4.8:n kanssa, Anthropicin entisen lippulaivan kanssa. DeepSeek V4 Pro 0813 päihitti sen koodausvertailuissa molemmilta puolilta: Terminal-Bench 2.1 - 87.9 vs. 85.0, DeepSWE - 62.7 vs. 58.0. Samaan aikaan Opus 4.8 maksaa 5 dollaria miljoonalta syöttötunnisteelta ja 25 dollaria miljoonalta lähtötunnisteelta - 11 ja 29 kertaa kalliimpia. Tässä on taulukko:

Coding benchmark table: DeepSeek V4 Pro 0813 beats Claude Opus 4.8 in Terminal-Bench 2.1 and DeepSWE

Lopullinen versio oli lähinnä Claude Fable 5:tä: 87.9 verrattuna Terminal-Benchin 88.0:aan – kymmenesosan ero. DeepSWE:n mukaan Fable on selvästi edellä: 70,0 vs. 62,7. Jos lasket kaikki kymmenen agenttipohjaista vertailuarvoa taulukosta DeepSeek, Fable on edellä keskimäärin 5,3 % - mutta kahdella kymmenestä DeepSeek-voitosta, ja ilman ainoaa poikkeamaa (Humanity's Last Exam ilman työkaluja: 42,7 vs. 53,3) keskimääräinen johto kutistuu 2,8 prosenttiin.

Hinta ei eroa prosentteina, vaan useita kertoja. Fable 5 maksaa 10 dollaria miljoonaa syöttöä kohden ja 50 dollaria miljoonaa lähtömerkkiä kohden; V4 Prolla on 0,435 dollaria ja 0,87 dollaria. Sekakorolla se on noin 30 dollaria vs. 0,65 dollaria. Toisin sanoen muutaman prosentin erosta testeissä Anthropic pyytää maksamaan noin 46 kertaa enemmän. Rehelliset varoitukset: Mittasin vertailutaulukon DeepSeek itse, omalla julkaisemattomalla infrastruktuurillani, kaksi kymmenestä testistä on sisäisiä, eikä 0813:sta ole vielä itsenäisiä mittauksia - malli julkaistiin vasta tänään.

Ymmärtääksesi mittakaavan, ajattele Kimi K3:a. Kuukausi sitten hän oli ensimmäinen kiinalainen malli, joka ohitti Claude Opuksen - se oli sensaatio. Mutta Kimi K3 on malli, jossa on biljoonia parametreja, se vaatii kalliin palvelimen toimiakseen, joten vähittäiskaupassa se on vain kolme kertaa halvempi kuin Claude Fable ja vain 40 % halvempi kuin Claude Opus. Vaikuttavaa, mutta tässä ei ole demokratisoitumista.

Mutta DeepSeek V4 Pro on todella historiallinen hetki. Se on todella kuromassa kiinni Opusin koodauksen suhteen, ja se maksaa 30 kertaa vähemmän kuin Opus ja 60 kertaa vähemmän kuin Fable. Nykyään värikoodauksesta on tullut kaikkien saatavilla – ei "saatavilla" mainonnan merkityksessä, vaan siihen pääsyn hinnalla.

GPT:n kanssa tilanne on monimutkaisempi. GPT-5.5:n keinotekoisen analyysin pistemäärä on 56,3 ja DeepSeek 45,3 - ero on selvästi havaittavissa. Mutta tariffit eivät ole vertailukelpoisia: 5 dollaria / 30 dollaria miljoonalta vastaan ​​0,435 dollaria / 0,87 dollaria. Mutta halvempi GPT-5.6 Luna maksaa jo 0,10/0,60 dollaria - eli halvempi kuin DeepSeek - ja pisteet 52,3. Osoittautuu, että "halvin suurista" ei ole enää ainoa: V4 Pron hinnalla se kilpailee Lunan kanssa ja häviää pisteissä sekä Terralle että Solille.

Lisään raittiin lainauksen ulkopuolelta: amerikkalaisen NISTin (CAISI) tuore arvio sanoi, että V4 Pro on noin kahdeksan kuukautta jäljessä markkinajohtajista. Totta, he mittasivat esikatseluversion. Riippumattomat vertailuarvot osoittavat, onko 0813 kaventunut tätä eroa, mutta niitä ei vielä ole olemassa.

Hinta ei ole muuttunut. Heippa

Sisäänpääsy – 0,435 dollaria miljoonalta tokenilta, poistuminen – 0,87 dollaria. Käteisosuma on edelleen lähes ilmainen: 0,003625 dollaria miljoonalta, 120 kertaa halvempi kuin tavallinen sisäänpääsy. Agenttiketjuille tämä on pääasia: projektikonteksti luetaan uudestaan ​​ja uudestaan, ja välimuisti päättää, kuinka paljon agenttityötunti maksaa.

Yksi varoitus: DeepSeek on jo varoittanut dokumentaatiossa, että se aikoo nostaa hintoja koko API:lleen. Milloin ja kuinka kauan, ei kerrota. Huhtikuun tariffit ovat edelleen voimassa, ja tämä on huomattavasti alhaisempi kuin vastaavan luokan länsimaiset analogit.

Mistä kannattaa kokeilla juuri nyt

  • Chat:avatamallisivu— lopullinen 0813 on jo oletusarvo.
  • Koodi: V "Koodi" -osiomalli muodostaa yhteyden projektiin ja toimii arkiston, tiedostojen ja päätteen kanssa.
  • API:avain myönnetään osiossaAPI-avaimet NeuralSpace, muoto on yhteensopiva OpenAI:n kanssa.

Maksu - ruplissa yleisestä saldosta, ilman tilausta, VPN-korttia tai ulkomaista korttia. Todellinen käyttö kirjataan pois, ei "kuukausi etukäteen" -paketti.

Malli ei voi katsoa kuvia: syöttö on vain tekstiä. Jos tarvitset kuvakaappauksen tai valokuvan analysointia, tämä on muille malleille. Mutta teksti-, koodi- ja pitkiä agenttitehtäviä varten lopullinen V4 Pro on nyt yksi rehellisimmistä ehdotuksista tehon ja hintasuhteen suhteen.Voit tarkistaa sen chatissa, ja jos sinun on rakennettava se tuotteeseesi -avain on otettu API-avaimet-sivulta.

Usein kysytyt kysymykset (FAQ)

Kysymys: Kuinka päästä alkuun?Vastaus: Rekisteröidy alustalle ja saat ilmaisia ​​tokeneita testausta varten.

Kysymys: Soveltuvatko syntyneet materiaalit kaupalliseen käyttöön?Vastaus: Kyllä, saat täydet kaupalliset oikeudet kaikkeen luotuun sisältöön.