← Összes cikk

A DeepSeek V4 Pro 0813 történelmi fordulópont

A DeepSeek V4 Pro 0813 történelmi fordulópont

Röviden a legfontosabbról (BLUF)

A DeepSeek kiadta a V4 Pro végleges verzióját - 0813-as verzió: a frissítés automatikusan megérkezett az API-n keresztül, prezentációk és hivatkozások nélkül. Megnézzük, hogy pontosan mi nőtt a benchmarkok segítségével, őszintén kiszámoljuk a különbséget Claude-dal és GPT-vel, és elmagyarázzuk, miért nem változott még az ár.

Ma a DeepSeek kiadta a V4 Pro végleges verzióját – a 0813-as verziót. Nincs konferencia vagy visszaszámláló: csak frissítette az API-t. Azok, akik már dolgoztak a `deepseek-v4-pro`-val, automatikusan új modellt kaptak anélkül, hogy bármit is megváltoztattak volna a kódban. Az áprilisi előzetes volt, ez a GA, és a különbség elsősorban ott figyelhető meg, ahol a modelltől nem chaten kell válaszolni, hanem koherensen kell működnie.

Glowing digital whale - DeepSeek V4 Pro in the final version

Ma van az a nap, amikor az Opus szintű kódolás valóban elérhetővé vált.Ez a javaslat reggelre a marketingesek álma lett volna, este pedig tény lett volna, ha benchmarkokat kellett volna indítani.

A NeuralSpace-ben a modell már áll:chatben, V "Kód" szakaszbanés beAPI. Nincs „várni, amíg kigördül” – kinyitod és használod.

Milyen modell

Technikailag ugyanaz a vadállat, mint áprilisban: Szakértők keveréke 1,6 billió paraméterrel, amelyből minden lépésben 49 milliárd aktív. A kontextus egymillió token, és a modell akár 384 ezer tokent is képes előállítani egy válaszban. Összehasonlításképpen: ez körülbelül hússzor több, mint a szomszédos lapokon található legtöbb modellnél.

A modell két módban tud gondolkodni - gondolkodó és nem gondolkodó, az érvelési_erőfeszítésnek pedig három szintje van: max, magas, alacsony. Ez a gyakorlatban azt jelenti, hogy egy kis probléma olcsón megoldható, egy összetett lánc pedig maximális átgondolással, modellváltás nélkül megoldható.

Benchmark: pontosan mi nőtt

Growth of benchmarks DeepSeek V4 Pro after the release of the final version

A mesterséges elemzés újramérte a végleges verziót. Az intelligencia index 43,7-ről 45,3-ra nőtt. Kódolási index - 58,7-től 59,4-ig. De a legnagyobbat az Agentic Index ugrott: 35,3-ról 37,8-ra. Ez nem véletlen - a 0813-as revíziót kifejezetten az ügynök alapú forgatókönyvekre javították, ahol a modell nem egy mozdulattal válaszol, hanem oda-vissza jár: fájlokat olvas, eszközöket hív meg, megnézi az eredményt és korrigálja magát.

Sebesség tekintetében minden az előző verzió szintjén van: körülbelül 76 token másodpercenként a kimeneten, az első token körülbelül másfél-két másodperc alatt érkezik meg. Ez gyors egy ekkora modellnél. Őszinte hátránya: a modell beszédes. Az AA méréseknél a piaci átlagnál másfél-kétszer több tokent szór ki – vegye figyelembe, hogy a részletes érvelésért plusz tokenekkel és extra másodperc várakozással is fizet.

Claude és GPT ellen: korrekt aritmetika

A legszembetűnőbb dolog a legutóbbi táblázatban a Claude Opus 4.8-cal, az Anthropic korábbi zászlóshajójával. A DeepSeek V4 Pro 0813 mindkét oldalon megverte a kódolási benchmarkokban: Terminal-Bench 2.1 – 87.9 versus 85.0, DeepSWE – 62.7 versus 58.0. Ugyanakkor az Opus 4.8 millió bemeneti tokenenként 5 dollárba, millió kimeneti tokenenként 25 dollárba kerül – ez 11-szer és 29-szer drágább. Íme a táblázat:

Coding benchmark table: DeepSeek V4 Pro 0813 beats Claude Opus 4.8 in Terminal-Bench 2.1 and DeepSWE

A végső verzió a legközelebb állt a Claude Fable 5-höz: 87,9 versus 88,0 a Terminal-Benchben – ez egytized különbség. A DeepSWE szerint a Fable észrevehetőbb előrébb van: 70,0 a 62,7-hez képest. Ha a DeepSeek táblázatból mind a tíz ügynökalapú benchmarkot összeszámoljuk, akkor a Fable átlagosan 5,3%-kal előrébb áll – de tízből kettő DeepSeek-győzelemnél, és az egyetlen kiugró érték nélkül (az emberiség utolsó vizsgája szerszámok nélkül: 42,7 vs 53,3) az átlagos előny 2,8%-ra csökken.

Az ár nem százalékosan, hanem többszörösen tér el. A Fable 5 10 dollárba kerül millió bemenetenként és 50 dollár millió kimeneti tokenenként; A V4 Pro ára 0,435 és 0,87 dollár. Vegyes árfolyamon ez körülbelül 30 dollár a 0,65 dollárral szemben. Vagyis a tesztek néhány százalékos eltéréséért az Anthropic hozzávetőlegesen 46-szor többet kér. Őszinte figyelmeztetés: a DeepSeek összehasonlító táblázatot magam mértem, saját, még nem publikált infrastruktúrámon, tíz tesztből kettő belső, és a 0813-ról még nincs független mérés - a modell csak ma jelent meg.

A lépték megértéséhez gondoljon a Kimi K3-ra. Egy hónappal ezelőtt ő volt az első kínai modell, aki megelőzte Claude Opust – ez szenzáció volt. De a Kimi K3 egy billió paraméterekkel rendelkező modell, működéséhez drága szerverre van szükség, így kiskereskedelemben csak háromszor olcsóbb, mint a Claude Fable, és csak 40%-kal olcsóbb, mint a Claude Opus. Lenyűgöző, de ebben nincs demokratizálódás.

De a DeepSeek V4 Pro valóban történelmi pillanat. A kódolás terén valóban utoléri az Opust, 30-szor kevesebbe kerül, mint az Opus és 60-szor kevesebb, mint a Fable. Mára a vibrációs kódolás mindenki számára elérhetővé vált – nem az „elérhető”, hanem a belépő árán.

A GPT esetében a helyzet bonyolultabb. A GPT-5.5 56,3 pontot ért el a mesterséges elemzés indexében, szemben a DeepSeek 45,3-as értékével – a különbség őszintén észrevehető. De a tarifák nem összehasonlíthatók: 5/30 dollár milliónként, szemben a 0,435 dollár/0,87 dollárral. De az olcsóbb GPT-5.6 Luna már 0,10/0,60 dollárba kerül – vagyis olcsóbb, mint a DeepSeek – és 52,3 pontot ér. Kiderült, hogy már nem a „nagyok közül a legolcsóbb” az egyetlen: V4 Pro áron a Lunával versenyez, pontok tekintetében pedig alulmarad a Terrával és a Sollal szemben.

Hozzáteszek egy józan idézetet kívülről: az amerikai NIST (CAISI) friss értékelése szerint a V4 Pro körülbelül nyolc hónappal van lemaradva a piacvezetők mögött. Igaz, előzetes verziót mértek. Hogy a 0813 csökkentette-e ezt a különbséget, azt független benchmarkok mutatják majd, de ezek még nem léteznek.

Az ár nem változott. Viszlát

Belépés – 0,435 dollár millió tokenenként, kilépés – 0,87 dollár. A készpénzes találat továbbra is szinte ingyenes: 0,003625 dollár milliónként, 120-szor olcsóbb, mint a normál belépő. Az ügynökláncok esetében ez a fő szempont: a projektkörnyezet újra és újra beolvasásra kerül, és a gyorsítótár dönti el, mennyibe kerül egy óra ügynöki munka.

Egy figyelmeztetés: a DeepSeek már figyelmeztetett a dokumentációban, hogy emelni fogja az API egészének árait. Hogy mikor és meddig, azt nem mondják el. Az áprilisi tarifák még mindig érvényben vannak, és ez észrevehetően alacsonyabb, mint egy hasonló osztály nyugati analógjai.

Hol lehet most kipróbálni

  • Csevegés:nyitottmodell oldal— a végleges 0813 már az alapértelmezett.
  • Kód: V "Kód" szakaszbana modell csatlakozik a projekthez, és együttműködik a tárolóval, fájlokkal és terminállal.
  • API:szakaszban adják ki a kulcsotAPI kulcsok NeuralSpace, OpenAI-val kompatibilis formátum.

Fizetés - rubelben az általános egyenlegből, előfizetés, VPN vagy külföldi kártya nélkül. A tényleges használatot írjuk le, nem a „hónapra előre” csomagot.

Amit a modell nem tud, az az, hogy képeket néz: a bevitel csak szöveg. Ha egy képernyőkép vagy fénykép elemzésére van szüksége, ez más modellekhez való. De a szöveges, kódos és hosszú ügynöki feladatokhoz a végleges V4 Pro most az egyik legőszintébb ajánlat teljesítmény és árarány tekintetében.Chatben ellenőrizheti, és ha be kell építeni a termékébe -a kulcs az API kulcsok oldaláról származik.

Gyakran ismételt kérdések (GYIK)

Kérdés: Hogyan kezdjünk hozzá?Válasz: Regisztráljon a platformon, és ingyenes tokeneket kaphat a teszteléshez.

Kérdés: Az előállított anyagok alkalmasak kereskedelmi használatra?Válasz: Igen, teljes kereskedelmi jogot kap az összes létrehozott tartalomhoz.