← Összes cikk

DeepSeek V4.1 Flash: az új verzió képeket lát, és felülmúlja a V4 Pro-t

DeepSeek V4.1 Flash: az új verzió képeket lát, és felülmúlja a V4 Pro-t

A DeepSeek kiadta a V4.1 Flash-t – egy olyan modellt, amely egyszerre két korábbit váltott fel: a normál V4 Flasht és egy kísérleti verziót képfelismerővel. Most egyetlen modellről van szó, amely kódot ír és képeket is olvas: veri a V4 Pro-t az ügynöki benchmarkokon, egymillió token kontextust tartalmaz, és nagyjából négyszer kevesebb KV gyorsítótárat használ. A NeuralSpace-en a V4.1 Flash már elérhető a csevegésben, a „Kód” részben és az API-n keresztül – ez változott a V4 Flash-hez képest.

Mi ez a modell

Szigorúan véve ez nem az előző Flash átdolgozása, hanem egy új architektúra család első modellje. A V4.1 Flash rendelkezik552 milliárd paramétera V4 Flash 284 milliárdjával szemben, így a modell érezhetően nagyobb. Ennek ellenére lépésenként kevesebb paramétert aktivál: kb8 milliárd a bemenet olvasása közbenés 16 milliárd a válasz generálása közben.

Az új sémát Causal Encoder-Decodernek hívják: a 40 transzformátorréteg 20 kódolórétegre és 20 dekódolórétegre oszlik, a megosztott kulcsérték-gyorsítótár pedig egyszer épül fel – a kódoló rejtett állapotaiból – ahelyett, hogy minden rétegben újraszámítanák. Ezért olcsó a bemeneti feldolgozás. Az aszimmetria szándékos: egy ügynök sokat olvas – fájlokat, beszélgetési előzményeket, utasításokat –, és viszonylag keveset ír – szerkeszt, parancsol, döntéseket hoz. A drága felét könnyűvé tették, így az ügynöki munka is olcsóbb lett.

A kontextus egymillió token. Az okoskodás 1-től 100-ig folyamatosan állítható: egy egyszerű kérdés olcsón futhat, míg a kemény lánc maximálisan futhat modellváltás nélkül.

Most képeket lát

Ez a legszembetűnőbb különbség az előző verzióhoz képest. A V4 Flash csak szöveges bemenettel rendelkezett: nem tudott képeket nézni, a DeepSeek pedig külön kísérleti látásmodellt szállított erre. A V4.1 Flash-ben a látás magába a modellbe van beépítve – natívan elfogadja a szöveget és a képeket, és szöveggel válaszol.

A gyakorlatban átadhat a modellnek egy UI képernyőképet, diagramot, fényképet vagy dokumentumoldalt úgy, ahogy van. Leírja a képet, kivonja a szöveget egy képernyőképből, vagy beolvas egy diagramot. Ez különösen ügynökök számára hasznos: az egyik modell beolvassa a kódot és a felhasználói felület képernyőképet is, anélkül, hogy váltani kellene két szolgáltatás között.

A DeepSeek megszüntette a régi modellneveket: a v4-flash és a v4-flash-vision-exp kérései mostantól a V4.1 Flash-re vannak irányítva, így a meglévő integrációk semmit sem fognak észrevenni.

A lens with text lines and image frames flowing in and a single stream of light coming out

Veri a V4 Pro-t

A kiadás leghangosabb része: A V4.1 Flash ügynöki feladatokban felülmúlta a nagyobb V4 Pro-t. Íme a számok a DeepSeek hivatalos értékeléseiből:

  • Terminal-Bench 2.1(terminálban dolgozik) – 90,6 a 87,9-hez képest a V4 Pro és 82,7 az előző V4 Flash esetében;
  • CyberGym(kiberbiztonság) – 88,1 a 83,3-mal szemben a V4 Pro esetében;
  • DeepSWE v1.1— 74,2 a V4 Flash 54,4-gyel szemben;
  • Terminal-Bench 4.0— 31.2 a 7.0-val szemben a V4 Flash esetében.

Ezen felül: 90,9 a GPQA Diamondon, a Codeforces 3471-es besorolása és 65,6 a MathArena Apexen. A számok nem függetlenek – a DeepSeek maga jelentette be őket, ezért tekintse őket követelésként, nem pedig ítéletként. De az előző Flashhez képesti ugrás mértéke látható harmadik féltől származó futtatások nélkül is.

A DeepSeek bejelentette a V4 Pro szabályos kivonását is: szeptember 14-től API-ja a V4 Pro kérelmeit a V4.1 Flash-re irányítja, és Flash-árakkal számlázza ki. A gyakorlati megoldás egyszerű: a Flash már nem a "junior" modell. Most már ez viseli a fő terhelést, a normál és a vision változat már nem létezik külön.

Kisebb gyorsítótár, olcsóbb ügynöki feladatok

Ügynöki forgatókönyvek esetén a fő megtakarítás nem a token árában, hanem a gyorsítótárban van. Az ügynök újra és újra elolvassa a beszélgetési előzményeket, az utasításokat és a projektfájlokat, és a gyorsítótárazott bemenet az, amely felemészti a számla nagy részét. A V4.1 Flash globális KV gyorsítótára kb890 bájt tokenenként– nagyjából négyszer kevesebb, mint a V4 Flash –, és a tartós gyorsítótár körülbelül nyolcszorosára van tömörítve.

A modell ára a korábbi Flash-hez képest is csökkent: a gyorsítótárazott bemenet 60%-kal, a gyorsítótárazott bemenet körülbelül harmadával, a kimenet pedig 11%-kal olcsóbb. A nyereség leginkább azokban a munkaterhelésekben mutatkozik meg, amelyek ismételten nagy kontextust dolgoznak fel; ahol az új kimenet hossza számít jobban, ott szerényebb a megtakarítás.

A data stream compressing into a narrow bright band as it passes through a crystal lattice

V4 Flash versus V4.1 Flash: mi változott

ParaméterV4 FlashV4.1 Flash
Paraméterek284B552B
Lépésenként aktiválva13B8B bemenet / 16B kimenet
ÉpítészetMoE dekóderOksági kódoló-dekódoló
Megérti a képeketNem, külön látásmodellIgen, natívan
Kontextus1 millió token1 millió token
Terminal-Bench 2.182.790.6
DeepSWE v1.154.474.2
KV gyorsítótár tokenenként~4× nagyobb890 bájt

A NeuralSpace ára és a kipróbálás módja

A NeuralSpace-en a modell ugyanolyan sebességgel fut, mint az előző V4 Flash:0,14 dollár millió bemeneti tokenenkéntés0,28 dollár millió kimeneti tokenenként. Akár 3 tokennel is kezdheti az egyenlegét; a használat a megosztott egyenlegről kerül felszámításra, külön előfizetés és külföldi kártya nélkül. A kipróbáláshoz elég egy lépés:

Gyakran ismételt kérdések

A V4.1 Flash új modell vagy frissítés?Ez egy új architektúra család modellje, nem pedig az előző Flash átdolgozása: megváltozott az architektúra, nőtt a gerinc, és hozzáadták a jövőképet.

Lát képeket?Igen, natív módon: küldjön fotót, képernyőképet, diagramot vagy dokumentumot. Az előző V4 Flash csak szöveges volt.

Mi történt a V4 Pro-val?A DeepSeek fokozatosan megszünteti, és a kéréseket a V4.1 Flash-re irányítja, amely az ügynöki benchmarkok alapján legyőzte a V4 Pro-t.

Mennyibe kerül kipróbálni?0,14 USD/0,28 USD millió tokenenként, 3 tokentől kezdve az egyenlegén – achat modell oldal.

Megszakadnak a régi v4-flash kérések?Nem: a v4-flash és a v4-flash-vision-exp hívásait a rendszer a V4.1 Flash-re irányítja, és annak díjával számlázzuk ki.