DeepSeek V4.1 Flash: az új verzió képeket lát, és felülmúlja a V4 Pro-t
A DeepSeek kiadta a V4.1 Flash-t – egy olyan modellt, amely egyszerre két korábbit váltott fel: a normál V4 Flasht és egy kísérleti verziót képfelismerővel. Most egyetlen modellről van szó, amely kódot ír és képeket is olvas: veri a V4 Pro-t az ügynöki benchmarkokon, egymillió token kontextust tartalmaz, és nagyjából négyszer kevesebb KV gyorsítótárat használ. A NeuralSpace-en a V4.1 Flash már elérhető a csevegésben, a „Kód” részben és az API-n keresztül – ez változott a V4 Flash-hez képest.
Mi ez a modell
Szigorúan véve ez nem az előző Flash átdolgozása, hanem egy új architektúra család első modellje. A V4.1 Flash rendelkezik552 milliárd paramétera V4 Flash 284 milliárdjával szemben, így a modell érezhetően nagyobb. Ennek ellenére lépésenként kevesebb paramétert aktivál: kb8 milliárd a bemenet olvasása közbenés 16 milliárd a válasz generálása közben.
Az új sémát Causal Encoder-Decodernek hívják: a 40 transzformátorréteg 20 kódolórétegre és 20 dekódolórétegre oszlik, a megosztott kulcsérték-gyorsítótár pedig egyszer épül fel – a kódoló rejtett állapotaiból – ahelyett, hogy minden rétegben újraszámítanák. Ezért olcsó a bemeneti feldolgozás. Az aszimmetria szándékos: egy ügynök sokat olvas – fájlokat, beszélgetési előzményeket, utasításokat –, és viszonylag keveset ír – szerkeszt, parancsol, döntéseket hoz. A drága felét könnyűvé tették, így az ügynöki munka is olcsóbb lett.
A kontextus egymillió token. Az okoskodás 1-től 100-ig folyamatosan állítható: egy egyszerű kérdés olcsón futhat, míg a kemény lánc maximálisan futhat modellváltás nélkül.
Most képeket lát
Ez a legszembetűnőbb különbség az előző verzióhoz képest. A V4 Flash csak szöveges bemenettel rendelkezett: nem tudott képeket nézni, a DeepSeek pedig külön kísérleti látásmodellt szállított erre. A V4.1 Flash-ben a látás magába a modellbe van beépítve – natívan elfogadja a szöveget és a képeket, és szöveggel válaszol.
A gyakorlatban átadhat a modellnek egy UI képernyőképet, diagramot, fényképet vagy dokumentumoldalt úgy, ahogy van. Leírja a képet, kivonja a szöveget egy képernyőképből, vagy beolvas egy diagramot. Ez különösen ügynökök számára hasznos: az egyik modell beolvassa a kódot és a felhasználói felület képernyőképet is, anélkül, hogy váltani kellene két szolgáltatás között.
A DeepSeek megszüntette a régi modellneveket: a v4-flash és a v4-flash-vision-exp kérései mostantól a V4.1 Flash-re vannak irányítva, így a meglévő integrációk semmit sem fognak észrevenni.

Veri a V4 Pro-t
A kiadás leghangosabb része: A V4.1 Flash ügynöki feladatokban felülmúlta a nagyobb V4 Pro-t. Íme a számok a DeepSeek hivatalos értékeléseiből:
- Terminal-Bench 2.1(terminálban dolgozik) – 90,6 a 87,9-hez képest a V4 Pro és 82,7 az előző V4 Flash esetében;
- CyberGym(kiberbiztonság) – 88,1 a 83,3-mal szemben a V4 Pro esetében;
- DeepSWE v1.1— 74,2 a V4 Flash 54,4-gyel szemben;
- Terminal-Bench 4.0— 31.2 a 7.0-val szemben a V4 Flash esetében.
Ezen felül: 90,9 a GPQA Diamondon, a Codeforces 3471-es besorolása és 65,6 a MathArena Apexen. A számok nem függetlenek – a DeepSeek maga jelentette be őket, ezért tekintse őket követelésként, nem pedig ítéletként. De az előző Flashhez képesti ugrás mértéke látható harmadik féltől származó futtatások nélkül is.
A DeepSeek bejelentette a V4 Pro szabályos kivonását is: szeptember 14-től API-ja a V4 Pro kérelmeit a V4.1 Flash-re irányítja, és Flash-árakkal számlázza ki. A gyakorlati megoldás egyszerű: a Flash már nem a "junior" modell. Most már ez viseli a fő terhelést, a normál és a vision változat már nem létezik külön.
Kisebb gyorsítótár, olcsóbb ügynöki feladatok
Ügynöki forgatókönyvek esetén a fő megtakarítás nem a token árában, hanem a gyorsítótárban van. Az ügynök újra és újra elolvassa a beszélgetési előzményeket, az utasításokat és a projektfájlokat, és a gyorsítótárazott bemenet az, amely felemészti a számla nagy részét. A V4.1 Flash globális KV gyorsítótára kb890 bájt tokenenként– nagyjából négyszer kevesebb, mint a V4 Flash –, és a tartós gyorsítótár körülbelül nyolcszorosára van tömörítve.
A modell ára a korábbi Flash-hez képest is csökkent: a gyorsítótárazott bemenet 60%-kal, a gyorsítótárazott bemenet körülbelül harmadával, a kimenet pedig 11%-kal olcsóbb. A nyereség leginkább azokban a munkaterhelésekben mutatkozik meg, amelyek ismételten nagy kontextust dolgoznak fel; ahol az új kimenet hossza számít jobban, ott szerényebb a megtakarítás.

V4 Flash versus V4.1 Flash: mi változott
| Paraméter | V4 Flash | V4.1 Flash |
|---|---|---|
| Paraméterek | 284B | 552B |
| Lépésenként aktiválva | 13B | 8B bemenet / 16B kimenet |
| Építészet | MoE dekóder | Oksági kódoló-dekódoló |
| Megérti a képeket | Nem, külön látásmodell | Igen, natívan |
| Kontextus | 1 millió token | 1 millió token |
| Terminal-Bench 2.1 | 82.7 | 90.6 |
| DeepSWE v1.1 | 54.4 | 74.2 |
| KV gyorsítótár tokenenként | ~4× nagyobb | 890 bájt |
A NeuralSpace ára és a kipróbálás módja
A NeuralSpace-en a modell ugyanolyan sebességgel fut, mint az előző V4 Flash:0,14 dollár millió bemeneti tokenenkéntés0,28 dollár millió kimeneti tokenenként. Akár 3 tokennel is kezdheti az egyenlegét; a használat a megosztott egyenlegről kerül felszámításra, külön előfizetés és külföldi kártya nélkül. A kipróbáláshoz elég egy lépés:
- Csevegés:amodell oldal— csatoljon egy képet vagy képernyőképet, és a modell elolvassa;
- Kód:a"Kód" szakaszban— a modell csatlakozik a projekthez, és együttműködik a tárolóval, fájlokkal és terminállal;
- API:kap egy kulcsot aAPI kulcsok oldal; a formátum OpenAI-kompatibilis, és a dokumentumok itt érhetők elneuralspace.pro/en/v1/docs.
Gyakran ismételt kérdések
A V4.1 Flash új modell vagy frissítés?Ez egy új architektúra család modellje, nem pedig az előző Flash átdolgozása: megváltozott az architektúra, nőtt a gerinc, és hozzáadták a jövőképet.
Lát képeket?Igen, natív módon: küldjön fotót, képernyőképet, diagramot vagy dokumentumot. Az előző V4 Flash csak szöveges volt.
Mi történt a V4 Pro-val?A DeepSeek fokozatosan megszünteti, és a kéréseket a V4.1 Flash-re irányítja, amely az ügynöki benchmarkok alapján legyőzte a V4 Pro-t.
Mennyibe kerül kipróbálni?0,14 USD/0,28 USD millió tokenenként, 3 tokentől kezdve az egyenlegén – achat modell oldal.
Megszakadnak a régi v4-flash kérések?Nem: a v4-flash és a v4-flash-vision-exp hívásait a rendszer a V4.1 Flash-re irányítja, és annak díjával számlázzuk ki.