DeepSeek V4.1 Flash: nová verzia vidí obrázky a porazí V4 Pro
DeepSeek vydal V4.1 Flash – model, ktorý nahradil dva predchádzajúce naraz: bežný V4 Flash a experimentálnu verziu s rozpoznávaním obrázkov. Teraz je to jediný model, ktorý zapisuje kód aj číta obrázky: poráža V4 Pro v agentických benchmarkoch, má kontext s miliónom tokenov a používa zhruba štyrikrát menej vyrovnávacej pamäte KV. Na NeuralSpace je V4.1 Flash už dostupný v chate, v sekcii „Kód“ a cez API – tu je to, čo sa zmenilo v porovnaní s V4 Flash.
Čo je tento model
Presne povedané, toto nie je revízia predchádzajúceho Flash, ale prvý model novej rodiny architektúry. V4.1 Flash má552 miliárd parametrovoproti 284 miliardám vo V4 Flash, takže model je citeľne väčší. Napriek tomu aktivuje menej parametrov na krok: asi8 miliárd pri čítaní vstupua 16 miliárd pri generovaní odpovede.
Nová schéma sa nazýva Causal Encoder-Decoder: 40 vrstiev transformátora sa rozdelí na 20 vrstiev kódovača a 20 vrstiev dekodéra a zdieľaná vyrovnávacia pamäť kľúč-hodnota sa vytvorí raz – zo skrytých stavov kódovača – namiesto toho, aby sa prepočítavala v každej vrstve. Preto je spracovanie vstupov lacné. Asymetria je zámerná: agent veľa číta – súbory, históriu konverzácií, inštrukcie – a pomerne málo píše – úpravy, príkazy, rozhodnutia. Drahá polovica bola odľahčená, takže agentská záťaž bola tiež lacnejšia.
Kontext je jeden milión tokenov. Úsilie uvažovania je plynule nastaviteľné od 1 do 100: jednoduchá otázka môže fungovať lacno, zatiaľ čo tvrdá reťaz môže bežať na maximum bez prepínania modelov.
Teraz vidí obrázky
Toto je najviditeľnejší rozdiel oproti predchádzajúcej verzii. V4 Flash mal iba textový vstup: nemohol sa pozerať na obrázky a DeepSeek na to dodal samostatný experimentálny model videnia. Vo verzii Flash verzie 4.1 je vízia zabudovaná do samotného modelu – natívne prijíma text a obrázky a odpovedá textom.
V praxi môžete modelu odovzdať snímku obrazovky používateľského rozhrania, graf, fotografiu alebo stránku dokumentu tak, ako je. Opíše obrázok, extrahuje text zo snímky obrazovky alebo prečíta diagram. To je užitočné najmä pre agentov: jeden model číta kód aj snímku obrazovky používateľského rozhrania bez potreby prepínania medzi dvoma službami.
DeepSeek zrušil staré názvy modelov: požiadavky na v4-flash a v4-flash-vision-exp sú teraz smerované do V4.1 Flash, takže existujúce integrácie si nič nevšimnú.

Poráža V4 Pro
Najhlasnejšia časť vydania: V4.1 Flash prekonal väčší V4 Pro pri úlohách agentov. Tu sú čísla z oficiálnych hodnotení DeepSeek:
- Terminál-Bench 2.1(pracuje v termináli) — 90,6 oproti 87,9 pre V4 Pro a 82,7 pre predchádzajúci V4 Flash;
- CyberGym(kybernetická bezpečnosť) — 88,1 oproti 83,3 pre V4 Pro;
- DeepSWE v1.1— 74,2 oproti 54,4 pre V4 Flash;
- Terminál-Bench 4.0— 31,2 oproti 7,0 pre V4 Flash.
Okrem toho: 90,9 na GPQA Diamond, hodnotenie Codeforces 3471 a 65,6 na MathArena Apex. Čísla nie sú nezávislé – DeepSeek ich nahlásil sám, takže ich berte ako tvrdenie, nie ako verdikt. Ale miera skoku oproti predchádzajúcemu Flashu je viditeľná bez spúšťania tretích strán.
DeepSeek tiež oznámil postupné vyradenie V4 Pro: od 14. septembra jeho API smeruje žiadosti o V4 Pro do V4.1 Flash a účtuje ich za ceny Flash. Praktické riešenie je jednoduché: Flash už nie je „juniorským“ modelom. Teraz nesie hlavnú záťaž a bežná a vízová verzia už neexistujú oddelene.
Menšia vyrovnávacia pamäť, lacnejšie úlohy agentov
V prípade agentných scenárov nie je hlavná úspora v cene tokenu, ale vo vyrovnávacej pamäti. Agent znova a znova načítava históriu konverzácie, inštrukcie a projektové súbory a je to vstup z vyrovnávacej pamäte, ktorý spotrebuje väčšinu účtu. Globálna vyrovnávacia pamäť KV verzie 4.1 Flash trvá približne890 bajtov na token— zhruba štyrikrát menej ako V4 Flash — a jeho trvalá vyrovnávacia pamäť je komprimovaná asi osemkrát.
Cena modelu klesla aj v porovnaní s predchádzajúcim Flashom: vstup z vyrovnávacej pamäte je o 60 % lacnejší, vstup bez vyrovnávacej pamäte o tretinu lacnejší a výstup o 11 % lacnejší. Zisk je najviditeľnejší pri záťaži, ktorá opakovane spracováva veľký kontext; tam, kde na dĺžke nového výstupu záleží viac, je úspora skromnejšia.

V4 Flash verzus V4.1 Flash: čo sa zmenilo
| Parameter | Flash V4 | Flash verzie 4.1 |
|---|---|---|
| Parametre | 284B | 552B |
| Aktivuje sa na krok | 13B | 8B vstup / 16B výstup |
| Architektúra | Dekodér MŽP | Kauzálny kódovač-dekodér |
| Rozumie obrazom | Nie, samostatný model videnia | Áno, natívne |
| Kontext | 1 milión žetónov | 1 milión žetónov |
| Terminál-Bench 2.1 | 82.7 | 90.6 |
| DeepSWE v1.1 | 54.4 | 74.2 |
| KV cache na token | ~4× väčšie | 890 bajtov |
Cena na NeuralSpace a ako to vyskúšať
Na NeuralSpace model beží rovnakou rýchlosťou ako predchádzajúci V4 Flash:0,14 USD za milión vstupných tokenova0,28 USD za milión výstupných tokenov. Môžete začať už s 3 tokenmi na vašom zostatku; používanie sa účtuje zo zdieľaného zostatku bez samostatného predplatného a zahraničnej karty. Na vyskúšanie stačí jeden krok:
- Chat:amodelová stránka— pripojte obrázok alebo snímku obrazovky a model si to prečíta;
- kód:aSekcia "Kód".— model sa pripojí k vášmu projektu a funguje s úložiskom, súbormi a terminálom;
- API:dostať kľúč naStránka kľúčov API; formát je kompatibilný s OpenAI a dokumenty sú k dispozíciineuralspace.pro/en/v1/docs.
Často kladené otázky
Je V4.1 Flash nový model alebo aktualizácia?Je to skôr model novej rodiny architektúry než revízia predchádzajúceho Flash: architektúra sa zmenila, chrbtica rástla a bola pridaná vízia.
Vidí obrázky?Áno, natívne: pošlite fotografiu, snímku obrazovky, graf alebo dokument. Predchádzajúci V4 Flash bol len textový.
Čo sa stalo s V4 Pro?DeepSeek ho postupne vyraďuje a smeruje požiadavky na V4.1 Flash, ktorý porazil V4 Pro v agentických benchmarkoch.
Koľko stojí vyskúšanie?0,14 USD/0,28 USD za milión tokenov, počnúc 3 tokenmi na vašom zostatku – nastránka modelu chatu.
Prerušia sa staré požiadavky v4-flash?Nie: volania do v4-flash a v4-flash-vision-exp sú smerované do verzie 4.1 Flash a účtujú sa podľa príslušnej sadzby.