← Все статьи

DeepSeek V4.1 Flash: nová verze vidí obrázky a překonává V4 Pro

DeepSeek V4.1 Flash: nová verze vidí obrázky a překonává V4 Pro

DeepSeek vydal V4.1 Flash — model, který nahradil dva dřívější najednou: běžný V4 Flash a experimentální verzi s rozpoznáváním obrázků. Nyní je to jediný model, který jak zapisuje kód, tak čte obrázky: překonává V4 Pro v agentních benchmarcích, obsahuje kontext jednoho milionu tokenů a využívá zhruba čtyřikrát méně KV cache. Na NeuralSpace je V4.1 Flash již k dispozici v chatu, v sekci „Kód“ a prostřednictvím API – zde je to, co se změnilo ve srovnání s V4 Flash.

Jaký je tento model

Přísně vzato se nejedná o revizi předchozího Flashe, ale o první model nové rodiny architektur. V4.1 Flash má552 miliard parametrůoproti 284 miliardám ve V4 Flash, takže model je znatelně větší. Přesto aktivuje méně parametrů na krok: asi8 miliard při čtení vstupua 16 miliard při generování odpovědi.

Nové schéma se nazývá Causal Encoder-Decoder: 40 vrstev transformátoru se rozdělí na 20 vrstev kodéru a 20 vrstev dekodéru a sdílená mezipaměť klíč-hodnota se vytvoří jednou – ze skrytých stavů kodéru – místo toho, aby se přepočítávala v každé vrstvě. Proto je zpracování vstupů levné. Asymetrie je záměrná: agent hodně čte — soubory, historii konverzace, instrukce — a zapisuje poměrně málo — úpravy, příkazy, rozhodnutí. Drahá polovina byla odlehčena, takže pracovní zátěž agentů byla také levnější.

Kontext je jeden milion tokenů. Uvažovací úsilí je plynule nastavitelné od 1 do 100: jednoduchá otázka může běžet levně, zatímco pevný řetěz může běžet na maximum bez přepínání modelů.

Nyní vidí obrázky

To je nejviditelnější rozdíl oproti předchozí verzi. V4 Flash měl pouze textový vstup: neuměl se dívat na obrázky a DeepSeek pro to dodal samostatný experimentální model vidění. Ve verzi 4.1 Flash je vize zabudována do samotného modelu – nativně přijímá text a obrázky a odpovídá textem.

V praxi můžete modelu předat snímek obrazovky uživatelského rozhraní, graf, fotografii nebo stránku dokumentu tak, jak jsou. Popíše obrázek, extrahuje text ze snímku obrazovky nebo přečte diagram. To je zvláště užitečné pro agenty: jeden model čte kód i snímek obrazovky uživatelského rozhraní, aniž by bylo nutné přepínat mezi dvěma službami.

DeepSeek zrušil staré názvy modelů: požadavky na v4-flash a v4-flash-vision-exp jsou nyní směrovány do V4.1 Flash, takže stávající integrace si ničeho nevšimnou.

A lens with text lines and image frames flowing in and a single stream of light coming out

Poráží V4 Pro

Nejhlasitější část vydání: V4.1 Flash překonal větší V4 Pro v agentních úlohách. Zde jsou čísla z oficiálních hodnocení DeepSeek:

  • Terminál-Bench 2.1(pracuje v terminálu) — 90,6 oproti 87,9 pro V4 Pro a 82,7 pro předchozí V4 Flash;
  • CyberGym(kybernetická bezpečnost) — 88,1 oproti 83,3 pro V4 Pro;
  • DeepSWE v1.1— 74,2 oproti 54,4 pro V4 Flash;
  • Terminal-Bench 4.0— 31,2 oproti 7,0 pro V4 Flash.

Navíc: 90,9 na GPQA Diamond, hodnocení Codeforces 3471 a 65,6 na MathArena Apex. Čísla nejsou nezávislá – DeepSeek je nahlásil sám, takže je považujte spíše za tvrzení než za verdikt. Ale rozsah skoku přes předchozí Flash je viditelný bez spuštění třetích stran.

DeepSeek také oznámil řádné vyřazení V4 Pro: od 14. září jeho API směruje požadavky na V4 Pro do V4.1 Flash a účtuje je za ceny Flash. Praktický postup je jednoduchý: Flash již není „juniorským“ modelem. Nyní nese hlavní zatížení a verze regular a vision již neexistují odděleně.

Menší mezipaměť, levnější agentní úkoly

U agentních scénářů není hlavní úspora v ceně tokenu, ale v mezipaměti. Agent znovu a znovu čte historii konverzace, instrukce a soubory projektu a většinu účtu spotřebovává právě vstup z mezipaměti. Globální mezipaměť KV Flash verze 4.1 zabírá přibližně890 bajtů na token— zhruba čtyřikrát méně než V4 Flash — a jeho perzistentní mezipaměť je komprimována asi osmkrát.

Cena modelu oproti předchozímu Flash také klesla: vstup z mezipaměti je o 60 % levnější, vstup bez mezipaměti asi o třetinu levnější a výstup o 11 % levnější. Zisk je nejviditelnější u zátěží, které opakovaně zpracovávají rozsáhlý kontext; tam, kde na délce nového výstupu záleží více, je úspora skromnější.

A data stream compressing into a narrow bright band as it passes through a crystal lattice

V4 Flash versus V4.1 Flash: co se změnilo

ParametrFlash V4Flash verze 4.1
Parametry284B552B
Aktivováno na krok13B8B vstup / 16B výstup
Architekturadekodér MŽPKauzální kodér-dekodér
Rozumí obrázkůmNe, samostatný model viděníAno, nativně
Kontext1 milion žetonů1 milion žetonů
Terminál-Bench 2.182.790.6
DeepSWE v1.154.474.2
KV mezipaměť na token~4× větší890 bajtů

Cena na NeuralSpace a jak to vyzkoušet

Na NeuralSpace model běží stejnou rychlostí jako předchozí V4 Flash:0,14 $ za milion vstupních tokenůa0,28 $ za milion výstupních tokenů. Můžete začít s pouhými 3 žetony na vašem zůstatku; použití se účtuje ze sdíleného zůstatku, bez samostatného předplatného a bez zahraniční karty. K vyzkoušení stačí jeden krok:

Často kladené otázky

Je V4.1 Flash nový model nebo aktualizace?Jde spíše o model nové rodiny architektury než o revizi předchozího Flashe: architektura se změnila, páteř rostla a byla přidána vize.

Vidí obrázky?Ano, nativně: pošlete fotografii, snímek obrazovky, graf nebo dokument. Předchozí V4 Flash byl pouze textový.

Co se stalo s V4 Pro?DeepSeek to postupně vyřazuje a směruje požadavky na Flash V4.1, který porazil V4 Pro v agentních benchmarcích.

Kolik stojí vyzkoušení?0,14 $/0,28 $ za milion tokenů, počínaje 3 tokeny na vašem zůstatku – nastránka modelu chatu.

Zlomí se staré požadavky v4-flash?Ne: volání do v4-flash a v4-flash-vision-exp jsou směrována do verze 4.1 Flash a účtována podle příslušné sazby.