← Kaikki artikkelit

DeepSeek V4.1 Flash: uusi versio näkee kuvat ja voittaa V4 Pron

DeepSeek V4.1 Flash: uusi versio näkee kuvat ja voittaa V4 Pron

DeepSeek on julkaissut V4.1 Flashin – mallin, joka korvasi kaksi aikaisempaa kerralla: tavallisen V4 Flashin ja kokeellisen version kuvantunnistuksella. Nyt se on yksi malli, joka sekä kirjoittaa koodia että lukee kuvia: se voittaa V4 Pron agenttivertailuissa, sisältää miljoonan tokenin kontekstin ja käyttää noin neljä kertaa vähemmän KV-välimuistia. NeuralSpacessa V4.1 Flash on jo saatavilla chatissa, "Koodi"-osiossa ja API:n kautta – tämä on muuttunut V4 Flashiin verrattuna.

Mikä tämä malli on

Tarkkaan ottaen tämä ei ole versio edellisestä Flashista, vaan ensimmäinen malli uudesta arkkitehtuuriperheestä. V4.1 Flash sisältää552 miljardia parametriaV4 Flashin 284 miljardiin verrattuna, joten malli on huomattavasti suurempi. Silti se aktivoi vähemmän parametreja askelta kohti: noin8 miljardia lukiessasi syötettäja 16 miljardia samalla kun tuotetaan vastaus.

Uuden järjestelmän nimi on Causal Encoder-Decoder: 40 muuntajakerrosta jaetaan 20 enkooderikerrokseen ja 20 dekooderikerrokseen, ja jaettu avainarvovälimuisti rakennetaan kerran – kooderin piilotiloista – sen sijaan, että se laskettaisiin uudelleen jokaisessa tasossa. Siksi syötteiden käsittely on halpaa. Epäsymmetria on tahallista: agentti lukee paljon - tiedostoja, keskusteluhistoriaa, ohjeita - ja kirjoittaa suhteellisen vähän - muokkauksia, komentoja, päätöksiä. Kallis puolikko tehtiin kevyeksi, joten agenttityökuormatkin halpenivat.

Konteksti on miljoona tokenia. Päättelyponnistus on portaattomasti säädettävissä 1:stä 100:aan: yksinkertainen kysymys voi toimia halvalla, kun taas kova ketju voi pyöriä maksimissaan ilman mallin vaihtoa.

Se näkee nyt kuvia

Tämä on näkyvin ero edelliseen versioon. V4 Flashissa oli vain tekstin syöttö: se ei voinut katsoa kuvia, ja DeepSeek toimitti erillisen kokeellisen visiomallin tätä varten. V4.1 Flashissa visio on sisäänrakennettu itse malliin – se hyväksyy tekstin ja kuvat ja vastaa tekstillä.

Käytännössä voit antaa mallille käyttöliittymän kuvakaappauksen, kaavion, valokuvan tai asiakirjasivun sellaisenaan. Se kuvaa kuvaa, poimii tekstiä kuvakaappauksesta tai lukee kaavion. Tämä on erityisen kätevää agenteille: yksi malli lukee sekä koodin että käyttöliittymän kuvakaappauksen, eikä kahden palvelun välillä tarvitse vaihtaa.

DeepSeek poisti vanhat mallinimet: v4-flash- ja v4-flash-vision-exp-pyynnöt reititetään nyt V4.1 Flashiin, joten nykyiset integraatiot eivät huomaa mitään.

A lens with text lines and image frames flowing in and a single stream of light coming out

Se voittaa V4 Pron

Julkaisun äänekkäin osa: V4.1 Flash suoritti suuremman V4 Pron agenttitehtävissä. Tässä ovat numerot DeepSeekin virallisista arvioista:

  • Terminal-Bench 2.1(työskentely terminaalissa) — 90.6 vastaan ​​87.9 V4 Prossa ja 82.7 edellisessä V4 Flashissa;
  • CyberGym(kyberturvallisuus) — 88.1 vastaan ​​83.3 V4 Prolle;
  • DeepSWE v1.1— 74,2 vastaan ​​54,4 V4 Flashille;
  • Terminal-Bench 4.0— 31.2 vastaan ​​7.0 V4 Flashille.

Tämän lisäksi: 90,9 GPQA Diamondissa, Codeforces-luokitus 3471 ja 65,6 MathArena Apexissa. Luvut eivät ole riippumattomia – DeepSeek ilmoitti ne itse, joten pidä niitä väitteenä eikä tuomiona. Mutta hyppyn laajuus edelliseen Flashiin on nähtävissä ilman kolmannen osapuolen suorituksia.

DeepSeek ilmoitti myös V4 Pron hallitusta käytöstä poistamisesta: 14. syyskuuta alkaen sen API reitittää V4 Pron pyynnöt V4.1 Flashiin ja laskuttaa niitä Flash-hinnoittelulla. Käytännöllinen takeaway on yksinkertainen: Flash ei ole enää "junior" malli. Se kantaa nyt pääkuorman, eikä tavallista ja visioversiota enää ole erikseen.

Pienempi välimuisti, halvemmat agenttitehtävät

Agenttiskenaarioissa tärkein säästö ei ole merkkihinnassa, vaan välimuistissa. Agentti lukee keskusteluhistorian, ohjeet ja projektitiedostot uudelleen ja uudelleen, ja välimuistissa oleva syöte syö suurimman osan laskusta. V4.1 Flashin globaali KV-välimuisti kestää noin890 tavua per merkki— noin neljä kertaa vähemmän kuin V4 Flash — ja sen pysyvä välimuisti on pakattu noin kahdeksankertaiseksi.

Mallin hinta laski myös edelliseen Flashiin verrattuna: välimuistitulo on 60 % halvempi, välimuisti noin kolmanneksen halvempi ja lähtö 11 % halvempi. Hyöty näkyy parhaiten työkuormissa, jotka käsittelevät toistuvasti suurta kontekstia; missä uuden tuotannon pituudella on enemmän merkitystä, säästö on vaatimattomampaa.

A data stream compressing into a narrow bright band as it passes through a crystal lattice

V4 Flash vs. V4.1 Flash: mikä muuttui

ParametriV4 FlashV4.1 Flash
Parametrit284B552B
Aktivoitu askelta kohti13B8B tulo / 16B lähtö
ArkkitehtuuriMoE dekooderiCausal Encoder-dekooderi
Ymmärtää kuviaEi, erillinen näkömalliKyllä, syntyperäisesti
Konteksti1M tokeneja1M tokeneja
Terminal-Bench 2.182.790.6
DeepSWE v1.154.474.2
KV-välimuisti per merkki~4× suurempi890 tavua

Hinta NeuralSpacessa ja kuinka kokeilla sitä

NeuralSpacessa malli toimii samalla nopeudella kuin edellinen V4 Flash:0,14 dollaria miljoonaa syöttötunnusta kohdenja0,28 dollaria miljoonaa tuottomerkkiä kohden. Voit aloittaa vain 3 tokenilla saldollasi; käyttö veloitetaan jaetusta saldosta ilman erillistä tilausta ja ulkomaista korttia. Kokeile sitä, yksi vaihe riittää:

Usein kysytyt kysymykset

Onko V4.1 Flash uusi malli vai päivitys?Se on malli uudesta arkkitehtuuriperheestä pikemminkin kuin edellisen Flashin versio: arkkitehtuuri muuttui, selkäranka kasvoi ja visio lisättiin.

Näkeekö se kuvia?Kyllä, alkuperäisesti: lähetä valokuva, kuvakaappaus, kaavio tai asiakirja. Edellinen V4 Flash oli vain teksti.

Mitä tapahtui V4 Prolle?DeepSeek lopettaa sen käytöstä ja reitittää pyynnöt V4.1 Flashiin, joka päihitti V4 Pron agenttivertailuissa.

Paljonko kokeilu maksaa?0,14 dollaria/0,28 dollaria miljoonaa merkkiä kohden, alkaen 3 tokenista saldollasi –chat-mallisivu.

Keskeytyvätkö vanhat v4-flash-pyynnöt?Ei: puhelut v4-flashiin ja v4-flash-vision-expiin reititetään V4.1 Flashiin ja laskutetaan sen hinnalla.