← Все статьи

DeepSeek V4.1 Flash: noua versiune vede imagini și a ocolit V4 Pro

O balenă digitală strălucitoare care se prăbușește în particule luminoase rapide este o metaforă pentru noua versiune ușoară a lui DeepSeek

DeepSeek lansat V4.1 Flash - un model care le-a înlocuit simultan pe două anterioare: V4 Flash obișnuit și o versiune experimentală cu recunoaștere a imaginii. Acum, acesta este un model care atât scrie cod, cât și analizează imagini: conform benchmark-urilor agenților, a ocolit V4 Pro, deține un context de un milion de jetoane și cheltuiește aproximativ un sfert din mai mult cache. În NeuralSpace V4.1 Flash este deja disponibil în chat, în secțiunea „Cod” și prin API - să vedem ce s-a schimbat în comparație cu V4 Flash.

Ce model

Formal, acesta nu mai este o revizuire a Flash-ului precedent, ci primul model al unei noi familii de arhitecturi. U V4.1 Flash 552 de miliarde de parametri față de 284 de miliarde pentru V4 Flash - modelul este vizibil mai mare. Dar sunt mai puțini parametri activi la fiecare pas: aproximativ 8 miliarde la citirea intrării și 16 miliarde atunci când se generează un răspuns.

Noua schemă se numește Causal Encoder-Decoder: 40 de straturi de transformator sunt împărțite în 20 de straturi de codificator și 20 de straturi de decodor, iar memoria cache generală de chei și valori este construită o singură dată - din stările ascunse ale codificatorului și nu este recalculată în fiecare strat din nou. Acesta este motivul pentru care modelul procesează intrările ieftin. Asimetria nu a fost aleasă întâmplător: agentul citește mult - fișiere, istoric dialog, instrucțiuni - și scrie relativ puțin - editări, comenzi, decizii. Partea scumpă a fost simplificată, astfel încât sarcinile de agent au devenit mai ieftine.

Context - un milion de jetoane. Efortul de raționament este reglabil continuu, de la 1 la 100: o întrebare simplă poate fi rulată ieftin, iar un lanț complex poate fi rulat la maximum fără a schimba modelul.

Acum vede poze

Cea mai vizibilă diferență față de versiunea anterioară. V4 Flash avea doar o introducere de text: ea nu știa să privească imaginile, iar pentru aceasta DeepSeek a lansat separat un model experimental de viziune. În V4.1 Flash viziunea este încorporată în modelul în sine - acceptă în mod nativ text și imagini și răspunde cu text.

În practică, aceasta înseamnă că o captură de ecran a interfeței, un grafic, o fotografie sau o pagină a unui document poate fi dată modelului așa cum este. Ea va descrie imaginea, va extrage text din captură de ecran și va analiza diagrama. Acest lucru este deosebit de convenabil pentru agenți: un model citește atât codul, cât și captura de ecran a interfeței și nu este nevoie să comutați între două servicii.

Numele modelelor vechi DeepSeek au fost scoase din funcțiune: cererile către v4-flash și v4-flash-vision-exp sunt acum redirecționate către V4.1 Flash - integrările vechi nu vor observa nimic.

O lentilă în care liniile de text și cadrele de imagine curg și iese ca un singur flux de lumină.

Ocolit V4 Pro

Cel mai mare punct culminant al versiunii a fost că V4.1 Flash a depășit-o pe V4 Pro mai mare în sarcinile de agent. Iată numerele de la măsurătorile oficiale DeepSeek:

  • Terminal-Bench 2.1 (funcționează în terminal) - 90,6 față de 87,9 pentru V4 Pro și 82,7 pentru V4 Flash anterior;
  • CyberGym (securitate cibernetică) - 88,1 față de 83,3 pentru V4 Pro;
  • DeepSWE v1.1 — 74,2 față de 54,4 pentru V4 Flash;
  • Terminal-Bench 4.0 — 31,2 față de 7,0 pentru V4 Flash.

La aceasta - 90,9 la GPQA Diamond, rating 3471 la Codeforces și 65,6 la MathArena Apex. Numerele nu sunt independente, au fost date de ea însăși DeepSeek, așa că ar trebui tratate ca o declarație, și nu un verdict. Dar scara saltului din Flash-ul anterior este vizibilă chiar și fără măsurători terțe.

În continuare, DeepSeek a anunțat că elimină treptat V4 Pro: din 14 septembrie, API redirecționează cererile către V4 Pro către V4.1 Flash și le numără la rata Flash. Concluzia practică este simplă: Flash nu mai este un model „junior”. Acum ea este cea care suportă sarcina principală, iar versiunile obișnuite și cele de viziune nu mai există separat.

Mai puțină memorie cache înseamnă sarcini de agent mai ieftine

Pentru scenariile bazate pe agent, principalele economii nu sunt în prețul simbolului, ci în cache. Agentul recitește istoricul dialogului, instrucțiunile și fișierele de proiect din nou și din nou, iar intrarea în cache este cea care consumă cea mai mare parte a facturii. Cache-ul global V4.1 Flash KV durează aproximativ 890 de octeți pe token - de aproximativ patru ori mai puțin decât V4 Flash, iar partea permanentă a cache-ului este comprimată de aproximativ opt ori.

Prețul modelului în sine a scăzut, de asemenea, față de Flash-ul anterior: intrarea în cache este cu 60% mai ieftină, intrarea obișnuită este cu aproximativ o treime mai ieftină, producția este cu 11% mai ieftină. Câștigurile sunt vizibile mai ales în sarcinile care reciclează contexte mari din nou și din nou; unde durata noului răspuns este mai importantă, economiile sunt mai modeste.

Fluxul de date este comprimat într-o bandă strălucitoare îngustă pe măsură ce trece prin rețeaua cristalină.

V4 Flash și V4.1 Flash: ce s-a schimbat

ParametruV4 FlashV4.1 Flash
Opțiuni284 miliarde552 miliarde
Activ în pas13 miliarde8 miliarde de intrare / 16 miliarde de ieșire
ArhitecturăMoE-decodorCausal Encoder-Decoder
Înțelege imaginileNu, model de vedere separatDa, nativ
Context1 milion de jetoane1 milion de jetoane
Terminal-Bench 2.182,790,6
DeepSWE v1.154,474,2
KV-numerar per jeton~4× mai mult890 de octeți

Preț NeuralSpace și cum să încerci

Modelul NeuralSpace funcționează în aceeași rată ca și precedentul V4 Flash: 0,14 USD per milion de jetoane de intrare Şi 0,28 USD per milion în weekenduri. Start - de la 3 jetoane pe soldul tău; debitul provine din soldul general, fara abonament separat si card strain. Pentru a o încerca, este suficient un singur pas:

Întrebări frecvente

V4.1 Flash - acesta este un model nou sau o actualizare? Aceasta este o versiune a unei noi familii de arhitecturi, și nu o revizuire a Flash-ului precedent: arhitectura s-a schimbat, partea de susținere a crescut și viziunea a apărut.

Vede ea pozele? Da, nativ: puteți trimite o fotografie, captură de ecran, diagramă sau document. Ultimul V4 Flash a fost text.

Ce sa întâmplat cu V4 Pro? DeepSeek îl elimină treptat și redirecționează cererile către V4.1 Flash, care a depășit V4 Pro în benchmark-urile bazate pe agenți.

Cât costă să încerci? 0,14 USD/0,28 USD per milion de jetoane, începând de la 3 jetoane în sold - la pagina de chat a modelului.

Se vor rupe cererile vechi de v4-flash? Nu: apelurile către v4-flash și v4-flash-vision-exp sunt redirecționate către V4.1 Flash și contorizate la tariful său.