← Все статьи

DeepSeek V4.1 Flash: η νέα έκδοση βλέπει εικόνες και κερδίζει το V4 Pro

DeepSeek V4.1 Flash: η νέα έκδοση βλέπει εικόνες και κερδίζει το V4 Pro

Το DeepSeek κυκλοφόρησε το V4.1 Flash — ένα μοντέλο που αντικατέστησε δύο προηγούμενα ταυτόχρονα: το κανονικό V4 Flash και μια πειραματική έκδοση με αναγνώριση εικόνας. Τώρα είναι ένα μεμονωμένο μοντέλο που γράφει κώδικα και διαβάζει εικόνες: ξεπερνά το V4 Pro στα agentic benchmarks, κατέχει ένα πλαίσιο ενός εκατομμυρίου token και χρησιμοποιεί περίπου τέσσερις φορές λιγότερη κρυφή μνήμη KV. Στο NeuralSpace, το V4.1 Flash είναι ήδη διαθέσιμο στη συνομιλία, στην ενότητα "Κώδικας" και μέσω του API — εδώ είναι τι άλλαξε σε σύγκριση με το V4 Flash.

Τι είναι αυτό το μοντέλο

Αυστηρά μιλώντας, δεν πρόκειται για αναθεώρηση του προηγούμενου Flash αλλά για το πρώτο μοντέλο μιας νέας οικογένειας αρχιτεκτονικής. V4.1 Flash έχει552 δισεκατομμύρια παραμέτρουςέναντι 284 δισεκατομμυρίων στο V4 Flash, οπότε το μοντέλο είναι αισθητά μεγαλύτερο. Ωστόσο, ενεργοποιεί λιγότερες παραμέτρους ανά βήμα: περίπου8 δισεκατομμύρια κατά την ανάγνωση της εισόδουκαι 16 δισεκατομμύρια ενώ δημιουργείται η απάντηση.

Το νέο σχήμα ονομάζεται Causal Encoder-Decoder: τα 40 επίπεδα μετασχηματιστή χωρίζονται σε 20 επίπεδα κωδικοποιητή και 20 επίπεδα αποκωδικοποιητή και η κοινόχρηστη κρυφή μνήμη κλειδιού-τιμής δημιουργείται μία φορά — από τις κρυφές καταστάσεις του κωδικοποιητή — αντί να υπολογίζεται εκ νέου σε κάθε επίπεδο. Αυτός είναι ο λόγος για τον οποίο η επεξεργασία εισροών είναι φθηνή. Η ασυμμετρία είναι σκόπιμη: ένας πράκτορας διαβάζει πολύ — αρχεία, ιστορικό συνομιλιών, οδηγίες — και γράφει σχετικά λίγα — επεξεργασίες, εντολές, αποφάσεις. Το ακριβό μισό έγινε ελαφρύ, οπότε οι πρακτικοί φόρτοι εργασίας έγιναν επίσης φθηνότεροι.

Το πλαίσιο είναι ένα εκατομμύριο μάρκες. Η προσπάθεια συλλογιστικής προσαρμόζεται συνεχώς από το 1 έως το 100: μια απλή ερώτηση μπορεί να λειτουργήσει φθηνά, ενώ μια σκληρή αλυσίδα μπορεί να λειτουργήσει στο μέγιστο χωρίς εναλλαγή μοντέλων.

Βλέπει εικόνες τώρα

Αυτή είναι η πιο ορατή διαφορά από την προηγούμενη έκδοση. Το V4 Flash είχε είσοδο μόνο κειμένου: δεν μπορούσε να δει τις εικόνες και το DeepSeek έστειλε ένα ξεχωριστό πειραματικό μοντέλο όρασης για αυτό. Στο V4.1 Flash, η όραση είναι ενσωματωμένη στο ίδιο το μοντέλο — δέχεται εγγενώς κείμενο και εικόνες και απαντά με κείμενο.

Στην πράξη, μπορείτε να δώσετε στο μοντέλο ένα στιγμιότυπο οθόνης διεπαφής χρήστη, ένα γράφημα, μια φωτογραφία ή μια σελίδα εγγράφου ως έχει. Θα περιγράφει την εικόνα, θα εξαγάγει κείμενο από ένα στιγμιότυπο οθόνης ή θα διαβάζει ένα διάγραμμα. Αυτό είναι ιδιαίτερα βολικό για πράκτορες: ένα μοντέλο διαβάζει τόσο τον κώδικα όσο και το στιγμιότυπο οθόνης της διεπαφής χρήστη, χωρίς να χρειάζεται εναλλαγή μεταξύ δύο υπηρεσιών.

Το DeepSeek απέσυρε τα παλιά ονόματα μοντέλων: τα αιτήματα για v4-flash και v4-flash-vision-exp δρομολογούνται τώρα στο V4.1 Flash, επομένως οι υπάρχουσες ενσωματώσεις δεν θα παρατηρήσουν τίποτα.

A lens with text lines and image frames flowing in and a single stream of light coming out

Ξεπερνά το V4 Pro

Το πιο δυνατό κομμάτι της έκδοσης: Το V4.1 Flash ξεπέρασε τις επιδόσεις του μεγαλύτερου V4 Pro σε εργασίες με πράκτορες. Ακολουθούν οι αριθμοί από τις επίσημες αξιολογήσεις του DeepSeek:

  • Τερματικός πάγκος 2.1(εργάζεται σε τερματικό) — 90,6 έναντι 87,9 για το V4 Pro και 82,7 για το προηγούμενο V4 Flash.
  • CyberGym(κυβερνοασφάλεια) — 88,1 έναντι 83,3 για το V4 Pro.
  • DeepSWE v1.1— 74,2 έναντι 54,4 για V4 Flash.
  • Terminal-Bench 4.0— 31,2 έναντι 7,0 για V4 Flash.

Επιπλέον: 90,9 στο GPQA Diamond, βαθμολογία Codeforces 3471 και 65,6 στο MathArena Apex. Οι αριθμοί δεν είναι ανεξάρτητοι - το DeepSeek τους ανέφερε το ίδιο, επομένως αντιμετωπίστε τους ως αξίωση και όχι ως ετυμηγορία. Αλλά η κλίμακα του άλματος πάνω από το προηγούμενο Flash είναι ορατή χωρίς εκτελέσεις τρίτων.

Η DeepSeek ανακοίνωσε επίσης μια τακτική σταδιακή κατάργηση του V4 Pro: από τις 14 Σεπτεμβρίου το API δρομολογεί αιτήματα για V4 Pro στο V4.1 Flash και τα χρεώνει σε τιμές Flash. Το πρακτικό takeaway είναι απλό: το Flash δεν είναι πλέον το "junior" μοντέλο. Τώρα φέρει το κύριο φορτίο και η κανονική και η έκδοση vision δεν υπάρχουν πλέον ξεχωριστά.

Μικρότερη κρυφή μνήμη, φθηνότερες εργασίες πρακτόρων

Για πρακτορικά σενάρια, η κύρια εξοικονόμηση δεν είναι στην τιμή συμβολικού αλλά στην κρυφή μνήμη. Ένας πράκτορας ξαναδιαβάζει το ιστορικό συνομιλιών, τις οδηγίες και τα αρχεία του έργου ξανά και ξανά και είναι η κρυφή είσοδος που τρώει το μεγαλύτερο μέρος του λογαριασμού. Η παγκόσμια κρυφή μνήμη KV του Flash V4.1 διαρκεί περίπου890 byte ανά διακριτικό— περίπου τέσσερις φορές λιγότερο από το V4 Flash — και η μόνιμη κρυφή μνήμη συμπιέζεται περίπου οκταπλάσια.

Η τιμή του μοντέλου μειώθηκε επίσης σε σχέση με το προηγούμενο Flash: η είσοδος στην κρυφή μνήμη είναι 60% φθηνότερη, η είσοδος χωρίς προσωρινή αποθήκευση περίπου κατά ένα τρίτο φθηνότερη και η έξοδος κατά 11% φθηνότερη. Το κέρδος είναι πιο ορατό σε φόρτους εργασίας που επεξεργάζονται επανειλημμένα ένα μεγάλο πλαίσιο. όπου το μήκος της νέας παραγωγής έχει μεγαλύτερη σημασία, η εξοικονόμηση είναι πιο μέτρια.

A data stream compressing into a narrow bright band as it passes through a crystal lattice

V4 Flash έναντι V4.1 Flash: τι άλλαξε

ΠαράμετροςV4 FlashV4.1 Flash
Παράμετροι284B552B
Ενεργοποιείται ανά βήμα13BΕίσοδος 8B / Έξοδος 16B
ΑρχιτεκτονικήΑποκωδικοποιητής MoEΑιτιακός Κωδικοποιητής-Αποκωδικοποιητής
Κατανοεί εικόνεςΌχι, ξεχωριστό μοντέλο όρασηςΝαι, εγγενώς
Συμφραζόμενα1 εκατομμύριο μάρκες1 εκατομμύριο μάρκες
Τερματικός πάγκος 2.182.790.6
DeepSWE v1.154.474.2
KV cache ανά διακριτικό~4× μεγαλύτερο890 byte

Τιμή στο NeuralSpace και πώς να το δοκιμάσετε

Στο NeuralSpace το μοντέλο τρέχει με τον ίδιο ρυθμό με το προηγούμενο V4 Flash:0,14 $ ανά εκατομμύριο διακριτικά εισόδουκαι0,28 $ ανά εκατομμύριο μάρκες εξόδου. Μπορείτε να ξεκινήσετε με μόλις 3 μάρκες στο υπόλοιπό σας. Η χρήση χρεώνεται από το κοινό υπόλοιπο, χωρίς ξεχωριστή συνδρομή και χωρίς ξένη κάρτα. Για να το δοκιμάσετε, αρκεί ένα βήμα:

  • Κουβέντα:οσελίδα μοντέλου— επισυνάψτε μια εικόνα ή ένα στιγμιότυπο οθόνης και το μοντέλο θα το διαβάσει.
  • Κώδικας:οΕνότητα "Κώδικας".— το μοντέλο συνδέεται με το έργο σας και λειτουργεί με το αποθετήριο, τα αρχεία και το τερματικό.
  • API:πάρε ένα κλειδί στοΣελίδα κλειδιών API; η μορφή είναι συμβατή με OpenAI και τα έγγραφα είναι ζωντανάneuralspace.pro/en/v1/docs.

Συχνές ερωτήσεις

Είναι το V4.1 Flash νέο μοντέλο ή ενημέρωση;Είναι ένα μοντέλο μιας νέας οικογένειας αρχιτεκτονικής και όχι μια αναθεώρηση του προηγούμενου Flash: η αρχιτεκτονική άλλαξε, η ραχοκοκαλιά μεγάλωσε και προστέθηκε το όραμα.

Βλέπει εικόνες;Ναι, εγγενώς: αποστολή φωτογραφίας, στιγμιότυπου οθόνης, γραφήματος ή εγγράφου. Το προηγούμενο V4 Flash ήταν μόνο κείμενο.

Τι έγινε με το V4 Pro;Το DeepSeek το καταργεί σταδιακά και δρομολογεί αιτήματα στο V4.1 Flash, το οποίο ξεπέρασε το V4 Pro σε αντιπροσωπευτικά benchmarks.

Πόσο κοστίζει η δοκιμή;0,14 $/0,28 $ ανά εκατομμύριο μάρκες, ξεκινώντας από 3 μάρκες στο υπόλοιπό σας — στοσελίδα μοντέλου συνομιλίας.

Θα χαλάσουν τα παλιά αιτήματα v4-flash;Όχι: οι κλήσεις προς v4-flash και v4-flash-vision-exp δρομολογούνται στο V4.1 Flash και χρεώνονται με την τιμή του.