DeepSeek V4.1 Flash: versi baharu melihat imej dan mengalahkan V4 Pro
DeepSeek telah mengeluarkan V4.1 Flash — model yang menggantikan dua yang terdahulu sekali gus: V4 Flash biasa dan versi percubaan dengan pengecaman imej. Kini ia adalah model tunggal yang menulis kod dan membaca imej: ia mengalahkan V4 Pro pada penanda aras agen, memegang konteks satu juta token dan menggunakan kira-kira empat kali lebih kurang cache KV. Pada NeuralSpace, V4.1 Flash sudah tersedia dalam sembang, dalam bahagian "Kod" dan melalui API — inilah yang berubah berbanding dengan V4 Flash.
Apakah model ini
Tegasnya, ini bukan semakan Flash sebelumnya tetapi model pertama keluarga seni bina baharu. V4.1 Flash mempunyai552 bilion parameterberbanding 284 bilion dalam V4 Flash, jadi model ini nyata lebih besar. Namun ia mengaktifkan lebih sedikit parameter setiap langkah: kira-kira8 bilion semasa membaca inputdan 16 bilion sambil menjana jawapan.
Skim baharu dipanggil Causal Encoder-Decoder: 40 lapisan pengubah berpecah kepada 20 lapisan pengekod dan 20 lapisan penyahkod, dan cache nilai kunci dikongsi dibina sekali — daripada keadaan tersembunyi pengekod — bukannya dikira semula dalam setiap lapisan. Itulah sebabnya pemprosesan input adalah murah. Asimetri adalah disengajakan: ejen membaca banyak — fail, sejarah perbualan, arahan — dan menulis secara perbandingan sedikit — suntingan, arahan, keputusan. Separuh yang mahal itu dibuat ringan, jadi beban kerja agen menjadi lebih murah juga.
Konteksnya ialah satu juta token. Usaha penaakulan boleh dilaraskan secara berterusan daripada 1 hingga 100: soalan mudah boleh dijalankan dengan murah, manakala rantai keras boleh berjalan pada maksimum tanpa menukar model.
Ia melihat imej sekarang
Ini adalah perbezaan yang paling ketara daripada versi sebelumnya. V4 Flash mempunyai input teks sahaja: ia tidak dapat melihat imej, dan DeepSeek menghantar model penglihatan percubaan yang berasingan untuk itu. Dalam V4.1 Flash, penglihatan terbina dalam model itu sendiri — ia menerima teks dan imej secara asal dan membalas dengan teks.
Dalam amalan, anda boleh menyerahkan tangkapan skrin UI kepada model, carta, foto atau halaman dokumen sebagaimana adanya. Ia akan menerangkan imej, mengekstrak teks daripada tangkapan skrin atau membaca rajah. Itu amat berguna untuk ejen: satu model membaca kedua-dua kod dan tangkapan skrin UI, tanpa perlu bertukar antara dua perkhidmatan.
DeepSeek menghentikan nama model lama: permintaan untuk v4-flash dan v4-flash-vision-exp kini dihalakan ke V4.1 Flash, jadi penyepaduan sedia ada tidak akan menyedari apa-apa.

Ia mengalahkan V4 Pro
Bahagian paling kuat keluaran: V4.1 Flash mengatasi V4 Pro yang lebih besar dalam tugas agen. Berikut ialah nombor daripada penilaian rasmi DeepSeek:
- Bangku Terminal 2.1(bekerja di terminal) — 90.6 berbanding 87.9 untuk V4 Pro dan 82.7 untuk V4 Flash sebelumnya;
- CyberGym(keselamatan siber) — 88.1 berbanding 83.3 untuk V4 Pro;
- DeepSWE v1.1— 74.2 berbanding 54.4 untuk V4 Flash;
- Bangku Terminal 4.0— 31.2 berbanding 7.0 untuk V4 Flash.
Selain itu: 90.9 pada GPQA Diamond, penarafan Codeforces 3471, dan 65.6 pada MathArena Apex. Nombor-nombor itu tidak bebas — DeepSeek melaporkannya sendiri, jadi anggap nombor itu sebagai tuntutan dan bukannya keputusan. Tetapi skala lompatan ke atas Flash sebelumnya boleh dilihat tanpa larian pihak ketiga.
DeepSeek juga mengumumkan penamatan V4 Pro secara teratur: mulai 14 September, laluan APInya meminta V4 Pro kepada V4.1 Flash dan mengebilkannya pada harga Flash. Praktikal bawa pulang adalah mudah: Flash bukan lagi model "junior". Ia kini membawa beban utama, dan versi biasa dan penglihatan tidak lagi wujud secara berasingan.
Cache yang lebih kecil, tugas agen yang lebih murah
Untuk senario agen, penjimatan utama bukan dalam harga token tetapi dalam cache. Seorang ejen membaca semula sejarah perbualan, arahan dan fail projek berulang kali, dan input cachelah yang memakan sebahagian besar bil. Cache KV global V4.1 Flash mengambil masa lebih kurang890 bait setiap token— kira-kira empat kali kurang daripada V4 Flash — dan cache berterusannya dimampatkan kira-kira lapan kali ganda.
Harga model juga turun berbanding Flash sebelumnya: input cache adalah 60% lebih murah, input tidak cache kira-kira satu pertiga lebih murah dan output 11% lebih murah. Keuntungan paling ketara dalam beban kerja yang berulang kali memproses konteks yang besar; di mana panjang output baharu lebih penting, penjimatan adalah lebih sederhana.

V4 Flash versus V4.1 Flash: apa yang berubah
| Parameter | V4 Denyar | V4.1 Denyar |
|---|---|---|
| Parameter | 284B | 552B |
| Diaktifkan setiap langkah | 13B | Input 8B / output 16B |
| Seni bina | Penyahkod KPM | Pengekod Sebab-Penyahkod |
| Memahami imej | Tidak, model penglihatan berasingan | Ya, secara asli |
| Konteks | token 1M | token 1M |
| Bangku Terminal 2.1 | 82.7 | 90.6 |
| DeepSWE v1.1 | 54.4 | 74.2 |
| KV cache setiap token | ~4× lebih besar | 890 bait |
Harga pada NeuralSpace dan cara mencubanya
Pada NeuralSpace model berjalan pada kadar yang sama seperti V4 Flash sebelumnya:$0.14 setiap juta token inputdan$0.28 setiap juta token keluaran. Anda boleh bermula dengan sekurang-kurangnya 3 token pada baki anda; penggunaan dicaj daripada baki yang dikongsi, tanpa langganan berasingan dan tiada kad asing. Untuk mencubanya, satu langkah sudah cukup:
- Sembang:yanghalaman model— lampirkan imej atau tangkapan skrin dan model akan membacanya;
- Kod:yangBahagian "Kod".— model bersambung ke projek anda dan berfungsi dengan repositori, fail dan terminal;
- API:dapatkan kunci padahalaman kunci API; formatnya serasi dengan OpenAI, dan dokumen disiarkan dineuralspace.pro/en/v1/docs.
Soalan lazim
Adakah V4.1 Flash model baharu atau kemas kini?Ia adalah model keluarga seni bina baharu dan bukannya semakan Flash sebelumnya: seni bina berubah, tulang belakang berkembang, dan penglihatan telah ditambah.
Adakah ia melihat imej?Ya, secara asli: hantar foto, tangkapan skrin, carta atau dokumen. V4 Flash sebelum ini ialah teks sahaja.
Apa yang berlaku kepada V4 Pro?DeepSeek sedang menghentikannya secara berperingkat dan menghalakan permintaan ke V4.1 Flash, yang mengalahkan V4 Pro pada penanda aras ejen.
Berapa kos untuk mencuba?$0.14/$0.28 setiap juta token, bermula daripada 3 token pada baki anda — padahalaman model sembang.
Adakah permintaan v4-flash lama akan rosak?Tidak: panggilan ke v4-flash dan v4-flash-vision-exp dihalakan ke V4.1 Flash dan dibilkan pada kadarnya.