← Все статьи

DeepSeek V4 Pro 0813 - ini adalah titik perubahan yang bersejarah

DeepSeek V4 Pro 0813 - ini adalah titik perubahan yang bersejarah

Versi pendek (BLUF)

DeepSeek telah menghantar binaan V4 Pro terakhir — semakan 0813 — dan setiap pengguna deepseek-v4-pro sedia ada mendapatnya secara automatik melalui API, tiada acara pelancaran dilampirkan. Penanda aras bergerak lebih dekat dengan wilayah Claude dan GPT sementara harga kekal tidak berubah, buat masa ini. Di bawah: apa sebenarnya yang bertambah baik, aritmetik jujur ​​terhadap persaingan, dan tempat untuk mencubanya.

Hari ini DeepSeek menghantar versi akhir V4 Pro — semakan 0813. Tiada acara pelancaran dan tiada undur: API hanya dikemas kini. Sesiapa sahaja yang telah bekerja dengan deepseek-v4-pro mendapat model baharu secara automatik, tanpa perubahan kod. Binaan April adalah pratonton; yang ini ialah keluaran GA, dan perbezaan menunjukkan dengan jelas di mana model dijangka melakukan kerja yang berterusan dan bukannya menjawab mesej sembang.

A glowing digital whale — DeepSeek V4 Pro in its final release

Ini adalah hari pengekodan di peringkat Opus menjadi benar-benar berpatutan.Ayat itu akan memasarkan angan-angan pagi ini; menjelang petang ia adalah fakta dengan tanda aras dilampirkan.

Model ini sudah pun disiarkan di NeuralSpace:dalam sembang, dalamBahagian koddan dalamAPI. Tiada "menunggu pelancaran" — cuma buka dan gunakannya.

Apa modelnya

Secara teknikal ia adalah binatang yang sama seperti pada bulan April: Gabungan Pakar dengan 1.6 trilion parameter, 49 bilion daripadanya aktif pada sebarang langkah. Konteks ialah satu juta token, dan model itu boleh mengeluarkan sehingga 384 ribu token dalam satu jawapan. Sebagai perbandingan, itu kira-kira dua puluh kali lebih banyak daripada kebanyakan model dalam tab jiran.

Model boleh berfikir dalam dua mod — berfikir dan tidak berfikir — dan usaha_penaakulan kini mempunyai tiga langkah: maks, tinggi, rendah. Dalam amalan, soalan kecil boleh dijalankan dengan murah, manakala rantaian kompleks boleh dikendalikan pada penaakulan maksimum tanpa menukar model.

Penanda aras: apa yang sebenarnya bertambah baik

Benchmark gains for DeepSeek V4 Pro after the final release

Analisis Buatan mengukur semula versi akhir. Indeks Perisikan meningkat daripada 43.7 kepada 45.3. Indeks Pengekodan berubah daripada 58.7 kepada 59.4. Tetapi Indeks Agen melonjak paling banyak: daripada 35.3 kepada 37.8. Itu bukan satu kebetulan — semakan 0813 telah ditala khusus untuk senario agenik, di mana model tidak menjawab dalam satu pukulan tetapi berulang-alik: membaca fail, memanggil alat, memeriksa hasilnya dan membetulkan dirinya sendiri.

Kelajuan adalah lebih kurang sama dengan versi sebelumnya: sekitar 76 token sesaat pada output, token pertama dalam kira-kira satu setengah hingga dua saat. Itu pantas untuk model saiz ini. Kelemahan yang jujur: model adalah verbose. Pada pengukuran AA, ia mengeluarkan satu setengah hingga dua kali lebih banyak token daripada purata pasaran — bergantung pada pembayaran untuk token tambahan dan beberapa saat tambahan menunggu apabila ia membuat alasan panjang.

Menentang Claude dan GPT: aritmetik jujur

Barisan yang paling menarik dalam jadual baru ialah Claude Opus 4.8, perdana Anthropic sebelum ini. DeepSeek V4 Pro 0813 mengalahkannya dalam penanda aras pengekodan pada kedua-dua belah: Terminal-Bench 2.1 — 87.9 berbanding 85.0, DeepSWE — 62.7 berbanding 58.0. Dan Opus 4.8 berharga $5 setiap juta token input dan $25 setiap juta token keluaran — 11 dan 29 kali lebih banyak. Berikut adalah jadualnya:

Coding benchmark table: DeepSeek V4 Pro 0813 passes Claude Opus 4.8 in Terminal-Bench 2.1 and DeepSWE

Versi terakhir datang paling hampir dengan Claude Fable 5: 87.9 berbanding 88.0 dalam Terminal-Bench — perbezaan sepersepuluh mata. Dalam DeepSWE Fable lebih jauh ke hadapan: 70.0 berbanding 62.7. Dengan purata kesemua sepuluh penanda aras ejen dari jadual DeepSeek, Fable mendahului sebanyak 5.3% secara purata — tetapi DeepSeek menang pada dua daripada sepuluh, dan tanpa satu outlier (Peperiksaan Terakhir Kemanusiaan tanpa alatan: 42.7 berbanding 53.3) jurang purata mengecil kepada 2.8%.

Harga, sementara itu, berbeza bukan mengikut mata peratusan tetapi mengikut urutan magnitud. Fabel 5 berharga $10 setiap juta input dan $50 setiap juta token output; V4 Pro berharga $0.435 dan $0.87. Pada kadar bercampur iaitu kira-kira $30 berbanding $0.65. Jadi untuk perbezaan beberapa mata peratusan pada ujian, Anthropic meminta kira-kira 46 kali lebih banyak wang. Kaveat kejujuran: DeepSeek mengukur jadual perbandingannya sendiri pada infrastrukturnya yang tidak diterbitkan, dua daripada sepuluh ujian adalah dalaman, dan belum ada ukuran bebas 0813 — model itu dikeluarkan hari ini.

Untuk skala, ingat Kimi K3. Sebulan yang lalu ia menjadi model Cina pertama yang mengalahkan Claude Opus — itu adalah sensasi. Tetapi Kimi K3 ialah model trilion parameter yang memerlukan pelayan mahal untuk dijalankan, jadi secara runcit ia hanya tiga kali lebih murah daripada Claude Fable dan hanya 40% lebih murah daripada Claude Opus. Mengagumkan, tetapi tidak betul-betul pendemokrasian.

DeepSeek V4 Pro ialah detik yang benar-benar bersejarah. Benar-benar mendekati Opus dalam pengekodan, kosnya 30 kali lebih rendah daripada Opus dan 60 kali lebih murah daripada Fable. Pengekodan vibe baru sahaja tersedia untuk semua orang — bukan dalam erti kata pengiklanan "tersedia", tetapi pada harga kemasukan.

Dengan GPT gambar lebih bernuansa. GPT-5.5 mendapat markah 56.3 pada indeks Analisis Buatan berbanding 45.3 untuk DeepSeek — jurang yang nyata. Tetapi kadarnya tiada tandingan: $5/$30 setiap juta berbanding $0.435/$0.87. GPT-5.6 Luna yang lebih murah, bagaimanapun, berharga $0.10/$0.60 — kurang daripada DeepSeek — dan mendapat markah 52.3. Jadi "yang paling murah daripada yang besar" tidak lagi unik: pada harga V4 Pro bersaing dengan Luna, manakala pada skor ia kalah kepada Terra dan Sol.

Tambah satu petikan yang menyedihkan dari luar: dalam penilaian baru-baru ini oleh NIST AS (CAISI), V4 Pro dikatakan akan mengekori peneraju pasaran kira-kira lapan bulan. Mereka mengukur versi pratonton, walaupun. Sama ada 0813 mengecilkan jurang itu kekal untuk penanda aras bebas — dan belum ada lagi.

Harga tidak berubah. Buat masa ini

Input ialah $0.435 setiap juta token, output ialah $0.87. Hit cache masih hampir percuma: $0.003625 setiap juta, 120 kali lebih murah daripada input biasa. Untuk rantaian agen ini ialah perkara utama: konteks projek dibaca semula berulang kali, dan cachelah yang menentukan berapa banyak kos kerja ejen sejam.

Satu kaveat: DeepSeek telah memberi amaran dalam dokumennya bahawa ia merancang untuk menaikkan harga API secara umum. Bila dan berapa banyak — tidak dikatakan. Kadar April masih terpakai buat masa ini, dan ia nyata lebih rendah daripada model Barat yang setanding.

Mana nak cuba sekarang

Pembayaran adalah dalam rubel daripada satu baki yang dikongsi, tanpa langganan, tiada VPN dan tiada kad asing. Anda dicaj untuk penggunaan sebenar, bukan pakej "bulan hadapan".

Perkara yang tidak boleh dilakukan oleh model ialah melihat imej: input adalah teks sahaja. Jika anda perlu membedah tangkapan skrin atau foto, itu adalah untuk model lain. Tetapi untuk teks, kod dan tugas agen yang panjang, V4 Pro terakhir ialah salah satu tawaran kekuatan kepada harga yang paling jujur.Cuba dalam sembang, atauambil kunci pada halaman kunci APIuntuk membinanya ke dalam produk anda.

Soalan Lazim (FAQ)

S: Bagaimana saya boleh bermula?
J: Daftar di platform dan dapatkan token percuma untuk ujian.

S: Bolehkah saya menggunakan kandungan yang dijana secara komersial?
J: Ya, anda mendapat hak komersial penuh untuk semua yang anda cipta.