← Tutti gli articoli

DeepSeek V4 Pro 0813 è una svolta storica

Balena digitale luminosa - DeepSeek V4 Pro nella versione finale

Brevemente sulla cosa principale (BLUF)

DeepSeek rilasciata la versione finale V4 Pro - revisione 0813: l'aggiornamento è arrivato in automatico tramite API, senza presentazioni o riferimenti. Osserviamo cosa è aumentato esattamente utilizzando i benchmark, calcoliamo onestamente la differenza con Claude e GPT e spieghiamo perché il prezzo non è ancora cambiato.

Oggi DeepSeek è stata lanciata la versione finale V4 Pro - revisione 0813. Nessuna conferenza o contatore alla rovescia: ho appena aggiornato l'API. Coloro che hanno già lavorato con `deepseek-v4-pro` hanno ricevuto automaticamente un nuovo modello senza modificare nulla nel codice. Quella di aprile era un'anteprima, questa è GA, e la differenza si nota soprattutto dove ci si aspetta che il modello non risponda in una chat, ma che lavori in modo coerente.

Balena digitale luminosa - DeepSeek V4 Pro nella versione finale

Oggi è il giorno in cui la codifica a livello di Opus è diventata veramente accessibile. Questa proposta sarebbe stata il sogno di ogni operatore di marketing al mattino, e alla sera sarebbe stata un dato di fatto con dei parametri di riferimento da aggiungere.

In NeuralSpace il modello è già in piedi: nella chat, V Sezione "Codice". e dentro API. Non c'è "attesa che venga lanciato": lo apri e lo usi.

Che modello

Tecnicamente si tratta della stessa bestia di aprile: una miscela di esperti con 1,6 trilioni di parametri, di cui 49 miliardi attivi ad ogni passaggio. Il contesto è di un milione di token e il modello è in grado di produrre fino a 384mila token in una risposta. Per fare un confronto: questo è circa venti volte di più rispetto alla maggior parte dei modelli nelle schede vicine.

Il modello può pensare in due modalità: pensiero e non pensiero, e lo sforzo di ragionamento ora ha tre livelli: massimo, alto, basso. In pratica, ciò significa che un piccolo problema può essere risolto a buon mercato, mentre una catena complessa può essere risolta con la massima attenzione, senza cambiare il modello.

Benchmark: cosa è cresciuto esattamente

Crescita dei benchmark DeepSeek V4 Pro dopo il rilascio della versione finale

L'analisi artificiale ha rimisurato la versione finale. L'indice di intelligenza è aumentato da 43,7 a 45,3. Indice di codifica - da 58,7 a 59,4. Ma l'indice Agentic è quello che ha registrato il balzo maggiore: da 35,3 a 37,8. Questo non è un incidente: la revisione 0813 è stata corretta specificamente per scenari basati su agenti, in cui il modello non risponde in una sola seduta, ma va avanti e indietro: legge file, chiama strumenti, guarda il risultato e si corregge.

In termini di velocità, tutto è al livello della versione precedente: circa 76 token al secondo in uscita, il primo token arriva in circa un secondo e mezzo o due secondi. È veloce per un modello di queste dimensioni. Onesto svantaggio: il modello è loquace. Alle misurazioni AA, vengono emessi da una volta e mezza a due volte più token rispetto alla media del mercato: considera che per un ragionamento dettagliato stai pagando sia con token extra che con secondi extra di attesa.

Contro Claude e GPT: giusta aritmetica

La cosa più evidente nell’ultima tabella è la linea con Claude Opus 4.8, l’ex fiore all’occhiello di Anthropic. DeepSeek V4 Pro 0813 lo ha battuto nei benchmark di codifica su entrambi i lati: Terminal-Bench 2.1 - 87.9 contro 85.0, DeepSWE - 62.7 contro 58.0. Allo stesso tempo, Opus 4.8 costa 5 dollari per milione di token di input e 25 dollari per milione di token di output: 11 e 29 volte più costosi. Ecco la tabella:

Tabella benchmark di codifica: DeepSeek V4 Pro 0813 batte Claude Opus 4.8 in Terminal-Bench 2.1 e DeepSWE

La versione finale si è avvicinata di più a Claude Fable 5: 87,9 contro 88,0 in Terminal-Bench, una differenza di un decimo. Secondo DeepSWE, Fable è nettamente più avanti: 70,0 contro 62,7. Se si contano tutti e dieci i benchmark basati su agenti dalla tabella DeepSeek, Fable è avanti in media del 5,3% - ma su due vittorie su dieci DeepSeek, e senza l'unico valore anomalo (Humanity's Last Exam senza strumenti: 42,7 contro 53,3) il vantaggio medio si riduce al 2,8%.

Il prezzo differisce non in percentuale, ma più volte. Fable 5 costa $ 10 per milione di token di input e $ 50 per milione di token di output; V4 Pro ha $ 0,435 e $ 0,87. Al tasso misto si arriva a circa $ 30 contro $ 0,65. Cioè, per una differenza di pochi punti percentuali nei test, Anthropic chiede di pagare circa 46 volte di più. Avvertenze sull'onestà: ho misurato io stesso la tabella comparativa DeepSeek, sulla mia infrastruttura non pubblicata, due test su dieci sono interni e non esistono ancora misurazioni indipendenti di 0813: il modello è stato rilasciato solo oggi.

Per capire la scala, pensa al Kimi K3. Un mese fa è stata la prima modella cinese a superare Claude Opus: è stato uno scalpore. Ma Kimi K3 è un modello con trilioni di parametri, richiede un server costoso per funzionare, quindi al dettaglio è solo tre volte più economico di Claude Fable e solo il 40% più economico di Claude Opus. Impressionante, ma non c’è democratizzazione in questo.

Ma DeepSeek V4 Pro è un momento davvero storico. Davvero al passo con Opus in termini di codifica, costa 30 volte meno di Opus e 60 volte meno di Fable. Oggi il vibecoding è diventato accessibile a tutti, non nel senso pubblicitario di “disponibile”, ma al prezzo dell’ingresso in esso.

Con GPT la situazione è più complicata. GPT-5.5 ottiene un punteggio di 56,3 nell'indice di analisi artificiale contro 45,3 per DeepSeek: il divario è onestamente evidente. Ma le tariffe non sono paragonabili: 5/30 dollari per milione contro 0,435/0,87 dollari. Ma il più economico GPT-5.6 Luna costa già $0,10/$0,60 - ovvero più economico di DeepSeek - e ottiene un punteggio di 52,3. Si scopre che il “più economico dei grandi” non è più l'unico: al prezzo di V4 Pro compete con Luna, e in termini di punti perde sia contro Terra che Sol.

Aggiungo una citazione sobria dall'esterno: una recente valutazione dell'americano NIST (CAISI) afferma che V4 Pro è in ritardo rispetto ai leader di mercato di circa otto mesi. È vero, hanno misurato una versione di anteprima. Se 0813 avrà ridotto questo divario sarà dimostrato da benchmark indipendenti, ma non esistono ancora.

Il prezzo non è cambiato. Ciao

Entrata – $ 0,435 per milione di token, uscita – $ 0,87. Il cash hit è ancora quasi gratuito: 0,003625 dollari per milione, 120 volte più economico dell’ingresso regolare. Per le catene di agenti questo è il punto principale: il contesto del progetto viene letto più e più volte, ed è la cache a decidere quanto costa un'ora di lavoro dell'agente.

Un avvertimento: DeepSeek ha già avvertito nella documentazione che aumenterà i prezzi per la sua API nel suo insieme. Quando e per quanto tempo non è detto. Le tariffe di aprile sono ancora in vigore, e questo è notevolmente inferiore rispetto agli analoghi occidentali di una classe comparabile.

Dove provarlo adesso

  • Chiacchierata: aprire pagina del modello — la finale 0813 è già quella predefinita.
  • Codice: V Sezione "Codice". il modello si connette al progetto e funziona con il repository, i file e il terminale.
  • API: la chiave viene rilasciata nella sezione Chiavi API NeuralSpace, formato compatibile con OpenAI.

Pagamento: in rubli dal saldo generale, senza abbonamento, VPN o carta straniera. Viene ammortizzato l'utilizzo effettivo, non il pacchetto “mese in anticipo”.

Ciò che il modello non può fare è guardare le immagini: l’input è solo testo. Se hai bisogno dell'analisi di uno screenshot o di una foto, questo è per altri modelli. Ma per testo, codice e compiti lunghi dell'agente, il V4 Pro finale è ora una delle proposte più oneste in termini di rapporto potenza e prezzo. Puoi verificarlo in chate se hai bisogno di integrarlo nel tuo prodotto: la chiave viene presa dalla pagina delle chiavi API.

Domande frequenti (FAQ)

Domanda: come iniziare? Risposta: registrati sulla piattaforma e ricevi token gratuiti per i test.

Domanda: i materiali generati sono adatti per l'uso commerciale? Risposta: Sì, ricevi tutti i diritti commerciali su tutti i contenuti creati.