← Tous les articles

DeepSeek V4 Pro 0813 - c'est un tournant historique

DeepSeek V4 Pro 0813 - c'est un tournant historique

La version courte (BLUF)

DeepSeek a livré la version finale de V4 Pro – révision 0813 – et chaque utilisateur deepseek-v4-pro existant l'a obtenue automatiquement via l'API, sans événement de lancement attaché. Les indices de référence se sont rapprochés du territoire Claude et GPT tandis que le prix reste inchangé, pour l'instant. Ci-dessous : ce qui a été amélioré exactement, une arithmétique honnête par rapport à la concurrence et où l'essayer.

Aujourd'hui, DeepSeek a livré la version finale de la V4 Pro — révision 0813. Pas d'événement de lancement ni de compte à rebours : l'API a simplement été mise à jour. Toute personne travaillant déjà avec deepseek-v4-pro a obtenu le nouveau modèle automatiquement, sans modification de code. La version d'avril était un aperçu ; celle-ci est la version GA, et la différence montre le plus clairement où un modèle est censé effectuer un travail soutenu plutôt que de répondre à un message de discussion.

A glowing digital whale — DeepSeek V4 Pro in its final release

C’est le jour où le codage au niveau Opus est devenu véritablement abordable.Cette phrase aurait été un vœu pieux de marketing ce matin ; le soir, c'est un fait avec des repères attachés.

Le modèle est déjà en ligne sur NeuralSpace :en conversation, dans leSection des codeset dans leAPI. Pas d'attente de déploiement : il suffit de l'ouvrir et de l'utiliser.

Quel est le modèle

Techniquement, c'est la même bête qu'en avril : un mélange d'experts avec 1,6 billion de paramètres, dont 49 milliards sont actifs à chaque étape. Le contexte est d'un million de jetons et le modèle peut émettre jusqu'à 384 000 jetons en une seule réponse. A titre de comparaison, c'est environ vingt fois plus que la plupart des modèles des onglets voisins.

Le modèle peut penser selon deux modes – réflexion et non-pensée – et Reasoning_effort comporte désormais trois étapes : max, élevé, faible. En pratique, une petite question peut être traitée à moindre coût, tandis qu'une chaîne complexe peut être traitée avec un raisonnement maximal sans changer de modèle.

Benchmarks : ce qui s'est réellement amélioré

Benchmark gains for DeepSeek V4 Pro after the final release

L'analyse artificielle a ré-mesuré la version finale. L'indice du renseignement est passé de 43,7 à 45,3. L'indice de codage est passé de 58,7 à 59,4. Mais c'est Agentic Index qui a le plus bondi : de 35,3 à 37,8. Ce n'est pas une coïncidence : la révision 0813 a été spécialement adaptée aux scénarios agents, dans lesquels un modèle ne répond pas d'un seul coup mais fait des allers-retours : lit des fichiers, appelle des outils, inspecte le résultat et se corrige.

La vitesse est à peu près la même que celle de la version précédente : environ 76 jetons par seconde en sortie, premier jeton en une seconde et demie à deux secondes environ. C'est rapide pour un modèle de cette taille. L’inconvénient honnête : le modèle est verbeux. Sur les mesures AA, il émet une fois et demie à deux fois plus de jetons que la moyenne du marché – comptez sur le paiement de jetons supplémentaires et de secondes d'attente supplémentaires lorsqu'il raisonne longuement.

Contre Claude et GPT : une arithmétique honnête

La ligne la plus frappante du nouveau tableau est Claude Opus 4.8, l'ancien produit phare d'Anthropic. DeepSeek V4 Pro 0813 l'a battu dans les tests de codage des deux côtés : Terminal-Bench 2.1 - 87,9 contre 85,0, DeepSWE - 62,7 contre 58,0. Et l'Opus 4.8 coûte 5 $ par million de jetons d'entrée et 25 $ par million de jetons de sortie, soit 11 et 29 fois plus. Voici le tableau :

Coding benchmark table: DeepSeek V4 Pro 0813 passes Claude Opus 4.8 in Terminal-Bench 2.1 and DeepSWE

La version finale se rapproche le plus de Claude Fable 5 : 87,9 contre 88,0 dans Terminal-Bench, soit une différence d'un dixième de point. Dans DeepSWE, Fable est plus avancé : 70,0 contre 62,7. En faisant la moyenne des dix benchmarks agents du tableau de DeepSeek, Fable mène de 5,3 % en moyenne – mais DeepSeek gagne sur deux sur dix, et sans la seule valeur aberrante (Dernier examen de l'humanité sans outils : 42,7 contre 53,3), l'écart moyen se réduit à 2,8 %.

Le prix, quant à lui, ne diffère pas en points de pourcentage mais en ordres de grandeur. Fable 5 coûte 10 $ par million de jetons d'entrée et 50 $ par million de jetons de sortie ; V4 Pro coûte 0,435 $ et 0,87 $. Sur un tarif mixte soit environ 30$ contre 0,65$. Ainsi, pour une différence de quelques points de pourcentage sur les tests, Anthropic demande environ 46 fois plus d’argent. Mises en garde en matière d'honnêteté : DeepSeek a mesuré son propre tableau de comparaison sur sa propre infrastructure non publiée, deux des dix tests sont internes et il n'y a pas encore de mesures indépendantes de 0813 – le modèle est sorti aujourd'hui.

Pour l'échelle, souvenez-vous du Kimi K3. Il y a un mois, elle est devenue le premier mannequin chinois à battre Claude Opus, ce qui a fait sensation. Mais Kimi K3 est un modèle comportant des milliards de paramètres qui nécessite un serveur coûteux pour fonctionner, donc au détail, il n'est que trois fois moins cher que Claude Fable et seulement 40 % moins cher que Claude Opus. Impressionnant, mais pas exactement démocratisation.

DeepSeek V4 Pro est un moment véritablement historique. Véritablement proche d'Opus en termes de codage, il coûte 30 fois moins cher qu'Opus et 60 fois moins cher que Fable. Le codage Vibe est devenu accessible à tous – non pas au sens publicitaire de « disponible », mais au prix d’entrée.

Avec GPT, la situation est plus nuancée. GPT-5.5 obtient un score de 56,3 sur l'indice d'analyse artificielle contre 45,3 pour DeepSeek – un écart honnêtement perceptible. Mais les tarifs sont incomparables : 5$/30$ par million contre 0,435$/0,87$. Le GPT-5.6 Luna, moins cher, coûte cependant 0,10 $/0,60 $ – moins que DeepSeek – et obtient un score de 52,3. Ainsi, « le moins cher des grands » n'est plus unique : en termes de prix, V4 Pro est en concurrence avec Luna, tandis qu'en termes de score, il perd à la fois contre Terra et Sol.

Ajoutez une citation extérieure qui donne à réfléchir : dans une récente évaluation du US NIST (CAISI), le V4 Pro aurait été à la traîne d'environ huit mois par rapport aux leaders du marché. Ils ont cependant mesuré la version d’aperçu. La question de savoir si 0813 a réduit cet écart reste à déterminer par des critères indépendants – et il n’y en a pas encore.

Le prix n'a pas changé. Pour l'instant

L'entrée est de 0,435 $ par million de jetons, la sortie est de 0,87 $. Les accès au cache sont toujours presque gratuits : 0,003625 $ par million, soit 120 fois moins cher qu'une entrée normale. Pour les chaînes agentiques, c'est le point principal : le contexte du projet est relu encore et encore, et c'est le cache qui décide combien coûte une heure de travail d'agent.

Une mise en garde : DeepSeek a déjà averti dans ses documents qu'il prévoyait d'augmenter les prix des API en général. Quand et dans quelle mesure – cela n’a pas été dit. Les tarifs d'avril s'appliquent toujours pour le moment et ils sont nettement inférieurs à ceux des modèles occidentaux comparables.

Où l'essayer maintenant

  • Chat:ouvrir lepage modèle— le 0813 final est déjà la valeur par défaut.
  • Code:dans leSection des codesle modèle se connecte à un projet et fonctionne avec un référentiel, des fichiers et un terminal.
  • API :la clé est délivrée enClés API NeuralSpace, Format compatible OpenAI.

Le paiement s'effectue en roubles à partir d'un solde partagé, sans abonnement, sans VPN et sans carte étrangère. Vous êtes facturé pour l'utilisation réelle, et non pour un forfait « un mois à l'avance ».

Ce que le modèle ne peut pas faire, c'est regarder les images : la saisie se fait uniquement en texte. Si vous avez besoin de décortiquer une capture d’écran ou une photo, c’est pour les autres modèles. Mais pour le texte, le code et les tâches d'agent longues, le V4 Pro final est l'une des offres rapport qualité-prix les plus honnêtes du marché.Essayez-le dans le chat, ourécupérez une clé sur la page des clés APIpour l'intégrer à votre produit.

Foire aux questions (FAQ)

Q : Comment puis-je commencer ?
R : Inscrivez-vous sur la plateforme et obtenez des jetons gratuits pour les tests.

Q : Puis-je utiliser le contenu généré à des fins commerciales ?
R : Oui, vous bénéficiez des droits commerciaux complets sur tout ce que vous créez.