DeepSeek V4 Pro 0813: este es un punto de inflexión histórico
La versión corta (BLUF)
DeepSeek envió la versión final de V4 Pro (revisión 0813) y todos los usuarios existentes de deepseek-v4-pro la obtuvieron automáticamente a través de la API, sin ningún evento de lanzamiento adjunto. Los puntos de referencia se acercaron al territorio de Claude y GPT mientras que el precio se mantiene sin cambios, por ahora. A continuación: qué mejoró exactamente, aritmética honesta frente a la competencia y dónde probarla.
Hoy DeepSeek envió la versión final de V4 Pro – revisión 0813. Sin evento de lanzamiento ni cuenta regresiva: la API simplemente se actualizó. Cualquiera que ya esté trabajando con deepseek-v4-pro obtuvo el nuevo modelo automáticamente, sin cambios de código. La construcción de abril fue una vista previa; ésta es la versión GA, y la diferencia muestra más claramente dónde se espera que un modelo realice un trabajo sostenido en lugar de responder un mensaje de chat.

Este es el día en que la codificación a nivel Opus se volvió realmente asequible.Esa frase habría sido una ilusión de marketing esta mañana; Al anochecer es un hecho con puntos de referencia adjuntos.
El modelo ya está disponible en NeuralSpace:en el chat, en elSección de códigoy en elAPI. No hay que "esperar el lanzamiento", simplemente ábrelo y úsalo.
cual es el modelo
Técnicamente es la misma bestia que en abril: una mezcla de expertos con 1,6 billones de parámetros, 49 mil millones de ellos activos en cualquier paso. El contexto es de un millón de tokens y el modelo puede emitir hasta 384 mil tokens en una sola respuesta. En comparación, esto es aproximadamente veinte veces más que la mayoría de los modelos de las pestañas vecinas.
El modelo puede pensar de dos modos (pensando y no pensando) y el razonamiento_esfuerzo ahora tiene tres pasos: máximo, alto y bajo. En la práctica, una pregunta pequeña se puede resolver de forma económica, mientras que una cadena compleja se puede manejar con el máximo razonamiento sin cambiar de modelo.
Puntos de referencia: lo que realmente mejoró

Análisis Artificial volvió a medir la versión final. El índice de inteligencia aumentó de 43,7 a 45,3. El Índice de Codificación pasó de 58,7 a 59,4. Pero el índice Agentic fue el que más saltó: de 35,3 a 37,8. Eso no es una coincidencia: la revisión 0813 se ajustó específicamente para escenarios agentes, donde un modelo no responde de una sola vez, sino que va y viene: lee archivos, llama a herramientas, inspecciona el resultado y se corrige a sí mismo.
La velocidad es aproximadamente la misma que la versión anterior: alrededor de 76 tokens por segundo en la salida, el primer token en aproximadamente un segundo y medio a dos. Eso es rápido para un modelo de este tamaño. El verdadero problema: la versión es detallada. En mediciones AA, emite entre una y media y dos veces más tokens que el promedio del mercado; cuente con pagar por tokens adicionales y segundos adicionales de espera cuando razona extensamente.
Contra Claude y GPT: aritmética honesta
La fila más llamativa de la nueva tabla es Claude Opus 4.8, el anterior buque insignia de Anthropic. DeepSeek V4 Pro 0813 lo superó en pruebas de codificación en ambos lados: Terminal-Bench 2.1: 87,9 frente a 85,0, DeepSWE: 62,7 frente a 58,0. Y Opus 4.8 cuesta 5 dólares por millón de tokens de entrada y 25 dólares por millón de tokens de salida, 11 y 29 veces más. Aquí está la tabla:

La versión final se acercó más a Claude Fable 5: 87,9 frente a 88,0 en Terminal-Bench, una diferencia de una décima de punto. En DeepSWE, Fable está más por delante: 70,0 frente a 62,7. Con un promedio de los diez puntos de referencia agentes de la tabla de DeepSeek, Fable lidera con un 5,3% en promedio, pero DeepSeek gana en dos de diez, y sin el único valor atípico (El último examen de la Humanidad sin herramientas: 42,7 versus 53,3) la brecha promedio se reduce al 2,8%.
Mientras tanto, el precio no difiere en puntos porcentuales sino en órdenes de magnitud. Fable 5 cuesta 10 dólares por millón de fichas de entrada y 50 dólares por millón de salida; V4 Pro cuesta $0,435 y $0,87. Con una tasa mixta, eso es alrededor de $30 frente a $0,65. Entonces, por una diferencia de unos pocos puntos porcentuales en las pruebas, Anthropic pide aproximadamente 46 veces más dinero. Advertencias de honestidad: DeepSeek midió su propia tabla de comparación en su propia infraestructura inédita, dos de las diez pruebas son internas y aún no hay mediciones independientes de 0813: el modelo salió hoy.
Para la escala, recuerde Kimi K3. Hace un mes se convirtió en la primera modelo china en vencer a Claude Opus, lo que fue una sensación. Pero Kimi K3 es un modelo de un billón de parámetros que necesita un servidor caro para funcionar, por lo que en el comercio minorista es sólo tres veces más barato que Claude Fable y sólo un 40% más barato que Claude Opus. Impresionante, pero no exactamente democratización.
DeepSeek V4 Pro es un momento genuinamente histórico. Realmente acercándose a Opus en codificación, cuesta 30 veces menos que Opus y 60 veces menos que Fable. La codificación Vibe acaba de estar disponible para todos, no en el sentido publicitario de "disponible", sino al precio de entrada.
Con GPT el panorama tiene más matices. GPT-5.5 obtiene una puntuación de 56,3 en el índice de Análisis Artificial frente a 45,3 de DeepSeek, una brecha sinceramente notable. Pero las tasas son incomparables: 5 dólares/30 dólares por millón frente a 0,435 dólares/0,87 dólares. El GPT-5.6 Luna, más económico, sin embargo, cuesta $0,10/$0,60 (menos que DeepSeek) y obtiene una puntuación de 52,3. Por lo tanto, "el más barato de los grandes" ya no es único: en precio, V4 Pro compite con Luna, mientras que en puntaje pierde frente a Terra y Sol.
Agregue una cita aleccionadora del exterior: en una evaluación reciente realizada por el NIST de EE. UU. (CAISI), se dijo que V4 Pro estaba a unos ocho meses de los líderes del mercado. Sin embargo, midieron la versión preliminar. Queda por determinar si 0813 redujo esa brecha o no, y todavía no hay ninguno.
El precio no cambió. Por ahora
La entrada es de 0,435 dólares por millón de tokens y la salida es de 0,87 dólares. Los accesos a la caché siguen siendo casi gratuitos: 0,003625 dólares por millón, 120 veces más baratos que una entrada normal. Para las cadenas de agentes, este es el punto principal: el contexto del proyecto se relee una y otra vez, y es el caché el que decide cuánto cuesta una hora de trabajo del agente.
Una advertencia: DeepSeek ya advirtió en sus documentos que planea aumentar los precios de las API en general. Cuándo y cuánto, no se dice. Las tarifas de abril todavía se aplican por ahora y son notablemente más bajas que las de los modelos occidentales comparables.
Dónde probarlo ahora mismo
- Charlar:abre elpágina modelo— el 0813 final ya es el predeterminado.
- Código:en elSección de códigoel modelo se conecta a un proyecto y funciona con un repositorio, archivos y una terminal.
- API:la clave se emite enClaves de la API de NeuralSpace, Formato compatible con OpenAI.
El pago se realiza en rublos desde un saldo compartido, sin suscripción, sin VPN y sin tarjeta extranjera. Se le cobra por el uso real, no por un paquete de "mes por delante".
Lo que el modelo no puede hacer es mirar imágenes: la entrada es sólo texto. Si necesitas diseccionar una captura de pantalla o una foto, eso es para otros modelos. Pero para texto, código y tareas de agencia largas, el V4 Pro final es una de las ofertas de relación calidad-precio más honestas que existen.Pruébalo en el chat, oobtenga una clave en la página de claves APIpara incorporarlo a su producto.
Preguntas frecuentes (FAQ)
P: ¿Cómo empiezo?
R: Regístrese en la plataforma y obtenga tokens gratis para realizar pruebas.
P: ¿Puedo utilizar comercialmente el contenido generado?
R: Sí, obtienes todos los derechos comerciales sobre todo lo que creas.