DeepSeek V4 Pro 0813 é um ponto de viragem histórico
Resumidamente sobre o principal (BLUF)
DeepSeek lançou a versão final V4 Pro - revisão 0813: a atualização chegou automaticamente via API, sem apresentações ou referências. Observamos exatamente o que aumentou usando benchmarks, calculamos honestamente a diferença com Claude e GPT e explicamos por que o preço ainda não mudou.
Hoje DeepSeek lançou a versão final V4 Pro - revisão 0813. Sem conferências ou contadores regressivos: apenas atualizei a API. Quem já trabalhou com `deepseek-v4-pro` recebeu automaticamente um novo modelo sem alterar nada no código. O de abril foi uma prévia, este é GA, e a diferença é perceptível principalmente onde se espera que o modelo não responda no chat, mas trabalhe de forma coerente.

Hoje é o dia em que a codificação no nível Opus se tornou verdadeiramente acessível. Esta proposta teria sido o sonho de qualquer profissional de marketing pela manhã e, à noite, teria sido um fato, com benchmarks para arrancar.
Em NeuralSpace o modelo já está de pé: no bate-papo, V Seção "Código" e em API. Não há como “esperar que seja lançado” – você abre e usa.
Qual modelo
Tecnicamente, esta é a mesma fera de Abril: Mistura de Especialistas com 1,6 biliões de parâmetros, dos quais 49 mil milhões estão activos em cada etapa. O contexto é de um milhão de tokens e o modelo é capaz de produzir até 384 mil tokens em uma resposta. Para efeito de comparação: isso é cerca de vinte vezes mais do que a maioria dos modelos nas guias vizinhas.
O modelo pode pensar em dois modos - pensando e não pensando, e o raciocínio_esforço agora tem três níveis: máximo, alto, baixo. Na prática, isso significa que um pequeno problema pode ser resolvido de forma barata, e uma cadeia complexa pode ser resolvida com o máximo de reflexão, sem alterar o modelo.
Benchmarks: o que exatamente cresceu

A Análise Artificial mediu novamente a versão final. O Índice de Inteligência aumentou de 43,7 para 45,3. Índice de codificação - de 58,7 a 59,4. Mas o Índice Agentic foi quem mais saltou: de 35,3 para 37,8. Isso não é um acidente - a revisão 0813 foi corrigida especificamente para cenários baseados em agentes, onde o modelo não responde de uma só vez, mas vai e volta: lê arquivos, chama ferramentas, olha o resultado e se corrige.
Em termos de velocidade, tudo está no nível da versão anterior: cerca de 76 tokens por segundo na saída, o primeiro token chega em cerca de um segundo e meio a dois segundos. Isso é rápido para um modelo deste tamanho. Desvantagem honesta: o modelo é falante. Nas medições AA, ele distribui uma vez e meia a duas vezes mais tokens do que a média do mercado - considere que, para um raciocínio detalhado, você está pagando com tokens extras e segundos extras de espera.
Contra Claude e GPT: aritmética justa
O que mais chama a atenção na última tabela é a linha com Claude Opus 4.8, antigo carro-chefe da Anthropic. DeepSeek V4 Pro 0813 superou em benchmarks de codificação em ambos os lados: Terminal-Bench 2.1 - 87,9 versus 85,0, DeepSWE - 62,7 versus 58,0. Ao mesmo tempo, o Opus 4.8 custa US$ 5 por milhão de tokens de entrada e US$ 25 por milhão de tokens de saída – 11 e 29 vezes mais caro. Aqui está a tabela:

A versão final chegou mais perto de Claude Fable 5: 87,9 contra 88,0 no Terminal-Bench – um décimo de diferença. De acordo com DeepSWE, Fable está visivelmente à frente: 70,0 versus 62,7. Se você contar todos os dez benchmarks baseados em agentes da tabela DeepSeek, Fable está à frente por uma média de 5,3% - mas em duas em cada dez DeepSeek vitórias, e sem o único outlier (Último Exame da Humanidade sem ferramentas: 42,7 vs 53,3) a vantagem média diminui para 2,8%.
O preço difere não em porcentagem, mas em várias vezes. Fable 5 custa US$ 10 por milhão de entrada e US$ 50 por milhão de tokens de saída; V4 Pro tem US$ 0,435 e US$ 0,87. Na taxa mista, chega a cerca de US$ 30 contra US$ 0,65. Ou seja, por uma diferença de alguns por cento nos testes, a Anthropic pede para pagar aproximadamente 46 vezes mais. Advertências de honestidade: eu mesmo medi a tabela de comparação DeepSeek, em minha própria infraestrutura não publicada, dois em cada dez testes são internos e não há medições independentes de 0813 ainda - o modelo foi lançado apenas hoje.
Para entender a escala, pense no Kimi K3. Há um mês, ela foi a primeira modelo chinesa a ultrapassar Claude Opus - foi uma sensação. Mas o Kimi K3 é um modelo com trilhões de parâmetros, requer um servidor caro para funcionar, então no varejo é apenas três vezes mais barato que Claude Fable e apenas 40% mais barato que Claude Opus. Impressionante, mas não há democratização nisso.
Mas DeepSeek V4 Pro é um momento verdadeiramente histórico. Realmente alcançando o Opus em termos de codificação, custa 30 vezes menos que o Opus e 60 vezes menos que o Fable. Hoje, o vibecoding tornou-se acessível a todos – não no sentido publicitário de “disponível”, mas ao preço de entrar nele.
Com o GPT a situação é mais complicada. GPT-5.5 pontua 56,3 no índice de Análise Artificial versus 45,3 para DeepSeek - a lacuna é honestamente perceptível. Mas as tarifas não são comparáveis: 5 dólares/30 dólares por milhão versus 0,435 dólares/0,87 dólares. Mas o GPT-5.6 Luna mais barato já custa US$ 0,10/US$ 0,60 – ou seja, mais barato que DeepSeek – e pontua 52,3. Acontece que o “mais barato dos grandes” não é mais o único: ao preço de V4 Pro concorre com a Luna, e em pontos perde tanto para a Terra quanto para o Sol.
Acrescentarei uma citação sóbria vinda de fora: uma avaliação recente do NIST americano (CAISI) disse que V4 Pro está cerca de oito meses atrás dos líderes de mercado. É verdade que eles mediram uma versão prévia. Se o 0813 reduziu esta lacuna será demonstrado por benchmarks independentes, mas eles ainda não existem.
O preço não mudou. Tchau
Entrada – US$ 0,435 por milhão de tokens, saída – US$ 0,87. O acerto em dinheiro ainda é quase gratuito: US$ 0,003625 por milhão, 120 vezes mais barato que a entrada normal. Para cadeias de agentes, este é o ponto principal: o contexto do projeto é lido repetidas vezes, e é o cache que decide quanto custa uma hora de trabalho do agente.
Uma ressalva: DeepSeek já avisou na documentação que vai aumentar os preços de sua API como um todo. Quando e por quanto tempo não é dito. As tarifas de abril ainda estão em vigor e são visivelmente mais baixas do que as contrapartes ocidentais de uma classe comparável.
Onde experimentar agora
- Bater papo: abrir página do modelo — o 0813 final já é o padrão.
- Código: V Seção "Código" o modelo se conecta ao projeto e funciona com o repositório, arquivos e terminal.
- API: a chave é emitida na seção Chaves de API NeuralSpace, formato compatível com OpenAI.
Pagamento - em rublos do saldo geral, sem assinatura, VPN ou cartão estrangeiro. O uso real é amortizado, não o pacote “com um mês de antecedência”.
O que o modelo não pode fazer é olhar imagens: a entrada é apenas texto. Se precisar de análise de uma captura de tela ou foto, isso é para outros modelos. Mas para tarefas de texto, código e agentes longos, o V4 Pro final é agora uma das propostas mais honestas em termos de relação poder e preço. Você pode conferir no chat, e se você precisar incorporá-lo ao seu produto - a chave é obtida da página de chaves de API.
Perguntas frequentes (FAQ)
Pergunta: Como começar? Resposta: Cadastre-se na plataforma e receba tokens grátis para testes.
Pergunta: Os materiais gerados são adequados para uso comercial? Resposta: Sim, você recebe direitos comerciais totais sobre todo o conteúdo criado.