← Todos os artigos

DeepSeek V4 Pro 0813 é um ponto de viragem histórico

Baleia digital brilhante - DeepSeek V4 Pro na versão final

Resumidamente sobre o principal (BLUF)

DeepSeek lançou a versão final V4 Pro - revisão 0813: a atualização chegou automaticamente via API, sem apresentações ou referências. Observamos exatamente o que aumentou usando benchmarks, calculamos honestamente a diferença com Claude e GPT e explicamos por que o preço ainda não mudou.

Hoje DeepSeek lançou a versão final V4 Pro - revisão 0813. Sem conferências ou contadores regressivos: apenas atualizei a API. Quem já trabalhou com `deepseek-v4-pro` recebeu automaticamente um novo modelo sem alterar nada no código. O de abril foi uma prévia, este é GA, e a diferença é perceptível principalmente onde se espera que o modelo não responda no chat, mas trabalhe de forma coerente.

Baleia digital brilhante - DeepSeek V4 Pro na versão final

Hoje é o dia em que a codificação no nível Opus se tornou verdadeiramente acessível. Esta proposta teria sido o sonho de qualquer profissional de marketing pela manhã e, à noite, teria sido um fato, com benchmarks para arrancar.

Em NeuralSpace o modelo já está de pé: no bate-papo, V Seção "Código" e em API. Não há como “esperar que seja lançado” – você abre e usa.

Qual modelo

Tecnicamente, esta é a mesma fera de Abril: Mistura de Especialistas com 1,6 biliões de parâmetros, dos quais 49 mil milhões estão activos em cada etapa. O contexto é de um milhão de tokens e o modelo é capaz de produzir até 384 mil tokens em uma resposta. Para efeito de comparação: isso é cerca de vinte vezes mais do que a maioria dos modelos nas guias vizinhas.

O modelo pode pensar em dois modos - pensando e não pensando, e o raciocínio_esforço agora tem três níveis: máximo, alto, baixo. Na prática, isso significa que um pequeno problema pode ser resolvido de forma barata, e uma cadeia complexa pode ser resolvida com o máximo de reflexão, sem alterar o modelo.

Benchmarks: o que exatamente cresceu

Crescimento dos benchmarks DeepSeek V4 Pro após o lançamento da versão final

A Análise Artificial mediu novamente a versão final. O Índice de Inteligência aumentou de 43,7 para 45,3. Índice de codificação - de 58,7 a 59,4. Mas o Índice Agentic foi quem mais saltou: de 35,3 para 37,8. Isso não é um acidente - a revisão 0813 foi corrigida especificamente para cenários baseados em agentes, onde o modelo não responde de uma só vez, mas vai e volta: lê arquivos, chama ferramentas, olha o resultado e se corrige.

Em termos de velocidade, tudo está no nível da versão anterior: cerca de 76 tokens por segundo na saída, o primeiro token chega em cerca de um segundo e meio a dois segundos. Isso é rápido para um modelo deste tamanho. Desvantagem honesta: o modelo é falante. Nas medições AA, ele distribui uma vez e meia a duas vezes mais tokens do que a média do mercado - considere que, para um raciocínio detalhado, você está pagando com tokens extras e segundos extras de espera.

Contra Claude e GPT: aritmética justa

O que mais chama a atenção na última tabela é a linha com Claude Opus 4.8, antigo carro-chefe da Anthropic. DeepSeek V4 Pro 0813 superou em benchmarks de codificação em ambos os lados: Terminal-Bench 2.1 - 87,9 versus 85,0, DeepSWE - 62,7 versus 58,0. Ao mesmo tempo, o Opus 4.8 custa US$ 5 por milhão de tokens de entrada e US$ 25 por milhão de tokens de saída – 11 e 29 vezes mais caro. Aqui está a tabela:

Tabela de benchmark de codificação: DeepSeek V4 Pro 0813 supera Claude Opus 4.8 no Terminal-Bench 2.1 e DeepSWE

A versão final chegou mais perto de Claude Fable 5: 87,9 contra 88,0 no Terminal-Bench – um décimo de diferença. De acordo com DeepSWE, Fable está visivelmente à frente: 70,0 versus 62,7. Se você contar todos os dez benchmarks baseados em agentes da tabela DeepSeek, Fable está à frente por uma média de 5,3% - mas em duas em cada dez DeepSeek vitórias, e sem o único outlier (Último Exame da Humanidade sem ferramentas: 42,7 vs 53,3) a vantagem média diminui para 2,8%.

O preço difere não em porcentagem, mas em várias vezes. Fable 5 custa US$ 10 por milhão de entrada e US$ 50 por milhão de tokens de saída; V4 Pro tem US$ 0,435 e US$ 0,87. Na taxa mista, chega a cerca de US$ 30 contra US$ 0,65. Ou seja, por uma diferença de alguns por cento nos testes, a Anthropic pede para pagar aproximadamente 46 vezes mais. Advertências de honestidade: eu mesmo medi a tabela de comparação DeepSeek, em minha própria infraestrutura não publicada, dois em cada dez testes são internos e não há medições independentes de 0813 ainda - o modelo foi lançado apenas hoje.

Para entender a escala, pense no Kimi K3. Há um mês, ela foi a primeira modelo chinesa a ultrapassar Claude Opus - foi uma sensação. Mas o Kimi K3 é um modelo com trilhões de parâmetros, requer um servidor caro para funcionar, então no varejo é apenas três vezes mais barato que Claude Fable e apenas 40% mais barato que Claude Opus. Impressionante, mas não há democratização nisso.

Mas DeepSeek V4 Pro é um momento verdadeiramente histórico. Realmente alcançando o Opus em termos de codificação, custa 30 vezes menos que o Opus e 60 vezes menos que o Fable. Hoje, o vibecoding tornou-se acessível a todos – não no sentido publicitário de “disponível”, mas ao preço de entrar nele.

Com o GPT a situação é mais complicada. GPT-5.5 pontua 56,3 no índice de Análise Artificial versus 45,3 para DeepSeek - a lacuna é honestamente perceptível. Mas as tarifas não são comparáveis: 5 dólares/30 dólares por milhão versus 0,435 dólares/0,87 dólares. Mas o GPT-5.6 Luna mais barato já custa US$ 0,10/US$ 0,60 – ou seja, mais barato que DeepSeek – e pontua 52,3. Acontece que o “mais barato dos grandes” não é mais o único: ao preço de V4 Pro concorre com a Luna, e em pontos perde tanto para a Terra quanto para o Sol.

Acrescentarei uma citação sóbria vinda de fora: uma avaliação recente do NIST americano (CAISI) disse que V4 Pro está cerca de oito meses atrás dos líderes de mercado. É verdade que eles mediram uma versão prévia. Se o 0813 reduziu esta lacuna será demonstrado por benchmarks independentes, mas eles ainda não existem.

O preço não mudou. Tchau

Entrada – US$ 0,435 por milhão de tokens, saída – US$ 0,87. O acerto em dinheiro ainda é quase gratuito: US$ 0,003625 por milhão, 120 vezes mais barato que a entrada normal. Para cadeias de agentes, este é o ponto principal: o contexto do projeto é lido repetidas vezes, e é o cache que decide quanto custa uma hora de trabalho do agente.

Uma ressalva: DeepSeek já avisou na documentação que vai aumentar os preços de sua API como um todo. Quando e por quanto tempo não é dito. As tarifas de abril ainda estão em vigor e são visivelmente mais baixas do que as contrapartes ocidentais de uma classe comparável.

Onde experimentar agora

Pagamento - em rublos do saldo geral, sem assinatura, VPN ou cartão estrangeiro. O uso real é amortizado, não o pacote “com um mês de antecedência”.

O que o modelo não pode fazer é olhar imagens: a entrada é apenas texto. Se precisar de análise de uma captura de tela ou foto, isso é para outros modelos. Mas para tarefas de texto, código e agentes longos, o V4 Pro final é agora uma das propostas mais honestas em termos de relação poder e preço. Você pode conferir no chat, e se você precisar incorporá-lo ao seu produto - a chave é obtida da página de chaves de API.

Perguntas frequentes (FAQ)

Pergunta: Como começar? Resposta: Cadastre-se na plataforma e receba tokens grátis para testes.

Pergunta: Os materiais gerados são adequados para uso comercial? Resposta: Sim, você recebe direitos comerciais totais sobre todo o conteúdo criado.