← 모든 글

DeepSeek V4 Pro 0813 - 역사적인 전환점입니다.

DeepSeek V4 Pro 0813 - 역사적인 전환점입니다.

짧은 버전(BLUF)

DeepSeek은 최종 V4 Pro 빌드인 개정판 0813을 출시했으며 기존의 모든 deepseek-v4-pro 사용자는 출시 이벤트가 첨부되지 않은 API를 통해 자동으로 빌드를 받았습니다. 벤치마크는 Claude 및 GPT 영역에 더 가까워졌고 가격은 현재 그대로 유지됩니다. 아래: 정확히 개선된 점, 경쟁업체에 대한 정직한 산술 및 이를 시도할 수 있는 위치.

오늘 DeepSeek는 V4 Pro의 최종 버전인 개정판 0813을 출시했습니다. 출시 이벤트나 카운트다운도 없고 API만 업데이트되었습니다. 이미 deepseek-v4-pro을 사용하고 있는 사람은 코드 변경 없이 자동으로 새 모델을 얻게 됩니다. 4월 빌드는 미리보기였습니다. 이것은 GA 릴리스이며 모델이 채팅 메시지에 응답하는 대신 지속적인 작업을 수행해야 하는 부분에서 차이점이 가장 명확하게 나타납니다.

A glowing digital whale — DeepSeek V4 Pro in its final release

오늘은 Opus 수준의 코딩이 진정으로 저렴해진 날입니다.그 문장은 오늘 아침에 희망적인 생각을 마케팅하는 것이었을 것입니다. 저녁에는 벤치마크가 첨부된 사실이 됩니다.

모델은 이미 NeuralSpace에 게시되어 있습니다.채팅 중, 에서코드 섹션그리고API. "롤아웃을 기다리는 중"이 아닙니다. 그냥 열어서 사용하세요.

모델이 무엇인가요?

기술적으로는 4월과 동일한 짐승입니다. 1조 6천억 개의 매개변수를 가진 전문가의 혼합체로서 어느 단계에서나 490억 개의 매개변수가 활성화됩니다. 컨텍스트는 100만 개의 토큰이며, 모델은 단일 답변으로 최대 384,000개의 토큰을 방출할 수 있습니다. 비교하자면, 이는 인접한 탭에 있는 대부분의 모델보다 대략 20배 더 많습니다.

모델은 생각과 비생각의 두 가지 모드로 생각할 수 있으며 이제 Reasoning_effort에는 최대, 높음, 낮음의 세 단계가 있습니다. 실제로 작은 질문은 저렴하게 실행할 수 있는 반면, 복잡한 체인은 모델을 전환하지 않고도 최대한 추론하여 처리할 수 있습니다.

벤치마크: 실제로 개선된 점

Benchmark gains for DeepSeek V4 Pro after the final release

인공 분석을 통해 최종 버전을 다시 측정했습니다. 지능지수는 43.7에서 45.3으로 상승했다. 코딩지수가 58.7에서 59.4로 상승했습니다. 그러나 Agentic Index는 35.3에서 37.8로 가장 많이 뛰어 올랐습니다. 이는 우연이 아닙니다. 개정판 0813은 모델이 한 번에 응답하지 않고 앞뒤로 이동하는 에이전트 시나리오에 맞게 특별히 조정되었습니다. 즉, 파일을 읽고, 도구를 호출하고, 결과를 검사하고 자체적으로 수정합니다.

속도는 이전 버전과 거의 동일합니다. 출력 시 초당 약 76개 토큰, 첫 번째 토큰은 약 1.5초에서 2초 정도 소요됩니다. 이 크기의 모델에서는 빠른 속도입니다. 솔직한 단점: 모델이 장황합니다. AA 측정에서 시장 평균보다 1.5배에서 2배 더 많은 토큰을 방출합니다. 추가 토큰에 대한 비용을 지불하고 오랫동안 추론할 때 추가 시간을 기다려야 합니다.

Claude와 GPT에 반대: 정직한 산술

새로운 테이블에서 가장 눈에 띄는 행은 Anthropic의 이전 주력 제품인 Claude Opus 4.8입니다. DeepSeek V4 Pro 0813은 터미널 벤치 2.1 — 87.9 대 85.0, DeepSWE — 62.7 대 58.0 등 양쪽 코딩 벤치마크에서 이를 능가했습니다. 그리고 Opus 4.8의 비용은 백만 입력 토큰당 5달러, 출력 토큰 백만 달러당 25달러로 11배와 29배 더 높습니다. 테이블은 다음과 같습니다.

Coding benchmark table: DeepSeek V4 Pro 0813 passes Claude Opus 4.8 in Terminal-Bench 2.1 and DeepSWE

최종 버전은 Claude Fable 5의 87.9와 Terminal-Bench의 88.0에 가장 가깝습니다. 이는 1/10포인트의 차이입니다. DeepSWE Fable에서는 70.0 대 62.7이 더 앞서 있습니다. DeepSeek 테이블의 에이전트 벤치마크 10개를 모두 평균하면 Fable이 평균 5.3% 앞서지만 DeepSeek은 10개 중 2개에서 승리하며 단일 이상치(도구가 없는 인류의 마지막 시험: 42.7 대 53.3)가 없으면 평균 격차가 2.8%로 줄어듭니다.

한편 가격은 백분율이 아니라 규모에 따라 다릅니다. Fable 5의 비용은 입력 토큰 백만 달러당 10달러, 출력 토큰 백만 달러당 50달러입니다. V4 Pro의 가격은 0.435달러와 0.87달러입니다. 약 $30 대 $0.65의 혼합 요율입니다. 따라서 테스트에서 몇 퍼센트 포인트의 차이에 대해 Anthropic은 대략 46배 더 많은 돈을 요구합니다. 정직 주의 사항: DeepSeek은 게시되지 않은 자체 인프라에서 자체 비교 테이블을 측정했으며 10개의 테스트 중 2개는 내부 테스트이며 아직 0813에 대한 독립적인 측정은 없습니다. 모델이 오늘 나왔습니다.

규모에 대해서는 Kimi K3를 기억하십시오. 한 달 전 이 모델은 Claude Opus를 꺾은 최초의 중국 모델이 되었습니다. 이는 센세이션이었습니다. 그러나 Kimi K3는 실행하려면 고가의 서버가 필요한 10억 매개변수 모델이므로 소매점에서는 Claude Fable보다 3배만 저렴하고 Claude Opus보다 40%만 저렴합니다. 인상적이지만 정확하게 민주화는 아닙니다.

DeepSeek V4 Pro는 정말 역사적인 순간입니다. 코딩에 있어 진정으로 Opus에 접근한 이 제품은 Opus보다 30배, Fable보다 60배 저렴합니다. Vibe 코딩은 "사용 가능"이라는 광고적인 의미가 아니라 진입 가격으로 모든 사람이 사용할 수 있게 되었습니다.

GPT를 사용하면 그림이 더욱 미묘해집니다. GPT-5.5는 인공 분석 지수에서 56.3점을 얻었고 DeepSeek에서는 45.3점을 얻었습니다. 이는 솔직히 눈에 띄는 격차입니다. 그러나 이율은 비교할 수 없습니다. 백만 달러당 $5/$30 대 $0.435/$0.87입니다. 그러나 더 저렴한 GPT-5.6 Luna의 가격은 $0.10/$0.60로 DeepSeek보다 낮으며 점수는 52.3입니다. 따라서 "큰 제품 중 가장 저렴한 제품"은 더 이상 고유하지 않습니다. 가격 면에서는 V4 Pro가 Luna와 경쟁하지만 점수 면에서는 Terra와 Sol 모두에게 패합니다.

외부에서 한 가지 냉정한 인용문을 추가합니다. 미국 NIST(CAISI)의 최근 평가에 따르면 V4 Pro는 시장 선두업체보다 약 8개월 뒤처지는 것으로 나타났습니다. 하지만 그들은 미리보기 버전을 측정했습니다. 0813이 그 격차를 좁혔는지 여부는 독립적인 벤치마크에 남아 있으며 아직 아무것도 없습니다.

가격은 변하지 않았습니다. 지금은

입력은 백만 토큰당 $0.435이고, 출력은 $0.87입니다. 캐시 적중은 여전히 ​​거의 무료입니다. 백만 달러당 0.003625달러로 일반 입력보다 120배 저렴합니다. 에이전트 체인의 경우 이것이 주요 포인트입니다. 프로젝트 컨텍스트는 계속해서 다시 읽혀지며, 에이전트 작업 시간에 드는 비용을 결정하는 것은 캐시입니다.

한 가지 주의 사항: DeepSeek은 이미 문서에서 전반적인 API 가격을 인상할 계획이라고 경고했습니다. 언제, 얼마만큼 — 말하지 않았습니다. 4월 요금은 현재에도 여전히 적용되며, 동급의 서구 모델에 비해 눈에 띄게 낮습니다.

지금 당장 시험해 볼 수 있는 곳

  • 채팅:열어모델 페이지— 마지막 0813은 이미 기본값입니다.
  • 암호:에서코드 섹션모델은 프로젝트에 연결되어 저장소, 파일 및 터미널과 함께 작동합니다.
  • API:키는 다음에서 발급됩니다.NeuralSpace API 키, OpenAI 호환 형식.

결제는 구독, VPN, 외국 카드 없이 하나의 공유 잔액에서 루블로 이루어집니다. "한 달 전" 번들이 아닌 실제 사용량에 대해 요금이 청구됩니다.

모델이 할 수 없는 것은 이미지를 보는 것입니다. 입력은 텍스트로만 이루어집니다. 스크린샷이나 사진을 분석해야 하는 경우에는 다른 모델용입니다. 그러나 텍스트, 코드 및 긴 에이전트 작업의 경우 최종 V4 Pro는 가격 대비 가장 정직한 장점 중 하나입니다.채팅으로 사용해 보세요, 또는API 키 페이지에서 키를 가져옵니다.당신의 제품에 그것을 구축합니다.

자주 묻는 질문(FAQ)

Q: 어떻게 시작하나요?
A: 플랫폼에 가입하고 테스트용 무료 토큰을 받으세요.

Q: 생성된 콘텐츠를 상업적으로 사용할 수 있나요?
A: 예, 귀하는 귀하가 창작한 모든 것에 대한 완전한 상업적 권리를 갖습니다.