← Все статьи

DeepSeek V4 Pro 0813 – to historyczny punkt zwrotny

DeepSeek V4 Pro 0813 – to historyczny punkt zwrotny

Wersja krótka (BLUF)

DeepSeek dostarczył ostateczną wersję V4 Pro — wersję 0813 — i każdy istniejący użytkownik deepseek-v4-pro otrzymał ją automatycznie za pośrednictwem interfejsu API, bez dołączonego zdarzenia uruchomienia. Benchmarki zbliżyły się do terytorium Claude i GPT, podczas gdy cena na razie pozostaje niezmieniona. Poniżej: co dokładnie poprawiło, uczciwa arytmetyka na tle konkurencji i gdzie tego spróbować.

Dzisiaj DeepSeek dostarczył ostateczną wersję V4 Pro — wersja 0813. Brak zdarzenia uruchomienia i odliczania: interfejs API został po prostu zaktualizowany. Każdy, kto już pracuje z deepseek-v4-pro, automatycznie otrzymuje nowy model, bez zmian w kodzie. Wersja kwietniowa była wersją zapoznawczą; ta jest wersją GA, a różnica najwyraźniej pokazuje, gdzie od modelu oczekuje się ciągłej pracy, a nie odpowiadania na wiadomość na czacie.

A glowing digital whale — DeepSeek V4 Pro in its final release

To dzień, w którym kodowanie na poziomie Opus stało się naprawdę przystępne.To zdanie byłoby dziś rano marketingowym myśleniem życzeniowym; wieczorem jest to fakt z dołączonymi punktami odniesienia.

Model jest już dostępny w NeuralSpace:na czacie, wSekcja kodui wAPI. Żadnego „czekania na wdrożenie” — po prostu otwórz i użyj.

Jaki jest model

Technicznie rzecz biorąc, jest to ta sama bestia co w kwietniu: mieszanka ekspertów z 1,6 biliona parametrów, z czego 49 miliardów jest aktywnych na każdym kroku. Kontekst to milion tokenów, a model może wyemitować aż 384 tysiące tokenów w jednej odpowiedzi. Dla porównania to mniej więcej dwadzieścia razy więcej niż większość modeli w sąsiednich zakładkach.

Model może myśleć na dwa sposoby — myśląc i niemyśląc — a wysiłek rozumowania ma teraz trzy etapy: maksymalny, wysoki, niski. W praktyce małe pytanie można rozwiązać tanio, podczas gdy złożony łańcuch można rozwiązać przy maksymalnym rozumowaniu bez konieczności przełączania modeli.

Benchmarki: co faktycznie uległo poprawie

Benchmark gains for DeepSeek V4 Pro after the final release

Sztuczna analiza ponownie zmierzyła ostateczną wersję. Indeks inteligencji wzrósł z 43,7 do 45,3. Indeks kodowania wzrósł z 58,7 do 59,4. Najbardziej jednak skoczył Agentic Index: z 35,3 do 37,8. To nie przypadek — wersja 0813 została dostosowana specjalnie do scenariuszy agentycznych, w których model nie odpowiada od razu, ale porusza się tam i z powrotem: czyta pliki, wywołuje narzędzia, sprawdza wynik i poprawia się.

Szybkość jest mniej więcej taka sama jak w poprzedniej wersji: około 76 tokenów na sekundę na wyjściu, pierwszy token w około półtorej do dwóch sekund. To szybko jak na model tej wielkości. Szczery minus: model jest gadatliwy. W przypadku pomiarów AA emituje półtora do dwóch razy więcej tokenów niż średnia rynkowa — możesz liczyć na zapłacenie za dodatkowe tokeny i dodatkowe sekundy oczekiwania, gdy rozsądnie się rozwiąże.

Przeciwko Claude’owi i GPT: uczciwa arytmetyka

Najbardziej rzucającym się w oczy rzędem na świeżym stole jest Claude Opus 4.8, poprzedni flagowiec Anthropic. DeepSeek V4 Pro 0813 pobił go w testach kodowania po obu stronach: Terminal-Bench 2.1 — 87,9 w porównaniu z 85,0, DeepSWE — 62,7 w porównaniu z 58,0. Opus 4.8 kosztuje 5 dolarów za milion tokenów wejściowych i 25 dolarów za milion tokenów wyjściowych — 11 i 29 razy więcej. Oto tabela:

Coding benchmark table: DeepSeek V4 Pro 0813 passes Claude Opus 4.8 in Terminal-Bench 2.1 and DeepSWE

Ostateczna wersja była najbliższa Claude Fable 5: 87,9 w porównaniu z 88,0 w Terminal-Bench — różnica jednej dziesiątej punktu. W DeepSWE Fable jest jeszcze dalej: 70,0 w porównaniu z 62,7. Uśredniając wszystkie dziesięć testów porównawczych agentów z tabeli DeepSeek, Fable prowadzi średnio o 5,3% — ale DeepSeek wygrywa w dwóch z dziesięciu i bez jednej wartości odstającej (Ostatni egzamin ludzkości bez narzędzi: 42,7 w porównaniu z 53,3) średnia różnica zmniejsza się do 2,8%.

Tymczasem cena różni się nie punktami procentowymi, ale rzędami wielkości. Fable 5 kosztuje 10 dolarów za milion tokenów wejściowych i 50 dolarów za milion żetonów wyjściowych; V4 Pro kosztuje 0,435 i 0,87 dolara. Przy mieszanym kursie wynoszącym około 30 USD w porównaniu z 0,65 USD. Zatem za różnicę kilku punktów procentowych w testach Anthropic żąda około 46 razy więcej pieniędzy. Zastrzeżenia dotyczące uczciwości: DeepSeek dokonał pomiarów własnej tabeli porównawczej na własnej, niepublikowanej infrastrukturze, dwa z dziesięciu testów mają charakter wewnętrzny i nie ma jeszcze niezależnych pomiarów godziny 0813 — model ukazał się dzisiaj.

Dla skali pamiętajcie Kimi K3. Miesiąc temu jako pierwsza chińska modelka pokonała Claude’a Opusa – to była sensacja. Ale Kimi K3 to model o bilionach parametrów, który do działania potrzebuje drogiego serwera, więc w sprzedaży detalicznej jest tylko trzy razy tańszy od Claude Fable i tylko 40% tańszy od Claude Opus. Imponujące, ale nie do końca demokratyzacja.

DeepSeek V4 Pro to naprawdę historyczny moment. Naprawdę zbliżając się do Opus w kodowaniu, kosztuje 30 razy mniej niż Opus i 60 razy mniej niż Fable. Kodowanie Vibe właśnie stało się dostępne dla wszystkich — nie w reklamowym znaczeniu „dostępne”, ale po cenie wejścia.

W przypadku GPT obraz jest bardziej dopracowany. GPT-5.5 uzyskał wynik 56,3 w indeksie Sztucznej Analizy w porównaniu do 45,3 w przypadku DeepSeek — naprawdę zauważalna różnica. Ale stawki są nieporównywalne: 5 USD/30 USD za milion w porównaniu z 0,435 USD/0,87 USD. Tańszy GPT-5.6 Luna kosztuje jednak 0,10/0,60 dolara – mniej niż DeepSeek – i osiąga 52,3. Zatem „najtańszy z dużych” nie jest już wyjątkowy: cenowo V4 Pro konkuruje z Luną, natomiast pod względem wyniku przegrywa zarówno z Terrą, jak i Solem.

Dodaj jeden otrzeźwiający cytat z zewnątrz: w niedawnej ocenie przeprowadzonej przez amerykański NIST (CAISI) stwierdzono, że V4 Pro traci do liderów rynku około osiem miesięcy. Zmierzyli jednak wersję poglądową. To, czy 0813 zmniejszył tę różnicę, pozostaje kwestią niezależnych testów porównawczych – a takich jeszcze nie ma.

Cena nie uległa zmianie. Na razie

Wartość wejściowa wynosi 0,435 USD za milion tokenów, a wartość wyjściowa wynosi 0,87 USD. Trafienia w pamięć podręczną są nadal prawie bezpłatne: 0,003625 USD za milion, 120 razy tańsze niż normalne dane wejściowe. W przypadku sieci agentów to jest najważniejsze: kontekst projektu jest odczytywany na nowo i to pamięć podręczna decyduje o tym, ile kosztuje godzina pracy agenta.

Jedno zastrzeżenie: DeepSeek ostrzegał już w swoich dokumentach, że planuje ogólnie podnieść ceny API. Kiedy i o ile – nie powiedziano. Stawki kwietniowe nadal obowiązują i są zauważalnie niższe niż porównywalne modele zachodnie.

Gdzie teraz tego spróbować

  • Pogawędzić:otwórzstrona modelowa— ostateczny numer 0813 jest już domyślny.
  • Kod:wSekcja kodumodel łączy się z projektem i współpracuje z repozytorium, plikami oraz terminalem.
  • API:klucz wydawany jest wKlucze API NeuralSpace, Format zgodny z OpenAI.

Płatność odbywa się w rublach z jednego wspólnego salda, bez subskrypcji, bez VPN i bez zagranicznej karty. Opłata jest naliczana za faktyczne wykorzystanie, a nie za pakiet „z wyprzedzeniem” na miesiąc.

Model nie może tylko patrzeć na obrazy: wprowadzany jest tylko tekst. Jeśli chcesz przeanalizować zrzut ekranu lub zdjęcie, dotyczy to innych modeli. Jednak w przypadku tekstów, kodu i długich zadań agentowych ostateczny V4 Pro to jedna z najbardziej uczciwych ofert pod względem stosunku jakości do ceny.Wypróbuj na czacie, Lubchwyć klucz na stronie kluczy APIwbudować go w swój produkt.

Często zadawane pytania (FAQ)

P: Jak zacząć?
O: Zarejestruj się na platformie i odbierz darmowe tokeny do testów.

P: Czy mogę wykorzystywać wygenerowaną treść komercyjnie?
Odpowiedź: Tak, otrzymujesz pełne prawa komercyjne do wszystkiego, co tworzysz.