← Все статьи

DeepSeek V4 Pro 0813 to historyczny punkt zwrotny

Świecący cyfrowy wieloryb - DeepSeek V4 Pro w ostatecznej wersji

Krótko o najważniejszym (BLUF)

DeepSeek wydało wersję ostateczną V4 Pro - wersja 0813: aktualizacja dotarła automatycznie poprzez API, bez prezentacji i odniesień. Przyglądamy się, co dokładnie wzrosło, korzystając z benchmarków, uczciwie obliczamy różnicę z Claude i GPT i wyjaśniamy, dlaczego cena jeszcze się nie zmieniła.

Dzisiaj DeepSeek wypuściło ostateczną wersję V4 Pro - wersja 0813. Żadnych konferencji ani liczników odliczania: właśnie zaktualizowałem API. Ci, którzy już pracowali z `deepseek-v4-pro`, automatycznie otrzymali nowy model bez zmiany czegokolwiek w kodzie. Kwietniowa była podglądem, ta jest GA, a różnica jest zauważalna przede wszystkim tam, gdzie model ma nie odpowiadać na czacie, ale działać spójnie.

Świecący cyfrowy wieloryb - DeepSeek V4 Pro w ostatecznej wersji

Dziś jest dzień, w którym kodowanie na poziomie Opus stało się naprawdę dostępne. Taka propozycja rano byłaby marzeniem marketera, a wieczorem – biorąc pod uwagę benchmarki – stałaby się faktem.

W NeuralSpace model już stoi: na czacie, V Sekcja „Kod”. i w API. Nie ma potrzeby „czekania, aż się uruchomi” — otwierasz i używasz.

Jakiego modelu

Technicznie rzecz biorąc, jest to ta sama bestia, co w kwietniu: mieszanka ekspertów z 1,6 biliona parametrów, z czego 49 miliardów jest aktywnych na każdym kroku. Kontekst to milion tokenów, a model jest w stanie wygenerować w jednej odpowiedzi aż 384 tysiące tokenów. Dla porównania: to około dwudziestokrotnie więcej niż większość modeli w sąsiednich zakładkach.

Model może myśleć w dwóch trybach – myśląc i niemyśląc, a wysiłek rozumowania ma teraz trzy poziomy: maksymalny, wysoki, niski. W praktyce oznacza to, że mały problem można rozwiązać tanio, a złożony łańcuch można rozwiązać z maksymalnym namysłem, bez zmiany modelu.

Punkty odniesienia: co dokładnie urosło

Rozwój benchmarków DeepSeek V4 Pro po wydaniu ostatecznej wersji

Sztuczna analiza ponownie zmierzyła ostateczną wersję. Wskaźnik inteligencji wzrósł z 43,7 do 45,3. Indeks kodowania - od 58,7 do 59,4. Najbardziej jednak skoczył Agentic Index: z 35,3 do 37,8. To nie przypadek - wersja 0813 została poprawiona specjalnie dla scenariuszy opartych na agentach, gdzie model nie odpowiada od razu, ale porusza się tam i z powrotem: czyta pliki, wywołuje narzędzia, patrzy na wynik i sam się poprawia.

Pod względem szybkości wszystko jest na poziomie poprzedniej wersji: około 76 tokenów na sekundę na wyjściu, pierwszy token dociera w około półtorej do dwóch sekund. To szybko jak na model tej wielkości. Szczera wada: modelka jest rozmowna. Przy pomiarach AA wyrzuca półtora do dwóch razy więcej tokenów niż średnia rynkowa – weź pod uwagę, że dla szczegółowego uzasadnienia płacisz zarówno dodatkowymi tokenami, jak i dodatkowymi sekundami oczekiwania.

Przeciwko Claude’owi i GPT: uczciwa arytmetyka

Najbardziej rzucającą się w oczy rzeczą w najnowszej tabeli jest linia z Claude Opus 4.8, dawnym flagowcem Anthropic. DeepSeek V4 Pro 0813 pobił go w testach kodowania po obu stronach: Terminal-Bench 2.1 – 87,9 w porównaniu z 85,0, DeepSWE – 62,7 w porównaniu z 58,0. Jednocześnie Opus 4.8 kosztuje 5 dolarów za milion tokenów wejściowych i 25 dolarów za milion tokenów wyjściowych – 11 i 29 razy droższe. Oto tabela:

Tabela testów porównawczych kodowania: DeepSeek V4 Pro 0813 przewyższa Claude Opus 4.8 w Terminal-Bench 2.1 i DeepSWE

Ostateczna wersja była najbliższa Claude Fable 5: 87,9 w porównaniu z 88,0 w Terminal-Bench – różnica wynosząca jedną dziesiątą. Według DeepSWE bardziej zauważalnie przoduje Fable: 70,0 w porównaniu z 62,7. Jeśli policzymy wszystkie dziesięć testów porównawczych opartych na agentach z tabeli DeepSeek, Fable prowadzi średnio o 5,3%, ale przy dwóch z dziesięciu zwycięstw DeepSeek i bez jedynej wartości odstającej (Ostatni egzamin ludzkości bez narzędzi: 42,7 vs 53,3) średnia przewaga spada do 2,8%.

Cena różni się nie procentowo, ale kilkukrotnie. Fable 5 kosztuje 10 dolarów za milion tokenów wejściowych i 50 dolarów za milion żetonów wyjściowych; V4 Pro ma 0,435 USD i 0,87 USD. Przy stawce mieszanej wychodzi to około 30 USD w porównaniu do 0,65 USD. Oznacza to, że za kilkuprocentową różnicę w testach Anthropic prosi o zapłatę około 46 razy więcej. Szczere zastrzeżenia: tabelę porównawczą DeepSeek zmierzyłem sam, na własnej, niepublikowanej infrastrukturze, dwa z dziesięciu testów mają charakter wewnętrzny, a niezależnych pomiarów 0813 jeszcze nie ma - model został wypuszczony dopiero dzisiaj.

Aby zrozumieć skalę, pomyśl o Kimi K3. Miesiąc temu jako pierwsza chińska modelka wyprzedziła Claude’a Opusa – to była sensacja. Ale Kimi K3 to model o bilionach parametrów, do działania wymaga drogiego serwera, więc w sprzedaży detalicznej jest tylko trzy razy tańszy od Claude Fable i tylko 40% tańszy od Claude Opus. Robi wrażenie, ale nie ma w tym demokratyzacji.

Ale DeepSeek V4 Pro to moment prawdziwie historyczny. Naprawdę dogania Opusa pod względem kodowania, kosztuje 30 razy mniej niż Opus i 60 razy mniej niż Fable. Dzisiaj vibecoding stał się dostępny dla każdego – nie w reklamowym sensie „dostępny”, ale za cenę wejścia do niego.

W przypadku GPT sytuacja jest bardziej skomplikowana. GPT-5.5 osiąga 56,3 w indeksie Sztucznej Analizy w porównaniu do 45,3 dla DeepSeek – różnica jest naprawdę zauważalna. Ale cła nie są porównywalne: 5 USD/30 USD za milion w porównaniu z 0,435 USD/0,87 USD. Ale tańsza GPT-5.6 Luna kosztuje już 0,10 USD/0,60 USD – czyli taniej niż DeepSeek – i osiąga 52,3. Okazuje się, że „najtańszy z dużych” nie jest już jedyny: ceną V4 Pro konkuruje z Luną, a pod względem punktowym przegrywa zarówno z Terrą, jak i Solem.

Dodam trzeźwy cytat z zewnątrz: z ostatniej oceny amerykańskiego NIST (CAISI) wynika, że ​​V4 Pro pozostaje w tyle za liderami rynku o około osiem miesięcy. To prawda, że ​​\u200b\u200bzmierzyli wersję poglądową. To, czy 0813 zmniejszył tę różnicę, pokażą niezależne testy porównawcze, ale jeszcze ich nie ma.

Cena nie uległa zmianie. Do widzenia

Wejście – 0,435 $ za milion tokenów, wyjście – 0,87 $. Hit gotówkowy jest nadal prawie darmowy: 0,003625 dolara za milion, 120 razy tańszy niż zwykły wpis. W przypadku sieci agentów o to właśnie chodzi: kontekst projektu jest odczytywany wielokrotnie i to pamięć podręczna decyduje o tym, ile kosztuje godzina pracy agenta.

Jedno zastrzeżenie: DeepSeek ostrzegał już w dokumentacji, że zamierza podnieść ceny całego swojego API. Kiedy i na jak długo nie jest powiedziane. Nadal obowiązują kwietniowe taryfy, które są zauważalnie niższe niż w zachodnich odpowiednikach porównywalnej klasy.

Gdzie teraz tego spróbować

  • Pogawędzić: Otwarte strona modelowa — ostateczny numer 0813 jest już domyślny.
  • Kod: V Sekcja „Kod”. model łączy się z projektem i współpracuje z repozytorium, plikami oraz terminalem.
  • API: klucz jest wydawany w sekcji Klucze API NeuralSpace, format zgodny z OpenAI.

Płatność - w rublach z salda ogólnego, bez subskrypcji, VPN lub karty zagranicznej. Odpisywane jest rzeczywiste wykorzystanie, a nie pakiet „z miesięcznym wyprzedzeniem”.

Model nie może patrzeć na zdjęcia: wprowadzany jest tylko tekst. Jeśli potrzebujesz analizy zrzutu ekranu lub zdjęcia, dotyczy to innych modeli. Ale w przypadku zadań związanych z tekstem, kodem i długimi agentami ostateczny V4 Pro jest obecnie jedną z najbardziej uczciwych propozycji pod względem stosunku mocy do ceny. Możesz to sprawdzić na czacie, a jeśli chcesz wbudować to w swój produkt - klucz jest pobierany ze strony kluczy API.

Często zadawane pytania (FAQ)

Pytanie: Jak zacząć? Odpowiedź: Zarejestruj się na platformie i odbierz darmowe tokeny do testów.

Pytanie: Czy wygenerowane materiały nadają się do użytku komercyjnego? Odpowiedź: Tak, otrzymujesz pełne prawa komercyjne do wszystkich stworzonych treści.