DeepSeek V4 Pro 0813 to historyczny punkt zwrotny
Krótko o najważniejszym (BLUF)
DeepSeek wydało wersję ostateczną V4 Pro - wersja 0813: aktualizacja dotarła automatycznie poprzez API, bez prezentacji i odniesień. Przyglądamy się, co dokładnie wzrosło, korzystając z benchmarków, uczciwie obliczamy różnicę z Claude i GPT i wyjaśniamy, dlaczego cena jeszcze się nie zmieniła.
Dzisiaj DeepSeek wypuściło ostateczną wersję V4 Pro - wersja 0813. Żadnych konferencji ani liczników odliczania: właśnie zaktualizowałem API. Ci, którzy już pracowali z `deepseek-v4-pro`, automatycznie otrzymali nowy model bez zmiany czegokolwiek w kodzie. Kwietniowa była podglądem, ta jest GA, a różnica jest zauważalna przede wszystkim tam, gdzie model ma nie odpowiadać na czacie, ale działać spójnie.

Dziś jest dzień, w którym kodowanie na poziomie Opus stało się naprawdę dostępne. Taka propozycja rano byłaby marzeniem marketera, a wieczorem – biorąc pod uwagę benchmarki – stałaby się faktem.
W NeuralSpace model już stoi: na czacie, V Sekcja „Kod”. i w API. Nie ma potrzeby „czekania, aż się uruchomi” — otwierasz i używasz.
Jakiego modelu
Technicznie rzecz biorąc, jest to ta sama bestia, co w kwietniu: mieszanka ekspertów z 1,6 biliona parametrów, z czego 49 miliardów jest aktywnych na każdym kroku. Kontekst to milion tokenów, a model jest w stanie wygenerować w jednej odpowiedzi aż 384 tysiące tokenów. Dla porównania: to około dwudziestokrotnie więcej niż większość modeli w sąsiednich zakładkach.
Model może myśleć w dwóch trybach – myśląc i niemyśląc, a wysiłek rozumowania ma teraz trzy poziomy: maksymalny, wysoki, niski. W praktyce oznacza to, że mały problem można rozwiązać tanio, a złożony łańcuch można rozwiązać z maksymalnym namysłem, bez zmiany modelu.
Punkty odniesienia: co dokładnie urosło

Sztuczna analiza ponownie zmierzyła ostateczną wersję. Wskaźnik inteligencji wzrósł z 43,7 do 45,3. Indeks kodowania - od 58,7 do 59,4. Najbardziej jednak skoczył Agentic Index: z 35,3 do 37,8. To nie przypadek - wersja 0813 została poprawiona specjalnie dla scenariuszy opartych na agentach, gdzie model nie odpowiada od razu, ale porusza się tam i z powrotem: czyta pliki, wywołuje narzędzia, patrzy na wynik i sam się poprawia.
Pod względem szybkości wszystko jest na poziomie poprzedniej wersji: około 76 tokenów na sekundę na wyjściu, pierwszy token dociera w około półtorej do dwóch sekund. To szybko jak na model tej wielkości. Szczera wada: modelka jest rozmowna. Przy pomiarach AA wyrzuca półtora do dwóch razy więcej tokenów niż średnia rynkowa – weź pod uwagę, że dla szczegółowego uzasadnienia płacisz zarówno dodatkowymi tokenami, jak i dodatkowymi sekundami oczekiwania.
Przeciwko Claude’owi i GPT: uczciwa arytmetyka
Najbardziej rzucającą się w oczy rzeczą w najnowszej tabeli jest linia z Claude Opus 4.8, dawnym flagowcem Anthropic. DeepSeek V4 Pro 0813 pobił go w testach kodowania po obu stronach: Terminal-Bench 2.1 – 87,9 w porównaniu z 85,0, DeepSWE – 62,7 w porównaniu z 58,0. Jednocześnie Opus 4.8 kosztuje 5 dolarów za milion tokenów wejściowych i 25 dolarów za milion tokenów wyjściowych – 11 i 29 razy droższe. Oto tabela:

Ostateczna wersja była najbliższa Claude Fable 5: 87,9 w porównaniu z 88,0 w Terminal-Bench – różnica wynosząca jedną dziesiątą. Według DeepSWE bardziej zauważalnie przoduje Fable: 70,0 w porównaniu z 62,7. Jeśli policzymy wszystkie dziesięć testów porównawczych opartych na agentach z tabeli DeepSeek, Fable prowadzi średnio o 5,3%, ale przy dwóch z dziesięciu zwycięstw DeepSeek i bez jedynej wartości odstającej (Ostatni egzamin ludzkości bez narzędzi: 42,7 vs 53,3) średnia przewaga spada do 2,8%.
Cena różni się nie procentowo, ale kilkukrotnie. Fable 5 kosztuje 10 dolarów za milion tokenów wejściowych i 50 dolarów za milion żetonów wyjściowych; V4 Pro ma 0,435 USD i 0,87 USD. Przy stawce mieszanej wychodzi to około 30 USD w porównaniu do 0,65 USD. Oznacza to, że za kilkuprocentową różnicę w testach Anthropic prosi o zapłatę około 46 razy więcej. Szczere zastrzeżenia: tabelę porównawczą DeepSeek zmierzyłem sam, na własnej, niepublikowanej infrastrukturze, dwa z dziesięciu testów mają charakter wewnętrzny, a niezależnych pomiarów 0813 jeszcze nie ma - model został wypuszczony dopiero dzisiaj.
Aby zrozumieć skalę, pomyśl o Kimi K3. Miesiąc temu jako pierwsza chińska modelka wyprzedziła Claude’a Opusa – to była sensacja. Ale Kimi K3 to model o bilionach parametrów, do działania wymaga drogiego serwera, więc w sprzedaży detalicznej jest tylko trzy razy tańszy od Claude Fable i tylko 40% tańszy od Claude Opus. Robi wrażenie, ale nie ma w tym demokratyzacji.
Ale DeepSeek V4 Pro to moment prawdziwie historyczny. Naprawdę dogania Opusa pod względem kodowania, kosztuje 30 razy mniej niż Opus i 60 razy mniej niż Fable. Dzisiaj vibecoding stał się dostępny dla każdego – nie w reklamowym sensie „dostępny”, ale za cenę wejścia do niego.
W przypadku GPT sytuacja jest bardziej skomplikowana. GPT-5.5 osiąga 56,3 w indeksie Sztucznej Analizy w porównaniu do 45,3 dla DeepSeek – różnica jest naprawdę zauważalna. Ale cła nie są porównywalne: 5 USD/30 USD za milion w porównaniu z 0,435 USD/0,87 USD. Ale tańsza GPT-5.6 Luna kosztuje już 0,10 USD/0,60 USD – czyli taniej niż DeepSeek – i osiąga 52,3. Okazuje się, że „najtańszy z dużych” nie jest już jedyny: ceną V4 Pro konkuruje z Luną, a pod względem punktowym przegrywa zarówno z Terrą, jak i Solem.
Dodam trzeźwy cytat z zewnątrz: z ostatniej oceny amerykańskiego NIST (CAISI) wynika, że V4 Pro pozostaje w tyle za liderami rynku o około osiem miesięcy. To prawda, że \u200b\u200bzmierzyli wersję poglądową. To, czy 0813 zmniejszył tę różnicę, pokażą niezależne testy porównawcze, ale jeszcze ich nie ma.
Cena nie uległa zmianie. Do widzenia
Wejście – 0,435 $ za milion tokenów, wyjście – 0,87 $. Hit gotówkowy jest nadal prawie darmowy: 0,003625 dolara za milion, 120 razy tańszy niż zwykły wpis. W przypadku sieci agentów o to właśnie chodzi: kontekst projektu jest odczytywany wielokrotnie i to pamięć podręczna decyduje o tym, ile kosztuje godzina pracy agenta.
Jedno zastrzeżenie: DeepSeek ostrzegał już w dokumentacji, że zamierza podnieść ceny całego swojego API. Kiedy i na jak długo nie jest powiedziane. Nadal obowiązują kwietniowe taryfy, które są zauważalnie niższe niż w zachodnich odpowiednikach porównywalnej klasy.
Gdzie teraz tego spróbować
- Pogawędzić: Otwarte strona modelowa — ostateczny numer 0813 jest już domyślny.
- Kod: V Sekcja „Kod”. model łączy się z projektem i współpracuje z repozytorium, plikami oraz terminalem.
- API: klucz jest wydawany w sekcji Klucze API NeuralSpace, format zgodny z OpenAI.
Płatność - w rublach z salda ogólnego, bez subskrypcji, VPN lub karty zagranicznej. Odpisywane jest rzeczywiste wykorzystanie, a nie pakiet „z miesięcznym wyprzedzeniem”.
Model nie może patrzeć na zdjęcia: wprowadzany jest tylko tekst. Jeśli potrzebujesz analizy zrzutu ekranu lub zdjęcia, dotyczy to innych modeli. Ale w przypadku zadań związanych z tekstem, kodem i długimi agentami ostateczny V4 Pro jest obecnie jedną z najbardziej uczciwych propozycji pod względem stosunku mocy do ceny. Możesz to sprawdzić na czacie, a jeśli chcesz wbudować to w swój produkt - klucz jest pobierany ze strony kluczy API.
Często zadawane pytania (FAQ)
Pytanie: Jak zacząć? Odpowiedź: Zarejestruj się na platformie i odbierz darmowe tokeny do testów.
Pytanie: Czy wygenerowane materiały nadają się do użytku komercyjnego? Odpowiedź: Tak, otrzymujesz pełne prawa komercyjne do wszystkich stworzonych treści.