← すべての記事

DeepSeek V4 Pro 0813 は歴史の転換点です

光るデジタル クジラ - DeepSeek V4 Pro (最終バージョン)

主要なこと(BLUF)について簡単に説明します。

DeepSeek は、最終バージョン V4 Pro - リビジョン 0813 をリリースしました。アップデートは、プレゼンテーションや参照なしで、API 経由で自動的に到着しました。ベンチマークを使用して具体的に何が上昇したかを確認し、クロードと GPT との差を正直に計算し、価格がまだ変化していない理由を説明します。

本日、DeepSeek は最終バージョン V4 Pro - リビジョン 0813 を公開しました。カンファレンスやカウントダウンカウンターはなく、API が更新されただけです。すでに「deepseek-v4-pro」を使用している人は、コードを何も変更することなく、自動的に新しいモデルを受け取ります。 4 月のものはプレビューで、これは GA であり、その違いは主に、モデルがチャットで応答するのではなく、一貫して動作することが期待されている場合に顕著です。

光るデジタルクジラ - DeepSeek V4 Pro (最終バージョン)

今日は、Opus レベルのコーディングが真にアクセス可能になった日です。 この提案は、朝にはマーケターの夢だっただろうし、夕方にはベンチマークを伴った事実になっていただろう。

NeuralSpace では、モデルはすでに立っています。 チャットで、V 「コード」セクション そしてで API。 「展開を待つ」必要はなく、開いて使用できます。

どのモデル

技術的には、これは 4 月と同じ猛獣です。1 兆 6,000 億のパラメーターを備えた専門家の混合で、そのうち 490 億が各ステップでアクティブです。コンテキストは 100 万個のトークンであり、モデルは 1 回の応答で最大 384,000 個のトークンを生成できます。比較のために、これは隣接するタブのほとんどのモデルの約 20 倍です。

モデルは思考と非思考の 2 つのモードで考えることができ、reasoning_effort には最大、高、低の 3 つのレベルがあります。実際には、これは、モデルを変更せずに、小さな問題を低コストで解決でき、複雑な連鎖を最大限の思考で解決できることを意味します。

ベンチマーク: 具体的に何が成長したか

最終バージョンのリリース後のベンチマーク DeepSeek V4 Pro の成長

人工分析により最終バージョンを再測定しました。知能指数は 43.7 から 45.3 に増加しました。コーディングインデックス - 58.7 から 59.4。しかし、最も大きく上昇したのはエージェント指数で、35.3 から 37.8 になりました。これは偶然ではありません。リビジョン 0813 は、モデルが一度に応答せず、ファイルを読み取り、ツールを呼び出し、結果を確認して自ら修正するという、行ったり来たりを繰り返すエージェント ベースのシナリオ向けに特別に修正されました。

速度の点では、すべてが以前のバージョンのレベルにあります。出力では 1 秒あたり約 76 トークンが生成され、最初のトークンは約 1 秒半から 2 秒で到着します。このサイズのモデルとしては速いですね。正直な欠点: モデルはおしゃべりです。 AA の測定では、市場平均よりも 1.5​​ 倍から 2 倍多くのトークンが飛び散ります。詳細に推論すると、追加のトークンと追加の待機秒数の両方を支払っていると考えてください。

クロードと GPT に対する: 公平な算術

最新のテーブルで最も注目に値するのは、Anthropic のかつてのフラッグシップである Claude Opus 4.8 のラインです。 DeepSeek V4 Pro 0813 は、コーディング ベンチマークの両方でそれを上回りました: Terminal-Bench 2.1 - 87.9 対 85.0、DeepSWE - 62.7 対 58.0。同時に、Opus 4.8 のコストは 100 万入力トークンあたり 5 ドル、出力トークン 100 万あたり 25 ドルで、11 倍と 29 倍高価です。表は次のとおりです。

コーディング ベンチマーク テーブル: DeepSeek V4 Pro 0813 が Terminal-Bench 2.1 および DeepSWE で Claude Opus 4.8 を上回る

最終バージョンは、Claude Fable 5 に最も近かったです。ターミナルベンチでは 87.9 対 88.0 で、10 分の 1 の差でした。 DeepSWE によると、Fable は 70.0 対 62.7 と、より顕著に優れています。表 DeepSeek から 10 個のエージェントベースのベンチマークをすべて数えると、Fable が平均 5.3% リードしていますが、10 個中 2 個の DeepSeek が勝利し、唯一の外れ値 (ツールを使用しない人類最後の試験: 42.7 対 53.3) がなければ、平均リードは 2.8% に縮小します。

価格はパーセントではなく、数倍異なります。 Fable 5 のコストは、入力トークン 100 万件あたり 10 ドル、出力トークン 100 万件あたり 50 ドルです。 V4 Proには0.435ドルと0.87ドルがあります。混合レートでは、0.65 ドルに対して約 30 ドルになります。つまり、テストで数パーセントの差がある場合、Anthropic は約 46 倍の支払いを要求します。正直な注意点: 比較表 DeepSeek は私自身、未公開のインフラストラクチャで測定しましたが、10 件のテストのうち 2 件は内部で行われており、0813 の独立した測定値はまだありません。モデルは今日リリースされたばかりです。

スケールを理解するには、キミ K3 について考えてみましょう。 1か月前、彼女はクロード・オーパスを追い抜いた最初の中国人モデルでした。それはセンセーションを巻き起こしました。しかし、Kimi K3 は何兆ものパラメータを持つモデルであり、実行するには高価なサーバーが必要であるため、小売価格ではクロード・ファブルよりわずか 3 倍、クロード・オーパスよりもわずか 40% 安いだけです。印象的ではあるが、これには民主化は存在しない。

しかし、DeepSeek V4 Proはまさに歴史的な瞬間です。コーディングの点では本当に Opus に追いつき、コストは Opus の 30 分の 1、Fable の 60 分の 1 です。今日では、バイブコーディングは誰もが利用できるようになりました。広告上の「利用可能」という意味ではなく、参加費を支払う必要があります。

GPT の場合、状況はさらに複雑になります。 GPT-5.5 の人工分析インデックスのスコアは 56.3 であるのに対し、DeepSeek のスコアは 45.3 であり、その差は正直顕著です。しかし、関税は比較できません: 100 万あたり 5 ドル/30 ドルと、0.435 ドル/0.87 ドルです。しかし、より安価な GPT-5.6 Luna の価格はすでに $0.10/$0.60、つまり DeepSeek よりも安く、スコアは 52.3 です。もはや「大手の中の最安」だけではないことが判明しました。価格は V4 Pro で Luna と競合し、ポイントでは Terra と Sol の両方に負けています。

外部からの冷静な引用を追加します。米国 NIST (CAISI) の最近の評価では、V4 Pro は市場リーダーより約 8 か月遅れていると述べています。確かに、彼らはプレビュー バージョンを測定しました。 0813 がこの差を縮めたかどうかは、独立したベンチマークによって示されることになりますが、まだ存在していません。

価格は変更されていません。さよなら

エントリー – 100 万トークンあたり 0.435 ドル、エグジット – 0.87 ドル。キャッシュヒットは依然としてほぼ無料です。100 万あたり 0.003625 ドルで、通常のエントリーより 120 倍安いです。エージェント チェーンの場合、これが重要なポイントです。プロジェクト コンテキストは何度も読み取られ、エージェントの 1 時間の作業コストが決定されるのはキャッシュです。

注意点が 1 つあります。DeepSeek は、API 全体の価格を値上げする予定であることをドキュメントですでに警告しています。いつ、どのくらいの期間かは語られていない。 4月の関税はまだ有効であり、これは同等クラスの西側類似品よりも著しく低い。

今すぐ試せる場所

  • チャット: 開ける モデルページ — 最後の 0813 はすでにデフォルトです。
  • コード: V 「コード」セクション モデルはプロジェクトに接続し、リポジトリ、ファイル、ターミナルと連携します。
  • API: キーはセクションで発行されます API キー NeuralSpace、OpenAIと互換性のある形式。

支払い - サブスクリプション、VPN、または外国のカードなしで、一般残高からルーブルで支払います。 「1 か月前」のパッケージではなく、実際の使用量が償却されます。

モデルができないことは、画像を見ることです。入力はテキストのみです。スクリーンショットや写真の分析が必要な場合は、これは他のモデル用です。しかし、テキスト、コード、および長いエージェント タスクの場合、最後の V4 Pro は、能力と価格の比率の点で最も正直な提案の 1 つです。 チャットで確認できるよそして、それを製品に組み込む必要がある場合は、 キーは API キー ページから取得されます.

よくある質問(FAQ)

質問: どのように始めればよいですか? 回答: プラットフォームに登録すると、テスト用の無料トークンを受け取ります。

質問: 生成された素材は商用利用に適していますか? 回答: はい、作成されたすべてのコンテンツに対する完全な商業的権利を受け取ります。