← جميع المقالات

DeepSeek V4 Pro 0813 نقطة تحول تاريخية

الحوت الرقمي المتوهج - DeepSeek V4 Pro في النسخة النهائية

باختصار عن الشيء الرئيسي (BLUF)

DeepSeek أصدر الإصدار النهائي من V4 Pro - المراجعة 0813: وصل التحديث تلقائيًا من خلال API، بدون عروض تقديمية أو عمليات عد تنازلي. نحن ننظر إلى ما زاد بالضبط باستخدام المعايير، ونحسب الفرق بصراحة مع كلود وGPT ونشرح سبب عدم تغير السعر بعد.

اليوم DeepSeek طرح الإصدار النهائي من V4 Pro - المراجعة 0813. لا توجد مؤتمرات وعدادات للعد التنازلي: تم التحديث فقط API. أولئك الذين عملوا بالفعل مع "deepseek-v4-pro" حصلوا تلقائيًا على نموذج جديد دون تغيير أي شيء في الكود. كان إصدار أبريل بمثابة معاينة، وهذا هو GA، والفرق ملحوظ في المقام الأول حيث من المتوقع ألا يستجيب النموذج في الدردشة، ولكن أن يعمل بشكل متماسك.

الحوت الرقمي المتوهج - DeepSeek V4 Pro في النسخة النهائية

اليوم هو اليوم الذي أصبح فيه البرمجة على مستوى Opus متاحة بالفعل. كان من الممكن أن يكون هذا الاقتراح بمثابة حلم للمسوق في الصباح، وفي المساء كان سيصبح حقيقة مع معايير تمهيدية.

في NeuralSpace النموذج قائم بالفعل: في الدردشة، ف قسم "الرمز". وفي API. ليس هناك "انتظار حتى يتم طرحه" - يمكنك فتحه واستخدامه.

ما النموذج

من الناحية الفنية، هذا هو نفس الوحش الذي كان عليه في أبريل: مزيج من الخبراء مع 1.6 تريليون معلمة، منها 49 مليارًا نشطة في كل خطوة. السياق عبارة عن مليون رمز، والنموذج قادر على إنتاج ما يصل إلى 384 ألف رمز في استجابة واحدة. للمقارنة: هذا يزيد بحوالي عشرين مرة عن معظم الطرز الموجودة في علامات التبويب المجاورة.

يمكن للنموذج أن يفكر في وضعين - التفكير وعدم التفكير، وأصبح لجهد الاستدلال الآن ثلاثة مستويات: الحد الأقصى والعالي والمنخفض. من الناحية العملية، هذا يعني أنه يمكن حل مشكلة صغيرة بتكلفة زهيدة، ويمكن حل سلسلة معقدة بأقصى قدر من التفكير، دون تغيير النموذج.

المعايير: ما نمت بالضبط

نمو المعايير DeepSeek V4 Pro بعد إصدار النسخة النهائية

أعاد التحليل الاصطناعي قياس النسخة النهائية. ارتفع مؤشر الذكاء من 43.7 إلى 45.3. مؤشر الترميز - من 58.7 إلى 59.4. لكن مؤشر Agentic هو الأكثر قفزًا: من 35.3 إلى 37.8. هذا ليس من قبيل الصدفة - لقد تم تصحيح المراجعة 0813 خصيصًا للسيناريوهات المستندة إلى الوكيل، حيث لا يستجيب النموذج في جلسة واحدة، ولكنه يتحرك ذهابًا وإيابًا: يقرأ الملفات، ويستدعي الأدوات، وينظر إلى النتيجة ويصحح نفسه.

من حيث السرعة، كل شيء على مستوى الإصدار السابق: حوالي 76 رمزًا في الثانية عند الإخراج، يصل الرمز الأول في حوالي ثانية ونصف إلى ثانيتين. هذا سريع بالنسبة لنموذج بهذا الحجم. الجانب السلبي الصادق: النموذج ثرثار. في قياسات AA، يتم توزيع الرموز المميزة بمعدل مرة ونصف إلى مرتين أكثر من متوسط ​​السوق - ضع في اعتبارك أنه من أجل التفكير التفصيلي، فإنك تدفع باستخدام كل من الرموز المميزة والثواني الإضافية من الانتظار.

ضد كلود و GPT: الحساب العادل

أكثر ما يلفت الانتباه في الجدول الأخير هو الخط مع كلود أوبوس 4.8، الرائد السابق Anthropic. DeepSeek V4 Pro 0813 تغلب عليها في معايير الترميز على كلا الجانبين: Terminal-Bench 2.1 - 87.9 مقابل 85.0، DeepSWE - 62.7 مقابل 58.0. في الوقت نفسه، تبلغ تكلفة Opus 4.8 5 دولارات لكل مليون رمز إدخال و25 دولارًا لكل مليون رمز مخرج - أي 11 و29 مرة أكثر تكلفة. هنا الجدول:

الجدول القياسي للترميز: DeepSeek V4 Pro 0813 يتفوق على Claude Opus 4.8 في Terminal-Bench 2.1 وDeepSWE

جاء الإصدار النهائي الأقرب إلى Claude Fable 5: 87.9 مقابل 88.0 في Terminal-Bench - بفارق عُشر. وفقًا لـ DeepSWE، تتقدم Fable بشكل ملحوظ: 70.0 مقابل 62.7. إذا قمت بحساب جميع المعايير العشرة المستندة إلى الوكيل من الجدول DeepSeek، فإن Fable تتقدم بمتوسط ​​5.3% - ولكن في فوزين من أصل عشرة DeepSeek، وبدون القيمة المتطرفة الوحيدة (الاختبار الأخير للإنسانية بدون أدوات: 42.7 مقابل 53.3) يتقلص متوسط ​​الرصاص إلى 2.8%.

السعر لا يختلف بالنسبة المئوية، ولكن عدة مرات. Fable 5 تكلف 10 دولارات لكل مليون إدخال و50 دولارًا لكل مليون رمز إخراج؛ لـ V4 Pro – 0.435 دولارًا و 0.87 دولارًا. وبسعر مختلط يصل إلى حوالي 30 دولارًا مقابل 0.65 دولارًا. أي أنه مقابل اختلاف بسيط في الاختبارات، يطلب Anthropic دفع ما يقرب من 46 مرة أكثر. تحذيرات الصدق: لقد قمت بقياس جدول المقارنة DeepSeek بنفسي، على البنية التحتية غير المنشورة الخاصة بي، اثنان من كل عشرة اختبارات داخلية، ولا توجد قياسات مستقلة لـ 0813 حتى الآن - تم إصدار النموذج اليوم فقط.

لفهم الميزان تذكر Kimi K3. قبل شهر، كانت أول عارضة أزياء صينية تتفوق على كلود أوبوس - لقد كان ذلك بمثابة ضجة كبيرة. لكن Kimi K3 هو نموذج يحتوي على تريليونات من المعلمات، ويتطلب تشغيله خادمًا باهظ الثمن، لذا فهو أرخص بثلاث مرات فقط من Claude Fable في تجارة التجزئة وأرخص بنسبة 40٪ فقط من Claude Opus. إنه أمر مثير للإعجاب، لكن لا توجد ديمقراطية في هذا الأمر.

لكن DeepSeek V4 Pro هي لحظة تاريخية حقًا. لقد تمكنت حقًا من اللحاق بـ Opus من حيث الترميز، فهي تكلف 30 مرة أقل من Opus وأقل 60 مرة من Fable. اليوم، أصبح الترميز الاهتزازي في متناول الجميع - ليس بالمعنى الإعلاني لكلمة "متاح"، ولكن بسعر الدخول إليه.

من GPT أصبح الوضع أكثر تعقيدًا. GPT-5.5 درجات 56.3 في مؤشر التحليل الاصطناعي مقابل 45.3 لـ DeepSeek - الفجوة ملحوظة بصراحة. لكن التعريفات غير قابلة للمقارنة: 5 دولارات/30 دولارًا لكل مليون مقابل 0.435 دولارًا/0.87 دولارًا. لكن أرخص GPT-5.6 Luna يكلف بالفعل 0.10 دولار/0.60 دولار - أي أرخص من DeepSeek - ويسجل 52.3. اتضح أن "الأرخص من بين الشركات الكبرى" لم يعد الوحيد: من حيث السعر، يتنافس V4 Pro مع Luna، ومن حيث النقاط يخسر أمام Terra وSol.

سأضيف اقتباسًا رصينًا من الخارج: قال تقييم حديث لـ NIST الأمريكية (CAISI) إن V4 Pro يتخلف عن رواد السوق بحوالي ثمانية أشهر. صحيح أنهم قاموا بقياس نسخة المعاينة. ما إذا كان 0813 قد قام بتضييق هذه الفجوة أم لا، سيتم إظهاره من خلال معايير مستقلة، لكنها غير موجودة بعد.

السعر لم يتغير. الوداع

الدخول – 0.435 دولار لكل مليون رمز، الخروج – 0.87 دولار. لا تزال الضربة النقدية مجانية تقريبًا: 0.003625 دولارًا لكل مليون، أي 120 مرة أرخص من الدخول العادي. بالنسبة لسلاسل الوكلاء، هذه هي النقطة الأساسية: تتم قراءة سياق المشروع مرارًا وتكرارًا، وذاكرة التخزين المؤقت هي التي تحدد تكلفة ساعة عمل الوكيل.

تحذير واحد: لقد حذر DeepSeek بالفعل في الوثائق من أنه سيرفع الأسعار على API بشكل عام. متى وإلى متى لا يقال. لا تزال تعريفات أبريل سارية المفعول، وهذا أقل بشكل ملحوظ من نظيراتها الغربية من فئة مماثلة.

أين تحاول ذلك الآن

  • محادثة: يفتح صفحة النموذج — الرقم 0813 الأخير هو الرقم الافتراضي بالفعل.
  • شفرة: V قسم "الرمز". يتصل النموذج بالمشروع ويعمل مع المستودع والملفات والمحطة الطرفية.
  • API: يتم إصدار المفتاح في القسم API-مفاتيح NeuralSpace‎تنسيق متوافق مع OpenAI.

الدفع - بالروبل من الرصيد العام، بدون اشتراك أو VPN أو بطاقة أجنبية. يتم شطب الاستخدام الفعلي، وليس باقة "الشهر المقدم".

ما لا يستطيع النموذج فعله هو النظر إلى الصور: الإدخال هو النص فقط. إذا كنت بحاجة إلى تحليل لقطة شاشة أو صورة، فهذا مخصص للنماذج الأخرى. ولكن بالنسبة للنصوص والتعليمات البرمجية ومهام الوكيل الطويلة، أصبح V4 Pro النهائي الآن واحدًا من أكثر العروض عدالة من حيث نسبة القوة والسعر. يمكنك التحقق من ذلك في الدردشة، وإذا كنت تريد تضمينه في منتجك - المفتاح مأخوذ من صفحة API-مفاتيح.

الأسئلة المتداولة (الأسئلة الشائعة)

السؤال: كيف تبدأ؟ الإجابة: سجل على المنصة واحصل على رموز مجانية للاختبار.

سؤال: هل المواد المولدة صالحة للاستخدام التجاري؟ الإجابة: نعم، تحصل على الحقوق التجارية الكاملة لكل المحتوى الذي تم إنشاؤه.