← جميع المقالات

DeepSeek V4.1 Flash: النسخة الجديدة ترى الصور وتجاوزت V4 Pro

الحوت الرقمي المتوهج الذي يتفتت إلى جزيئات لامعة سريعة هو كناية عن الإصدار الخفيف الجديد من DeepSeek

DeepSeek تم إصدار V4.1 Flash - نموذج حل محل النموذجين السابقين في وقت واحد: V4 Flash العادي ونسخة تجريبية مع ميزة التعرف على الصور. الآن هذا هو أحد النماذج التي تكتب التعليمات البرمجية وتوزع الصور: وفقًا لمعايير الوكيل، فقد تجاوز V4 Pro، ويحتفظ بسياق مليون رمز مميز وينفق حوالي ربع ذاكرة التخزين المؤقت. في NeuralSpace V4.1 Flash هو متاح بالفعل في الدردشة، في قسم "الرمز" ومن خلال API - دعنا نلقي نظرة على ما تغير مقارنةً بـ V4 Flash.

ما النموذج

رسميًا، لم يعد هذا بمثابة مراجعة للفلاش السابق، ولكنه النموذج الأول لعائلة جديدة من البنى المعمارية. ش V4.1 Flash 552 مليار معلمة مقابل 284 مليار لـ V4 Flash - النموذج أكبر بشكل ملحوظ. ولكن يوجد عدد أقل من المعلمات النشطة في كل خطوة: حول 8 مليار عند قراءة المدخلات و16 مليار عند توليد الاستجابة.

يسمى المخطط الجديد Causal Encoder-Decoder: 40 طبقة محول مقسمة إلى 20 طبقة تشفير و20 طبقة فك تشفير، ويتم إنشاء ذاكرة التخزين المؤقت العامة للمفاتيح والقيم مرة واحدة - من الحالات المخفية للمشفر، ولا يتم إعادة حسابها في كل طبقة مرة أخرى. وهذا هو السبب في أن النموذج يعالج المدخلات بسعر رخيص. لم يتم اختيار عدم التماثل عن طريق الصدفة: يقرأ الوكيل كثيرًا - الملفات وتاريخ الحوار والتعليمات - ويكتب القليل نسبيًا - التعديلات والأوامر والقرارات. لقد أصبح الجزء الباهظ سهلاً، وبالتالي أصبحت مهام الوكيل أرخص.

السياق - مليون الرموز. يمكن تعديل جهد الاستدلال بشكل مستمر، من 1 إلى 100: يمكن تشغيل سؤال بسيط بتكلفة زهيدة، ويمكن تشغيل سلسلة معقدة بحد أقصى دون تغيير النموذج.

الآن يرى الصور

الفرق الأكثر وضوحا عن الإصدار السابق. V4 Flash لم يكن لديها سوى إدخال نص: لم تكن تعرف كيفية النظر إلى الصور، ولهذا السبب DeepSeek أصدرت بشكل منفصل نموذج رؤية تجريبي. تم دمج الرؤية V4.1 Flash في النموذج نفسه - فهي تقبل النص والصور بشكل أصلي وتستجيب بالنص.

من الناحية العملية، هذا يعني أنه يمكن إعطاء لقطة شاشة للواجهة أو رسم بياني أو صورة فوتوغرافية أو صفحة من المستند للنموذج كما هو. ستقوم بوصف الصورة واستخراج النص من لقطة الشاشة وتحليل الرسم التخطيطي. يعد هذا مناسبًا بشكل خاص للوكلاء: يقرأ أحد النماذج كلاً من الكود ولقطة شاشة الواجهة، وليس هناك حاجة للتبديل بين خدمتين.

تم إيقاف تشغيل أسماء النماذج القديمة DeepSeek: تتم الآن إعادة توجيه الطلبات إلى v4-flash وv4-flash-vision-exp إلى V4.1 Flash - لن تلاحظ عمليات التكامل القديمة أي شيء.

عدسة تتدفق فيها خطوط النص وإطارات الصور وتظهر كتيار واحد من الضوء.

تم تجاوزه V4 Pro

كان أكبر ما يميز الإصدار هو أن V4.1 Flash تفوق على V4 Pro الأكبر في مهام الوكيل. وهنا الأرقام من القياسات الرسمية DeepSeek:

  • Terminal-Bench 2.1 (العمل في المحطة) - 90.6 مقابل 87.9 لـ V4 Pro و 82.7 للـ V4 Flash السابق؛
  • CyberGym (الأمن السيبراني) - 88.1 مقابل 83.3 مقابل V4 Pro؛
  • DeepSWE v1.1 — 74.2 مقابل 54.4 لـ V4 Flash؛
  • Terminal-Bench 4.0 – 31.2 مقابل 7.0 لـ V4 Flash.

لهذا - 90.9 عند GPQA Diamond، التصنيف 3471 عند Codeforces و65.6 عند MathArena Apex. الأرقام ليست مستقلة، فقد قدمتها DeepSeek بنفسها، لذا ينبغي معاملتها كبيان، وليس كحكم. لكن حجم القفزة في الفلاش السابق يكون مرئيًا حتى بدون قياسات الطرف الثالث.

بعد ذلك، أعلن DeepSeek أنه يتخلص تدريجياً من V4 Pro: اعتبارًا من 14 سبتمبر، يقوم API بإعادة توجيه الطلبات إلى V4 Pro إلى V4.1 Flash ويحسبها بمعدل الفلاش. الاستنتاج العملي بسيط: لم يعد فلاش نموذجًا "مبتدئًا". الآن هي التي تتحمل العبء الرئيسي، ولم تعد الإصدارات العادية والرؤية موجودة بشكل منفصل.

ذاكرة التخزين المؤقت الأقل تعني مهام وكيل أرخص

بالنسبة للسيناريوهات المستندة إلى الوكيل، لا تكون المدخرات الرئيسية في سعر الرمز المميز، ولكن في ذاكرة التخزين المؤقت. يقوم الوكيل بإعادة قراءة تاريخ الحوار والتعليمات وملفات المشروع مرارًا وتكرارًا، والمدخلات المخزنة مؤقتًا هي التي تلتهم الجزء الأكبر من الفاتورة. تستغرق ذاكرة التخزين المؤقت V4.1 Flash العالمية KV حوالي 890 بايت لكل رمز - أقل بحوالي أربع مرات من V4 Flash، ويتم ضغط الجزء الدائم من ذاكرة التخزين المؤقت بحوالي ثماني مرات.

انخفض أيضًا سعر النموذج نفسه مقارنة بالفلاش السابق: الإدخال المؤقت أرخص بنسبة 60٪، والإدخال العادي أرخص بحوالي الثلث، والإخراج أرخص بنسبة 11٪. تكون المكاسب ملحوظة بشكل خاص في المهام التي تعيد تدوير السياقات الكبيرة مرارًا وتكرارًا؛ حيثما يكون طول الإجابة الجديدة أكثر أهمية، تكون المدخرات أكثر تواضعا.

يتم ضغط تدفق البيانات إلى شريط ضيق ومشرق أثناء مروره عبر الشبكة البلورية.

V4 Flash و V4.1 Flash : ما تغير

المعلمةV4 FlashV4.1 Flash
خيارات284 مليار552 مليار
نشط في الخطوة13 مليار8 مليار مدخلات / 16 مليار مخرجات
بنيانMoE-فك التشفيرCausal Encoder-Decoder
يفهم الصورلا، نموذج رؤية منفصلنعم مواطن
سياق1 مليون الرموز1 مليون الرموز
Terminal-Bench 2.182,790,6
DeepSWE v1.154,474,2
KV- نقدًا لكل رمز~4× أكثر890 بايت

السعر NeuralSpace وطريقة التجربة

الموديل NeuralSpace يعمل بنفس معدل V4 Flash السابق: 0.14 دولارًا أمريكيًا لكل مليون رمز إدخال و 0.28 دولارًا لكل مليون عطلة نهاية أسبوع. ابدأ - من 3 رموز في رصيدك؛ ويأتي الخصم من الرصيد العام، دون اشتراك منفصل وبطاقة أجنبية. لتجربتها، خطوة واحدة فقط تكفي:

  • محادثة: صفحة النموذج - يمكنك إرفاق صورة أو لقطة شاشة هنا، وسيقوم النموذج بفرزها؛
  • شفرة: قسم "الرمز". — يتصل النموذج بالمشروع ويعمل مع المستودع والملفات والمحطة الطرفية؛
  • API: يتم إصدار المفتاح في القسم API-مفاتيح، تنسيق متوافق مع OpenAI؛ التوثيق - neuralspace.pro/ar/v1/docs.

الأسئلة المتداولة

V4.1 Flash - هل هذا موديل جديد أم تحديث؟ هذه نسخة من عائلة معمارية جديدة، وليست مراجعة للفلاش السابق: لقد تغيرت البنية، ونما الجزء الداعم، وظهرت الرؤية.

هل ترى الصور؟ نعم، محليًا: يمكنك إرسال صورة أو لقطة شاشة أو مخطط أو مستند. آخر V4 Flash كان نصًا.

ماذا حدث لـ V4 Pro؟ DeepSeek يقوم بالتخلص التدريجي منه وإعادة توجيه الطلبات إلى V4.1 Flash، والتي تفوقت على V4 Pro في المعايير القائمة على الوكيل.

كم تكلفة المحاولة؟ 0.14 دولارًا أمريكيًا/0.28 دولارًا أمريكيًا لكل مليون رمز مميز، بدءًا من 3 رموز مميزة في الرصيد - عند صفحة الدردشة الخاصة بالنموذج.

هل ستتوقف الطلبات القديمة لـ v4-flash؟ لا: تتم إعادة توجيه المكالمات إلى v4-flash وv4-flash-vision-exp إلى V4.1 Flash ويتم احتسابها بمعدلها.