→ כל המאמרים

DeepSeek V4.1 Flash: הגרסה החדשה רואה תמונות ועקפה את V4 Pro

לוויתן דיגיטלי זוהר המתפורר לחלקיקים בהירים מהירים הוא מטפורה לגרסה הקלה החדשה של DeepSeek

DeepSeek שוחרר V4.1 Flash - דגם שהחליף שניים קודמים בו-זמנית: V4 Flash הרגיל וגרסה ניסיונית עם זיהוי תמונה. כעת זהו דגם אחד שגם כותב קוד וגם מנתח תמונות: על פי מדדי הסוכן, הוא עקף את V4 Pro, מחזיק בהקשר של מיליון אסימונים ומוציא בערך רבע מכמות המטמון. בNeuralSpace V4.1 Flash זה כבר זמין בצ'אט, בקטע "קוד" ובאמצעות API - בואו נראה מה השתנה לעומת V4 Flash.

איזה דגם

פורמלית, זה כבר לא גרסה של הפלאש הקודם, אלא הדגם הראשון של משפחה חדשה של ארכיטקטורות. U V4.1 Flash 552 מיליארד פרמטרים לעומת 284 מיליארד עבור V4 Flash - הדגם גדול יותר באופן ניכר. אבל יש פחות פרמטרים פעילים בכל שלב: בערך 8 מיליארד בקריאת קלט ו-16 מיליארד בעת יצירת תגובה.

הסכימה החדשה נקראת Causal Encoder-Decoder: 40 שכבות שנאי מחולקות ל-20 שכבות מקודד ו-20 שכבות מפענח, והמטמון הכללי של המפתחות והערכים נבנה פעם אחת - מהמצבים הנסתרים של המקודד, ואינו מחושב מחדש בכל שכבה שוב. זו הסיבה שהמודל מעבד קלט בזול. האסימטריה לא נבחרה במקרה: הסוכן קורא הרבה - קבצים, היסטוריית דיאלוגים, הוראות - וכותב מעט יחסית - עריכות, פקודות, החלטות. החלק היקר נעשה קל, ולכן משימות הסוכן הפכו זולות יותר.

הקשר - מיליון אסימונים. מאמץ החשיבה מתכוונן ברציפות, מ-1 ל-100: שאלה פשוטה יכולה להתנהל בזול, ושרשרת מורכבת יכולה להתנהל מקסימום מבלי לשנות את המודל.

עכשיו הוא רואה תמונות

ההבדל הבולט ביותר מהגרסה הקודמת. ל-V4 Flash היה רק ​​קלט טקסט: היא לא ידעה איך להסתכל על תמונות, ולשם כך DeepSeek הוציאה בנפרד מודל ראייה ניסיוני. בV4.1 Flash החזון מובנה במודל עצמו - הוא מקבל טקסט ותמונות באופן טבעי ומגיב בטקסט.

בפועל, זה אומר שניתן לתת לדגם צילום מסך של הממשק, גרף, צילום או עמוד של מסמך כפי שהוא. היא תתאר את התמונה, תחלץ טקסט מצילום המסך ותנתח את הדיאגרמה. זה נוח במיוחד לסוכנים: דגם אחד קורא גם את הקוד וגם את צילום המסך של הממשק, ואין צורך לעבור בין שני שירותים.

שמות הדגמים הישנים DeepSeek בוטלו: בקשות ל- v4-flash ו- v4-flash-vision-exp מנותבות כעת ל- V4.1 Flash - אינטגרציות ישנות לא יבחינו בכלום.

עדשה שלתוכה זורמים שורות טקסט ומסגרות תמונה ומתגלות כזרם אור יחיד.

עקף V4 Pro

גולת הכותרת הגדולה ביותר של המהדורה הייתה ש-V4.1 Flash התעלו על V4 Pro הגדולים יותר במשימות סוכן. להלן המספרים ממדידות רשמיות DeepSeek:

  • Terminal-Bench 2.1 (עבודה בטרמינל) - 90.6 לעומת 87.9 עבור V4 Pro ו-82.7 עבור V4 Flash הקודם;
  • CyberGym (אבטחת סייבר) - 88.1 לעומת 83.3 עבור V4 Pro;
  • DeepSWE v1.1 - 74.2 לעומת 54.4 עבור V4 Flash;
  • Terminal-Bench 4.0 - 31.2 לעומת 7.0 עבור V4 Flash.

לשם כך - 90.9 ב-GPQA Diamond, דירוג 3471 ב-Codeforces ו-65.6 ב-MathArena Apex. המספרים אינם עצמאיים, הם ניתנו על ידי DeepSeek בעצמה, ולכן יש להתייחס אליהם כאל אמירה, ולא כפסק דין. אבל קנה המידה של הזינוק בפלאש הקודם נראה גם ללא מדידות של צד שלישי.

בשלב הבא, DeepSeek הודיעה שהיא מוציאה בהדרגה את V4 Pro: מה-14 בספטמבר, API שלו מפנה בקשות ל-V4 Pro ל-V4.1 Flash וסופרת אותן בקצב הבזק. המסקנה המעשית פשוטה: פלאש אינו עוד דגם "ז'וניור". כעת היא הנושאת בעומס העיקרי, והגרסה הרגילה והחזון כבר לא קיימות בנפרד.

פחות מטמון פירושו משימות סוכן זולות יותר

עבור תרחישים מבוססי סוכן, החיסכון העיקרי הוא לא במחיר האסימון, אלא במטמון. הסוכן קורא שוב ושוב את היסטוריית הדיאלוגים, ההוראות וקבצי הפרויקט, והקלט המטמון הוא זה שאוכל את עיקר החשבון. המטמון V4.1 Flash העולמי KV לוקח בערך 890 בייטים לכל אסימון - בערך פי 4 פחות מ-V4 Flash, והחלק הקבוע של המטמון נדחס בערך פי שמונה.

גם מחיר הדגם עצמו ירד ביחס לפלאש הקודם: קלט מטמון זול ב-60%, קלט רגיל זול בערך בשליש, הפלט זול ב-11%. הרווחים בולטים במיוחד במשימות שממחזרות הקשרים גדולים שוב ושוב; כאשר אורך התשובה החדשה חשוב יותר, החיסכון צנוע יותר.

זרם הנתונים נדחס לרצועה בהירה צר כשהוא עובר דרך סריג הגביש.

V4 Flash וV4.1 Flash: מה השתנה

פָּרָמֶטֶרV4 FlashV4.1 Flash
אפשרויות284 מיליארד552 מיליארד
פעיל בשלב13 מיליארד8 מיליארד קלט / 16 מיליארד תפוקה
אַדְרִיכָלוּתמפענח MoECausal Encoder-Decoder
מבין תמונותלא, מודל חזון נפרדכן, יליד
הֶקשֵׁרמיליון אסימוניםמיליון אסימונים
Terminal-Bench 2.182,790,6
DeepSWE v1.154,474,2
KV-מזומן לכל אסימון~4× יותר890 בתים

מחיר NeuralSpace ואיך לנסות

דגם NeuralSpace עובד באותו קצב כמו V4 Flash הקודם: $0.14 למיליון אסימוני קלט ו 0.28 דולר למיליון סופי שבוע. התחל - מ-3 אסימונים על היתרה שלך; החיוב מגיע מהיתרה הכללית, ללא מנוי נפרד וכרטיס זר. כדי לנסות, מספיק רק שלב אחד:

  • לְשׂוֹחֵחַ: דף דגם - אתה יכול לצרף תמונה או צילום מסך כאן, והדגם יסדר אותם;
  • קוד: סעיף "קוד". - המודל מתחבר לפרויקט ועובד עם המאגר, הקבצים והמסוף;
  • API: המפתח מופק בסעיף API-מפתחות, פורמט תואם OpenAI; תיעוד - neuralspace.pro/he/v1/docs.

שאלות נפוצות

V4.1 Flash - האם זה דגם חדש או עדכון? זוהי גרסה של משפחה חדשה של ארכיטקטורות, ולא גרסה של הפלאש הקודם: הארכיטקטורה השתנתה, החלק התומך גדל והחזון הופיע.

האם היא רואה את התמונות? כן, באופן מקורי: אתה יכול לשלוח תמונה, צילום מסך, תרשים או מסמך. V4 Flash האחרון היה טקסט.

מה קרה ל-V4 Pro? DeepSeek מוציא אותה בהדרגה ומפנה בקשות ל- V4.1 Flash, שהצליחו על V4 Pro במדדים מבוססי סוכנים.

כמה עולה לנסות? $0.14/$0.28 למיליון אסימונים, החל מ-3 אסימונים במאזן - בשעה דף הצ'אט של הדוגמנית.

האם בקשות ישנות ל-v4-flash יישברו? לא: שיחות ל-v4-flash ו-v4-flash-vision-exp מופנות ל-V4.1 Flash ונספרות לפי הקצב שלהן.