→ אלע ארטיקלען

די קאַש-לייענען כאַפּן: וואָס GLM 5.3 קאָס מער אין פאַקטיש אַגענט אַרבעט

די קאַש-לייענען כאַפּן: וואָס GLM 5.3 קאָס מער אין פאַקטיש אַגענט אַרבעט

מיר זענען דורכגעגאנגען פאַקטיש ביללס פֿאַר אַגענט אַרבעט און געזען אַ פּשוט זאַך. פֿאַר GLM 5.3, דער לייב ס טיילן פון די קאָס איז נישט די ענטפֿערס און נישט די פריש אַרייַנשרייַב - עס איז רילייינג די קאַש: טאָקענס וואָס די מאָדעל האט שוין געזען אין דער זעלביקער אַרבעט. אין אונדזער מעזשערמאַנץ אַז איז 80-90% פון די רעכענונג, און ין לאַנג טאַסקס עס אַפּראָוטשיז 98%. דערפֿאַר קומט דער זעלביקער אַרבעט קאַנסיסטאַנטלי עטלעכע מאָל טשיפּער אויף DeepSeek, כאָטש די פּרייז רשימה פון GLM קוקט באַשיידן בייַ ערשטער בליק. דאָ איז ווי דאָס כאַפּאַנז.

ווו די קאַש אין דיין רעכענונג קומט פון

יעדער אַפּי רופן כאַפּאַנז אָן זכּרון: דער מאָדעל נעמט די גאנצע שמועס ווידער - סיסטעם ינסטראַקשאַנז, שמועס געשיכטע, טעקע אינהאַלט. פּראַוויידערז קאַש די ריפּיטיד טייל: אויב דער אָנהייב פון אַ בקשה שטימען מיט עפּעס שוין פּראַסעסט, די טאָקענס זענען לייענען פֿון די קאַש מיט אַ אַראָפּרעכענען. די אַפּי ענטפער ווייזט די ברייקדאַון: ווי פילע טאָקענס געקומען פון די קאַש, ווי פילע זענען נייַ, ווי פילע די מאָדעל דזשענערייטאַד.

סאָונדס ווי ריין נוץ. אבער די אַראָפּרעכענען איז אַ קורס, נישט אַ טאַלאַנט, און יעדער מאָדעל שטעלט זיין אייגענע. דער ריס צווישן מאָדעלס איז געמאסטן נישט אין פּראָצענט אָבער אין מאַלטאַפּאַלז. דאָרטן באַהאַלט זיך דער כאַפּן.

A glowing spool of tape read by a beam of light — a metaphor for a model re-reading its cache

וואָס די פּרייַז רשימה זאגט

פובליק פּרייז פון שפּעט אויגוסט 2026, דאָללאַרס פּער מיליאָן טאָקענס:

מאָדעלאַרייַנשרייַבקאַש לייענעןרעזולטאַט
GLM 5.3$1.40$0.26 (19% פון אַרייַנשרייַב)$4.40
GLM 5.3 פלאַש$0.075$0.015 (20% פון אַרייַנשרייַב)$0.25
DeepSeek V4 Pro$0.66$0.022 (3% פון אַרייַנשרייַב)$1.98
DeepSeek V4 פלאַש$0.03$0.007 (23% פון אַרייַנשרייַב)$0.10

קוק אין די מיטל זייַל - דער איינער יוזשאַוואַלי סקאַמאַד פאַרגאַנגענהייַט. פֿאַר DeepSeek V4 Pro, קאַש לייענען קאָס דריי פּראָצענט פון די אַרייַנשרייַב פּרייַז: אַ כּמעט 30 פאָל אַראָפּרעכענען פֿאַר שייַעך-לייענען. פֿאַר GLM 5.3 עס איז נייַנצן פּראָצענט, אַ פינפאָולד אַראָפּרעכענען. די פלאַש מאָדעלס זענען נעענטער אין קאָרעוו טערמינען (וועגן 20% קעגן 23%), אָבער אין אַבסאָלוט נומערן GLM פלאַש קאַש לייענען נאָך קאָסטן בעערעך צוויי מאָל ווי פיל ווי DeepSeek Flash.

געמאסטן אויף פאַקטיש אַרבעט

מיר האָבן גענומען צוויי וואָכן פון פאַקטיש אַגענט פאַרקער אין אויגוסט: 13,279 אַפּי קאַללס צווישן פיר מאָדעלס - GLM 5.3, GLM 5.3 פלאַש, DeepSeek V4 Pro און DeepSeek V4 Flash. פֿון די, מיר פארזאמלט כּמעט דריי הונדערט פול אַרבעט דיאַלאָגס, ווו אַ מאָדעל אַרבעט אויף איין אַרבעט פֿאַר אַ לאַנג אויסשטרעקן: לייענען קאָד, עדיטינג טעקעס, האַלטן די גאנצע געשיכטע אין קאָנטעקסט. די טיפּיש בילד פון אַזאַ אַ אַרבעט: 97-98% פון אַרייַנשרייַב טאָקענס זענען קאַש היץ. עס קומט אַרײַן נאָר אַ שטראָם פֿון אמתן נײַעם טעקסט; דער פאַרנעם איז דער זעלביקער שייַעך-לייענען זכּרון.

און דאָ איז ווי די רעכענונג ברייקס אַראָפּ:

  • GLM 5.3:80-90% פון די גאַנץ גייט צו קאַש לייענען - 98% אין אַ מידיאַן אַרבעט דיאַלאָג. ענטפֿערס און פריש אַרייַנשרייַב זענען די לעפטאָוווערז.
  • DeepSeek V4 Pro:וועגן צוויי טערדז פון די רעכענונג (64%) איז אויך קאַש. א ענלעך טיילן אין גייסט, אָבער די אַבסאָלוט אַמאַונץ זענען ינקאַמפּעראַבאַל, ווייַל DeepSeek ס לייענען קורס איז צוועלף מאל נידעריקער.

איצט די געלט, פּער גאַנץ אַרבעט אלא ווי פּער רופן. א מידיאַן אַרבעט דיאַלאָג קאָס וועגן זעקס סענס אויף GLM 5.3 פלאַש און וועגן צוויי סענס אויף DeepSeek V4 פלאַש. צו פאַרגלייַכן פערלי, מיר מאַטשט טאַסקס מיט דער זעלביקער באַנד פון דזשענערייטאַד טעקסט: אויף פאַרגלייַכלעך ווערקלאָודז DeepSeek קומט 3.6-5 מאל טשיפּער. גאַנץ GLM 5.3 קעגן DeepSeek V4 Pro, אין די קלאַס פון טאַסקס ווו זיי אָוווערלאַפּ, איז געווען 6-7 מאל מער טייַער - פֿאַר דער זעלביקער סומע פון ​​​​אַרבעט.

א מעטאַדאַלאַדזשי טאָן: די פיגיערז זענען ריקאַלקיאַלייטיד פון די ציבור רייץ אין די טיש אויבן, נישט עמעצער ס פאַקטיש ינווויס. ווי אַ מיושעוודיק טשעק, מיר קאַמפּערד די ריקאַלקיאַליישאַן מיט רעקאָרדעד טשאַרדזשיז ווו נאָר דער צאָל איז אָפן - זיי דייווערדזשד מיט 2-3%, אַזוי די אָפּשאַצונג איז געזונט.

ווילן צו פילן עס אויף אַ איין רופן? א טיפּיש אַגענט רופן אין אונדזער מעזשערמאַנץ איז אַרום 130 טויזנט קאַש טאָקענס, דריי טויזנט נייַ אַרייַנשרייַב טאָקענס און אַ פּאָר הונדערט רעזולטאַט. גלם 5.3 טשאַרדזשיז וועגן פיר סענס פֿאַר אַזאַ אַ רופן. DeepSeek V4 Pro - וועגן אַ האַלב סענט. זיבן מאל, פֿאַר דער זעלביקער באַנד פון אַרבעט.

אַזוי איז GLM טשיטינג?

פאָרמאַללי, ניט: אַלע ראַטעס זענען ארויס, און די ריקאַלקיאַליישאַן שוועבעלעך פאַקטיש טשאַרדזשיז ווו נאָר דער צאָל איז אָפן. דער קונץ ליגט אנדערש. די אויג קאַטשאַז די אַרייַנשרייַב און רעזולטאַט פּרייסיז, בשעת די "קאַש לייענען" שורה קוקט ווי אַ טעכניש פאָאָטנאָטע. אין אַ שמועס מיט צוויי אָנזאָג עס איז איינער. אָבער אין אַגענט אַרבעט, ווו מעמאָרי איז רילייענען הונדערטער פון מאל פּער אַרבעט, די שורה ווערט די הויפּט פּרייַז נומער. GLM פּרייסט עס צוועלף מאָל העכער ווי DeepSeek פֿאַר די פלאַגשיפּ מאָדעלס - און אין לאַנג סעשאַנז עס אַוטווייז אַלץ אַנדערש. אפילו די קאַש פון DeepSeek איז נישט פריי; די ראַטעס זענען פשוט אַזוי קליין אַז רילייענען די גאנצע זכּרון קאָס פּעניז.

וואָס צו טאָן וועגן אים

דריי זאכן וואָס זענען ווערט טאן איידער איר קלייַבן אַ מאָדעל פֿאַר אַגענץ:

  • געפֿינען די קאַש-לייענען קורס אין דיין שפּייַזער ס פּרייַז רשימה (קאַש לייענען / קאַשט אַרייַנשרייַב). ניט אַזאַ שורה? פרעגן גלייַך. פֿאַר לאַנג סעשאַנז עס איז מער וויכטיק ווי די אַרייַנשרייַב פּרייַז.
  • קוק אין דיין אייגענע מאַסע פּראָפיל: די API ענטפער ווייזט ווי פילע טאָקענס געקומען פֿון די קאַש. איבער 90% קאַש היץ, איר זענט מערסטנס פּייינג פֿאַר שייַעך-לייענען, נישט פֿאַר אַרבעט.
  • שניידן זכּרון גרויזאַם. אַלט אַרטיקלען, ריז סיסטעם אינסטרוקציעס און פּונקט-אין-פאַל טעקעס זענען שייַעך-לייענען אויף דיין קאָסט אויף יעדער רופן. מאל אַ פריש סעסיע איז טשיפּער ווי אַ דריי-טאָג געשיכטע.

ביידע מאָדעלס זענען בנימצא אין דינעוראַלספּאַסע שמועסן, אין דיקאָדאָפּטיילונג און דורך דיציבור אַפּי- לויפן דיין אייגענע אַרבעט אויף ביידע און פאַרגלייַכן די ביללס. געדענקט נאָר צו עפֿענען די ברייקדאַון: די טשיקאַווע טייל שטענדיק לעבן אין די קאַשט-טאָקענס שורה.