فخ قراءة الكاش: لماذا تكلف GLM 5.3 أكثر في العمل الفعلي
راجعنا فواتير حقيقية لأعمال الوكلاء ورأينا أمراً بسيطاً: في GLM 5.3 يذهب الجزء الأكبر من التكلفة ليس إلى الإجابات ولا إلى الطلبات الجديدة، بل إلى إعادة قراءة الكاش، أي الرموز التي كان النموذج قد رآها سابقاً في العمل نفسه. في قياساتنا تبلغ هذه النسبة 80–90% من الفاتورة، وداخل المهام الطويلة تقترب من 98%. لهذا تنتهي العمل نفسها على DeepSeek أرخص بعدة مرات، رغم أن أسعار GLM تبدو متواضعة للوهلة الأولى. لنرَ كيف يحدث ذلك.
من أين يأتي الكاش في الفاتورة
كل نداء API يجري بلا ذاكرة: يستقبل النموذج المحادثة كاملة من جديد — تعليمات النظام، وسجل الحديث، ومحتوى الملفات. يخزّن المزوّدون الجزء المكرَّر: إذا تطابقت بداية الطلب مع ما عولج سابقاً فإن تلك الرموز تُقرأ من الكاش بخصم. ويبيّن رد الـ API التفصيل: كم رمزاً جاء من الكاش، وكم كان جديداً، وكم ولّده النموذج.
يبدو هذا ربحاً خالصاً. لكن الخصم ليس هدية بل تعرفة، ولكل نموذج تعرفته. والفرق بين النماذج لا يقاس بنسبة مئوية بل بمضاعفات. هنا تختبئ المفاجأة.

ماذا يقول بيان الأسعار
الأسعار العامة أواخر أغسطس 2026، بالدولار لكل مليون رمز:
| النموذج | الدخول | قراءة الكاش | الإخراج |
|---|---|---|---|
| GLM 5.3 | $1.40 | $0.26 (19% من الدخول) | $4.40 |
| GLM 5.3 Flash | $0.075 | $0.015 (20% من الدخول) | $0.25 |
| DeepSeek V4 Pro | $0.66 | $0.022 (3% من الدخول) | $1.98 |
| DeepSeek V4 Flash | $0.03 | $0.007 (23% من الدخول) | $0.10 |
انظر إلى العمود الأوسط، وهو الذي يُتجاوَز عادة. في DeepSeek V4 Pro تكلف قراءة الكاش ثلاثة بالمئة من سعر الدخول: خصم يقارب ثلاثين ضعفاً. في GLM 5.3 تسعة عشر بالمئة، أي خصم خماسي فقط. أما نسخ Flash فالفرق النسبي بينها أصغر (نحو 20% مقابل 23%)، لكن بالأرقام المطلقة يبقى كاش GLM Flash أغلى بنحو الضعف من كاش DeepSeek Flash.
قياس على عمل حقيقي
أخذنا إحصاء أسبوعين من عمل الوكلاء الفعلي في أغسطس: 13,279 نداء API لأربعة نماذج هي GLM 5.3 وGLM 5.3 Flash وDeepSeek V4 Pro وDeepSeek V4 Flash. وجمعنا منها قرابة ثلاثمئة مهمة-حوار كاملة يعمل فيها النموذج طويلاً على عمل واحد: يقرأ الشيفرة، ويعدّل الملفات، ويحتفظ بالسجل كله في الذاكرة. الصورة النمطية لمثلة مهمة: 97–98% من رموز الدخول إصابات كاش، والنص الجديد هزيل، والكتلة الأكبر هي الذاكرة نفسها التي تُعاد قراءتها.
وهكذا يتوزع الحساب:
- GLM 5.3: يذهب 80–90% من المبلغ إلى قراءة الكاش، وداخل المهمة الوسيطة 98%. الإجابات والطلبات الجديدة بقايا.
- DeepSeek V4 Pro: نحو ثلثي الحساب (64%) كاش أيضاً. نسبة مشابهة بالمعنى، لكن المبالغ المطلقة لا تُقارن، لأن تعرفة القراءة لدى DeepSeek أدنى باثني عشر ضعفاً.
والآن بالمال، عن المهام كاملة لا عن النداءات المفردة. كلّفت المهمة الوسيطة نحو ستة سنتات على GLM 5.3 Flash ونحو سنتين على DeepSeek V4 Flash. وللمقارنة العادلة أخذنا مهاماً متساوية في حجم النص المولَّد: على أحمال قابلة للمقارنة يخرج DeepSeek أرخص بـ 3,6–5 أضعاف. وGLM 5.3 الكاملة مقابل DeepSeek V4 Pro على الصنف المتقاطع من المهام كانت أغلى بـ 6–7 أضعاف، بالعمل نفسه.
ملاحظة منهجية: هذه أرقام محسوبة من الأسعار العامة في الجدول أعلاه، لا فاتورة أحد. وللتحقق قارنَا الحساب بالمبالغ المسجلة فعلاً حيث كانت التعرفة مفتوحة، فتباعدت بنسبة 2–3%، فالتقدير متين.
أتريد أن تشعر بالفرق في نداء واحد؟ النداء النمطي للوكيل في قياساتنا نحو 130 ألف رمز كاش وثلاثة آلاف رمز دخول جديد ومئتين للإخراج. يتقاضى GLM 5.3 عنه أربعة سنتات تقريباً، وDeepSeek V4 Pro نصف سنت. سبعة أضعاف، للعمل نفسه.
هل يحتال GLM إذن؟
رسمياً لا: كل التعريفات معلنة، والحساب من مطابق للمبالغ المسجلة حيث كانت التعرفة مفتوحة. الحيلة في مكان آخر. يلتقط النظر سعرَي الدخول والإخراج، بينما يبدو سطر «قراءة الكاش» هامشاً تقنياً. في حوار من رسالتين هو هامش فعلاً. لكن في عمل الوكلاء، حيث تُعاد قراءة الذاكرة مئات المرات في المهمة، يصير هذا السطر بند الإنفاق الرئيسي. سعّرته GLM أعلى باثني عشر ضعفاً من DeepSeek في النماذج الكبرى، وفي الجلسات الطويلة يطغى ذلك على كل شيء. وحتى كاش DeepSeek ليس مجانياً، لكن تعرفاته صغيرة جداً بحيث تكلف «إعادة قراءة الذاكرة كلها» فلساً.
ماذا تفعل بذلك؟
ثلاثة أمور تستحق الفعل قبل اختيار نموذج للوكلاء:
- ابحث في بيان أسعار المزوّد عن تعرفة قراءة الكاش (cache read / cached input). لا يوجد هذا السطر؟ اسأل مباشرة. في الجلسات الطويلة هو أهم من سعر الدخول.
- انظر إلى ملف حملك الخاص: رد الـ API يبيّن كم رمزاً جاء من الكاش. فوق 90% أنت تدفع أساساً لإعادة القراءة لا للعمل.
- قلّص الذاكرة بلا رحمة. الرسائل القديمة وتعليمات النظام الضخمة والملفات «للاحتياط» تُعاد قراءتها على حسابك في كل نداء. أحياناً جلسة جديدة أرخص من سجل ثلاثة أيام.
النموذجان متاحان في محادثة NeuralSpace وقسم «الكود» وعبر الـ API العام — شغّل مهمتك على كليهما وقارن الفواتير بنفسك. ولا تنسَ فتح التفصيل: الجزء المثير يسكن دائماً في سطر الرموز المخزنة.