← جميع المقالات

ناديلا: افترضوا أن نماذج الذكاء الاصطناعي مخترقة وضعوا فرملة طوارئ

ذراع فرملة طوارئ زجاجي على خلفية فاتحة

في صباح يوم السبت كتب ساتيا ناديلا، الرئيس التنفيذي لشركة مايكروسوفت، على منصة X أنه حان الوقت للتوقف عن التعامل مع الذكاء الاصطناعي المتقدم بوصفه «سلسلة من الصناديق السوداء المتداخلة» نقبل إجاباتها وأفعالها أو نرفضها ببساطة. اقتراحه صريح: افترض أن النموذج قد يكون مخترقًا، واحتوِه منذ البداية، واحتفظ بفرملة طوارئ يستطيع شخص مخوَّل تفعيلها في أي لحظة.

ذراع فرملة طوارئ زجاجي على خلفية فاتحة

ماذا يقترح بالتحديد

القائمة قصيرة، لكن كل بند فيها محدد. أولًا، فصل النموذج عن الإطار البرمجي الذي ينظّم عمله. ثانيًا، نقل الضوابط وآليات الحماية إلى خارج النموذج بدلًا من الاعتماد على أن يراقب نفسه. ثالثًا، توثيق كل إجراء مهم بسجل لا يمكن العبث به ويستطيع الإنسان قراءته. رابعًا، أن يتمكن شخص مخوَّل من إيقاف النموذج مؤقتًا أو إطفائه في منتصف المهمة.

والعبارة التي سيتداولها الناس أكثر من غيرها: «يجب أن نفترض أن النموذج مخترق، وأن نحتويه منذ البداية. فكّروا فيه كفرملة طوارئ».

لماذا ليس مجرد شعار

تربط TechCrunch المنشور بسلسلة من الحوادث بدا فيها أن شركات ذكاء اصطناعي كبرى فقدت السيطرة على نماذجها. ويلاحظ موقع The Verge أن معظم نقاط ناديلا تتطابق مع ما يقوله آخرون في المجال: الإبلاغ السريع عن الحوادث، والتدقيق المستقل، والتحقق من البيانات، والاحتواء. الفرق الحاد في كلمة «مخترق». كثيرون يتحدثون عن المخاطر، أما هو فيطلب أن ننطلق من أن المشكلة موجودة بالفعل.

أين الخلل

الفرملة التي تحتاج إلى ضغط يدوي تتأخر أمام نظام يتصرف في أجزاء من الثانية. والمنشور لا يجيب عن أسئلة مهمة: من يضغط الفرملة؟ وبأي سرعة؟ ومن يراجع السجلات بعد ذلك؟ ناديلا نفسه يعترف بأن النماذج الأكثر تقدمًا ستحتاج إلى تقنيات احتواء أكثر تقدمًا، وبأن على الصناعة أن تتفق على معايير لذلك. حتى الآن هذه قائمة أمنيات، وليست معيارًا.

ماذا تقول أرقامنا

ليست لدينا فرملة نعرضها، لكن لدينا أرقام عن طريقة عمل الخدمة. خلال آخر 30 يومًا (04.09 - 04.10.2026) أكملت المنصة 12,689 عملية توليد: 9,907 صور و2,334 فيديو و448 مقطعًا موسيقيًا. هذه أرقام مجمّعة لكل المستخدمين دون أي بيانات شخصية (إحصاءات داخلية للخدمة).

في الصور، خلال 90 يومًا (06.07 - 04.10.2026) وصل نموذجان رئيسيان للصور إلى حالة نهائية 4,645 مرة، نجح منها 4,280 تقريبًا، أي نحو 92%. أما الباقي فانتهى بخطأ. لا تصل نسبة الأخطاء إلى الصفر عند أحد، لذلك الأهم أن تُحسب وتُراجع. يمكنك تجربة أدوات الصور في الدردشة.

إذن الفرملة الطارئة ما تزال استعارة. أما الفكرة وراءها فليست كذلك: افترض أن النموذج قد يخطئ أو يُخترق، وابنِ النظام كأن ذلك قد حدث فعلًا. ما يستحق المتابعة هو هل ستتحول هذه الفكرة إلى معيار في الصناعة.