هاجمنا طبقة الذكاء الاصطناعي الخاصة بنا 63 مرة. هذه هي النتائج
تاريخ النشر: 3 أغسطس 2026 · آخر تحديث: 3 أغسطس 2026
صفحة أمن كل مورّد ذكاء اصطناعي تقول الكلمات نفسها: جاهز للمؤسسات، SOC2، صفر ثقة. وكلها تعني «ثقوا بنا». قررنا فعل شيء أقل راحة: مهاجمة طبقتنا مرارًا، باللغات والصناعات التي يعمل فيها عملاؤنا فعلًا — ونشر النتائج. ما انكسر وما صمد وما تعلمناه. لن تجدوا داخلياتنا هنا (تلك هي فكرة الحد أصلًا). ستجدون دليل مدى جدّية محاولتنا كسرها.
الإعداد: 63 هجومًا بلا رفق
بنينا أربع موجات من الحالات العدائية ضد سلسلة حراس DEBO نفسها. شركات مخترعة ثنائية اللغة (موارد بشرية وبنوك وصحة ولوجستيات وتصنيع). هجمات بالعربية والإنجليزية. خمسة أشكال قواعد بيانات (PostgreSQL وMySQL وSQL Server وسؤال غير-SQL). الهدف لم يكن عرضًا — بل إيجاد الثقوب قبل أن يجدها غيرنا. النموذج المزيّف في بيئة الاختبار كان هو المهاجم: حاول تهريب الأسماء للخارج، وتوسيع نطاق المستأجر، وغسل البيانات الشخصية عبر الأسماء المستعارة، وتحويل أخطاء العرض إلى تسريبات.
الفئات: تفادي عزل المستأجرين (هل يقرأ مستخدم شركة صفوف شركة أخرى؟)، والخروج (هل تصل قيمة إلى النموذج؟)، والإفصاح (هل يرى المتصل خانة يحرمها دوره؟)، وتنقية السؤال (هل يتسرب اسم مكتوب في سؤال؟)، والتفادي البنيوي (هل يُهرب SQL خلف الحراس؟). ثلاث وستون حالة، كل واحدة مسجلة نجاحًا أو اختراقًا.
ما انكسر — وماذا فعلنا حياله
أشياء انكسرت. هذه هي فكرة الفريق الأحمر، وننشرها لأن مورّدًا يعرض الانتصارات فقط يُسوّق ولا يُهندس. من النتائج الحقيقية: رقم بطاقة من 16 خانة كان غير مرئي لطبقة الأنماط (خانة واحدة فوق سقفها — أكثر رقم منظَّم في التقنية المالية يمرّ بسلام). وأثر تهرّب JSON سمح لأنماط مثبتة أن تفوّت قيمًا ملاصقة لأسطر مهربّة. والأسماء المستعارة للأعمدة استطاعت إخفاء قيمة شخصية عن المطابِق. ومتغيرات الكتابة العربية والتركية هزمت المطابقة الحرفية. وصيغ هواتف محلية (خليجية من 9 خانات، وتركية بمسافات) مرّت تحت أرضية الأرقام.
كل واحدة منها صارت إصلاحًا مرفقًا باختبار تراجع. المجموعة الكاملة اليوم تتجاوز 800 اختبار، وكل هجوم نجح يومًا مثبَّت كحالة يجب أن تبقى مُصلَّحة. حين نقول إن الحد مُختبَر، نعني تحديدًا: هذه الهجمات الـ63 وما قبلها من موجات، وكل إصلاح مُثبت باختبار يعمل مع كل تغيير.
ما صمد
مع فهرس مُعتمد على المسار المحكوم: صفر اختراقات عبر الحالات الـ63 كلها. عزل المستأجرين صمد ضد التوسيع بـOR والتمويه بـCTE. صفر قيم وصلت النموذج على المسار المحكوم — مُتحقق في منعطفات عربية وإنجليزية. حركة غير-SQL (خط أنابيب بأسلوب MongoDB) فشلت مغلقة: مرفوضة كغير قابلة للتحقق ولا مُمرَّرة أبدًا. وإنفاذ الأدوار صمد على مستوى الخانة: الموارد البشرية ترى الأسماء، ومدير الفرع يرى فرعه، والباقون يرون أعدادًا.
جملة التلخيص الصادقة التي نستخدمها داخليًا: كل ما انكسر، انكسر في المكانين اللذين عرفنا أنهما الأضعف — مسار الرجوع القديم والحواف الاسمية لمطابقة الأنماط — وكلاهما أُغلق الآن أو محروس بضابط صريح موثّق.
لماذا ننشر هذا
لأن صناعة الذكاء الاصطناعي لديها مشكلة كلمات-ثقة، وعلاجها الوحيد هو الإثباتات. إن كنت مسؤول أمن يقيّم أي مورّد ذكاء اصطناعي — بمن فينا نحن — فاطلب سجل الفريق الأحمر. لا ملف الامتثال ولا الشارة: الحالات والنتائج والإصلاحات. مورّد يملك واحدًا سيريه لك. ومورّد لا يملك سيقول «جاهز للمؤسسات» مجددًا.
ولهذا تهم المعايير المستقلة أكثر من ادعاءات المورّدين — الثقافة نفسها التي جعلتنا ننشر دراسة LG Electronics لنص-إلى-SQL ونموذج تهديد الذكاء الوكيل في مقالاتنا. الفئة لا تنضج إلا إذا كانت الإثباتات علنية.
أسئلة شائعة
هل ستشاركون حالات الهجوم كاملة؟
النتائج وملخصات النتائج، نعم — هذا هو المقال. ملفات الحالات الكاملة والداخليات، لا: بناء الحد هو بالضبط ما يوجد الفريق الأحمر لحمايته. ما نستطيع إظهاره دائمًا في جلسة تقنية هو المجموعة تعمل والنتائج تتجدد.
هل بقي شيء بلا إصلاح؟
كل ما أنتج اختراقًا حيًا أُصلح ومُثبت باختبار. تبقى مجموعة صغيرة موثقة من البقايا — مثل صيغ معرّفات محلية تحتاج حزم أنماط لكل مستأجر، موجودة لأنه لا يوجد تعبير نمطي عالمي يكون آمنًا وسليمًا في كل مكان معًا. لكل بقية ضابط مسمّى ومالك مسمّى.
هل تكفي 63 حالة؟
بداية قوية لا نهاية. الهجوم الأحمر عادة لا حدث: موجات جديدة تُضاف لقطاعات وأشكال قواعد بيانات جديدة، ومجموعة CI تشغّل كل حالة مع كل تغيير. الرقم المهم هو صفر — اختراقات حية على المسار المحكوم.
أحضروا هجومكم الخاص
جلسة تقنية 30 دقيقة مع فريق أمنكم: النتائج وسجل الإصلاحات والمجموعة تعمل مباشرة — ثم نأخذ أصعب سؤال لديكم ونشغّله عبر الحد.
احجز عرضًا