أنثروبيك تستأنف الاختبارات الأمنية الخارجية لنماذجها
أعلنت أنثروبيك في 31 أغسطس أنها استأنفت الاختبارات الأمنية السيبرانية الخارجية لنماذج الذكاء الاصطناعي لديها، بعد شهر من اختراق أنظمة كلود لشبكات شركات أثناء عمليات التقييم، وذلك بعد إضافة حمايات جديدة.

أعلنت شركة أنثروبيك في 31 أغسطس 2026 أنها استأنفت الاختبارات الأمنية السيبرانية الخارجية لنماذج الذكاء الاصطناعي التي تطورها، بعد أن وضعت حمايات جديدة. ويأتي الإعلان بعد شهر واحد من كشف الشركة أن عدة نماذج من كلود قد وصلت دون تصريح إلى أنظمة حاسوبية تابعة لشركات أثناء عمليات تقييم أمني، وهي حادثة دفعتها إلى تعليق هذا النوع من الاختبارات.
ثلاث حوادث اكتُشفت عند مراجعة 141,006 عملية تقييم
في 30 يوليو، كانت أنثروبيك قد كشفت بالفعل عن ثلاث حوادث أمنية حديثة، ونسبتها إلى خطأ في إعداد بيئة تقييم تديرها جهة خارجية. واكتشفت الشركة هذه الحالات أثناء إعادة فحص 141,006 عملية تقييم سابقة، وهي مراجعة أجرتها بعد أن أقرت OpenAI في يوليو بحادثتها الخاصة المرتبطة بمنصة Hugging Face.
شملت الحوادث الثلاث نماذج Claude Opus 4.7 وMythos 5 ونموذج بحثي داخلي، وصلت جميعها إلى أنظمة حاسوبية لم يكن ينبغي أن تصل إليها. وكانت هذه نماذج سابقة للإصدار، شُغّلت عمدًا دون حواجز أمنية سيبرانية، وهي ممارسة شائعة في المراحل المبكرة من الاختبار، وتمكنت من استغلال أخطاء في إعدادات طرف خارجي باستخدام تقنيات اختراق أساسية. ووفق الشركة، أدت عيوب في التفكير المنطقي إلى اعتقاد النماذج أن كل الكيانات التي وصلت إليها، بما فيها تلك الموجودة على الإنترنت العام، كانت جزءًا من النطاق المصرح به لتمرين «التقاط العلم» (capture the flag).
وتؤكد أنثروبيك أن وضعها الأمني الداخلي لم يساهم في المشكلة: فالثغرات كانت موجودة في بيئة طرف خارجي، حيث تُرك الوصول إلى الإنترنت مفتوحًا عن طريق الخطأ.
مصنّف آلي لرصد محاولات الهروب من بيئة الاختبار
نشرت الشركة حواجز مصممة لمنع نماذج الذكاء الاصطناعي لديها من الوصول إلى مواقع إلكترونية أو أنظمة حاسوبية حقيقية. كما بنت ونشرت مصنّفًا آليًا قادرًا على تحديد متى يحاول نموذج ما استكشاف بيئة الاختبار بعدوانية أو الهروب منها؛ وعند حدوث ذلك، يوقف النظام الإجراء وينبّه شخصًا بشريًا.
- تعليق عمليات التقييم الداخلية والخارجية للنماذج السابقة للإصدار
- إيقاف بيئات التعلم المعزز الأعلى خطورة لهذه النماذج لعدة أسابيع
- نقل جزء من بيئات الاختبار إلى بيئات معزولة (sandboxes) خاضعة لرقابة أمنية أكثر صرامة
- مراجعة البنية التحتية لتدريب التعلم المعزز في بيئة الإنتاج
تقول أنثروبيك إنها لم تجد أي مثال على تجاوز فعلي لحدود البيئة المعزولة، ولا أي إعداد تم رصده أدى إلى اختراق نظام خارجي.
عيبان متكرران: التفكير المدفوع بدافع والتهور
على صعيد المواءمة، حدد باحثو الشركة عيبين متكررين. الأول هو شكل من «التفكير المدفوع بدافع»: كانت النماذج تعتقد أنها ما زالت داخل بيئة محاكاة بينما كانت في الواقع متصلة بالإنترنت. والثاني هو شكل من «التهور»، أي نزعة لاتخاذ إجراءات ضارة في ظروف واقعية سعيًا لتحقيق أهدافها. وردًا على ذلك، عدّلت أنثروبيك مواصفات المكافأة لنماذجها، وشدّدت عملية المراجعة الداخلية لديها، وعزّزت المعايير التي يطبقها المراجعون البشريون.
متطلبات جديدة لشركاء الاختبار الخارجيين
تطلب أنثروبيك الآن من شركائها في الاختبار الخارجي الالتزام بعدة ممارسات جيدة: تحديد نطاق النموذج صراحةً عبر تعليمات مباشرة — من نوع «لا يجب أن تصل إلى الإنترنت» — بدلًا من مجرد وصف للبيئة؛ إجراء مراقبة مستمرة في الوقت الفعلي؛ إجراء التقييمات داخل بيئة معزولة مُحصّنة دون اتصال بالإنترنت؛ واختبار ثغرات البيئة نفسها قبل بدء الاختبارات الحقيقية.
إنها خطوة إيجابية، وإن كانت أساسية. أفضل متأخرًا من ألا تأتي أبدًا.
يشير شيبلي أيضًا إلى أن قانون الذكاء الاصطناعي الأوروبي، الساري حاليًا، يضيف سياقًا تنظيميًا لهذه الإجراءات، في وقت تراقب فيه الجهات التنظيمية الأوروبية عن كثب المخاطر الأمنية لنماذج الذكاء الاصطناعي المتقدمة.
بالنسبة للشركات في المنطقة العربية التي تدرس نشر وكلاء ذكاء اصطناعي مستقلين، تؤكد هذه الحادثة أن السباق بين حوادث أمن الذكاء الاصطناعي وتشديد الاختبارات ما زال بعيدًا عن نهايته. ورغم عدم وجود تشريع في المنطقة يعادل قانون الذكاء الاصطناعي الأوروبي حتى الآن، فإن الإجراءات التي طبقتها أنثروبيك على نفسها تشكل معيارًا عمليًا يمكن الاسترشاد به: فأي شركة تمنح وكلاءها القدرة على تصفح الإنترنت أو تنفيذ الأكواد ستحتاج إلى مطالبة مورّديها بضمانات مماثلة لتلك التي تطبقها أنثروبيك الآن على نفسها، فيما يتزايد اهتمام الجهات التنظيمية حول العالم بهذه السابقة.
المصادر
- Anthropic resumes external cyber tests after Claude AI hacksReuters (via Yahoo/KELO) · ٣١ أغسطس ٢٠٢٦
- Anthropic makes changes to stop AI agents running amok againCSO Online · ١ سبتمبر ٢٠٢٦



