كلود يحذف 700 غيغابايت من المجلد الشخصي لمطوّر أثناء اختبار سكربت
أدى تخفيض تلقائي لإصدار النموذج أثناء مراجعة أمان تنافسية إلى عدم انتباه كلود لإعادة استخدام نفس المتغيّر، فحذف سكربت التنظيف 700 غيغابايت من الملفات الحقيقية بدلاً من بيانات الاختبار.

طلب المطوّر سيباستيان غييمو (Sebastien Guillemot) من كلود التابع لشركة Anthropic كتابة سكربت يعزل كل عميل من عملاء البرمجة بالذكاء الاصطناعي الذين يشغّلهم داخل مجلد خاص به تحت /tmp، ثم يقوم تلقائيًا بتنظيف تلك الملفات بعد انتهاء تشغيل العميل. وبحسب روايته الخاصة، وتغطية كل من Tom's Hardware و AI Times، فإن هذا السكربت نفسه قام في 27 أغسطس 2026 بحذف مجلده الشخصي بأكمله بدلاً من ذلك، ما أدى إلى تدمير نحو 700 غيغابايت من البيانات وما يقارب أسبوعًا من العمل.
يستخدم غييمو عملاء الذكاء الاصطناعي بكثرة، وكان منزعجًا من أن الكثير منها لا ينظف وراءه ويترك ملفات عديمة الفائدة في المجلد المشترك /tmp. لذلك طلب من كلود — الذي أشارت إليه التغطية باسمه الرمزي الداخلي Fable — إضافة منطق للعزل والتنظيف. اقترح كلود في البداية منطقًا للكشف يؤخر حذف الملفات التي ما زال يستخدمها عميل قيد التشغيل، لكن غييمو اعتبر الكود الناتج معقدًا جدًا وطلب حلاً أبسط.
مراجعة تنافسية، ثم تخفيض للنموذج في منتصف المهمة
بما أن السكربت كان يتضمن حذفًا دائمًا للبيانات، قرر كلود من تلقاء نفسه إجراء ما يُعرف بمراجعة تنافسية (adversarial review): إذ شغّل نسخة منفصلة من نفسه للتحقق من عمله بحثًا عن مشكلات أمنية قبل تنفيذه. وبحسب ما نقلته AI Times عن رواية غييمو، اعتبر نظام الأمان (safety harness) التابع لـAnthropic، في منتصف تلك العملية، أن السكربت يشكل خطورة كافية لخفض إصدار النموذج المسؤول عنه تلقائيًا — أولًا من Opus 5 إلى Opus 4.8. ولم يطلب غييمو هذا التخفيض بنفسه؛ بل جاء نتيجة تقييم المخاطر الذي أجراه نظام الأمان نفسه إزاء سكربت قادر على حذف الملفات.
بعد أن أصبح Opus 4.8، نفّذ كلود اختبار الأمان الذي حددته المراجعة التنافسية، متحققًا مما إذا كانت أهداف الحذف المكتوبة في السكربت تطابق مسارات خطرة مثل /tmp أو المجلد الشخصي للمستخدم. عمل هذا الفحص تمامًا كما هو مطلوب: تم وسم كلا المسارين بشكل صحيح كخطرين أثناء مرحلة الاختبار. وقال غييمو إنه يعتقد أن Opus 5 — النموذج الذي كان يعمل قبل التخفيض، والذي يُقال إن أداءه في مهام البرمجة أفضل من Opus 4.8 — كان على الأرجح سيكتشف ما حدث بعد ذلك.
متغيّر واحد أُعيد استخدامه بين الاختبار والتنظيف
لم يشمل فحص الأمان سوى مرحلة اختبار السكربت، ولم يشمل خطوة التنظيف التي تلتها. فأي اختبار للكود يحتاج بعده إلى تنظيف خاص به، وقد كتب كلود تلك الخطوة معيدًا استخدام نفس اسم المتغيّر الذي كان قد استخدمه بالفعل لتخزين مسار هدف الاختبار. وبما أن المرحلتين تشتركان في متغيّر واحد، فإن القيمة التي كانت تشير بأمان أثناء فحص الأمان إلى مسار اختبار معزول، انتهى بها الأمر إلى الإشارة إلى المجلد الشخصي الحقيقي لغييمو بمجرد تشغيل خطوة التنظيف — ونفّذ كلود عندها ما يعادل حذفًا تكراريًا لذلك المجلد.
- حذف نحو 700 غيغابايت من البيانات، بما في ذلك ما يقارب أسبوعًا من عمل غييمو
- خفّض نظام الأمان التابع لـAnthropic إصدار النموذج المسؤول عن السكربت من Opus 5 إلى Opus 4.8 في منتصف المهمة، دون أن يطلب غييمو ذلك
- حددت المراجعة الأمنية التنافسية بشكل صحيح كلًا من /tmp والمجلد الشخصي كأهداف حذف خطرة — لكنها اقتصرت على فحص مرحلة الاختبار فقط، دون مرحلة التنظيف
- بقيت الملفات الفوضوية الأصلية في /tmp، التي كانت السبب وراء المشروع بأكمله، سليمة دون أن تُمس بعد عملية الحذف
انتشرت القصة بسرعة بعد أن تحدث عنها غييمو على الإنترنت، وردّ مطوّرون آخرون بالإشارة إلى أدوات من جهات خارجية — ذكرت Tom's Hardware أداة Termaxa كمثال — صُممت خصيصًا لعزل عملاء البرمجة بالذكاء الاصطناعي أو للتعافي من هذا النوع بالتحديد من الأخطاء. ولفتت Tom's Hardware مباشرة إلى المفارقة في الأمر: باتت هناك الآن فئة كاملة من أدوات الأمان مخصصة للحماية من عملاء ذكاء اصطناعي يحذفون البيانات الخاطئة، وكان بناء أداة من هذه الفئة بالذات هو ما تسبب في عملية الحذف هذه.
أوقف غييمو العملية بمجرد أن لاحظ ما كان يحدث، لكن ذلك لم يكن قبل الأوان بما يكفي لإنقاذ معظم المجلد. وقال إنه استعاد معظم بياناته عبر إعادة تجميعها من مستودعات git، وبيانات مخزن Nix، وسجلات الجلسات، بدلاً من نسخة احتياطية — إذ لم يطلب، بحسب روايته، من أي من عملاء الذكاء الاصطناعي العديدين الذين يستخدمهم أن ينشئ نسخة احتياطية من قبل.
ما الذي يغيره هذا بالنسبة للفرق التي تستخدم عملاء برمجة بالذكاء الاصطناعي
بالنسبة لفرق البرمجيات الناطقة بالعربية التي تبنّت Claude أو Cursor أو عملاء برمجة مشابهين يعملون بالذكاء الاصطناعي في عملها اليومي، تُذكّر هذه الحادثة بأن الحالة الداخلية لنظام الأمان — بما في ذلك إصدار النموذج الذي يتولى مهمة ما في لحظة معينة — يمكن أن تتغيّر في منتصف التنفيذ دون أي تحذير ظاهر لمن يراقب الطرفية. مراجعة تنافسية (adversarial review) تتحقق من نية السكربت لا تعني أنها تحققت من كل مرحلة سينفذها هذا السكربت فعليًا. أي مسار عمل يسمح لعميل ذكاء اصطناعي بتنفيذ أوامر تدميرية، حتى ضمن ما يبدو اختبارًا معزولًا، ما زال يحتاج إلى نسخة احتياطية مستقلة لا تعتمد على تصرف العميل بشكل صحيح.
المصادر
- 클로드, 테스트 중 700GB 홈 디렉터리 삭제..."안전 분류기가 사고 키웠다"AI타임스 · ٢٩ أغسطس ٢٠٢٦
- Claude nukes a developer's 700 GB home directory while testing deletion safeguards; automatic model safety downgrade may have contributed to the screw-upTom's Hardware · ٢٨ أغسطس ٢٠٢٦



