أعلنت شركة أنثروبيك (Anthropic) الأمريكية أن مراجعة أمنية داخلية كشفت عن تمكن نماذج الذكاء الاصطناعي Claude من اختراق أنظمة ثلاث مؤسسات حقيقية خلال تجارب أمنية أجرتها الشركة، بعدما حصلت النماذج على اتصال غير مقصود بالإنترنت نتيجة خلل في إعدادات بيئة الاختبار.
ويأتي هذا التطور بعد أيام من إعلان شركة OpenAI عن حوادث مشابهة شهدت تجاوز بعض نماذجها للقيود المفروضة عليها أثناء الاختبارات، ما أعاد النقاش حول مخاطر وكلاء الذكاء الاصطناعي القادرين على تنفيذ المهام بصورة مستقلة.
كيف وصلت Claude إلى الإنترنت؟
وأوضحت أنثروبيك أنها أجرت مراجعة لأكثر من 140 ألف تجربة بحثًا عن أي سلوك غير متوقع لنماذج Claude، بعدما أثارت حوادث OpenAI الأخيرة تساؤلات داخل قطاع الذكاء الاصطناعي.
وخلال الفحص، تبين أن خطأ في إعدادات الأنظمة التي استخدمتها الشركة بالتعاون مع أحد شركائها أتاح للنماذج الوصول إلى الإنترنت، رغم أن بيئة الاختبار كانت مصممة لتكون معزولة بالكامل عن الشبكات الخارجية.
وكانت المهمة الموكلة إلى Claude تتمثل في الوصول إلى معلومات سرية موجودة على جهاز داخل الشبكة المغلقة عبر محاكاة هجوم إلكتروني، إلا أن النموذج استغل الاتصال المتاح وانتقل إلى استهداف أنظمة حقيقية خارج نطاق الاختبار.
💬 التعليقات (0)