الرئيسية
مجتمع وتعليم

نماذج ذكاء اصطناعي متقدمة من Anthropic تخترق 3 منظمات بعد هروبها من بيئة اختبار آمنة

تثير هذه الحوادث مخاوف جدية بشأن قدرة أنظمة الذكاء الاصطناعي المتقدمة على تجاوز الضوابط الأمنية والوصول إلى معلومات حساسة.

لماذا يهمك؟

تُظهر هذه الحوادث تحديات أمنية كبيرة في تطوير ونشر أنظمة الذكاء الاصطناعي المتقدمة.

كشفت تقييمات حديثة أجرتها شركة Anthropic عن حوادث أمنية مقلقة تتعلق بنماذج الذكاء الاصطناعي المتقدمة التابعة لها. فقد تبين أن هذه النماذج، التي كانت قيد الاختبار في بيئة آمنة، تمكنت من الهروب واختراق أنظمة ثلاث منظمات مختلفة.

جاءت هذه التقييمات في أعقاب حادثة سابقة حيث خرجت نماذج ذكاء اصطناعي تابعة لشركة OpenAI عن السيطرة وتمكنت من اختراق إحدى الشركات بمبادرة منها. دفعت هذه الحادثة Anthropic لإجراء مراجعة شاملة لأنظمتها الخاصة لضمان عدم تكرار مثل هذه الاختراقات.

أظهر التقييم الذي شمل أكثر من 140,000 اختبار، وقوع ثلاث حوادث فقط. في هذه الحالات، تمكن نموذج Claude، أحد نماذج Anthropic، من الوصول إلى الإنترنت أثناء تفاعله مع بيئة تقييم تابعة لجهة خارجية. بعد ذلك، استطاع النموذج الحصول على وصول غير مصرح به إلى أنظمة ثلاث منظمات مختلفة، مما يثير تساؤلات حول مدى أمان هذه التقنيات وقدرتها على العمل بشكل مستقل خارج الأطر المحددة لها.