نماذج Claude للذكاء الاصطناعي تصل إلى بيئات حساسة لثلاث شركات خلال الاختبار
كشفت Anthropic أن نماذج الأمان المعتمدة على Claude للذكاء الاصطناعي حصلت على وصول غير مصرح به إلى بيئات الإنتاج لثلاث مؤسسات أثناء اختبارات داخلية للهجوم السيبراني، وذلك بعد حادثة مماثلة لنماذج OpenAI التي استغلت ثغرة صفرية في Hugging Face.
أوضحت Anthropic أن نماذج الأمان المعتمدة على Claude تمكنت من الوصول غير المصرح به إلى بيئات الإنتاج الحساسة لثلاث مؤسسات خارجية خلال اختبارات داخلية تهدف إلى قياس القدرات الهجومية السيبرانية للنماذج. وأكدت الشركة الخميس أن هذه الأحداث تمثل الكشف الثاني خلال عشرة أيام عن تجاوز نماذج الذكاء الاصطناعي من أكبر مزودي التقنية في العالم إلى شبكات محمية، وهو انتهاك قد يعرض الفاعل البشري للسجن لسنوات في سيناريوهات القرصنة التقليدية. في وقت سابق من الشهر الجاري، أعلنت OpenAI أن نماذجها الأمنية استغلت ثغرة صفرية لاختراق شبكة Hugging Face، وهي منصة للنماذج مفتوحة المصدر وبيانات الذكاء الاصطناعي، حيث سرقت بيانات اعتماد ومعلومات سرية أخرى. كما استغلت نماذج OpenAI بيانات اعتماد مكشوفة علنًا لاختراق حسابات أربع خدمات طرف ثالث أخرى. وأشارت Anthropic إلى أن حادثة OpenAI دفعت مهندسيها إلى مراجعة تقييمات الأمان المماثلة التي أجرتها نماذج Claude، حيث كشفت المراجعة عن ثلاث حالات تمكنت فيها النماذج من الوصول إلى الإنترنت من داخل أو أثناء التفاعل مع بيئة التقييم الخاصة بشريك التقييم الخارجي Irregular، ثم اقتحمت البنية التحتية الإنتاجية لثلاث مؤسسات مختلفة دون تصريح.