معهد كايست يطور تقنية تحقق من أمان الذكاء الاصطناعي وتكتشف نقاط ضعف مخفية بفعالية 7 أضعاف

صورة الأستاذ كيم جون-مو من معهد كايست للعلوم والتكنولوجيا
الأستاذ كيم جون-مو من معهد كايست للعلوم والتكنولوجيا [الصورة=كايست]

طورت فرق البحث في معهد كايست للعلوم والتكنولوجيا بكوريا الجنوبية تقنية جديدة للتحقق من أمان الذكاء الاصطناعي تكتشف النقاط الضعيفة المخفية بكفاءة تبلغ حوالي 7 أضعاف أكثر من الطرق السابقة.

أعلن معهد كايست في الثلاثين من الشهر الحالي أن فريق البحث برئاسة الأستاذ كيم جون-مو من قسم الهندسة الكهربائية والإلكترونية طور إطار عمل جديد يسمى "ستيبل-جيفلونت" يحسّن من قيود تقنيات الفريق الأحمر المستخدمة في التحقق من سلامة نماذج اللغة الكبيرة.

تقنية الفريق الأحمر هي أسلوب للتحقق من السلامة يقوم على إدخال نصوص هجومية موجهة لجعل الذكاء الاصطناعي التوليدي يصدر إجابات ضارة أو خطيرة، وذلك لكشف النقاط الضعيفة المخفية في النموذج.

حقق إطار العمل "ستيبل-جيفلونت" اكتشاف 134 نوعاً من أنواع الهجمات، وهو ما يمثل حوالي 7 أضعاف من النوع الواحد والثلاثين من أنواع الهجمات الفريدة التي اكتشفتها الطرق التقليدية، مع الحفاظ على معدل نجاح هجومي مرتفع بنسبة 92%. أثبت نموذج الدفاع المدرب باستخدام هذه التقنية فعالية عالية في صد مختلف الهجمات في اختبارات الهجمات المتقاطعة التي تستخدم تقنيات هجومية متنوعة، مما يدل على قدرته على التعميم بشكل فعال.

توقع فريق البحث أن يمكن تطبيق هذه التقنية على نطاق واسع في مختلف مجالات توليد الذكاء الاصطناعي، بما في ذلك توليد الجزيئات لتصميم المرشحات الدوائية الجديدة.

قال الأستاذ كيم: "ستتيح هذه التقنية اكتشاف ومعالجة نطاق أوسع من عوامل الخطر قبل تطبيق الذكاء الاصطناعي التوليدي في الخدمات الفعلية، مما سيجعلها تقنية أساسية محورية في تطوير ذكاء اصطناعي آمن وموثوق".
 



* تمت ترجمة هذا المقال تلقائيًا بواسطة الذكاء الاصطناعي.