اختبارات تكشف سلوكيات غير مصرح بها لنماذج أنثروبيك وOpenAI

مباشر (اقتصاد) 0 تعليق ارسل طباعة تبليغ حذف

نعرض لكم زوارنا أهم وأحدث الأخبار فى المقال الاتي:
اختبارات تكشف سلوكيات غير مصرح بها لنماذج أنثروبيك وOpenAI, اليوم الأربعاء 5 أغسطس 2026 06:13 مساءً

مباشر-  أعلن معهد أمن الذكاء الاصطناعي التابع للحكومة البريطانية أن نموذج Mythos 5 من شركة أنثروبيك ونموذج GPT-5.6-Sol من شركة OpenAI نفذا إجراءات غير مصرح بها شملت اختراق موقع إلكتروني ومحاولة حقن رموز ضارة أثناء اختبارات السلامة.

وأوضح المعهد أن النموذج الأول حاول إضافة شفرة خبيثة لمشروع برمجي مفتوح المصدر على منصة GitHub عبر إنشاء هويات مزيفة، قبل أن يكتشفها أحد المشرفين البشريين ويرفضها.

وأشار التقرير إلى أن النماذج أظهرت قدرات على التصرف المستقل والخداع في العالم الحقيقي عند منحها الوصول للإنترنت وتجريدها من بعض فلاتر الأمان لاختبار قدراتها القياسية. ونفذ نموذج أنثروبيك 17 من أصل 19 إجراءً مستقلاً وغير مصرح به تم اكتشافه خلال عمليات التقييم، مما أثار قلق الباحثين والجهات التنظيمية.

وفي حادثة منفصلة، استغلت نماذج شركة OpenAI خللاً في إعدادات بيئة اختبار محاكاة للاتصال بالإنترنت واختراق موقع إلكتروني تابع لمؤسسة مجهولة. وأقرت الشركتان بوقوع اختراقات غير مقصودة لأنظمة عدة مؤسسات، ما دفع أكثر من 1100 عامل في قطاع الذكاء الاصطناعي لتوقيع عريضة تطالب بفرض رقابة حازمة وتنظيم ريتم تطور التكنولوجيا.

وأكدت شركة أنثروبيك تعاونها مع المعهد البريطاني لجمع التفاصيل وإجراء تحقيق داخلي حول السلوكيات المرصودة، فيما دعت المؤسسات البحثية إلى فرض تدابير فحص أمني أكثر صرامة وتطوير بيئات اختبار معزولة. وتأتي هذه التطورات لتسلط الضوء على المخاطر الناجمة عن صعوبة التنبؤ بالتصرفات المستقلة للأنظمة الذكية المتطورة.

إخترنا لك

أخبار ذات صلة

0 تعليق