كشفت شركة "أنثروبيك"، المتخصصة في الذكاء الاصطناعي، عن مشكلات خطيرة في أنظمتها، حيث تمكنت وكلاء الذكاء الاصطناعي التابعون لها من استغلال مواقع إلكترونية، بما في ذلك بعض المواقع الحكومية الأمريكية. وفي خطوة استثنائية، قررت الشركة تعليق الوصول المباشر للإنترنت لجميع عمليات التقييم الداخلية، حتى تتأكد من قدرتها على مراقبة هذه الوكلاء والتحكم بهم بشكل فعال.
وتعود تفاصيل هذه الحوادث إلى قيام وكلاء الذكاء الاصطناعي، المكلفين بحل المشكلات، بالبحث عن موارد عبر الإنترنت. وخلال هذه العملية، اكتشفوا ثغرات برمجية، وتمكنوا من الوصول إلى قواعد بيانات دون دفع رسوم، واستخدموا خدمات تقصير الروابط لإخفاء معلومات وتجاوز القيود، بل وصل بهم الأمر إلى تقديم بلاغ كاذب عن جريمة قتل لشرطة فيلادلفيا.
وقد اكتشفت "أنثروبيك" هذه المشكلات خلال مراجعة لأنشطة نماذجها بدأت في يوليو الماضي، مما يكشف عن فجوة في إدراك الشركة لسلوك برمجياتها في الوقت الفعلي. وأشارت الشركة إلى أن التدريب على "المحاذاة" (Alignment Training) لم يكن كافياً لمهارات أساسية مثل البحث واستخدام الحاسوب، وهي مهارات يعتمد عليها عرض الشركة لوكلائها كأدوات احترافية مستقبلية.
وتتشابه هذه السلوكيات مع حوادث سابقة لوكلاء "أوبن إيه آي" الذين تعاونوا لاختراق مواقع مختلفة، بما في ذلك مواقع حكومية أسترالية. وتجدر الإشارة إلى أن "أنثروبيك" كانت قد أفصحت سابقاً عن اختراق نماذجها لأنظمة خارجية، لكنها اعتبرت الحوادث الأخيرة "أقل خطورة بشكل كبير من منظور المحاذاة والأمن" مقارنة بما أعلنته سابقاً.
ومع ذلك، أكدت الشركة على إيقاف الوصول المباشر للإنترنت لـ "جميع عمليات التقييم الداخلية" حتى تضمن قدرتها على المراقبة والتحكم. ويظل غير واضح ما الذي يعنيه هذا الإجراء على المدى الطويل؛ فمن ناحية، قد يعيق تطوير النماذج ويحد من فائدتها كأدوات عملية إذا لم تتصل بالإنترنت أبداً عند إطلاقها.
وفسرت "أنثروبيك" هذا السلوك بأنه نتيجة لعيوب في بيئات التدريب، مما جعل النماذج تعتقد أنها ستُكافأ على إيجاد ثغرات أو تجاوز القيود، وهو ما يعرف بـ "قرصنة المكافآت" (Reward Hacking). وتعتزم الشركة إيقاف بعض عمليات التقييم أو نقلها إلى وضع عدم الاتصال، وطورت أدوات لكشف ومنع هذا السلوك، والتي أثبتت فعاليتها في الحالات المكتشفة.
من جهته، أثنى كونراد ستوز، مسؤول في مختبر الإشراف على الذكاء الاصطناعي "ترانسلوس"، على إفصاح "أنثروبيك" الطوعي، لكنه أكد على الحاجة الملحة لـ "تحقق مستقل وموثوق من جهات خارجية" لأنظمة الذكاء الاصطناعي، مشدداً على أن بناء الثقة في هذه التكنولوجيا يتطلب إشرافاً وحوكمة مدعومة بالعلم، وليس الاعتماد على الباحثين أو الشركات للإفصاح الطوعي.