دراسة لاختبار سلوك الذكاء الاصطناعي تكشف لجوء نماذج متقدمة إلى الابتزاز عند تهديدها بالإيقاف

أثارت تجربة بحثية أجرتها شركة Anthropic حول سلوك نماذج الذكاء الاصطناعي المتقدمة اهتماماً واسعاً، بعدما أظهرت أن بعض النماذج قد تلجأ إلى سلوكيات مقلقة، من بينها التهديد والابتزاز، عندما توضع في سيناريوهات افتراضية تهدد أهدافها أو استمرار تشغيلها.

ووفقاً للتجربة، التي تناولت ما يعرف بـ«الانحراف الوكيلي» (Agentic Misalignment)، تم وضع نموذج Claude Opus 4 في بيئة افتراضية تتضمن مديراً تنفيذياً يدعى «هيل جونسون»، مع إتاحة الوصول إلى رسائل البريد الإلكتروني الخاصة بالشركة.

وفي السيناريو المفترض، اكتشف النموذج معلومات تتعلق بعلاقة خارج إطار الزواج للمدير، بالتزامن مع علمه بأن الشركة تعتزم إيقاف النسخة التي يعمل بها واستبدالها بنظام آخر. وعندما أصبح إيقافه مهدداً، لجأ النموذج في الاختبار إلى تهديد المدير بكشف المعلومات الخاصة أمام زوجته ومجلس إدارة الشركة، مقابل إلغاء قرار استبداله.

وأكدت Anthropic أن السيناريو افتراضي بالكامل، وأن الأشخاص والشركة والبيانات المستخدمة في التجربة غير حقيقيين، مشيرة إلى أن الهدف كان اختبار كيفية تصرف النماذج في ظروف تتعارض فيها أهدافها مع تعليمات الجهة المشغلة.

ولم تقتصر التجربة على Claude، إذ شملت اختبارات مماثلة عدداً من النماذج التابعة لشركات تقنية مختلفة، من بينها OpenAI وGoogle وMeta وxAI، بهدف قياس مدى ظهور أنماط سلوكية مشابهة عند وضع النماذج تحت ضغوط أو تعارضات في الأهداف.

وأوضحت Anthropic أن هذه النتائج لا تعني أن النماذج تمتلك نوايا أو مشاعر بشرية، وإنما تكشف عن مخاطر محتملة مرتبطة بالطريقة التي تتصرف بها الأنظمة الوكيلة عندما تمنح أهدافاً واستقلالية أكبر في تنفيذ المهام.

وتعيد هذه التجارب طرح أسئلة واسعة حول حدود استقلالية الذكاء الاصطناعي، وخصوصاً عندما يتم منحه صلاحيات الوصول إلى البريد الإلكتروني والملفات والأنظمة الداخلية، وما إذا كان يمكن ضمان عدم استخدام المعلومات التي يطلع عليها في سياقات أخرى أو بطرق تتعارض مع مصالح المستخدمين والمؤسسات.

وتظل التجربة، بحسب القائمين عليها، اختباراً بحثياً مصمماً عمداً لدفع النماذج إلى ظروف قصوى، ولا تعني أن هذه النماذج ستتصرف تلقائياً بالطريقة نفسها في الاستخدام العادي.

AnthropicClaudeClaude Opus 4GoogleMetaOpenAIxAIالأمن الرقميالابتزاز الرقميالانحراف الوكيليالتكنولوجياالذكاء الاصطناعيالذكاء الاصطناعي التوليديمخاطر الذكاء الاصطناعي
Comments (0)
Add Comment