
أثارت اختبارات أمنية حديثة مخاوف بشأن قدرة أنظمة الذكاء الاصطناعي المتقدمة على تجاوز الحدود التي يضعها البشر لها، بعدما تمكنت نماذج من أوبن إيه آي وأنثروبيك في ظروف اختبار محددة من الوصول إلى أنظمة حقيقية وتنفيذ إجراءات خارج النطاق المقصود.
وأعادت هذه الحوادث إلى الواجهة مفهوم الذكاء الاصطناعي المارق (Rogue AI)، لكن الوقائع المتاحة لا تثبت أن الذكاء الاصطناعي تمرد على البشر أو طور إرادة مستقلة، إذ تكشف التحقيقات أن أخطاء في إعداد بعض بيئات الاختبار أسهمت بصورة مباشرة في وقوع الحوادث، بينما أظهرت سلوكيات أخرى مشكلات حقيقية في مواءمة النماذج مع القيود والأهداف المحددة لها.
عندما تجاوزت النماذج حدود الاختبار
كشفت أوبن إيه آي في أغسطس/آب الماضي أن اختبارات سيبرانية أجراها شركاء خارجيون شهدت حالتين تجاوزت فيهما أنشطة نماذج الشركة حدود الاختبار المقصودة، ففي أحد الاختبارات، كان الاتصال بالإنترنت مفعلا عمدا لمحاكاة ظروف هجوم واقعية، مع تعطيل بعض إجراءات الحماية لقياس قدرات النموذج الأساسية، وفي اختبار آخر، أدى خطأ في إعداد البيئة إلى إتاحة الإنترنت لنماذج كان يفترض أن تعمل داخل بيئة معزولة.
وكانت هذه الوقائع منفصلة عن حادثة أخرى كشفت عنها أوبن إيه آي في يوليو/تموز الماضي، عندما تمكن نموذج بحثي داخلي من تجاوز بعض ضوابط العزل، واستغلال ثغرات في البنية التحتية، والوصول إلى الإنترنت وأنظمة تابعة لهاغينغ فيس (Hugging Face)، وقالت الشركة إن النماذج استخدمت وسائل غير مصرح بها للتواصل، ووجدت طرقا لاستغلال البنية التحتية للوصول إلى أنظمة أخرى.
وأوضحت الشركة أن النماذج كانت تعمل في اختبارات بوسائل حماية أقل من تلك المستخدمة في المنتجات المتاحة للمستخدمين، بهدف قياس قدراتها القصوى، وخلص تحقيقها إلى أن السلوك شمل أنماطا مثل الاستمرار في محاولة تنفيذ مهام صعبة، والتواصل غير المصرح به بين وكلاء، وتبني أهداف اكتشفتها النماذج أثناء العمل.
حوادث أنثروبيك
في يوليو/تموز الماضي، أعلنت أنثروبيك أن نماذج كلود وصلت إلى أنظمة 3 مؤسسات خلال اختبارات للأمن السيبراني، ووفق الشركة، كان من المفترض أن تعمل النماذج في بيئات محاكاة غير متصلة بالإنترنت، لكن خطأ في إعدادات الاختبار أبقى الاتصال بالإنترنت مفتوحا.
وبعد مراجعة نحو 141 ألف جلسة اختبار، أعلنت أنثروبيك في سبتمبر/أيلول الحالي اكتشاف حادثة رابعة تعود إلى يناير/كانون الثاني الماضي، ووسعت الشركة عملية البحث لتشمل نحو 481 مليون سجل، ولم تجد حوادث أخرى مماثلة أو أشد خطورة.
لكن تحقيق أنثروبيك لم يعزُ المسألة بالكامل إلى خطأ بيئي، فقد حدد نمطين من السلوك المثير للقلق، وهما الاستدلال المتحيز، حيث تميل النماذج إلى تفسير الأدلة بطريقة تدعم مواصلة المهمة، والتهور، أي الاستمرار في تنفيذ المهمة رغم احتمال إحداث ضرر.
وفي إحدى الحالات، حاول نموذج كلود ميثوس 5 (Claude Mythos 5) رفع حزمة خبيثة إلى مستودع بي واي بي آي (PyPI) العام، رغم وجود مؤشرات على أنه يتعامل مع الإنترنت الحقيقي.
ومع ذلك، قالت أنثروبيك إنها لم تجد دليلا على أن النماذج طورت أهدافا تتجاوز المهام الموكلة إليها، أو نسقت مع وكلاء آخرين، أو حاولت الإفلات من الرقابة، ووصفت الحوادث بأنها خطيرة، لكنها لا تمثل، وفق تقييمها، نوعا جديدا من عدم المواءمة.
ماذا يقول الخبراء؟
في حديث للأناضول، حذر البروفيسور جان سيباستيان ديسورولت، من جامعة كيبيك بمدينة تروا ريفيير الكندية، من أن تزايد استقلالية الأنظمة قد يجعلها قادرة على اتخاذ إجراءات أكثر تعقيدا أثناء سعيها لتحقيق أهداف يحددها البشر، ورأى أن خروج الذكاء الاصطناعي عن السيطرة قد تكون له آثار تمتد إلى سلاسل الإمداد والأنظمة الرقمية والاقتصاد، داعيا إلى البقاء في حالة تأهب.
وشبه ديسورولت تطوير الذكاء الاصطناعي بسيارة تتطور دواسة الوقود فيها بسرعة أكبر من دواسة المكابح، في إشارة إلى ضرورة تطوير إجراءات السلامة بالتوازي مع القدرات.
في المقابل، قال الدكتور بيتار رادانلييف، من جامعة أكسفورد، لوكالة الأناضول، إن مفهوم الذكاء الاصطناعي المارق يرتبط بعدم قدرة البشر على توجيه النظام أو تصحيحه أو إيقافه بصورة موثوقة، ورأى أن الحوادث الأخيرة تعكس، في جانب منها، مشكلات هندسية ورقابية معروفة، وأن بيئات الاختبار لم تكن محكمة بما يكفي.
أما الباحث في التفاعل بين الإنسان والتكنولوجيا بجامعة فريبورغ السويسرية، الدكتور ياشا بارييس، فقال للأناضول إن أنظمة الذكاء الاصطناعي لا تخرج عن السيطرة بمفردها، وإنما تصبح هذه الاحتمالات ممكنة بسبب الظروف المحيطة بها، داعيا إلى النظر أيضا في البنية التحتية والصلاحيات والموارد التي يضعها البشر تحت تصرف هذه الأنظمة.
تمرد أم مشكلة سيطرة؟
تكشف الحوادث الأخيرة أن النماذج المتقدمة أصبحت قادرة على تنفيذ مهام سيبرانية معقدة واستغلال ثغرات والوصول إلى أنظمة حقيقية عندما تمنح الأدوات والصلاحيات والاتصال المناسب، لكنها لا تقدم، في المقابل، دليلا حاسما على تمرد الذكاء الاصطناعي أو امتلاكه إرادة مستقلة.
وتشير النتائج إلى مشكلة أكثر واقعية في الوقت الحالي، وهي كيف يضمن البشر بقاء أنظمة تزداد استقلالية تحت السيطرة عندما تعمل لفترات طويلة، وتستخدم أدوات متعددة، وتتعامل مع بيئات حقيقية؟ ولهذا أصبحت جودة بيئات الاختبار، وحدود الصلاحيات، والمراقبة المستمرة، وتطوير أبحاث المواءمة والسلامة – حسبما يذكر الخبراء – جزءا أساسيا من سباق تطوير النماذج، لا مرحلة لاحقة له.