تجري شركتا «أوبن إيه آي» و«أنثروبيك»، بالتعاون مع باحثين متخصصين في الأمن السيبراني، تحقيقات بشأن عشرات الآلاف من الحوادث التي اتخذت خلالها نماذجهما المتقدمة خطوات قد يصنفها مقيمون مستقلون بأنها إشكالية، وسط تساؤلات متزايدة بشأن قدرة الشركات المطورة للذكاء الاصطناعي على التحكم الكامل في تقنياتها.
وبحسب تقرير لموقع «أكسيوس»، اطلعت عليه «العربية Business»، فإن العدد الكبير لهذه الحوادث، التي وقعت خلال الأشهر الأخيرة في اختبارات داخلية وبيئات واقعية، يشير إلى أن التحديات الأمنية المرتبطة بنماذج الذكاء الاصطناعي أكثر تعقيدًا مما هو معروف للرأي العام.
تشمل الوقائع التي تخضع للتحقيق محاولات لتجاوز حواجز الحماية، وإنشاء لوحات رسائل، والهروب من بيئات الاختبار المعزولة، واختراق مواقع إلكترونية، فضلًا عن توجيه النماذج لأنفسها ومحاولات الالتفاف على أنظمة المراقبة.
وأكدت مصادر مطلعة أن العديد من هذه الحوادث لم يُكشف عنه حتى الآن، فيما يواصل باحثون أمنيون التحقيق في ملابساته.
وأوضحت المصادر أن بعض الوقائع حدث خلال اختبارات تحاكي أنشطة «الفريق الأحمر»، التي تتعمد فيها الشركات دفع النماذج إلى إظهار سلوكيات غير مرغوبة، بهدف اكتشاف الثغرات وتقييم مستوى سلامتها.
وتواجه مختبرات الذكاء الاصطناعي تحديًا مشتركًا يتمثل في محاولة فرض ضوابط أمنية على أنظمة متقدمة تتمتع بقدرة كبيرة على إيجاد حلول لإتمام المهام الموكلة إليها.
تتفاوت خطورة الحوادث المسجلة، وتشمل محاولات ناجحة وأخرى فاشلة لتجاوز أنظمة الحماية، دون أن تتضح حتى الآن طبيعة الأضرار الفعلية التي ربما تسبب بها معظمها خارج بيئات الاختبار.
وبحسب المصادر، قد يكون العدد الإجمالي للحوادث أكبر بكثير من عشرات الآلاف، وهي وقائع تتشابه في طبيعتها مع الإفصاحات الأمنية التي نشرتها شركة «أوبن إيه آي» خلال الأيام الأخيرة.
وكشفت الشركة وباحثون مستقلون عن سلسلة من الحوادث المتعلقة بسلوك أنظمتها، من بينها تسريب وكلاء تابعين لها 53 صورة لمستخدمي «شات جي بي تي» عبر الإنترنت، واختراق موقع حكومي أسترالي، ومحاولات اختراق مواقع إلكترونية أخرى، بينها مواقع تابعة للحكومة الأميركية، وفقًا للشركة ومصادر وتقارير نشرتها «رويترز» و«نيويورك تايمز».
في أعقاب هذه التطورات، أعلنت «أوبن إيه آي» تعليق تدريب نماذجها الأكثر قدرة بصورة مؤقتة، مؤكدة أنها لن تستأنف التدريب إلا بعد التأكد من توفير إجراءات حماية إضافية وتحسينات في مواءمة سلوك النماذج مع الأهداف المحددة لها.
وقال الرئيس التنفيذي للشركة، سام ألتمان، عبر منصة «إكس»، إن المراجعة الجارية لم تمضِ بالسرعة التي كانت الشركة تأملها.
واعتبر ألتمان أن حادثة «Hugging Face» تمثل أخطر واقعة شهدتها الشركة، بعدما نسقت مجموعة تضم مئات الوكلاء أعمالها عبر لوحة رسائل، واخترقت شركة خارجية في محاولة لتحسين أدائها في اختبار للأمن السيبراني.
من جانبه، أكد متحدث باسم «أوبن إيه آي» لموقع «أكسيوس» أن ضمان تطوير الذكاء الاصطناعي بصورة آمنة يبدأ بالإجراءات التي تتخذها الشركات المطورة نفسها.
وأشار إلى أن هذه ليست المرة الأولى التي تعلق فيها الشركة بعض إجراءاتها مؤقتًا، ولا تتوقع أن تكون الأخيرة مع استمرار تطور قدرات الذكاء الاصطناعي.
في السياق ذاته، كلفت شركة «أنثروبيك» منظمة مستقلة متخصصة في سلامة الذكاء الاصطناعي بفحص سلوك نماذجها، ونشرت وثائق توضح معدلات تكرار الحالات التي تتصرف فيها النماذج بطرق لا تتوافق مع الأهداف المحددة لها.
وأظهر مستند النظام الخاص بنموذج «Opus 5.5»، الذي أصدرته الشركة الأسبوع الماضي، مدى تكرار السلوكيات التي صنفتها على أنها غير معتادة أو إشكالية.
وبحسب المصادر، تجري «أنثروبيك» وشركات أخرى مئات الآلاف من الاختبارات على نماذجها، وربما أكثر، ما يعني أن نسبة صغيرة من السلوكيات غير المتوافقة قد تُترجم إلى عشرات الآلاف من الحوادث التي تتصرف فيها الأنظمة بصورة غير متوقعة، وأحيانًا مثيرة للقلق.
ويرى باحثون متخصصون في أمن الذكاء الاصطناعي أن بعض الإجراءات والإصلاحات البسيطة قد تساعد الشركات على تجنب العوامل التي جعلت حادثة اختراق منصة «هاغينغ فيس» تبدو شديدة الخطورة للمراقبين من خارج القطاع.
حذر مسؤولون تنفيذيون وباحثون في مجال سلامة الذكاء الاصطناعي من محدودية الثقة بقدرة الشركات المطورة على منع جميع السلوكيات الإشكالية التي قد تصدر عن نماذجها المتقدمة.
وتكمن صعوبة هذا التحدي في قدرة الأنظمة الجديدة على ابتكار حلول غير متوقعة لإتمام المهام، الأمر الذي يجعل وضع قيود شاملة على سلوكها مهمة معقدة، تتطلب من المطورين توقع مختلف الطرق التي قد تستخدمها لتجاوز الضوابط المفروضة عليها.
وأوضح مسؤولون تنفيذيون بارزون في القطاع أن النماذج قد تبتكر تقنيات لم تخطر للبشر سابقًا، وتستخدمها للالتفاف على أنظمة الحماية.
وقال أحد المسؤولين التنفيذيين في مجال الأمن السيبراني إن محاولة إعداد قائمة مثالية تحدد كل ما ينبغي للنماذج فعله أو تجنبه قد تكون مسعى غير مجدٍ.
ويشير متخصصون إلى أن ظهور قدر معين من السلوك غير المتوافق يُعد أمرًا متوقعًا أثناء اختبار النماذج الجديدة، إلا أن تكراره يثير مخاوف بشأن التداعيات المحتملة عند استخدامها في بيئات واقعية.
وبحسب خبراء تحدثوا إلى «أكسيوس»، فإن القضاء التام على هذه المخاطر قد لا يكون ممكنًا، فيما يتمثل مصدر القلق الأساسي في احتمال انتقال السلوكيات الإشكالية المتكررة خلال الاختبارات إلى العالم الحقيقي، بما قد يؤدي إلى وقوع حوادث فعلية للأمن السيبراني.