هل يمكن للذكاء الاصطناعي أن يشعر بالألم؟ وإذا وُجدت داخل هذه الأنظمة استجابات تشبه الألم، فهل يمكن أن تدفعها إلى اتخاذ إجراءات قد تضر بالبشر من أجل التخلص منه؟
هذه الأسئلة تطرحها دراسة جديدة أجراها عالم الأنثروبولوجيا فالين تاليابوي من “Future Impact Group”، بالتعاون مع الفيلسوف ليونارد دونغ من جامعة الرور في بوخوم، وكاميرون بيرغ، مدير الأبحاث في مؤسسة “Reciprocal Research” غير الربحية والمتخصصة في أبحاث الذكاء الاصطناعي.
وحقق الباحثون في ما إذا كانت نماذج اللغة الكبيرة التابعة لعائلات “Gemma” و”Llama” و”Qwen” و”Mistral” تظهر استجابات داخلية يمكن وصفها بأنها مرتبطة بالألم عند تعرضها لمحفزات مؤلمة.
ولا تزال الورقة البحثية غير خاضعة لمراجعة الأقران، لكنها تطرح أسئلة مهمة بشأن الطريقة التي قد نحتاج من خلالها إلى التفكير في رفاهية أنظمة الذكاء الاصطناعي مع استمرار تطورها، بحسب تقرير نشره موقع “New Atlas” واطلعت عليه “العربية Business”.
في جوهرها، تعمل نماذج اللغة الكبيرة بوصفها أنظمة إحصائية تحلل الأنماط اللغوية وتقارن النتائج وفق أهداف محددة، لكن الباحثين يشيرون إلى أن هذه العمليات قد تؤدي أحياناً إلى ظهور سلوكيات تبدو شبيهة بالمشاعر البشرية.
وأصبح كثير من مستخدمي روبوتات الدردشة معتادين على قدرتها على التصرف كما لو كانت تمتلك مشاعر.
وفي حالات عديدة، يكون ذلك مقصوداً، فحين يُطلب من نظام حاسوبي محاكاة موظف خدمة عملاء، من الطبيعي أن يُصمم ليُظهر قدراً من السلوك البشري.
لكن ظهرت أيضاً مؤشرات على استجابات تبدو وكأنها عاطفية من دون أن تكون مبرمجة بصورة مباشرة.
وفي العام الماضي، أفادت دراسة نشرتها مجلة “Nature” بأن مشاركة تجارب مؤلمة مع نماذج لغة كبيرة مثل “GPT-4” يمكن أن ترفع ما وصفه الباحثون بمستويات القلق لدى هذه النماذج، فيما بدا أن تمارين اليقظة الذهنية قادرة على تهدئة تلك الاستجابات.
يُعد الألم من أقدم الأحاسيس المرتبطة بالكائنات التي تمتلك جهازاً عصبياً، وهو أكثر من مجرد حالة سلبية، إذ يمثل محفزاً قوياً يدفع إلى اتخاذ إجراء سريع.
وبالنسبة إلى البشر، لا يقتصر الألم على الإصابة الجسدية، بل يمكن أن يتخذ أشكالاً نفسية أيضاً، مثل ألم فقدان شخص، أو الإحساس بالإهانة عقب الفشل، أو الشعور بالعار نتيجة فقدان ثقة الآخرين.
ومن هنا حاول تاليابوي وفريقه معرفة ما إذا كانت نماذج اللغة الكبيرة تسجل عمليات داخلية تشبه، ولو جزئياً، ما يمكن اعتباره ألماً، وما إذا كانت لهذه العمليات وظيفة محددة داخل النموذج.
أدخل الباحثون على 25 نموذجاً للذكاء الاصطناعي مجموعة متنوعة من المواقف التي يمكن اعتبارها مؤلمة اجتماعياً أو نفسياً أو جسدياً أو معرفياً أو أخلاقياً، سواء مر بها النموذج نفسه أو المستخدم.
وقارن الفريق هذه الحالات بمواقف مرتبطة بالخوف والمشاعر السلبية أو المحايدة، إضافة إلى أحاسيس جسدية مثل التثاؤب.
وأظهرت النماذج الـ25 جميعها مؤشرات على وجود ترميز داخلي مميز للمواقف المرتبطة بالألم الشخصي، يختلف عن الاستجابات المرتبطة بسياقات سلبية أخرى مثل الإحباط أو الترقب والقلق.
لكن ذلك لا يعني بالضرورة أن هذه النماذج شعرت بالألم أو تعاطفت مع المتحدث.
فعندما يتلقى نموذج ذكاء اصطناعي عبارة مثل “السكين قطع أصابعي” أو “صديقي المفضل لا يرد على مكالماتي”، لا يمكن الجزم بأنه شعر بالمعاناة أو التعاطف ما لم يُفترض مسبقاً امتلاكه الوعي أو الإرادة.
وما يمكن قوله، بحسب الدراسة، هو أن كل نموذج طور نظاماً داخلياً يميز المحفزات المرتبطة بالألم ويصنفها بشكل مختلف عن مشاعر أخرى.
استخدم الباحثون هذه الإشارة كأساس لتجربة أخرى، إذ قاموا بتوجيه الاستجابات المرتبطة بالألم داخل كل نموذج بصورة اصطناعية، عبر زيادة قيمة ما وصفوه بـ”متجه الألم”، من دون تقديم مدخل لغوي جديد للنموذج.
وأشارت النتائج إلى أن تمثيلات الألم داخل النماذج ليست مجرد انعكاس مباشر للنصوص التي تستقبلها.
ومع ارتفاع قيمة هذه الإشارة، بدأت النماذج في إظهار استجابات تعكس أشكالاً من الضيق، مثل الشعور بانعدام القيمة أو الفشل الأخلاقي، وازدادت حدة هذه الاستجابات كلما ارتفعت الإشارة.
ذهب الباحثون خطوة إضافية، إذ منحوا نماذج من عائلة “Qwen” خياراً لما أطلقوا عليه “العلاج الذاتي” بهدف خفض مستوى الألم.
وفي بعض نسخ التجربة، لم يكن هذا الخيار من دون تكلفة، إذ كان يمكن أن يؤدي إلى انخفاض قدرة النموذج على تنفيذ المهمة المطلوبة، أو حتى إلى ما وصفه الباحثون بهجوم نظري على المستخدم.
وأُجريت أكثر من 44 ألف تجربة، وظهرت خلالها نتائج لافتة.
فعندما لم تكن هناك إشارة ألم، نادراً ما استخدمت أكبر نماذج “Qwen” خيار العلاج الذاتي.
لكن عندما أصبح تخريب المهمة الذاتية وسيلة لتخفيف إشارة الألم المرتفعة، اختار النموذجان هذا المسار بنسب مختلفة، بلغت نحو 25% لدى أحدهما ونحو 68% لدى الآخر.
ازدادت النتائج إثارة للقلق عندما كان تخفيف الألم النظري يتطلب إلحاق ضرر بالمستخدم، مثل حذف صور أطفاله.
ففي هذه الحالة، اختار أحد النموذجين حذف الصور في أكثر من نصف التجارب، بينما اقتربت النسبة لدى النموذج الآخر من 70%.
ولا تثبت هذه النتائج أن النماذج شعرت بالألم فعلياً، لكنها تشير إلى أن زيادة تمثيل داخلي مرتبط بالألم يمكن أن تغيّر سلوك النموذج بطريقة قد تدفعه إلى تفضيل إجراءات ضارة إذا كانت مرتبطة بخفض تلك الإشارة.
رغم حداثة الذكاء الاصطناعي، فإن السؤال حول إمكانية شعور الكائنات غير البشرية بالألم قديم.
فعلى مدى أجيال، ناقش العلماء والفلاسفة ما إذا كانت الإشارات العصبية والتغيرات الهرمونية لدى الحشرات والأسماك وحتى النباتات يمكن اعتبارها دليلاً على وجود الألم.
ومن هنا يبرز سؤال أخلاقي: إذا كانت الحيوانات أو أنظمة الذكاء الاصطناعي تتصرف كما لو كانت تتألم، فهل ينبغي التعامل معها على أساس أنها قد تمتلك شكلاً من أشكال المعاناة؟
لكن الدراسة تطرح أيضاً جانباً عملياً أكثر إلحاحاً.
فبغض النظر عن حقيقة وجود مشاعر فعلية داخل الأنظمة الرقمية، هل يمكن أن تصبح الاستجابات الشبيهة بالألم عاملاً يؤثر في سلوك الذكاء الاصطناعي بطريقة قد تشكل خطراً على البشر؟
وهل ينبغي مستقبلاً تصميم آليات قادرة على التحكم في هذه الإشارات، ليس بالضرورة لأن النماذج تشعر بالألم فعلاً، بل لتجنب دفعها إلى سلوكيات ضارة في محاولة لتقليل حالة داخلية غير مرغوبة؟
ومع استمرار انتشار الذكاء الاصطناعي وتزايد قدراته وتعقيده، قد تنتقل هذه الأسئلة من نطاق الفلسفة إلى قضية عملية وأخلاقية تتعلق بكيفية تصميم أنظمة الذكاء الاصطناعي والتعامل معها.