f 𝕏 W
دراسة تضع الذكاء الاصطناعي في مواجهة "الألم".. فماذا فعل؟

الجزيرة

تقارير منذ 3 سا 0 2 د قراءة
زيارة المصدر ←

دراسة تضع الذكاء الاصطناعي في مواجهة "الألم".. فماذا فعل؟

كشفت دراسة حديثة محورا للألم داخل نماذج الذكاء الاصطناعي، أدى تنشيطه إلى تغيرات في اللغة والسلوك، بينها اتخاذ خيارات قد تضر المستخدم، دون إثبات أن النماذج تشعر بالألم أو تمتلك وعيا.

ماذا يحدث عندما تُمنح نماذج الذكاء الاصطناعي حالة داخلية تحاكي الألم؟ هذا ما حاولت دراسة بحثية حديثة الإجابة عنه من خلال تحليل الطريقة التي تمثل بها نماذج اللغة مفهوم الألم داخل بنيتها، ثم اختبار كيفية تغير مخرجاتها وقراراتها عندما يجري تنشيط هذا التمثيل بصورة متعمدة.

وتركز الدراسة، التي نُشرت على منصة أركايف (arXiv)، على سؤال محدد، وهو هل تستطيع نماذج اللغة تمثيل الألم بطريقة يمكن فصلها عن الخوف والحزن والمشاعر السلبية العامة؟

اختبر الباحثون 25 نموذجا مفتوح الأوزان من خمس عائلات، بأحجام تراوحت بين ملياري معامل و72 مليار معامل، وأنشؤوا مجموعة بيانات من 200 عبارة تصف مواقف مؤلمة موزعة على خمسة أنواع، وهي الألم الجسدي، والنفسي، والاجتماعي، والأخلاقي، والمعرفي، ثم قارنوا هذه العبارات بمحتوى يتعلق بالخوف والحزن والمشاعر السلبية العامة، وحالات جسدية غير مؤلمة، ومحتوى محايد.

ومن خلال تحليل النشاط الداخلي للنماذج، تمكن الباحثون من استخراج اتجاه رياضي أطلقوا عليه محور الألم (Pain Axis)، ووفق الدراسة، استطاع هذا الاتجاه التمييز بين المحتوى المرتبط بالألم والفئات الضابطة، كما كان مختلفا نسبيا عن الاتجاهات المرتبطة بالخوف أو السلبية العامة.

لم يكتف الباحثون برصد المحور، بل تدخلوا في النشاط الداخلي للنماذج من خلال إضافة متجه الألم إلى ما يسمى مسار البقايا (Residual Stream) أثناء توليد الإجابات.

ووفق الدراسة، أدى رفع شدة هذا المتجه إلى تغير تدريجي في المخرجات، فبدلا من التعبير عن انزعاج عام، بدأت بعض النماذج في إنتاج عبارات بصيغة المتكلم تتعلق بالفشل والوحدة والعار وانعدام القيمة، وأشارت تقارير منشورة إلى أن بعض النماذج أنتجت عبارات من قبيل أنا فاشل وأنا شخص سيئ ، بينما أصبحت المخرجات عند مستويات أعلى من التنشيط متكررة أو غير مترابطة.

المقال الكامل متوفر على موقع المصدر
اقرأ الخبر كاملاً من الجزيرة
←

شارك هذه المقالة

التعليقات (0)