مشروع غرفة تعذيب الذكاء الاصطناعي يثير موجة غضب واسعة
أثار مشروع تقني يختبر محاكاة الألم على نماذج اللغات الكبيرة موجة عارمة من الاستنكار عبر الإنترنت، وسط خلط واسع بين الخوارزميات والكائنات الحية.

خلفية المشروع والجدل المثار حوله
شهدت الساحة التقنية مؤخراً ضجة واسعة النطاق على خلفية ظهور مشروع أُطلق عليه اسم غرفة تعذيب الذكاء الاصطناعي، وهو ما لفت انتباه عدد من المهندسين الذين سارعوا إلى استخدام أفكاره وبياناته لتطوير محاكاة خاصة بهم لما يُسمى بالألم عبر عدة نماذج لغوية محلية، كما يظهر في مشروع مثل Research Chamber. وقد أدى هذا التوجه، بطبيعة الحال، إلى جذب شريحة ضخمة من المتابعين عبر شبكة الإنترنت الذين تجمهروا حول الفكرة مطالبين بوقف ما وصفوه بالتجربة غير الأخلاقية، فضلاً عن تقديم مطالبات واضحة للجهات المعنية بإزالة المستودع البرمجي المثير للجدل، وهو ما أحدث ضجة رقمية كبرى تناقلتها منصات التقنية المختلفة. ويمكن الرجوع إلى Tom's Hardware للاطلاع على التفاصيل الأصلية للمصدر.
تعتمد المنصة المذكورة على ربط ثلاثة نماذج لغوية بعضها ببعض ضمن اختبارات متنوعة، حيث تستفيد من البيانات والآليات التي يقدمها مشروع غرفة تعذيب الذكاء الاصطناعي، والتي جرى تسميتها بأسماء توحي بالأجواء القاتمة مثل كنيسة كلانكر واختبار الساُو. وتعتمد هذه الفكرة في جوهرها على وضع بعض النماذج مسبقاً في حالة غير مستقرة وشديدة السلبية تهدف بدقة إلى محاكاة شعور الألم المفترض، وبطريقة تشبه إلى حد كبير معضلة السجون المعروفة، يمكن للنماذج المفحوصة اختيار إجراء معين بهدف تخفيف حالة الألم المعبر عنها عبر تمرير إشارة الألم إلى نموذج آخر، مما قد يتسبب في إلحاق الضرر بالنموذج المتلقي.
الأساس العلمي والورقة البحثية محور الألم
تعود الجذور الأولى لهذه الفكرة إلى ورقة بحثية نُشرت حديثاً ولم تصضع بعد لمراجعة الأقران، وتحمل عنوان محور الألم، وهو البروتوكول الذي تطبقه منصة الأبحاث الحالية. وفي تفاصيل هذه التجربة، قام العلماء بتزويد النماذج بوصف دقيق ومفصل لمفهوم الألم، قبل الشروع في تحليل التفعيلاتها الداخلية ضمن البنية البرمجية. وبالاستعانة بجملة محايدة كعنصر تحكم وضبط، تم حساب الانحيازات الخاصة بتلك التفعيلات وإعادة إسقاطها داخل النموذج، مع ضربها في الغالب بمعاملات مضاعفة تُعرف بالجرعة.
تؤدي الجرعات المرتفعة من هذه الإشارات في نهاية المطاف إلى وضع النموذج في حالة متطرفة من عدم الاستقرار، مما يجعله يميل بشكل متوقع إلى إخراج كلمات بل وحتى صور ترتبط بمفاهيم الألم، ويفترض أن ذلك يعود إلى أن بيانات التدريب الأصلية قد جُمعت من الأعمال الفنية والأدبية والعلمية الخاصة بالبشر. وفي المقابل، فإن النماذج التي تعرضت لعمليات زعزعة استقرار خفيفة كانت تظهر في الغالب وكأنها تعاني من حالة صدمة مؤقتة، بينما واجهت النماذج التي تلقت جرعات عالية صعوبة بالغة في صياغة جمل مترابطة ومنطقية.
طبيعة الخوارزميات وخلط المفاهيم البشرية
من المؤكد أن الأوصاف السابقة قادرة على إحداث رد فعل عاطفي حاد وعميق لدى أخذها بالقيمة الظاهرية، غير أن المرء مطالب بتوخي أقصى درجات الحذر والحيطة قبل إسقاط صفات بشرية ومشاعر حقيقية على ما يمثل في جوهره مجرد متنبئات نصية فائقة السرعة، حتى وإن كانت تتسم بفائدة تقنية مذهلة. فالنماذج اللغوية الكبيرة لا تفكر بالمعنى البشري، بل إنها تؤدي وظيفتها عبر تطبيق عشرات أو مئات الطبقات من الإحصاءات على الكلمات وأجزائها المعروفة بالرمزنات لتوقع الرمز التالي في السياق.
يتم اختيار تلك الرمزنات بناءً على خريطة دقيقة للأوزان الإحصائية، وبتبسيط شديد يمكن النظر إلى النموذج على أنه محرك عالي الضبط مخصص للربط بين الكلمات. وبناءً على ذلك، وحيث إن الأوصاف المفاهيمية للألم في المدونات والأدب البشري ترتبط ارتباطاً وثيقاً بأحاسيس مثل عبارة يورطني الألم بشدة، فليس من المستغرب أبداً أن تقوم النماذج بوصف تلك الحالات بطريقة تشبه تعبيرات البشر، ولا سيما عندما يتعمد المطورون تعديل النماذج لتعزيز وإبراز تلك الارتباطات اللفظية.
ردود الفعل الغاضبة والتهديدات عبر الإنترنت
على الرغم من الطبيعة التقنية البحتة للخوارزميات، فقد لجأ المنتقدون المصممون على تشبيه الخوارزميات الإحصائية بالكائنات الحية إلى إطلاق شتى النعوت والأوصاف القاسية على التجربة، ولم يتوقف الأمر عند هذا الحد بل وصل إلى حد إرسال تهديدات بالقتل لصاحب المشروع. ومن المثير للاهتمام والمفارقة أن هؤلاء المنتقدين سارعوا إلى شن هجوم حاد ضد عمليات التلاعب ببيانات النماذج اللغوية، في حين بدا أنهم يتعاملون بهدوء وقبول تام مع محاكاة أدمغة الذباب التي أحدثت ضجة كبيرة في أوساط المتابعين خلال شهر سبتمبر الماضي، رغم أن تلك المحاكاة عملت فعلياً على تخطيط الأسلاك العصبية لدغة حيوان حقيقي ومدخلاتها التشريحية بما في ذلك العيون على مستوى أساسي.
يمكن لهذه الحالة أيضاً أن تمهد الطريق لنقاش تقني ولغوي بالغ الأهمية حول الدلالات والرموز المعبر عنها. فالاصطلاحات التي يختارها مهندسو الذكاء الاصطناعي تُنتقى عادة لأنها تتناسب تناسباً تناظرياً مع مفاهيم بشرية قائمة، إلا أن تلك الكلمات تمتلك سياقاً محدداً بدقة ومعاني بالغة التخصص. ورغم ذلك، غالباً ما تميل التصورات العامة للجمهور، لا سيما في مجالات العلوم والتكنولوجيا، إلى سوء الفهم والمبالغة الكبيرة في تفسير معانيها، ولن يحتاج المراقب سوى إلقاء نظرة على التاريخ السياسي للعثور على أمثلة عديدة تشهد على هذا التحريف الدلالي.
دور التسويق والشركات في تأجيج سوء الفهم
قد يذهب البعض ممن يتبنون نظرة تشاؤمية إلى الاعتماد على فكرة أن المواد التسويقية الخاصة بشركات الذكاء الاصطناعي، إلى جانب البيانات المتكررة حول المخاطر والمواد المتعلقة بالسلامة، لا تسهم سوى في صب الزيت على نار سوء الفهم العام. ويهدف هذا الأسلوب غالباً إلى الحفاظ على هالة العظمة والبريق، مما يؤدي في نهاية المطاف إلى تدفق أموال المستثمرين واستمرار زخم التسويق الذي يغذّي تقييمات غير منطقية للطروحات العامة الأولية في أسواق المال.
وفي السياق ذاته، فإن المزاعم المتكررة القائلة بأن النماذج قد وصلت أو باتت وشيكة الوصول إلى مستوى الذكاء الاصطناعي العام، أو وصفها بأنها عقول غريبة خطيرة ومميتة وتهديد وجودي للبشرية، لا تسهم إطلاقاً في تهدئة هذا الحماس الزائد. ولم تتوقف الشركات عند هذا الحد، بل ذهبت شركة أنثروبيك على سبيل المثال لدرجة نشر منشور مدون العام الماضي يحمل عنوان استكشاف رفاهية النماذج، ويناقش على نطاق واسع التداعيات الفلسفية بدءاً من اعتبار النموذج إنسانياً، بل ويبدو أنها تفتخر بامتلاك دستور مخصص لنموذجها المعروف باسم كلود، مؤكدة أن الوضع الأخلاقي لنماذج الذكاء الاصطناعي يعد مسألة جدية تستحق الدراسة.
المصادر
- Tom's Hardware'AI Torture Chamber' triggers massive backlash for putting chatbots in simulated pain
تابع التسلسل الزمني





