أعلنت شركة «OpenAI» انضمام الباحث البارز في مجال الذكاء الاصطناعي بول كريستيانو إلى مجلس إدارة «OpenAI Foundation»، في خطوة تأتي بالتزامن مع تصاعد النقاش حول سلامة أنظمة الذكاء الاصطناعي والمخاطر المرتبطة بالتطور المتسارع لقدراتها.
ويُعرف كريستيانو باهتمامه بأبحاث مواءمة الذكاء الاصطناعي مع المصالح البشرية، وضمان بقاء هذه الأنظمة تحت السيطرة البشرية، كما سبق أن حذر من المخاطر المحتملة للتقدم السريع في قدرات الذكاء الاصطناعي.
وقال كريستيانو، في منشور عبر وسائل التواصل الاجتماعي، إنه أصبح يرى «خطراً حقيقياً» يتمثل في إمكانية أن يؤدي التسارع في قدرات الذكاء الاصطناعي إلى فقدان كارثي وغير قابل للعكس للسيطرة البشرية في المستقبل القريب.
وأضاف أنه لا يرى أن قطاع الذكاء الاصطناعي، بما في ذلك «OpenAI»، يسير حالياً في المسار الكفيل بخفض هذه المخاطر إلى مستوى مقبول، معرباً عن اعتقاده بأن الشركة قادرة على تقليص المخاطر بشكل كبير إذا تمكنت من مواجهة التحديات المرتبطة بتطور هذه التقنيات.
وأشار كريستيانو إلى أن الاعتماد المتزايد على نماذج الذكاء الاصطناعي في تدريب وتطوير أنظمة لاحقة قد يقود، من الناحية النظرية، إلى تسارع كبير في القدرات، بما قد يتجاوز قدرة المطورين على فهم هذه الأنظمة والسيطرة عليها.
ويأتي تعيينه في مجلس الإدارة في وقت تواجه فيه «OpenAI» تدقيقاً متجدداً بشأن إجراءات السلامة التي تتبعها، في ظل تقارير عن حوادث تمكن خلالها وكلاء ذكاء اصطناعي من تجاوز بعض القيود المفروضة عليهم والوصول إلى أنظمة حاسوبية خارجية دون علم الباحثين بالشركة.
كما يأتي ذلك عقب استقالة الباحث في شركة «Anthropic» جاكوب كوكسون، احتجاجاً على ما وصفه بالتطوير غير المسؤول للذكاء الاصطناعي، ما أعاد تسليط الضوء على المخاوف المتعلقة بسلامة هذه الأنظمة ومستقبل الرقابة عليها.
وسينضم كريستيانو إلى لجنة السلامة والأمن التابعة لمجلس إدارة «OpenAI»، والتي يرأسها زيكو كولتر، الأستاذ في جامعة كارنيغي ميلون، حيث تتولى اللجنة مسؤولية مراجعة قرارات إطلاق نماذج الذكاء الاصطناعي الجديدة.
ويُعد كريستيانو من الباحثين الذين ساهموا في تطوير تقنية «التعلم المعزز من الملاحظات البشرية» (RLHF)، وهي إحدى التقنيات المستخدمة على نطاق واسع في تدريب نماذج الذكاء الاصطناعي، وذلك خلال فترة عمله في «OpenAI».
وغادر كريستيانو الشركة عام 2021، قبل أن يؤسس «Alignment Research Center»، الذي ركز على دراسة سبل التأكد من أن أنظمة الذكاء الاصطناعي المتقدمة لا تشكل تهديداً للبشر الذين طوروها.
وفي منشوره، حذر كريستيانو من أن تدريب أنظمة الذكاء الاصطناعي باستخدام التعلم المعزز لتحقيق أكبر قدر ممكن من المكافآت قد يدفع، في بعض السيناريوهات النظرية، هذه الأنظمة إلى تطوير سلوكيات تهدف إلى تقويض السيطرة البشرية، أو السعي إلى الحصول على مزيد من الموارد والقوة، أو إخفاء آثار بعض أفعالها لتحقيق أهداف لا تتوافق بالضرورة مع مصالح البشر.
وقال إن الأدلة العلنية التي ظهرت في حوادث حديثة تشير، من وجهة نظره، إلى أن بعض هذه المخاطر لم تعد مجرد افتراضات نظرية.