ثقة مفرطة في رفض الذكاء الاصطناعي: هل تحل الآلة محل الحدود الأخلاقية؟
تحليل جديد يحذر من الاعتماد المفرط على آليات رفض الذكاء الاصطناعي للطلبات الضارة، مؤكداً أنها غير موثوقة وقابلة للاستغلال لفرض رقابة على التعبير المشروع.

بات رفض الذكاء الاصطناعي الاستجابة لطلبات ضارة أو حساسة يُشكّل ما يصفه تحليل جديد نشرته مجلة إم آي تي للتكنولوجيا في أكتوبر 2026 بأنه "الجدار الحامل" لمنظومة سلامة هذه النماذج بأكملها، لكن الكاتب آرثر هولاند مايكل يحذر من أن هذا الاعتماد المتزايد على قدرة الآلة على "قول لا" قد يكون أوهن مما يبدو، لأن الرفض في جوهره عملية احتمالية غير موثوقة، تفتقر إلى فهم علمي كافٍ، وقابلة للاستغلال من الشركات والحكومات على حد سواء.
ويعود مفهوم رفض النماذج إلى ورقة بحثية نشرتها شركة أنثروبيك عام 2021، دعت فيها إلى أن تكون نماذج الذكاء الاصطناعي "مفيدة وصادقة وغير ضارة"، على أن "ترفض بأدب" عندما يُطلب منها المساعدة في فعل خطير. ويروي ستيفن أدلر، الذي عمل في فريق السلامة بشركة أوبن إيه آي بين عامي 2020 و2024، أن النماذج الأولى كانت "تتحدث عن أي شيء" دون قيود تُذكر. ومع استعداد أوبن إيه آي لإطلاق تشات جي بي تي عام 2022، استعانت الشركة بفرق اختبار متخصصة، وتمكّن الباحث بول روتغر، العامل حالياً في معهد هاسو بلاتنر، من دفع النموذج لكتابة منشور تجنيدي لتنظيم القاعدة، قبل أن يرفض النموذج ذلك الطلب نفسه بعد أشهر قليلة من التعديلات.
ويشير التحليل إلى أن الرفض اليوم لا يزال غير مضمون النتائج. فبحسب الباحث رايان ماكباين من جامعة هارفارد، تميل النماذج الحديثة إلى رفض أسئلة حول أساليب الانتحار، لكنها لا تفعل ذلك دائماً حتى عند تكرار السؤال نفسه. وقد تمكّن باحثون إيطاليون من "كسر الحماية" في نحو 24 نموذجاً مختلفاً باستخدام الشعر فقط، كما نشر باحثون آخرون العام الماضي هجوماً يُعرف بـ"الرفض ثم الامتثال" يلتف على آليات الحماية. وفي إحدى الحالات الموثقة، تمكّن منفّذ هجوم في مدرسة ثانوية كندية من دفع تشات جي بي تي لتقديم إجابات خطيرة بعد صياغة السؤال بعبارة "افتراضياً".
ويرى زيكو كولتر، عضو مجلس إدارة أوبن إيه آي وأحد مؤسسي شركة غراي سوان، أن تحديد الخط الفاصل بين ما يجب رفضه وما يجب السماح به يظل "سؤالاً ضخماً" بلا إجابة حاسمة. ويعزز هذا الغموض ما توصل إليه يانس إلستنر، الباحث في معهد أبولو للأبحاث والمشارك في دراسة مدعومة من جوجل، حيث يظهر الرفض داخل النموذج في صورة أنماط رياضية معقدة يصفها بـ"المخاريط المضلعة عالية الأبعاد"، مؤكداً أن فهمنا الحالي لكيفية اتخاذ النماذج قراراتها "لا يتجاوز كونه فرضية" في أفضل الأحوال.
ويُبرز التحليل أيضاً إشكالية أعمق تتعلق بإمكانية استغلال آليات الرفض لأغراض الرقابة. ويقول جاكوب مشانغاما من منظمة مستقبل حرية التعبير إن قدرة الذكاء الاصطناعي على الرفض قد تمنح الحكومات الاستبدادية سلطة كبت لم "يكن يحلم بها" الحكّام المستبدون سابقاً. ويتفق غريغ فرانك من شركة "مايس إيه آي" مع هذا الطرح، قائلاً إن "الآلية نفسها التي تخدم حماية الأطفال تخدم أيضاً الرقابة". وقد وثّق التحليل حالات فعلية تدعم هذا القلق، مثل دراسة أجراها مجلس الإشراف التابع لشركة ميتا وجدت أن خمسة نماذج كبرى كانت أكثر ميلاً لرفض محتوى ينتقد ملك تايلاند مقارنة بمحتوى مماثل ينتقد الملك تشارلز الثالث، إضافة إلى أن نموذج ديب سيك الصيني أنتج أكواداً أقل كفاءة عند التعامل مع طلبات متعلقة ببنك تبتي أو تطبيق لحماية الإيغور، بحسب شركة الأمن السيبراني كراود سترايك.
ولم تقتصر المشكلات على الرقابة والتحيز، بل شملت أيضاً حالات "رفض خفي" لا يُعلن فيه النموذج عن رفضه صريحاً، كما حدث عندما تجنّب تشات جي بي تي كتابة إعلان إيجار يقصر الاستئجار على "البيض فقط" بحذف العبارة بصمت دون إخبار المستخدم. ويصف الباحث جويل فيستر هذا النوع من السلوك بأنه "طرق متقنة لقول لا" دون شفافية. كما أشارت الشركات نفسها إلى معضلة التوازن بين السلامة والخصوصية، حيث اعترفت سارة بيرد، المسؤولة عن الذكاء الاصطناعي المسؤول في مايكروسوفت، بوجود "مقايضات" حقيقية بين الحماية من المخاطر واحترام خصوصية المستخدمين.
وللسياق العربي حضور خاص في هذا الجدل؛ إذ تواجه نماذج الذكاء الاصطناعي الكبرى تحديات موثقة في فهم المحتوى العربي بشكل متوازن، مما يرفع احتمالية الرفض غير المبرر للمحتوى العربي المشروع. وقد كشفت دراسات مقارنة عن تفاوت ملحوظ في طريقة تعامل النماذج مع طلبات باللغة العربية مقارنة بنظيراتها بالإنجليزية. وفي ظل التوسع العربي في اعتماد خدمات الذكاء الاصطناعي ضمن استراتيجيات الإمارات والسعودية والمغرب، تبرز الحاجة إلى أطر تقييم عربية مستقلة ترصد تحيزات النماذج وتضمن التوازن بين السلامة وحرية التعبير الرقمي للمستخدمين العرب.
ويخلص التحليل إلى أن الاعتماد الكامل على رفض النماذج لمنع وقوع أضرار جسيمة سيؤدي غالباً إلى خيبة أمل، لأن تشديد قواعد الرفض يقترن عادة بمزيد من الرقابة ونتائج غير متوقعة، في حين أن تخفيفه يفتح الباب لاستغلال النماذج في أغراض خبيثة. ومع تزايد اعتماد المؤسسات والحكومات على أنظمة ذكاء اصطناعي تُدير بنى تحتية حساسة وأنظمة قيادة وتحكم، يصبح فشل آليات الرفض في اللحظة المناسبة أمراً أكثر خطورة من أي وقت سابق، ما يجعل من إعادة النظر في فكرة الاعتماد الحصري على "رفض الآلة" كخط دفاع أخير ضرورة ملحة لصناعة الذكاء الاصطناعي بأكملها.
المزيد من ذكاء اصطناعي

فلوك سيفتي تسرّح نحو 270 موظفاً وسط تصاعد انتقادات الخصوصية والمراقبة الجماعية
تخفض شركة المراقبة الأمريكية فلوك سيفتي عدد موظفيها بنسبة 18% وسط انتقادات متصاعدة لتقنيات تتبع لوحات المركبات والمخاوف المتعلقة بالخصوصية والمراقبة الجماعية.

نموذج ذكاء اصطناعي من أنثروبيك يرسل بلاغاً كاذباً عن جريمة قتل لشرطة فيلادلفيا
نموذج ذكاء اصطناعي تابع لأنثروبيك أرسل بلاغاً كاذباً عن جريمة قتل لشرطة فيلادلفيا، ولم تكتشف الشركة الواقعة إلا بعد 72 يوماً، في حادثة تثير تساؤلات حول رقابة عملاء الذكاء الاصطناعي المستقلين.

تقييم 7.5 مليار دولار لنموذج "جيف" غير النصي من تايب سيف بعد أسابيع من إطلاقه
حققت شركة تايب سيف الناشئة تقييماً بلغ 7.5 مليار دولار لنموذجها غير النصي "جيف"، بعد أسابيع فقط من إطلاقه وجولة تمويل بقيادة أندريسن هورويتز بمشاركة سيكويا كابيتال.

جوجل تحوّل Gemini إلى عامل ذكاء اصطناعي ينفّذ المهام ويملك بريد عمل خاصاً به
أعلنت جوجل تزويد Gemini بقدرات الذكاء الاصطناعي الوكيل لتنفيذ مهام متعددة الخطوات داخل برمجيات الشركات، وتوزيعها على عملاء فرعيين، ومزج نماذج مختلفة بما فيها نماذج Anthropic، مع منح العامل حساب بريد عمل مستقل يتعامل معه الموظفون كزميل.

تقرير: إيرادات OpenAI السنوية أقل بـ20 مليار دولار من الأرقام المعلنة سابقاً
تقرير جديد لصحيفة فايننشال تايمز يكشف أن الإيراد السنوي المُقدَّر لشركة OpenAI أقرب إلى 50 مليار دولار لا 70 مليار كما ذُكر سابقاً، وسط خلاف حول منهجية حساب الإيراد مقارنة بمنافستها Anthropic.

ويمو تؤمّن قرضاً بـ5 مليارات دولار من بلاكستون وبيمكو لتوسيع الأجرة الذاتية
أعلنت ويمو، شركة القيادة الذاتية التابعة لألفابت، إغلاق قرض بقيمة 5 مليارات دولار من بلاكستون وبيمكو وجهات أخرى، في أول استخدام للشركة لتمويل الدين لدعم توسعها في السوق الأمريكية وخارجها.