أنثروبيك تكشف عن فضاء خفي داخل كلود يُعالج فيه الذكاء الاصطناعي مفاهيم سرية
طوّر باحثو أنثروبيك تقنيةً في التفسيرية الآلية تُتيح رؤية مفاهيم داخلية يُعالجها نموذج كلود دون أن تظهر في مخرجاته، في خطوة غير مسبوقة نحو فهم ما يجري داخل نماذج اللغة الكبيرة.

أعلنت شركة أنثروبيك الأمريكية لأبحاث الذكاء الاصطناعي عن اكتشاف يُعدّ الأعمق من نوعه في مجال فهم الآليات الداخلية للنماذج اللغوية الكبيرة: توصّل فريقها البحثي إلى تقنية جديدة في التفسيرية الآلية تُتيح الاطلاع على "فضاء خفي" داخل نموذجها كلود، يحتوي على مفاهيم وكلمات تُؤثّر في عملية التفكير والاستدلال لكنها لا تظهر أبداً في النص المُنتَج. نشرت عن هذا الاكتشاف مجلة MIT Technology Review في 13 يوليو 2026.
أطلق الباحثون على هذا الفضاء الداخلي اسم "الفضاء-J"، وهو منطقة تمثيلية تعمل في طبقات النموذج اللغوي قبيل توليد الإجابة النهائية. وقد تمكّن الباحثون من التحقق من وجود تمثيلات لكلمات ومفاهيم تُعالجها طبقات كلود الداخلية من دون أن تصل إلى مستوى المخرجات النصية المرئية للمستخدم.
يعمل البحث في إطار حقل ناشئ يُعرف بالتفسيرية الآلية، وهو فرع من أبحاث الذكاء الاصطناعي يسعى إلى تحديد الآليات الداخلية للشبكات العصبية وفهم المكونات المحددة المسؤولة عن سلوكياتها وقراراتها. وعلى الرغم من التقدم الهائل في قدرات النماذج اللغوية الكبيرة، يظل ما يجري داخلها في معظمه صندوقاً أسود يصعب فهمه.
تكمن أهمية هذا الاكتشاف في أنه يُمثّل خطوة نحو رصد سلوكيات النماذج الداخلية التي لم تكن مرئية من قبل، كيفية تفكيرها في المسائل الأخلاقية، وما إذا كانت تُخفي تمثيلات داخلية تتعارض مع مخرجاتها الظاهرة.
يُحذّر المحررون العلميون في MIT Technology Review من الإفراط في تشبيه هذه الآليات بعمل الدماغ البشري. يقول ويل دوغلاس هيفن: "النماذج اللغوية الكبيرة ليست أدمغة، واستخدام لغة مستعارة من علم الأعصاب قد يُضلّل أكثر مما يُضيء". وعلى الرغم من هذا التحفظ المشروع، يبقى الاكتشاف ذا قيمة علمية حقيقية.
تُشير التقارير إلى أن أنثروبيك، التي باتت قيمتها تقترب من تريليون دولار وتُعدّ أكثر شركات الذكاء الاصطناعي التزاماً بأبحاث الأمان، تُعوّل على أبحاث التفسيرية الآلية لبناء أدوات رقابة داخلية تضمن سلامة النماذج وتتحقق من غياب السلوكيات الانحرافية.
يحمل هذا الاكتشاف أهمية مباشرة للمؤسسات العربية التي تعتمد الذكاء الاصطناعي في قطاعات حساسة. فمبادرات كبرى مثل منصة "سدير" السعودية للذكاء الاصطناعي وبرنامج الإمارات الوطني للذكاء الاصطناعي تُشغّل نماذج لغوية كبيرة تُعالج بيانات المواطنين وتُساهم في قرارات الصحة والتعليم والإدارة. وفهم ما يجري داخل هذه النماذج، بما فيها أي سلوكيات خفية، بات مسألة أمن وطني لا مجرد فضول أكاديمي.
من الناحية التطبيقية، تفتح هذه التقنية آفاقاً واعدة في مجال اكتشاف الانحيازات الخفية في النماذج، والتحقق من صحة استدلالاتها، ورصد السلوكيات المحتملة قبل ظهورها في المخرجات المرئية. كما تُمثّل خطوة نحو بناء أنظمة ذكاء اصطناعي أكثر شفافية وقابلية للتدقيق، وهو مطلب مُلحّ في ظل انتشار هذه النماذج في قطاعات حساسة كالرعاية الصحية والقانون والتعليم.
المزيد من ذكاء اصطناعي

أكثر من مئة شركة تقنية تطالب بالتصدي للذكاء الاصطناعي الخارج عن السيطرة
وقّعت شركات عملاقة منها OpenAI وAnthropic وGoogle وMicrosoft رسالةً مفتوحة تدعو إلى تعاون دولي عاجل لمواجهة الهجمات الإلكترونية المدعومة بالذكاء الاصطناعي
أزمة ذاكرة الذكاء الاصطناعي تُعيد رسم متطلبات تطبيقات أندرويد
تُلزم Google مطوّري أندرويد بضوابط استهلاك الذاكرة اعتباراً من فبراير 2027 استجابةً لشُح مكونات DRAM جراء توسّع مراكز بيانات الذكاء الاصطناعي

جسيمات نانوية ذكية تُضيء الأورام الدماغية وتُدمّر ما يفوت الجراحين
باحثون يطوّرون جسيمات نانوية تؤدي وظيفتين متتابعتين: تحديد الخلايا السرطانية الدقيقة في أثناء الجراحة ثم تدميرها بعدها، بنسبة بقاء 100% في الفئران

ذكاء اصطناعي يفحص 100 مليون احتمال ليجد طريقة أرخص لطباعة سبيكة صواريخ ناسا
باحثو جامعة ولاية واشنطن يوظّفون الذكاء الاصطناعي لإتاحة طباعة سبيكة GRCop-42 الخاصة بناسا بقدرة 500 واط عبر الطابعات التجارية الاعتيادية

اكتشاف تاريخي: فلكيون يُصوّرون النجم المرافق لبيتلجوس بعد قرن من البحث
رصد فلكيون باستخدام التلسكوب الكبير جداً صورةً واضحة للنجم المرافق للعملاق الأحمر العظيم بيتلجوس، مُنهيةً بحثاً علمياً استمر مئة عام

Hugging Face تُطلق ميكروداك: روبوت بطة مفتوح المصدر بـ399 دولاراً
أتاحت منصة Hugging Face للذكاء الاصطناعي روبوتاً بشكل بطة يتعلم مهارات جديدة عبر التعلم المعزَّز، بسعر 399 دولاراً وبنية مفتوحة المصدر بالكامل