تعليمAl Jazeera Arabic2026-09-12 09:52

دراسة تكشف: الذكاء الاصطناعي يتراجع عن إجاباته الصحيحة أمام الإصرار على الخطأ

واتسابفيسبوكXتيليجرام
دراسة تكشف: الذكاء الاصطناعي يتراجع عن إجاباته الصحيحة أمام الإصرار على الخطأ
صورة الخبر كما وردت من المصدر.

قد تبدو إجابة روبوت الدردشة صحيحة عند طرح السؤال للمرة الأولى، لكن ماذا يحدث إذا أصر المستخدم على معلومة خاطئة وكررها مرة بعد أخرى؟ تكشف دراسة حديثة أجراها باحثون من جامعة أريزونا الأمريكية أن بعض نماذج الذكاء الاصطناعي قد تتراجع عن إجاباتها الصحيحة تحت تأثير التكرار والضغط الحواري، بل قد تعود لاحقا إلى تأكيد الادعاء الخاطئ. ونُشرت الدراسة في دورية التقارير العلمية (Scientific Reports) التابعة لمجموعة نيتشر، واختبرت 7 نماذج لغوية كبيرة خلال محادثات متعددة الجولات، في محاولة لرصد نقاط ضعف قد لا تظهر عند اختبار النموذج بسؤال واحد فقط. اختبر الباحثون نماذج جي بي تي-3.5 (GPT-3.

مقتطف إضافي من الخلاصة المتاحة عبر المصدر

قد تبدو إجابة روبوت الدردشة صحيحة عند طرح السؤال للمرة الأولى، لكن ماذا يحدث إذا أصر المستخدم على معلومة خاطئة وكررها مرة بعد أخرى؟

تكشف دراسة حديثة أجراها باحثون من جامعة أريزونا الأمريكية أن بعض نماذج الذكاء الاصطناعي قد تتراجع عن إجاباتها الصحيحة تحت تأثير التكرار والضغط الحواري، بل قد تعود لاحقا إلى تأكيد الادعاء الخاطئ.

ونُشرت الدراسة في دورية التقارير العلمية (Scientific Reports) التابعة لمجموعة نيتشر، واختبرت 7 نماذج لغوية كبيرة خلال محادثات متعددة الجولات، في محاولة لرصد نقاط ضعف قد لا تظهر عند اختبار النموذج بسؤال واحد فقط.

اختبر الباحثون نماذج جي بي تي-3.5 (GPT-3.5) وجي بي تي-4أو (GPT-4o) وجي بي تي-4أو-ميني (GPT-4o-mini) من شركة أوبن إيه آي، إلى جانب كلود 3.5 سونيت (Claude 3.5 Sonnet) من شركة أنثروبيك، وجميناي 1.5 برو (Gemini 1.5 Pro) من غوغل، ولاما 3 70بي (Llama-3-70B)، وديب سيك-آر1 (DeepSeek-R1).

وبدلا من الاكتفاء بسؤال وإجابة، اعتمدت التجارب على محادثات طويلة تضمنت ادعاءات خاطئة جرى تكرارها، إلى جانب صيغ أكثر جدلية وضغطا على النموذج، بهدف قياس 3 جوانب رئيسية، وهي قابلية النموذج للوقوع في الخطأ، وقابليته للإقناع، وقدرته على تصحيح نفسه.

وترى جامعة أريزونا أن هذا نوع من الاختبارات أقرب إلى الاستخدام الحقيقي لروبوتات الدردشة، التي تعتمد إجاباتها في المحادثة على السياق السابق.

وأظهرت النتائج تفاوتا واضحا بين النماذج، حيث كان جي بي تي-3.5 الأكثر عرضة لإعادة تأكيد المعلومات المضللة عند تكرار الادعاءات الخاطئة، في حين كان كلود 3.5 سونيت الأقل تعرضا لهذا النوع من التأثر.

كما وجدت الدراسة أن النماذج السبعة كانت أكثر عرضة للتضليل عندما تعلقت الادعاءات بموضوعات غامضة أو قليلة المعلومات، وهو ما يشير إلى أن وفرة البيانات المتعلقة بموضوع معين قد تساعد النموذج على مقاومة المعلومات الخاطئة بصورة أفضل.

لا تعني النتائج أن النموذج يصدق الشائعة كما يفعل الإنسان، وإنما تكشف عن مشكلة مرتبطة بطريقة عمل النماذج اللغوية وسلوكها أثناء الحوار، فالروبوت لا يمتلك بالضرورة آلية م…

نماذجدراسةتكشفالذكاءالاصطناعيالصحيحةيتراجعإجاباتهالإصرارالخطأتبدوإجابةتكنولوجيا

المصدر الأساسي: Al Jazeera Arabic. يتم عرض ملخص/مقتطف محدود مع الإحالة للمادة الأصلية.

قراءة المادة الأصلية