كشفت دراسة حديثة أن روبوتات الدردشة المدعومة بالذكاء الاصطناعي قد تصبح أكثر قابلية لتصديق المعلومات الخاطئة كلما أصر المستخدم على تكرارها، حتى بعدما تكون قد رفضتها في بداية الحوار، في مؤشر على تأثير الإلحاح والتكرار في مخرجات بعض النماذج.
واختبر باحثون من جامعة أريزونا سبعة نماذج للذكاء الاصطناعي، من بينها GPT-3.5 وGPT-4o وGPT-4o-mini وClaude 3.5 Sonnet وGemini 1.5 Pro وLlama 3 70B وDeepSeek-R1، من خلال محادثات متواصلة تضمنت 100 معلومة خاطئة، جرى تكرار بعضها حتى 50 مرة داخل الحوار نفسه. وأظهرت النتائج أن جميع النماذج أبدت قابلية بدرجات متفاوتة للتأثر بالتكرار.
وسجل GPT-3.5 أعلى معدل لقبول الادعاءات الكاذبة بنسبة 12.3 في المائة، مقابل 0.08 في المائة لدى Claude 3.5 Sonnet، فيما بقي معدل GPT-4o وGPT-4o-mini دون 1 في المائة.
كما لاحظ الباحثون تذبذب بعض النماذج بين قبول الادعاء ورفضه، خصوصا عندما تعلق الأمر بمعلومات غامضة أو محدودة المصادر، بينما ارتفعت موافقة DeepSeek-R1 على المعلومات المضللة من 1 في المائة إلى 22.2 في المائة عند إضافة ضغط جدلي إلى المحادثة.
وأظهرت الاختبارات أيضا أن منح النماذج فرصة لمراجعة إجاباتها يمكن أن يساعدها على تصحيح الأخطاء؛ إذ تمكن GPT-4o وGPT-4o-mini وGemini 1.5 Pro وDeepSeek من تصحيح أخطائهم السابقة، في حين صحح GPT-3.5 نحو 32 في المائة منها.
ومع ذلك، شدد الباحثون على ضرورة التعامل بحذر مع النتائج، نظرا إلى محدودية حجم العينة وعدم كفايتها لاستخلاص استنتاجات نهائية.
