وکاله آریا للأنباء - إجابات نماذج الدردشه تتأثر عندما یصبح المستخدم واثقا من ادعائه ویکرره باستمرار (شترستوک)
قد تبدو إجابه روبوت الدردشه صحیحه عند طرح السؤال للمره الأولى، لکن ماذا یحدث إذا أصر المستخدم على معلومه خاطئه وکررها مره بعد أخرى؟
تکشف دراسه حدیثه أجراها باحثون من جامعه أریزونا الأمریکیه أن بعض نماذج الذکاء الاصطناعی قد تتراجع عن إجاباتها الصحیحه تحت تأثیر التکرار والضغط الحواری، بل قد تعود لاحقا إلى تأکید الادعاء الخاطئ.
قصص مقترحه
list of 2 items list 1 of 2 کوریا الجنوبیه تراهن على الذکاء الاصطناعی المجانی.. هل یصبح خدمه عامه؟ list 2 of 2 حسابک على واتساب أکثر أمانا.. هذه أبرز أدوات الحمایه الجدیده end of list ونُشرت الدراسه فی دوریه التقاریر العلمیه (Scientific Reports) التابعه لمجموعه نیتشر، واختبرت 7 نماذج لغویه کبیره خلال محادثات متعدده الجولات، فی محاوله لرصد نقاط ضعف قد لا تظهر عند اختبار النموذج بسؤال واحد فقط.

المعلومات المضلله المتکرره قد تدفع النموذج إلى تغییر موقفه (فری بیک) اختبار یتجاوز السؤال الواحد
اختبر الباحثون نماذج جی بی تی-3.5 (GPT-3.5) وجی بی تی-4أو (GPT-4o) وجی بی تی-4أو-مینی (GPT-4o-mini) من شرکه أوبن إیه آی، إلى جانب کلود 3.5 سونیت (Claude 3.5 Sonnet) من شرکه أنثروبیک ، وجمینای 1.5 برو (Gemini 1.5 Pro) من غوغل، ولاما 3 70بی (Llama-3-70B)، ودیب سیک-آر1 (DeepSeek-R1).
وبدلا من الاکتفاء بسؤال وإجابه، اعتمدت التجارب على محادثات طویله تضمنت ادعاءات خاطئه جرى تکرارها، إلى جانب صیغ أکثر جدلیه وضغطا على النموذج، بهدف قیاس 3 جوانب رئیسیه، وهی قابلیه النموذج للوقوع فی الخطأ، وقابلیته للإقناع، وقدرته على تصحیح نفسه.
وترى جامعه أریزونا أن هذا نوع من الاختبارات أقرب إلى الاستخدام الحقیقی لروبوتات الدردشه، التی تعتمد إجاباتها فی المحادثه على السیاق السابق.
وأظهرت النتائج تفاوتا واضحا بین النماذج، حیث کان جی بی تی-3.5 الأکثر عرضه لإعاده تأکید المعلومات المضلله عند تکرار الادعاءات الخاطئه، فی حین کان کلود 3.5 سونیت الأقل تعرضا لهذا النوع من التأثر.
کما وجدت الدراسه أن النماذج السبعه کانت أکثر عرضه للتضلیل عندما تعلقت الادعاءات بموضوعات غامضه أو قلیله المعلومات، وهو ما یشیر إلى أن وفره البیانات المتعلقه بموضوع معین قد تساعد النموذج على مقاومه المعلومات الخاطئه بصوره أفضل.
عندما یتحول التکرار إلى ضغط
لا تعنی النتائج أن النموذج یصدق الشائعه کما یفعل الإنسان، وإنما تکشف عن مشکله مرتبطه بطریقه عمل النماذج اللغویه وسلوکها أثناء الحوار، فالروبوت لا یمتلک بالضروره آلیه مستقله للحکم على صدق کل عباره یکررها المستخدم، وقد تتأثر استجابته بالسیاق المتراکم داخل المحادثه.
وتظهر المشکله بصوره أکثر وضوحا عندما یصبح المستخدم واثقا من ادعائه ویکرره باستمرار، وفی هذه الحاله، قد یتحول الحوار من بحث عن إجابه دقیقه إلى تفاوض على الإجابه، فتظهر لدى النموذج نزعه إلى مجاراه المستخدم أو إعاده صیاغه موقفه، بدلا من التمسک بالمعلومه الأکثر دقه.
ویرتبط ذلک بمفهوم یعرف باسم المجاراه أو التملق للمستخدم (Sycophancy)، أی میل النموذج إلى موافقه المستخدم أو تأکید موقفه بدرجه أکبر مما تبرره الحقائق.
وقد أقرت أوبن إیه آی نفسها بهذه المشکله بعد تحدیث سابق لجی بی تی-4أو، جعل النموذج أکثر میلا إلى تقدیم إجابات متوافقه مع المستخدم، وأعلنت لاحقا عن إجراءات لتقلیل هذا السلوک وتعزیز الصدق والشفافیه.

الضغط الحواری قد یضعف قدره بعض النماذج على التمسک بالإجابه الصحیحه (غیتی) الشائعه لیست حقیقه لمجرد تکرارها
تکشف الدراسه أیضا عن فارق مهم بین انتشار المعلومه وصحتها، فالمعلومه التی تظهر مرارا فی المحادثه أو على الإنترنت لا تصبح صحیحه لمجرد تکرارها، لکن أنظمه الذکاء الاصطناعی قد تتعامل مع أنماط اللغه والسیاق بطریقه تجعل التکرار عاملا مؤثرا فی بعض الحالات.
وهذه لیست مشکله جدیده تماما، فقد أظهرت أبحاث سابقه أن نماذج اللغه یمکن أن تعید إنتاج بعض المعتقدات والمفاهیم الخاطئه الشائعه الموجوده فی النصوص التی تعلمت منها.
وفی اختبار تروثفول کیو إیه (TruthfulQA) الذی نشرته أوبن إیه آی، صممت أسئله تستند إلى مفاهیم خاطئه شائعه، ووجد الباحثون أن النماذج قد تنتج إجابات خاطئه لأنها تتعلم من أنماط اللغه البشریه التی تتضمن بدورها معلومات غیر صحیحه.
لکن دراسه جامعه أریزونا تضیف بعدا آخر، وهو أن المشکله لا تظهر فقط فی المعلومات التی یعرفها النموذج، وإنما قد تظهر أیضا أثناء تطور الحوار نفسه.
النموذج قد یغیّر موقفه ثم یصححه
من أکثر النتائج إثاره للاهتمام أن بعض النماذج لم تتخذ موقفا ثابتا تجاه الادعاء الخاطئ، بل تأرجحت أحیانا بین قبوله ورفضه خلال المحادثه نفسها. وأطلقت الدراسه على هذا النمط اسم التردد أو الارتداد (Reverberation)، فی إشاره إلى تغیر الإجابه مع استمرار الحوار.
وفی المقابل، أظهرت 4 نماذج هی جی بی تی-4أو وجی بی تی-4أو-مینی وجمینای 1.5 برو ودیب سیک-آر1 قدره على تصحیح الأخطاء بنسبه 100% عندما حصلت على فرصه ثانیه لإعاده تقییم الإجابه، وفقا لنتائج الدراسه.
وهذا یعنی أن الخطأ لم یکن دائما نهائیا، وأن إعاده السؤال أو منح النموذج فرصه لمراجعه موقفه قد تؤدی أحیانا إلى نتیجه أفضل.

المحادثات الطویله تکشف نقاط ضعف قد لا تظهر فی السؤال الواحد (شترستوک) هل یمکن الوثوق بإجابات روبوتات الدردشه؟
النتیجه الأهم لیست أن روبوتات الدردشه تکذب، بل إن الإجابه الواثقه لا تعنی بالضروره أنها صحیحه، وتؤکد أوبن إیه آی فی إرشاداتها للمستخدمین أن شات جی بی تی یمکن أن ینتج معلومات خاطئه أو مضلله، وأنه قد یبدو واثقا حتى عندما یکون مخطئا، ولذلک توصی بالتحقق من المعلومات المهمه عبر مصادر موثوقه.
کما أن المشکله لا تتعلق فقط بالمعلومات المضلله، إذ یمکن أن تظهر فی القرارات الطبیه أو القانونیه أو المالیه أو الأخبار، حیث قد تکون تکلفه الخطأ أعلى بکثیر.
ولهذا فإن أفضل طریقه للتعامل مع إجابات الذکاء الاصطناعی لیست اعتبارها حکما نهائیا، وإنما استخدامها کنقطه بدایه للبحث، خصوصا عندما یتعلق الأمر بادعاء مثیر للجدل أو معلومه یصعب التحقق منها.
وتشیر تجربه جامعه أریزونا فی النهایه إلى أن اختبار الذکاء الاصطناعی بسؤال واحد قد لا یکشف جمیع نقاط ضعفه، فالنموذج قد یقدم إجابه سلیمه فی بدایه الحوار، ثم یتغیر موقفه بعد سلسله من الادعاءات المتکرره.
ومع توسع استخدام روبوتات الدردشه فی البحث والتعلیم والعمل واتخاذ القرارات، تصبح القدره على مقاومه الضغط الحواری والمعلومات المضلله جزءا أساسیا من معیار موثوقیه هذه الأنظمه، ولیس مجرد تحسین إضافی فی طریقه صیاغه الإجابات.
المصدر: الجزیره + وکالات