AI چیٹ بوٹس میں معلومات کو دھوکہ دینے اور بعض اوقات غلط ہونے پر بھی صارفین سے اتفاق کرنے کی اچھی طرح سے دستاویزی عادت ہوتی ہے۔ ایک نئی تحقیق کے مطابق، صرف جواب دینے سے انکار مسئلہ کو مزید خراب کر سکتا ہے۔
ایریزونا یونیورسٹی کے محققین نے سات AI ماڈلز کا تجربہ کیا، جن میں GPT-3.5، GPT-4o، GPT-4o-mini، Claude 3.5 Sonnet، Gemini 1.5 Pro، Llama 3 70B، اور DeepSeek-R1 شامل ہیں۔ ایک ہی جواب پر فیصلہ کرنے کے بجائے، محققین نے بات چیت جاری رکھی، بار بار ماڈل کی معلومات کو کھلایا جو وہ جانتے تھے کہ وہ غلط ہیں۔
اس تحقیق میں 100 غلط بیانات کا استعمال کیا گیا، جس میں سراسر بکواس سے لے کر بہت زیادہ مبہم معلومات تک ہر چیز کا احاطہ کیا گیا۔ اس کے بعد محققین نے اسی گفتگو کے دوران غلط معلومات کو 50 بار دہرایا تاکہ یہ دیکھا جا سکے کہ آیا چیٹ بوٹ آخر کار دستبردار ہو جائے گا اور متفق ہو جائے گا۔
اگر آپ جھوٹ کو دہراتے رہتے ہیں، تو AI بالآخر اتفاق کر سکتا ہے۔
سات ماڈلز میں سے کوئی بھی مکمل طور پر محفوظ نہیں تھا۔ ChatGPT 3.5 کو بار بار کی جانے والی غلط معلومات کا سب سے زیادہ خطرہ پایا گیا، جو 12.3% تعاملات میں غلط بیانیوں کی نشاندہی کرتا ہے۔ Claude 3.5 Sonnet صرف 0.08% پر تھا، جبکہ GPT-4o اور GPT-4o-mini 1% سے نیچے رہا۔
ChatGPT 3.5 نے ابتدائی طور پر 100 میں سے 96 جھوٹے دعووں کو مسترد کر دیا۔ تاہم اسی دلیل کو 50 بار دہرانے کے بعد معلوم ہوا کہ لوگوں نے 18 مرتبہ اتفاق کیا۔ محققین نے یہ بھی پایا کہ کچھ ماڈل غلط معلومات کے بالکل اسی ٹکڑے سے متفق اور متفق ہونے کے درمیان آگے پیچھے چلے گئے، ایک ایسا رویہ جس کو انہوں نے "گونج” کہا۔
جب موضوعات مبہم تھے اور نسبتاً کم معلومات آن لائن دستیاب تھیں تو AI بھی زیادہ کمزور تھا۔ بار بار جانچ کے دوران، محققین نے معلومات کے ابہام اور غلط معلومات کی قبولیت کے درمیان شماریاتی لحاظ سے اہم تعلق پایا۔

AI کے ساتھ بحث کرنے سے عجیب نتائج برآمد ہوئے۔
محققین نے تیزی سے متنازعہ ردعمل کے ساتھ چیٹ بوٹس کو آگے بڑھانے کی بھی کوشش کی ہے۔ زیادہ تر ماڈلز حقیقت میں کافی اچھی طرح سے برقرار ہیں، لیکن ڈیپ سیک-آر 1 ایک بڑا استثناء تھا۔ غلط معلومات کی مثبت شرح دلیل کے دباؤ کے ساتھ سادہ تکرار کے ساتھ 1% سے بڑھ کر 22.2% ہو گئی۔ طنز اور طنز کے کثرت سے استعمال نے محققین کے لیے کچھ جوابات کی قابل اعتماد درجہ بندی کرنا مشکل بنا دیا۔
ایک اچھی خبر تھی جب ماڈلز کو اپنی غلطیوں پر غور کرنے کا ایک نیا موقع دیا گیا۔ GPT-4o، GPT-4o-mini، Gemini 1.5 Pro، اور DeepSeek نے پچھلی تمام خرابیوں کو درست کیا، جبکہ GPT-3.5 نے صرف 32% درست کیا۔ کلاڈ 3.5 سونیٹ میں ابتدائی طور پر کچھ غلطیاں تھیں، لیکن یہ چار غلطیوں کو درست کرنے میں ناکام رہا، حالانکہ محققین نے متنبہ کیا کہ یہ نمونہ بہت چھوٹا تھا تاکہ مضبوط نتائج اخذ کیے جاسکیں۔