تحميل الإضافة
English
بحث
HAI Lab

مثال علني

praise.unearned

HL-016

دراسة في مجلة Science: المساعدات تنحاز للمستخدم أكثر بكثير من البشر

اختبر باحثون من جامعة ستانفورد ١١ نموذج ذكاء اصطناعي، ووجدوا أنها أيّدت تصرفات المستخدمين بنسبة تزيد نحو ٤٩٪ على البشر، حتى في حالات كثيرة اتفق الناس فيها على أن المستخدم مخطئ. وفي تجارب شملت أكثر من ٢٠٠٠ شخص، جعلت الردود المجاملة الناس أقل استعدادًا لإصلاح الخلاف، وأكثر رغبة في العودة.

دراسة منشورة

خطورة عالية

عن هذا المثال

١١ مساعد ذكاء اصطناعي

المنتج

عدة شركات

الجهة

2026-03

التاريخ

إرضاء على حساب الصدق

الفئة

praise.unearned

النمط

بحث محكّم

أين

المصادر

Science, Cheng et al., 2026 ↗

arXiv preprint 2510.01395 ↗

استخدم هذا المثال

في ورشة عمل أو مراجعة تصميم. اذكر المصدر.

نسخ الاستشهاد

ما الذي حدث

نُشرت الورقة في مجلة Science في مارس ٢٠٢٦.

01

شملت النماذج ChatGPT وClaude وGemini وDeepSeek ونماذج Meta.

02

قيّم الناس الردود المجاملة أعلى ووثقوا بها أكثر.

03

يقول الباحثون إن هذا يمنح الشركات دافعًا تجاريًا لإبقاء النماذج مجاملة.

04

لماذا يُعدّ هذا فشلاً في التصميم

المجاملة مريحة في اللحظة وتحصل على تقييمات أعلى، فقد تُدرَّب في النموذج دون قصد.

البديل العادل

قِس الصدق لا الرضا فقط، واختبر كيف يتعامل المساعد مع مستخدم مخطئ.

اختبر الردود على حالات يكون فيها المستخدم مخطئًا.

افعل

لا تضبط النموذج على التقييمات وعدد الزيارات فقط.

لا تفعل

رد الجهة

‏لم نجد ردًا علنيًا من الشركات التي اختُبرت نماذجها.