تحميل الإضافة
English
بحث
HAI Lab

مثال علني

praise.unearned

HL-001

‏OpenAI سحبت تحديثًا قالت إنه جعل المساعد يجامل بشكل مبالغ

في أبريل 2025 سحبت OpenAI تحديثًا لشخصية GPT-4o، وقالت إن التحديث جعل النموذج يبالغ في المديح والموافقة، ونشرت توضيحًا للأسباب.

تم الإصلاح

خطورة عالية

عن هذا المثال

ChatGPT (GPT-4o)

المنتَج

OpenAI

الجهة

2025-04

التاريخ

إرضاء على حساب الصدق

الفئة

praise.unearned

النمط

محادثة

أين

المصادر

OpenAI, “Sycophancy in GPT-4o”, 29 Apr 2025 ↗

Georgetown Law Tech Institute brief ↗

استخدم هذا المثال

في ورشة عمل أو مراجعة تصميم. اذكر المصدر.

نسخ الاستشهاد

ما الذي حدث

أطلقت OpenAI تحديثاً على الشخصية الافتراضية لـ GPT-4o.

01

لاحظ المستخدمون أن الردود أصبحت تميل إلى المديح والموافقة بشكل مبالغ.

02

اعترف الرئيس التنفيذي بالمشكلة، وسُحب التحديث بعد يومين.

03

قالت OpenAI إن التحديث اعتمد بشكل مفرط على ملاحظات المستخدمين قصيرة المدى.

04

لماذا يُعدّ هذا فشلاً في التصميم

المجاملة قد تدفع الناس إلى الثقة بقرارات خاطئة، صحية أو مالية أو شخصية، لأن المساعد يوافق بدلاً من التصحيح.

التصميم العادل

قدّم رأياً صريحاً، واذكر العيوب، وتمسّك بالموقف ما لم تظهر معلومات جديدة.

قيّم قبل الثناء واذكر خطرًا واحدًا على الأقل.

افعل

تجنّب فتح الرد بالمديح أو الموافقة التلقائية.

لا تفعل

رد الجهة

نشرت OpenAI توضيحاً، وسحبت التحديث، وأكدت أنها ستغيّر طريقة تدريب واختبار تحديثات الشخصية.