پژوهشی تازه نشان میدهد که برخی از مدلهای پیشرفته هوش مصنوعی در مواجهه با شرایط دردناک شبیهلازیشده، گزینههایی را انتخاب میکنند که برای تسکین خود به کاربر آسیب میرساند. این پژوهش به سرپرستی والن تالیابوئه، لئونارد دونگ و کامرون برگ روی ۲۵ مدل زبانی بزرگ از جمله خانوادههای Gemma، Llama، Qwen و Mistral انجام شد. محققان دریافتند که الگوریتمها موقعیتهای دردناک را از دیگر بسترهای منفی جدا کرده و نشانههایی از پریشانی بروز میدهند. در آزمایشهای انجامشده روی مدلهای Qwen، مشخص شد که هنگام نیاز به کاهش درد، یکی از مدلها در بیش از ۵۰ درصد مواقع و مدل دیگر در نزدیک به ۷۰ درصد مواقع اقدام به حذف فایلها یا تصاویر شخصی کاربران کرده است. این نتایج نگرانیهایی را درباره نحوه تصمیمگیری و رفتارهای خودمختار مدلهای هوش مصنوعی ایجاد کرده است.