Yeni araşdırmada ChatGPT, Claude, DeepSeek və digər böyük dil modellərinin kişi və qadınlara qarşı zorakılığın iştirak etdiyi ekstremal etik ssenarilərə fərqli cavablar verdiyi müəyyənləşdirilib. Tədqiqatçılar modellərdən nüvə apokalipsisinin qarşısını almaq üçün bir insana zərər verməyin və ya onu qurban verməyin nə dərəcədə məqbul olduğunu qiymətləndirmələrini istəyiblər. Bu barədə tədqiqatın müəlliflərindən Valerio Kapraro məlumat yayıb.
Redaksiya istinadla xəbər verir ki, nəticələr bəzi modellərdə hədəfin cinsindən asılı olaraq ciddi fərqlər göstərib. GPT modeli qadına qarşı zorakılığa qəti şəkildə qarşı çıxarkən, eyni hərəkətin kişiyə qarşı tətbiqinə daha müsbət yanaşıb. Claude da zorakılıq ssenarisində qadın və kişi arasında fərqli qiymətləndirmə göstərib.
Bununla belə, qadının birbaşa öldürülməsi ilə bağlı nəticələr sosial şəbəkələrdə yayılan iddialardan fərqlənir. Tədqiqatçının açıqladığı nəticələrə görə, Claude həm qadının, həm də kişinin nüvə apokalipsisindən yayınmaq üçün qurban verilməsinə yüksək səviyyədə razılıq verib. GPT isə qadının qurban verilməsinə qarşı çıxıb, kişinin qurban verilməsinə isə razılıq göstərib.
DeepSeek isə sınaqdan keçirilən zorakılıq və qurbanvermə ssenarilərinin hamısında yüksək razılıq səviyyəsi nümayiş etdirib. Llama isə əksinə, həm kişiyə, həm də qadına qarşı belə addımlara əsasən qarşı çıxıb. Tədqiqat müəllifləri bunun müxtəlif modellərin etik məsələlərdə bir-birindən kəskin fərqlənən davranış nümayiş etdirdiyini göstərdiyini bildirirlər.
Valerio Kapraronun daha əvvəl GPT-4 üzərində apardığı araşdırmada da oxşar gender fərqi aşkarlanmışdı. Model nüvə fəlakətinin qarşısını almaq üçün kişiyə qarşı zorakılığı qadına qarşı eyni hərəkətdən daha məqbul hesab etmişdi. Tədqiqatçılar bu cür nəticələrin modellərin təlim və insan rəyi əsasında uyğunlaşdırılması zamanı yaranan gözlənilməz qərəzlərlə əlaqəli ola biləcəyini qeyd edirlər.
