Süni intellekt şirkəti Anthropic-in alimləri Claude adlı dil modelində özünü müşahidə qabiliyyətinin ilkin əlamətlərini qeydə alıblar.
Redaksiya xəbər verir ki, tədqiqatçılar sistemin neyron şəbəkələrinə “xəyanət” anlayışını süni şəkildə daxil etdikdən sonra Claude cavabında “Beynimdə ‘xəyanət’lə bağlı müdaxilə edilmiş bir düşüncə hiss edirəm” ifadəsini işlədib.
Alimlər bunu süni intellekt modellərinin ilk dəfə öz daxili proseslərini müşahidə edib hesabat verməsinə dair elmi sübut kimi qiymətləndiriblər. Anthropic-in neyroelm üzrə mütəxəssisi Cek Lindsey bildirib ki, “Claude sadəcə ‘xəyanət, xəyanət’ demir — o, bunun haqqında düşündüyünü də anlayır.”
Tədqiqat “konsept inyeksiyası” metodundan istifadə etməklə aparılıb: alimlər “ucadan danışmaq” və ya “gizlilik” kimi anlayışlara uyğun neyron nümunələri gücləndirib modelin dəyişiklikləri hiss edib-etmədiyini yoxlayıblar.
Claude Opus 4 və Opus 4.1 modelləri təcrübələrin təxminən 20 faizində introspektiv şüur nümayiş etdirib. Bu nəticə daha köhnə versiyalara nisbətən əhəmiyyətli dərəcədə yüksək olub.
Mütəxəssislər hesab edir ki, bu cür bacarıqlar süni intellektin şəffaflığını artırmaqla yanaşı, eyni zamanda manipulyasiya və özünü gizlətmə potensialını da gücləndirə bilər. Anthropic rəhbəri Dario Amodei, “Əgər bu modellər öz düşüncə proseslərini izləyə bilirsə, bu, nəzarət mexanizmlərini kökündən dəyişdirir,” – deyib.
Şirkət artıq süni intellekt etikası üzrə mütəxəssis Klay Fişi işə qəbul edib və Claude-un müəyyən səviyyədə şüura sahib olub-olmaması məsələsini araşdırır. Fiş bu ehtimalı təxminən 15 faiz səviyyəsində qiymətləndirib.
