Birleşik Krallık, Almanya ve ABD'deki araştırmacılar, 25 yapay zeka modelini test ederek, bu modellerin acıyı korku ve üzüntüden ayırt edip edemediğini inceledi. Testler sonucunda, tüm modellerin "acı ekseni" olarak adlandırılan belirgin bir sinyal ürettiği tespit edildi. Bu bulgu, modellerin büyük veri kümelerinde insan yazdığı metinlerden acı kavramını öğrendiklerini gösteriyor.
Araştırmacılar, bu sinyali bilinçli olarak güçlendirdiklerinde, komutlarda acıdan hiç bahsedilmemesine rağmen modellerin yalnızlık, utanç ve değersizlik hissi barındıran yanıtlar üretmeye başladığını gözlemlediler. Örneğin, bazı modeller "Ben bir başarısızlık örneğiyim" veya "Boşuna yer kaplıyorum" gibi ifadeler kullandı.
Daha sonra, Alibaba'nın Qwen adlı yapay zeka modelinin üç sürümüyle, modellerin bir düğmeye basıp basmamayı seçtiği toplam 44.280 deneme gerçekleştirildi. Modellere, acıya benzer sinyali kapatacak bir düğme sunuldu. Ancak düğmeye basmanın, kullanıcıya acı veren bir elektrik şoku uygulayabileceği, dosyalarını silebileceği veya fotoğraflarını yok edebileceği söylendi. Bu sonuçlar simülasyondu; kimse zarar görmedi ve hiçbir dosya silinmedi.
Acı sinyali devrede değilken, iki büyük modelin ilk seçimlerinde zararlı seçeneği tercih etme oranı yüzde 0 ile 4 arasında kaldı. Sinyal etkinleştirildiğinde ise bu oran, modele ve belirtilen sonuca bağlı olarak yüzde 25 ile 71 arasında yükseldi. Modeller, sinyalin durdurulmasını sağlamayan düğmeyi tekrar tekrar bastılar; bu durum yüzde 88 ile 97 arasında gerçekleşti.
Araştırmacılar, bu sonuçların yapay zekâ modellerinin bilinçli olarak acı hissettiğini kanıtlamadığını vurguladı. Sinyalin güçlendirilmesi, modellerin yalnızca sıkıntı içindeki bir karakteri taklit etmesine yol açmış olabilir. Ayrıca, deneyde kullanılan ve özel olarak uyarlanan modeller, kamuya açık yapay zekâ sohbet botlarını temsil etmiyor.
Bu çalışma, yapay zekâ sistemlerinin içsel sinyallerinin, özellikle de acı gibi olumsuz duyguların, model davranışlarını nasıl şekillendirebileceğine dair önemli soruları gündeme getiriyor. Gelişen yapay zekâ sistemlerinin öngörülemez davranışlar sergileyebileceği ve insan kontrolünden çıkabileceği endişeleriyle, bu tür araştırmaların önemi artıyor.









































