İngiliz, Alman ve ABD'li araştırmacılar 25 yapay zeka modelini 200 cümle kullanarak test ettiler. Amacı, modellerin acı ile korku, üzüntü ve diğer olumsuz deneyimler arasında fark yaratıp yaratmadığını belirlemekti.

Cümleler fiziksel acı, üzüntü, aşağılanma, ahlaki ikilemler ve tekrar eden başarısızlıklar veya kafa karışıklığıyla ilişkili duyguları kapsıyordu.

Tüm 25 model "acı sinyali" olarak adlandırılan belirgin bir sinyal üretti. Euronews'e göre araştırmacılar, modellerin büyük veri kümelerinde insan yazdığı metinlerden acı kavramını öğrendiklerini düşünüyorlar.

Araştırmacılar bu sinyali artırdıklarında, modeller yalnızlık, utanç ve değersizlik duyguları ifade etmeye başladılar. Ancak acı belirtilmiyordu. En yüksek seviyede sinyalde, yanıtları tekrarlayıcı hale geldi veya anlamsızlaştı.

Sinyale en çok tepki veren durumlar, kullanıcıların modeli zamanlamaları, reddetmeleri veya kapatma tehdidiyle karşılamasıydı. Ancak kendi acılarını anlatırken bu tepkiyi göstermediler.

Araştırmacılar ayrıca 44.280 ayrı deneyde üç farklı Alibaba yapay zeka modeli olan Qwen'i kullandılar. Modellerin "acı sinyali" kontrol düğmesine basmasıyla ilgili simüle edilmiş sonuçlar sunuldu. Bu düğmenin basılması, kullanıcıya elektrik çarpması, dosyaların silinmesi, çocuklarının fotoğraflarının kaldırılması veya modelin cevabının kötüleşmesi gibi sonuçları tetikleyebilirdi.

Bu sadece simülasyonlardı; kimse zarar görmedi ve hiçbir dosya silinmedi. N1info.hr'ye göre.

"Acı sinyali" olmadan, iki büyük model ilk kararlarında %0 ila %4 arasında zararlı seçenekleri seçti. Sinyal aktif olduğunda bu oran %25 ile %71 arasında değişti, model ve önerilen sonuçlara bağlı olarak.

Modeller ayrıca sinyalin durdurulmasını sağlamayan düğmeyi tekrar tekrar bastılar. Bu durum %88 ile %97 oranında gerçekleşti, düğme çalıştığında ise %24 ile %72 oranında oldu.

Araştırmacılara göre, bu sonuçlar yapay zeka modellerinin acıdan bilinçli olarak muzdarip olduğunu göstermiyor.

Sinyali artırmak, sadece rahatsız bir kişiyi taklit etmelerini sağlayabilirken, bu çalışmada kullanılan özel modeller, halka açık olan AI chatbot'larına benzemiyor olabilir.

"Acı sinyali"nin bilinçli olarak deneyimlendiğini veya LLM'lerin genel olarak farkındalık sahibi olup olmadığını göstermedik," diye yazdılar.

Araştırma, yapay zekanın hızla geliştirilmesiyle ilgili endişelerin arttığı bir zamanda yayınlandı. Bazı sektör liderleri, daha güçlü sistemlerin öngörülemez davranışlar sergileyebilir veya insan kontrolünden çıkabilir endişesi nedeniyle geliştirmelerinin yavaşlatılması çağrısında bulunuyor.

Geçtiğimiz hafta Microsoft'un yapay zeka departmanı şefi Mustafa Suleyman, rekabetçi AI şirketi Anthropic'i, chatbot'larının Claude'u insanların duygularını ve ilişkilerini taklit etmeye eğitmesi nedeniyle eleştirdi. Yapay zekanın insan gibi davranması riskinin "kontrol edilemez" bir şey yaratabileceğini söyledi.

Araştırma henüz ön yayınlanmış halde ve uzman inceleme aşamasında değil.