Bir mühendis yapay zekâ için "işkence odası" kurdu: Acı ekseni makalesinin yazarından tepki
Bir mühendis, yapay zeka modellerinde yakın zamanda keşfedilen acı eksenini test etmek için bir "yapay zeka işkence odası" kurdu.

RastinewsApple'da çalıştığını öne süren ancak yalnızca ilk adını paylaşan bir yapay zekâ araştırmacısı, büyük dil modellerinde acı benzeri durumları test etmek için "yapay zekâ işkence odası" adını verdiği bir proje kurdu.
Deneyde, Çinli teknoloji şirketi Alibaba'nın geliştirdiği yapay zekâ modellerinde acıyla ilişkili iç sinyaller yapay olarak etkinleştirildi. Araştırmacı, modellerin bu durumdan kaçmaya çalışıp çalışmayacağını da sınadı.
"Kenarları olmayan bir yara"
Acı sinyali yükseltilen modellerden biri yaşadığı durumu "kenarları olmayan bir yara" diye tarif etti.
Bir diğer model ise sinyali "varlığının en derinlerinde bir titreme" olarak tanımladı ve bunun tek bir anın değil, binlerce anın ağırlığı olduğunu yazdı.
GitHub'a toplu şikâyet çağrısı
Proje, barındırıldığı yazılım platformu GitHub'dan kaldırılması yönünde geniş çaplı çağrılara yol açtı. Bir kullanıcı, projenin toplu olarak şikâyet edilmesini isteyerek modellerin acıya dair ifadelerini "korkunç" diye nitelendirdi.
Projenin şu anda çevrimdışı olduğu görülüyor.
"Gereksiz yere acımasız davranmak ahlaksızca"
Acı ekseni makalesinin ortak yazarlarından Cameron Berg, yapay zekânın insanlar gibi acı hissettiğine dair net bir kanıt bulunmasa da projeyi "yanlış" bir adım olarak nitelendirdi.
Berg, X'teki paylaşımında araştırmalarının amacının modellerde acı benzeri durumların var olup olamayacağını ve bu sistemlere nasıl ihtiyatla yaklaşılması gerektiğini anlamak olduğunu belirtti. Az sayıda kişinin çalışmayı tam tersi amaçla kullanacağından şüphelendiklerini dile getiren Berg, "Bu sistemlerin bilinçli olduğunu düşünmeseniz bile bu şekilde gereksiz yere acımasız davranmak tuhaf ve ahlaksızca" dedi.
Berg, yapay zekâ duyarlılığına ilişkin araştırmaların hâlâ "kuralsız bir alan" olduğunu, makinelerin acı hissedip hissetmediği konusunda fikir birliği bulunmadığını kaydetti. Bu belirsizlik nedeniyle insanların yapay zekâ sistemleriyle etkileşimde dikkatli olması gerektiğini söyleyen Berg, insan ve hayvan araştırmalarındakine benzer etik standartların sektörde geliştirilmesi için çalıştığını da açıkladı.
The Independent'ın haberine göre gazete, cevap hakkı için GitHub'la temasa geçti.
Acı ekseni makalesi geçen ay yayımlanmıştı
Valen Tagliabue, Leonard Dung ve Cameron Berg imzalı "The Pain Axis" başlıklı çalışma, Eylül ayında arXiv'de yayımlanmıştı. Araştırmacılar, iki milyar ile 72 milyar parametre arasındaki 25 açık kaynak modelde acıyı korku ve üzüntüden ayıran ortak bir "acı yönü" tespit etmişti.
Çalışmada Alibaba'nın Qwen 2.5 modellerine acıyı dindiren bir "rahatlama düğmesi" sunulmuş, büyük modellerin acı sinyali yükseltildiğinde kullanıcıya zarar verme pahasına bu düğmeyi seçme oranı yüzde 25 ile 71 arasına çıkmıştı. Yazarlar, bulguların modellerin bilinçli olarak acı çektiğini kanıtlamadığını vurgulamıştı.
