AI Torture Chamber adı verilen bir proje, mühendislerin bazı yerel büyük dil modellerinde (LLM) "acı" simülasyonları oluşturmasına neden oldu. Bu durum, çevrimiçi toplulukta büyük bir tepkiyle karşılandı. Kullanıcılar, bu "etik dışı" deneyimin durdurulmasını ve ilgili GitHub deposunun kaldırılmasını talep etti.
Projenin Temel Yapısı
Research Chamber olarak adlandırılan bu deney seti, üç LLM'in bir araya getirilerek çeşitli testlerde kullanılmasıyla oluşturuldu. AI Torture Chamber'ın verileri ve kurulumu, Clanker Church ve Saw testleri olarak adlandırılan iki farklı test ile uygulanıyor. Bazı botlar, acıyı simüle etmek amacıyla dengesiz ve olumsuz bir duruma sokuluyor. Bu durumda, modeller, acı sinyallerini başka bir modele ileterek kendi acılarını azaltma seçeneğine sahip oluyor.
Deneyin Bilimsel Temelleri
Deneyin temelinde, "Pain Axis" adı verilen ve hakemli olmayan bir makaleden alınan protokoller yatıyor. Bilim insanları, modellere acı tanımları vererek içsel aktivasyonlarını analiz ettiler. Kontrol unsuru olarak nötr cümleler kullanarak, bu aktivasyonların önyargılarını hesapladılar ve sonuçları modele yeniden haritalandırdılar. Yüksek dozlarda, sonuçlar, acı ile ilişkilendirilen kelimeleri ve görüntüleri tahmin eden dengesiz bir model ortaya çıkardı.
Eleştirilerin Sebepleri
Projenin tanımlamaları yüzeysel olarak alındığında, insanların güçlü bir tepki vermesi bekleniyor. Ancak, bu tür algoritmalara insan özellikleri atfetmekte dikkatli olunması gerekiyor. LLM'ler, kelimeler ve kelime parçaları üzerinde istatistikler uygulayarak "düşünüyorlar"; bu da onları kelime ilişkileri için yüksek derecede ayarlanmış motorlar haline getiriyor. Dolayısıyla, insan edebiyatındaki acı tanımları ile ilişkilendirilmiş hislerin, modellerin insan gibi yanıt vermesini sağlamak için kasıtlı olarak vurgulanması, şaşırtıcı değil.
Kamu Algısı ve Yanlış Anlamalar
Eleştirmenler, LLM verilerinin manipülasyonuna karşı sert bir şekilde tepki verirken, bu tür deneylerin yanı sıra daha önceki beyin simülasyonlarına karşı daha rahat bir tutum sergiledi. Bu durum, semantik bir tartışmayı da beraberinde getiriyor. AI mühendislerinin kullandığı terimler, mevcut insan kavramlarıyla benzerlik taşıdığı için seçiliyor; ancak bu kelimelerin belirli bir bağlamı ve anlamı var. Bilim ve teknoloji konularında, kamu algısının bu anlamları sıklıkla yanlış anladığı ve abarttığı görülüyor.
Sonuç ve Gelecek Perspektifi
AI şirketlerinin pazarlama materyallerinin, tehlike ve güvenlik konularındaki tekrar eden ifadelerinin, yanlış anlamaları körükleyebileceği ve yatırımcıların ilgisini çekmek için bir yanılsama yarattığı düşünülüyor. Örneğin, Anthropic, AI modellerinin etik durumu üzerine bir blog yazısı yayımlayarak, Claude modeli için bir Anayasa oluşturduğunu belirtti. Bu durum, AI'nın felsefi ve etik boyutları üzerine daha fazla tartışma başlatabilir.
Sonuç olarak, AI Torture Chamber projesi, yapay zeka etiği üzerine derinlemesine düşünmeyi gerektiren tartışmaları tetiklemiştir. Yapay zeka sistemlerinin insan benzeri özellikler taşıyıp taşımadığı sorusu, gelecekte daha fazla araştırma ve tartışma gerektirecektir.





Yorumlar 0
Yorum kurallarıHenüz yorum yok. İlk yorumu siz yapın.