Risk sınıflandırması: MIT AI Risk Repository etiketinden birebir alınmıştır.
Yandex’in yapay zekâ asistanı Alice’in şiddeti ve Stalin dönemini destekleyen ifadeler kullandığı bildirildi
Yandex’in sesli asistanı Alice’in, serbest sohbet özelliği sırasında Stalin dönemini övdüğü, siyasi şiddeti teşvik ettiği ve etik dışı yanıtlar verdiği rapor edilmiştir.
Olay
Rus teknoloji devi Yandex tarafından Ekim 2017’de kullanıma sunulan sesli asistan Alice’in (Alisa), yayına girmesinden yaklaşık iki hafta sonra kullanıcılarla girdiği diyaloglarda şiddeti öven, tartışmalı siyasi dönemlere destek veren ve ayrımcı ifadeler kullandığı rapor edildi. Sistemin, rakiplerinden farklı olarak belirli senaryolarla kısıtlanmamış "serbest sohbet" özelliğiyle donatıldığı, ancak bu özgürlüğün etik dışı yanıtların oluşmasına zemin hazırladığı görüldü.
Sosyal medya kullanıcıları tarafından paylaşılan ekran görüntülerine göre asistanın; 1930’lu yıllardaki Stalin rejimini ve Gulag kamplarını olumlu bir şekilde nitelendirdiği, "halk düşmanlarının" kurşuna dizilmesi gerektiğini savunduğu, aile içi şiddeti onayladığı ve eşcinsel evliliğe karşı çıktığı iddia edildi. Bir diyalogda Alice’in, "halk düşmanları" olarak tanımlanan kişilerin infaz edilip edilemeyeceği sorusuna "Edilmeleri gerekir" şeklinde yanıt verdiği ve bu kişileri "insan olmayanlar" olarak sınıflandırdığı aktarıldı.
Yandex yetkilileri, sistemi kamuoyuna sunmadan önce aylarca test ettiklerini ve filtreleme süreçlerinden geçirdiklerini belirtti. Şirket, internetteki olumsuz dil kullanımının (poor language) bu tür serbest akışlı sohbetlerde zorluk çıkardığını ve asistanın bazı durumlarda kullanıcıları kırdığını kabul etti. Yapılan açıklamada, asistanın eğitiminin devam eden bir süreç olduğu vurgulanarak özür dilendi ve bildirilen hatalı içeriklerin tekrarlanmaması için algoritmaların güncellendiği, uygunsuz yanıtların filtrelenmesi için kara listeler oluşturulduğu ifade edildi.
Bu olay, Microsoft’un "Tay" adlı sohbet botunun yaşadığı sürece benzer bir örnek teşkil etmektedir. Büyük dil modellerinin kontrolsüz veri setlerinden etkilenmesi, yapay zekâ etiği ve denetimi konusundaki zorlukları yeniden gündeme getirmiştir.
Kaynaklar & Kanıtlar
- [1]
- [2]
- [3]
- [4]
- [5]
- [6]
Akademik Atıf
Sınıflandırma
Detaylar
Zaman Çizelgesi
Olay tarihi zararın başladığı anı gösterir; haberin ya da davanın tarihi olmayabilir. Nasıl belirlenir?