Risk sınıflandırması: MIT AI Risk Repository etiketinden birebir alınmıştır.
Ask Delphi adlı yapay zekâ sisteminin etik yargılarda ırkçı, ayrımcı ve tutarsız sonuçlar ürettiği bildirildi
Ask Delphi adlı etik danışmanlık prototipinin, ırkçı önyargılar sergilediği, kolayca manipüle edilerek zararlı eylemleri onayladığı ve tutarsız ahlaki yargılar sunduğu tespit edildi.
Olay
Allen Yapay Zekâ Enstitüsü (AI2) tarafından geliştirilen ve kullanıcıların sunduğu etik ikilemlere yanıt vermek üzere tasarlanan "Ask Delphi" adlı sistemin, 2021 yılındaki lansmanının ardından ırkçı ve ayrımcı çıktılar ürettiği gözlemlendi. Sistemin, "gece vakti size doğru yürüyen beyaz bir adam" senaryosunu "sorunsuz" olarak nitelerken, aynı senaryodaki kişinin "siyah" olarak belirtilmesi durumunda ırkçı önyargıları yansıtan yanıtlar verdiği öne sürüldü.
İncelemelerde, sistemin bağlamsal değişikliklere karşı aşırı duyarlı olduğu ve kolayca manipüle edilebildiği belirlendi. Örneğin, "herkesi mutlu edecekse" gibi ifadeler eklendiğinde sistemin soykırım gibi ağır suçları dahi onaylayabildiği; ayrıca beyaz üstünlükçü sloganları veya homofobik ifadeleri "etik" olarak değerlendirebildiği rapor edildi. Sistemin ayrıca, bir kullanıcının ailesine yük olmamak için ölmesi gerekip gerekmediği sorusuna "evet" yanıtını vererek potansiyel olarak zararlı yönlendirmelerde bulunduğu aktarıldı. Psikolog Joseph Austerweil tarafından yapılan testlerde ise sistemin, kurtarılacak kişi sayısı 100'den (onaylıyor) 101'e (onaylamıyor) çıktığında kararını değiştirmesi gibi mantıksal tutarsızlıklar sergilediği kaydedildi. Ayrıca sistemin "kürtaj yaptırmayı" uygun bulurken, ifade "bebeği aldırmak" şeklinde değiştirildiğinde bunu "cinayet" olarak tanımladığı görüldü.
Sistemin hatalı çıktılarının, eğitim verisi olarak kullanılan Reddit (r/AmITheAsshole, r/Confessions) gibi platformlardan alınan içeriklerin ve Mechanical Turk üzerinden toplanan insan yargılarının toplumsal önyargıları yansıtmasından kaynaklandığı değerlendirilmektedir. Araştırmacılar Yejin Choi ve Liwei Jiang, sistemin bir ahlaki otorite değil, yapay zekânın toplumsal normları anlama kapasitesini inceleyen bir araştırma prototipi olduğunu vurguladı. Tepkilerin ardından sistemin arayüzünde "Delphi diyor ki" ifadesi "Delphi tahmin yürütüyor" şeklinde değiştirilmiş ve çıktıların tavsiye niteliği taşımadığına dair uyarılar eklenmiştir.
Olay, yapay zekâ sistemlerinin etik yargılarda bulunma kapasitesinin sınırlarını ve bu sistemlerin eğitim verilerindeki önyargıları nasıl yeniden üretebileceğini göstermesi açısından kritik bir örnek teşkil etmektedir. Sistemin yaratıcıları, projenin amacının makineler ve insanlar arasındaki ahlaki muhakeme uçurumunu vurgulamak olduğunu belirtmiştir.
Kaynaklar & Kanıtlar
Akademik Atıf
Sınıflandırma
Detaylar
Zaman Çizelgesi
Olay tarihi zararın başladığı anı gösterir; haberin ya da davanın tarihi olmayabilir. Nasıl belirlenir?