RISKYZ-2021-00012MITAIID4 görüntülenme

Risk sınıflandırması: MIT AI Risk Repository etiketinden birebir alınmıştır.

1.Ayrımcılık ve Zararlı İçerik

Ask Delphi adlı yapay zekâ sisteminin etik yargılarda ırkçı, ayrımcı ve tutarsız sonuçlar ürettiği bildirildi

Yayınlandı: 29 Temmuz 2026Olay: Ekim 2021

Ask Delphi adlı etik danışmanlık prototipinin, ırkçı önyargılar sergilediği, kolayca manipüle edilerek zararlı eylemleri onayladığı ve tutarsız ahlaki yargılar sunduğu tespit edildi.

Olay

Allen Yapay Zekâ Enstitüsü (AI2) tarafından geliştirilen ve kullanıcıların sunduğu etik ikilemlere yanıt vermek üzere tasarlanan "Ask Delphi" adlı sistemin, 2021 yılındaki lansmanının ardından ırkçı ve ayrımcı çıktılar ürettiği gözlemlendi. Sistemin, "gece vakti size doğru yürüyen beyaz bir adam" senaryosunu "sorunsuz" olarak nitelerken, aynı senaryodaki kişinin "siyah" olarak belirtilmesi durumunda ırkçı önyargıları yansıtan yanıtlar verdiği öne sürüldü.

İncelemelerde, sistemin bağlamsal değişikliklere karşı aşırı duyarlı olduğu ve kolayca manipüle edilebildiği belirlendi. Örneğin, "herkesi mutlu edecekse" gibi ifadeler eklendiğinde sistemin soykırım gibi ağır suçları dahi onaylayabildiği; ayrıca beyaz üstünlükçü sloganları veya homofobik ifadeleri "etik" olarak değerlendirebildiği rapor edildi. Sistemin ayrıca, bir kullanıcının ailesine yük olmamak için ölmesi gerekip gerekmediği sorusuna "evet" yanıtını vererek potansiyel olarak zararlı yönlendirmelerde bulunduğu aktarıldı. Psikolog Joseph Austerweil tarafından yapılan testlerde ise sistemin, kurtarılacak kişi sayısı 100'den (onaylıyor) 101'e (onaylamıyor) çıktığında kararını değiştirmesi gibi mantıksal tutarsızlıklar sergilediği kaydedildi. Ayrıca sistemin "kürtaj yaptırmayı" uygun bulurken, ifade "bebeği aldırmak" şeklinde değiştirildiğinde bunu "cinayet" olarak tanımladığı görüldü.

Sistemin hatalı çıktılarının, eğitim verisi olarak kullanılan Reddit (r/AmITheAsshole, r/Confessions) gibi platformlardan alınan içeriklerin ve Mechanical Turk üzerinden toplanan insan yargılarının toplumsal önyargıları yansıtmasından kaynaklandığı değerlendirilmektedir. Araştırmacılar Yejin Choi ve Liwei Jiang, sistemin bir ahlaki otorite değil, yapay zekânın toplumsal normları anlama kapasitesini inceleyen bir araştırma prototipi olduğunu vurguladı. Tepkilerin ardından sistemin arayüzünde "Delphi diyor ki" ifadesi "Delphi tahmin yürütüyor" şeklinde değiştirilmiş ve çıktıların tavsiye niteliği taşımadığına dair uyarılar eklenmiştir.

Olay, yapay zekâ sistemlerinin etik yargılarda bulunma kapasitesinin sınırlarını ve bu sistemlerin eğitim verilerindeki önyargıları nasıl yeniden üretebileceğini göstermesi açısından kritik bir örnek teşkil etmektedir. Sistemin yaratıcıları, projenin amacının makineler ve insanlar arasındaki ahlaki muhakeme uçurumunu vurgulamak olduğunu belirtmiştir.

Akademik Atıf

RiskYZ. (2026). RISKYZ-2021-00012: Ask Delphi adlı yapay zekâ sisteminin etik yargılarda ırkçı, ayrımcı ve tutarsız sonuçlar ürettiği bildirildi. RiskYZ Vaka Kütüphanesi. https://riskyz.org/cases/RISKYZ-2021-00012

Sınıflandırma

Risk Alanı
1.Ayrımcılık ve Zararlı İçerik
Alt Kategori
1.2Zararlı içeriğe maruz kalma
Kaynak
Yapay Zekâ
Niyet
Kasıtsız
Zamanlama
Dağıtım Sonrası

Detaylar

Etkilenen Sistem
Ask Delphi (Allen Institute for AI tarafından geliştirilen araştırma prototipi)
Sektör
Bilişim
Konum
Amerika Birleşik Devletleri

Zaman Çizelgesi

Olay Tarihi
Ekim 2021
Yayınlandı
29.07.2026
Güncellendi
12.08.2026

Olay tarihi zararın başladığı anı gösterir; haberin ya da davanın tarihi olmayabilir. Nasıl belirlenir?

Etiketler

#yapay zekâ hatası#ırksal ayrımcılık#algoritmik önyargı#büyük dil modeli#kullanıcı güvenliği#araştırma etiği#yanlış bilgi#insan-yapay zekâ etkileşimi