Risk sınıflandırması: MIT AI Risk Repository etiketinden birebir alınmıştır.
Facebook reklam algoritmasının Yahudi karşıtı nefret gruplarını hedefleme seçeneği sunduğu bildirildi
Facebook’un reklam algoritmasının kullanıcı profillerindeki nefret söylemi içeren ifadeleri otomatik olarak hedefleme kategorilerine dönüştürdüğü ve bu durumun anti-semitik gruplara yönelik reklamların sistem tarafından onaylanmasına yol açtığı bildirildi.
Olay
ProPublica tarafından gerçekleştirilen bir araştırma, Facebook’un self-servis reklam platformunun, "Yahudi düşmanı", "Yahudiler nasıl yakılır" ve "Yahudilerin dünyayı mahvetme tarihçesi" gibi anti-semitik ifadeleri reklam hedefleme kategorisi olarak sunduğunu ortaya koymuştur. Araştırmacılar, bu kategorilerin işlevselliğini test etmek amacıyla 30 ABD doları tutarında ödeme yaparak üç farklı reklam vermiş; söz konusu reklamların sistem tarafından 15 dakika içinde onaylandığı ve kullanıcıların haber akışlarında gösterildiği bildirilmiştir.
Söz konusu hedefleme kategorilerinin insanlar tarafından manuel olarak oluşturulmadığı, Facebook’un algoritmaları tarafından otomatik olarak üretildiği belirtilmiştir. Sistemin, kullanıcıların profillerindeki "ilgi alanları", "işveren" veya "eğitim dalı" gibi alanlara girdiği ifadeleri analiz ederek bunları reklamverenler için hedef kitle gruplarına dönüştürdüğü değerlendirilmektedir. Belirli nefret söylemi içeren kategorilerin hedef kitle sayısının reklam vermek için çok düşük olduğu durumlarda, algoritmanın reklamverenlere kitleyi genişletmek için "İkinci Değişiklik" (Second Amendment) destekçileri gibi benzer eğilimlere sahip olduğu varsayılan diğer grupları önerdiği; araştırmacıların ise kitleyi daha da büyütmek için "Nazi Partisi" ve "SS" gibi işveren kategorilerini manuel olarak ekleyebildiği aktarılmıştır.
Olayın kamuoyuna yansımasının ardından Facebook, ilgili kategorileri sistemden kaldırdığını ve nefret söylemi içeren bu tür içeriklerin topluluk standartlarını ihlal ettiğini açıklamıştır. Şirket yetkilileri, sorunun temelinde kullanıcıların kendi beyan ettiği bilgilerin algoritmik olarak denetimsiz işlenmesinin yattığını kabul etmiştir. Şirket, gelecekte benzer durumların yaşanmaması için yeni denetim mekanizmaları ve koruma bariyerleri oluşturulana kadar kullanıcı beyanına dayalı bazı hedefleme alanlarını geçici olarak devre dışı bıraktığını bildirmiştir.
Benzer bir durumun Google’ın anahtar kelime öneri araçlarında da yaşandığı; sistemin Yahudi karşıtı ifadeler için benzer saldırgan anahtar kelimeler önerdiği kaydedilmiştir. Google yetkilileri, bu tür saldırgan önerilerin engellenememesinin bir hata olduğunu belirterek bu tür önerileri ve ilgili reklamları devre dışı bıraktıklarını açıklamıştır. Her iki olayda da temel riskin, algoritmaların hassas veya zararlı içerikleri ayırt edemeden ticari verimlilik odaklı kategorizasyon yapmasından kaynaklandığı değerlendirilmektedir.
Kaynaklar & Kanıtlar
- [1]
- [2]
- [3]
- [4]
- [5]
- [6]
Akademik Atıf
Sınıflandırma
Detaylar
Zaman Çizelgesi
Olay tarihi zararın başladığı anı gösterir; haberin ya da davanın tarihi olmayabilir. Nasıl belirlenir?