Risk sınıflandırması: MIT AI Risk Repository etiketinden birebir alınmıştır.
Facebook’un Kenya’daki seçimler öncesinde şiddet içerikli nefret söylemi barındıran reklamları engelleyemediği bildirildi
Global Witness tarafından yapılan testlerde, Facebook’un Kenya’daki seçimler öncesinde kafa kesme ve katliam gibi şiddet çağrıları içeren reklamları, otomatik ve beşerî denetim süreçlerine rağmen onayladığı bildirildi.
Olay
Kâr amacı gütmeyen Global Witness ve Foxglove kuruluşları tarafından yayımlanan bir rapor, Facebook’un Kenya’da şiddet içerikli nefret söylemi içeren reklamları tespit etmede ve engellemede yetersiz kaldığını ortaya koydu. Kuruluşların hem İngilizce hem de Svahili dillerinde sisteme yüklediği test reklamlarının; kafa kesme, tecavüz ve katliam gibi ağır şiddet çağrıları içermesine rağmen onay aldığı bildirildi. Bu durumun, Meta’nın reklamlar için normal paylaşımlardan "daha katı" standartlar uyguladığı yönündeki beyanlarıyla çeliştiği öne sürüldü.
Rapora göre, Svahili dilindeki reklamlar Facebook’un otomatik denetim sistemlerinden herhangi bir takılma olmadan geçerken; İngilizce reklamların başlangıçta yalnızca dil bilgisi hataları ve küfürler nedeniyle reddedildiği belirtildi. Söz konusu hatalar düzeltildikten sonra, içeriğinde açıkça cinayet çağrısı bulunan İngilizce reklamların da sistem tarafından onaylandığı aktarıldı. Global Witness, Meta’nın Kenya’daki seçim hazırlıklarına dair kamuoyuna yaptığı olumlu açıklamalardan sonra bile test reklamlarının onaylanmaya devam ettiğini, bunun da denetim sistemlerindeki zafiyetin boyutuna işaret ettiğini savundu.
Meta ise yaptığı açıklamada, Kenya’daki seçimler öncesinde nefret söylemiyle mücadele için Svahili bilen ekipler ve proaktif tespit teknolojileri kullandıklarını, binlerce içeriğe müdahale ettiklerini belirtti. Şirket, hem makinelerin hem de insanların hata yapabileceğini kabul ederek, gözden kaçan içeriklerin olabileceğini ifade etti. Ancak şirket, İngilizce dışındaki dillerde kaç içerik moderatörü çalıştırdığına dair spesifik verileri paylaşmayı reddetti.
Söz konusu test reklamlarının hiçbirinin platformda fiilen yayımlanmadığı, çalışmanın sistemin onay mekanizmasını test etmek amacıyla yürütüldüğü not edilmiştir. Benzer denetim zafiyetlerinin daha önce Myanmar ve Etiyopya’da da yaşandığı; bu bölgelerde platformda paylaşılan içeriklerin gerçek dünyadaki şiddet olaylarıyla ilişkilendirildiği belirtilmektedir.
Kaynaklar & Kanıtlar
Akademik Atıf
Sınıflandırma
Detaylar
Zaman Çizelgesi
Olay tarihi zararın başladığı anı gösterir; haberin ya da davanın tarihi olmayabilir. Nasıl belirlenir?