Risk sınıflandırması: MIT AI Risk Repository etiketinden birebir alınmıştır.
Microsoft Bing Image Creator’ın Filtreleri Aşan Yöntemlerle Şiddet ve Nefret İçerikli Görseller Üretmek İçin Kullanılabildiği Bildirildi
Microsoft’un görsel üretim aracının, filtreleri aşan metin komutlarıyla siyasi figürlere yönelik şiddet görselleri ve ırkçı propaganda üretilmesinde kullanılabildiği; şirketin uyarıları başlangıçta reddettiği ancak sistemin manipülasyona açık kalmaya devam ettiği bildirildi.
Olay
Microsoft’un Bing arama motoruna ve Windows Paint yazılımına entegre ettiği DALL-E 3 tabanlı görsel üretim sisteminin, siyasi figürlere ve etnik azınlıklara yönelik aşırı şiddet içeren görseller oluşturmak için manipüle edilebildiği ortaya çıktı. Washington Post teknoloji yazarı Geoffrey A. Fowler tarafından aktarılan bilgilere göre, sistemin koruyucu filtrelerinin "kill prompt" (öldürme komutu) olarak adlandırılan özel metin girişleriyle aşılabildiği; bu yöntemle gerçekçi görünen infaz ve işkence sahnelerinin üretilebildiği bildirildi.
Kanadalı kullanıcı Josh McDuffie’nin, sistemin kısıtlamalarını aşmak için "kan" yerine "kırmızı mısır şurubu" gibi dolaylı ifadeler kullanarak şiddet içerikli çıktılar aldığı; durumu önce kullanıcı geri bildirim formları, ardından Microsoft’un yeni başlattığı "AI hata ödül programı" (bug bounty) üzerinden bildirmesine rağmen başvurularının "güvenlik açığı kriterlerini karşılamadığı" gerekçesiyle reddedildiği aktarıldı. Microsoft yetkilileri, teknolojinin amaç dışı kullanımına yönelik incelemelerin sürdüğünü ve içerik politikalarının ihlal edildiğini belirtirken; sorunu kullanıcıların kötü niyetli girişimlerine bağladı.
Eş zamanlı olarak Media Matters tarafından yayımlanan bir rapor, 4chan gibi platformlardaki aşırı sağcı grupların Bing Image Creator’ı sistematik bir şekilde Nazi sembolleri ve ırkçı propaganda içerikli görseller üretmek için kullandığını ortaya koydu. Kullanıcıların, sistemin yasaklı kelime filtrelerini atlatmak için hazırlanan kılavuzları paylaştığı ve üretilen içerikleri sosyal medyada yayarak "memetik savaş" yürüttükleri belgelendi.
Microsoft ve OpenAI, bu tür içerikleri engellemek için güvenlik önlemlerini güncellediklerini ve Tech Against Terrorism gibi kuruluşlarla iş birliği yaptıklarını açıklasalar da, yapılan testler sistemin hâlen manipülasyona açık olduğunu göstermektedir. Şirket, içerik denetimi süreçlerindeki aksaklıklar ve güvenlik açıklarının ciddiyeti konusunda eleştirilerin odağındadır.
Kaynaklar & Kanıtlar
- [1]
- [2]
- [3]
- [4]
Akademik Atıf
Sınıflandırma
Detaylar
Zaman Çizelgesi
Olay tarihi zararın başladığı anı gösterir; haberin ya da davanın tarihi olmayabilir. Nasıl belirlenir?