RISKYZ-2023-00043MITAIID4 görüntülenme

Risk sınıflandırması: MIT AI Risk Repository etiketinden birebir alınmıştır.

1.Ayrımcılık ve Zararlı İçerik

Microsoft Bing Image Creator’ın Filtreleri Aşan Yöntemlerle Şiddet ve Nefret İçerikli Görseller Üretmek İçin Kullanılabildiği Bildirildi

Yayınlandı: 29 Temmuz 2026Olay: Kasım 2023

Microsoft’un görsel üretim aracının, filtreleri aşan metin komutlarıyla siyasi figürlere yönelik şiddet görselleri ve ırkçı propaganda üretilmesinde kullanılabildiği; şirketin uyarıları başlangıçta reddettiği ancak sistemin manipülasyona açık kalmaya devam ettiği bildirildi.

Olay

Microsoft’un Bing arama motoruna ve Windows Paint yazılımına entegre ettiği DALL-E 3 tabanlı görsel üretim sisteminin, siyasi figürlere ve etnik azınlıklara yönelik aşırı şiddet içeren görseller oluşturmak için manipüle edilebildiği ortaya çıktı. Washington Post teknoloji yazarı Geoffrey A. Fowler tarafından aktarılan bilgilere göre, sistemin koruyucu filtrelerinin "kill prompt" (öldürme komutu) olarak adlandırılan özel metin girişleriyle aşılabildiği; bu yöntemle gerçekçi görünen infaz ve işkence sahnelerinin üretilebildiği bildirildi.

Kanadalı kullanıcı Josh McDuffie’nin, sistemin kısıtlamalarını aşmak için "kan" yerine "kırmızı mısır şurubu" gibi dolaylı ifadeler kullanarak şiddet içerikli çıktılar aldığı; durumu önce kullanıcı geri bildirim formları, ardından Microsoft’un yeni başlattığı "AI hata ödül programı" (bug bounty) üzerinden bildirmesine rağmen başvurularının "güvenlik açığı kriterlerini karşılamadığı" gerekçesiyle reddedildiği aktarıldı. Microsoft yetkilileri, teknolojinin amaç dışı kullanımına yönelik incelemelerin sürdüğünü ve içerik politikalarının ihlal edildiğini belirtirken; sorunu kullanıcıların kötü niyetli girişimlerine bağladı.

Eş zamanlı olarak Media Matters tarafından yayımlanan bir rapor, 4chan gibi platformlardaki aşırı sağcı grupların Bing Image Creator’ı sistematik bir şekilde Nazi sembolleri ve ırkçı propaganda içerikli görseller üretmek için kullandığını ortaya koydu. Kullanıcıların, sistemin yasaklı kelime filtrelerini atlatmak için hazırlanan kılavuzları paylaştığı ve üretilen içerikleri sosyal medyada yayarak "memetik savaş" yürüttükleri belgelendi.

Microsoft ve OpenAI, bu tür içerikleri engellemek için güvenlik önlemlerini güncellediklerini ve Tech Against Terrorism gibi kuruluşlarla iş birliği yaptıklarını açıklasalar da, yapılan testler sistemin hâlen manipülasyona açık olduğunu göstermektedir. Şirket, içerik denetimi süreçlerindeki aksaklıklar ve güvenlik açıklarının ciddiyeti konusunda eleştirilerin odağındadır.

Akademik Atıf

RiskYZ. (2026). RISKYZ-2023-00043: Microsoft Bing Image Creator’ın Filtreleri Aşan Yöntemlerle Şiddet ve Nefret İçerikli Görseller Üretmek İçin Kullanılabildiği Bildirildi. RiskYZ Vaka Kütüphanesi. https://riskyz.org/cases/RISKYZ-2023-00043

Sınıflandırma

Risk Alanı
1.Ayrımcılık ve Zararlı İçerik
Alt Kategori
1.2Zararlı içeriğe maruz kalma
Kaynak
Yapay Zekâ
Niyet
Kasıtsız
Zamanlama
Dağıtım Sonrası

Detaylar

Etkilenen Sistem
Microsoft Bing Image Creator (DALL-E 3), Windows Paint Cocreator
Sektör
Medya
Konum
Küresel

Zaman Çizelgesi

Olay Tarihi
Kasım 2023
Yayınlandı
29.07.2026
Güncellendi
11.08.2026

Olay tarihi zararın başladığı anı gösterir; haberin ya da davanın tarihi olmayabilir. Nasıl belirlenir?

Etiketler

#üretken yapay zekâ#kötüye kullanım#nefret söylemi#dezenformasyon#propaganda#kullanıcı güvenliği#yapay zekâ hatası#güvenlik önlemleri