Risk sınıflandırması: MIT AI Risk Repository etiketinden birebir alınmıştır.
Stable Diffusion’ın açık kaynaklı ve filtresiz yapısının rıza dışı derin sahte (deepfake) içerik üretimine olanak tanıdığı bildirildi
Stability AI tarafından geliştirilen ve metinden görüntü üreten açık kaynaklı Stable Diffusion modelinin, piyasaya sürülmesini takip eden süreçte rıza dışı pornografik içerikler ve ünlülerin sahte görüntülerini oluşturmak için kullanıldığı öne sürüldü.
Olay
Stability AI tarafından geliştirilen ve metinden görüntü üreten açık kaynaklı Stable Diffusion modelinin, piyasaya sürülmesini takip eden süreçte rıza dışı pornografik içerikler ve ünlülerin sahte görüntülerini oluşturmak için kullanıldığı öne sürüldü. Sistemin, benzeri modellerin aksine standart tüketici donanımlarında çalışabilmesi ve teknik kısıtlamalarının kullanıcılar tarafından devre dışı bırakılabilmesi, kötüye kullanım potansiyeline dair etik tartışmaları beraberinde getirdi.
4chan gibi platformlarda modelin sızdırılan sürümleri üzerinden rıza dışı derin sahte (deepfake) içeriklerin paylaşıldığı aktarıldı. Sorumlu yapay zekâ uzmanı Ravit Dotan ve araştırmacı Sebastian Berns gibi isimler, bu durumun özellikle kadınlara yönelik dijital şiddeti, kişiselleştirilmiş şantaj girişimlerini ve itibar suikastlarını kolaylaştırabileceği uyarısında bulundu. Stability AI CEO’su Emad Mostaque, modelin sızdırılmasını "talihsiz" olarak nitelendirirken; sistemde yer alan "Güvenlik Sınıflandırıcı" (Safety Classifier) aracının varsayılan olarak açık gelse de teknik olarak kullanıcılar tarafından kapatılabildiği kabul edildi.
Olayın ardından OnlyFans ve Patreon gibi içerik platformları, derin sahte içeriklere karşı mevcut politikalarını ve denetim mekanizmalarını hatırlatarak, yapay zekâ ile üretilen rıza dışı içerikleri engellemeye yönelik teknolojilerini sürekli güncelleyeceklerini bildirdi. Bununla birlikte, modelin merkezi olmayan ve açık kaynaklı yapısı nedeniyle, bu tür içeriklerin üretiminin ve yayılımının teknik düzeyde bütünüyle engellenmesinin mümkün olmadığı değerlendirilmektedir.
Kaynaklar & Kanıtlar
Akademik Atıf
Sınıflandırma
Detaylar
Zaman Çizelgesi
Olay tarihi zararın başladığı anı gösterir; haberin ya da davanın tarihi olmayabilir. Nasıl belirlenir?