RISKYZ-2022-00101MITAIID4 görüntülenme

Risk sınıflandırması: MIT AI Risk Repository etiketinden birebir alınmıştır.

2.Gizlilik ve Güvenlik

Özel tıbbi kayıt fotoğraflarının popüler bir yapay zekâ eğitim veri setinde yer aldığı bildirildi

Yayınlandı: 29 Temmuz 2026Olay: Mart 2022

Bir sanatçının rızası dışında internete sızan özel tıbbi fotoğraflarının, Stable Diffusion gibi modellerin eğitiminde kullanılan LAION-5B veri setine dahil edildiği ve benzer durumda binlerce hasta kaydının bulunduğu bildirildi.

Olay

California merkezli bir yapay zekâ sanatçısının, 2013 yılında doktoru tarafından klinik dokümantasyon amacıyla çekilen özel tıbbi fotoğraflarının, açık kaynaklı LAION-5B veri setinde yer aldığını keşfettiği bildirildi. Sanatçının, "Have I Been Trained" adlı platform üzerinden yaptığı görsel aramada, nadir bir genetik rahatsızlığına yönelik cerrahi işlemler öncesi ve sonrasına ait yüz fotoğraflarına ulaştığı aktarıldı.

Söz konusu fotoğrafların yalnızca tıbbi kullanım için onaylandığı; fotoğrafları çeken doktorun 2018'deki vefatının ardından verilerin bir şekilde internete sızdığı ve ardından LAION tarafından veri kazıma (scraping) yöntemiyle veri setine dahil edildiği değerlendirilmektedir. Ars Technica tarafından yapılan incelemede, veri setinde benzer durumda olan binlerce başka hastaya ait tıbbi fotoğrafların da bulunduğu öne sürülmüştür. Bu görsellerin, Midjourney ve Stability AI gibi şirketlerin ticari hizmetlerinde kullanılan modellerin eğitiminde kullanılmış olabileceği belirtilmektedir.

LAION yetkilileri, görüntüleri bizzat barındırmadıklarını, yalnızca internetteki mevcut URL'lere yönlendirme yaptıklarını ifade ederek sorumluluğu görselleri barındıran kaynak web sitelerine yönlendirmiştir. Stability AI CEO'su Emad Mostaque ise modellerin verileri doğrudan kopyalamadığını ancak belirli verilerin model üzerindeki etkisini azaltmanın teknik olarak mümkün olabileceğini ifade etmiştir. Bununla birlikte, bireysel talepler doğrultusunda verilerin eğitim sürecinden geriye dönük olarak çıkarılmasına yönelik yerleşik bir mekanizmanın veya taahhüdün bulunmadığı bildirilmiştir.

Olayda, yapay zekâ sistemlerinin sanatçının yüzünü mevcut teknolojiyle birebir kopyaladığına dair kesin bir kanıt sunulmamış; ancak rıza dışı veri kullanımının mahremiyet riskleri oluşturduğu ve gelecekteki olası kötüye kullanımlara zemin hazırladığı vurgulanmıştır. İlgili fotoğrafların veri setinden çıkarılmasına yönelik taleplerin, veri setinin dağıtık yapısı ve barındırma modelinin karmaşıklığı nedeniyle tam olarak karşılanamadığı görülmektedir.

Akademik Atıf

RiskYZ. (2026). RISKYZ-2022-00101: Özel tıbbi kayıt fotoğraflarının popüler bir yapay zekâ eğitim veri setinde yer aldığı bildirildi. RiskYZ Vaka Kütüphanesi. https://riskyz.org/cases/RISKYZ-2022-00101

Sınıflandırma

Risk Alanı
2.Gizlilik ve Güvenlik
Alt Kategori
2.1Hassas bilgilerin ihlali
Kaynak
İnsan
Niyet
Kasıtsız
Zamanlama
Dağıtım Sonrası

Detaylar

Etkilenen Sistem
LAION-5B veri seti; Stable Diffusion ve Google Imagen gibi görüntü sentezleme modelleri
Sektör
Sağlık
Konum
Amerika Birleşik Devletleri

Zaman Çizelgesi

Olay Tarihi
Mart 2022
Yayınlandı
29.07.2026
Güncellendi
11.08.2026

Olay tarihi zararın başladığı anı gösterir; haberin ya da davanın tarihi olmayabilir. Nasıl belirlenir?

Etiketler

#üretken yapay zekâ#veri sızıntısı#kişisel veri#sağlık verisi#özel hayatın gizliliği ihlali#eğitim verisi#Stable Diffusion#rıza ihlali