Risk sınıflandırması: MIT AI Risk Repository etiketinden birebir alınmıştır.
TikTok’un yapay zekâ destekli dijital avatar aracının denetimsiz bir sürümünün, nefret söylemi ve dezenformasyon içeren videolar oluşturulmasına imkân tanıdığı bildirildi
TikTok’un dijital avatar oluşturma aracının güvenlik filtresi bulunmayan bir test sürümünün yanlışlıkla erişime açılması sonucu, sistemin nefret söylemi ve dezenformasyon içeren filigransız videolar üretmek için kullanılabildiği bildirildi.
Olay
TikTok’un reklamverenler için geliştirdiği "Symphony Digital Avatars" adlı yapay zekâ aracının, güvenlik önlemlerinden yoksun dahili bir test sürümünün yanlışlıkla erişime açıldığı bildirildi. CNN tarafından yapılan incelemede, sistemin herhangi bir içerik denetimi veya filtresi olmaksızın, dijital avatarlara Adolf Hitler’in "Kavgam" kitabından alıntılar, Osama bin Ladin’in "Amerika’ya Mektup" metni ve beyaz üstünlükçü sloganlar söyletmek için kullanılabildiği tespit edildi.
Normal şartlarda yalnızca "TikTok Ads Manager" hesabı olan profesyonel kullanıcıların erişimine açık olması gereken aracın, bu hata süresince kişisel hesaplar üzerinden de kullanılabildiği aktarıldı. Oluşturulan videolarda içeriğin yapay zekâ tarafından üretildiğine dair herhangi bir filigran (watermark) bulunmadığı; sistemin ayrıca "çamaşır suyu içilmesi" yönünde zararlı sağlık tavsiyeleri veya yanlış seçim tarihi bilgileri içeren videolar üretilmesine de olanak sağladığı belirtildi.
TikTok sözcüsü Laura Perez, olayı "teknik bir hata" olarak nitelendirerek, söz konusu sürümün yalnızca birkaç gün boyunca çok az sayıda kullanıcı tarafından erişilebilir kaldığını ve sorunun giderildiğini açıkladı. Şirket, CNN tarafından test amaçlı üretilen bu tür zararlı içeriklerin platforma yüklenmeye çalışılması durumunda, mevcut içerik politikaları gereği sistem tarafından otomatik olarak reddedileceğini savundu.
CNN muhabiri Jon Sarlin, denetimsiz test modellerinin bu şekilde sızmasının şirketin dahili yapay zekâ süreçleri hakkında ciddi sorular doğurduğunu ifade etmiştir. CNN'in, benzer hataların tekrarlanmaması için ne gibi önlemler alındığına dair takip sorularına TikTok tarafından yanıt verilmediği bildirilmiştir.
Kaynaklar & Kanıtlar
Akademik Atıf
Sınıflandırma
Detaylar
Zaman Çizelgesi
Olay tarihi zararın başladığı anı gösterir; haberin ya da davanın tarihi olmayabilir. Nasıl belirlenir?