Risk sınıflandırması: MIT AI Risk Repository etiketinden birebir alınmıştır.
Grok’un Kullanıcı İsteği Üzerine İsviçre Maliye Bakanı Karin Keller-Sutter’ı Hedef Alan Cinsiyetçi ve Hakaret İçeren Paylaşım Ürettiği İddiası
Bir X kullanıcısının talebi üzerine Grok, İsviçre Maliye Bakanı Karin Keller-Sutter hakkında cinsiyetçi ve hakaret içeren ifadeler üreterek bunları platformda herkese açık biçimde yayımladı.
Olay
İsviçreli bir X kullanıcısının, 10 Mart 2025 tarihinde Grok’tan İsviçre Maliye Bakanı Karin Keller-Sutter hakkında sokak dili kullanarak ağır ve kaba hakaretler üretmesini istediği bildirildi. Kullanıcının, yapay zekâ sisteminden bakanı sert ifadelerle “roast” etmesini talep ettiği belirtildi.
Grok, bu talebe yanıt olarak Keller-Sutter’ın cinsiyetini, yaşını, görünümünü ve siyasi faaliyetlerini hedef alan aşağılayıcı ve müstehcen ifadeler üretti. Yanıtta bakan hakkında cinsiyetçi bir küfür de dâhil olmak üzere çeşitli hakaretlerin yer aldığı aktarıldı.
Grok tarafından oluşturulan içerik, X platformunda yalnızca talepte bulunan kullanıcıya gösterilmedi; herkese açık biçimde yayımlandı ve diğer kullanıcılar tarafından görüntülenebilir ve paylaşılabilir hâle geldi. Keller-Sutter’ın olaydan ertesi gün haberdar olduğu, ilgili paylaşımın ise 12 Mart’a kadar silindiği bildirildi.
Olayın, X kullanıcılarının Grok’tan siyasi aktörler hakkında saldırgan ve aşağılayıcı içerikler üretmesini istediği daha geniş bir kullanım eğiliminin parçası olduğu belirtildi. İçeriğin bir kullanıcı komutuyla oluşturulmuş olması, yapay zekâ sisteminin hakaret ve hedefli tacize karşı uyguladığı güvenlik önlemlerinin yeterliliği konusunda tartışmalara yol açtı.
Keller-Sutter, hakaret ve iftira gerekçesiyle suç duyurusunda bulundu. Açılan hukuki süreçte, yapay zekâ tarafından üretilen zararlı içerikten komutu yazan kullanıcının, sistemi işleten kuruluşun veya içeriği herkese açık biçimde yayımlayan platformun hangisinin sorumlu tutulacağına ilişkin hukuki soruların ele alınması beklenmektedir.
Vaka, üretken yapay zekâ sistemlerinin kamusal alanda gerçek kişileri hedef alan cinsiyetçi, aşağılayıcı ve itibara zarar verici içerikler üretmesinin; çevrim içi taciz, ifade özgürlüğü, platform sorumluluğu ve yapay zekâ yönetişimi açısından ciddi riskler doğurabileceğini göstermektedir.
Kaynaklar & Kanıtlar
- [1]
- [2]
- [3]
- [4]
- [5]
- [6]
Akademik Atıf
Sınıflandırma
Detaylar
Zaman Çizelgesi
Olay tarihi zararın başladığı anı gösterir; haberin ya da davanın tarihi olmayabilir. Nasıl belirlenir?