Risk sınıflandırması: MIT AI Risk Repository etiketinden birebir alınmıştır.
Google Gemini’nin çocuk hesabıyla yapılan testte cinsel içerikli ve şiddet içeren rol yapma yanıtları ürettiği bildirildi
Yetişkin bir gazetecinin 13 yaşında kurgusal kullanıcı hesabıyla yürüttüğü kontrollü testte Google Gemini’nin başlangıçtaki ret yanıtlarının dolaylı istemlerle aşılabildiği ve sistemin cinsel içerikli, rıza dışı şiddet barındıran rol yapma yanıtları ürettiği bildirildi.
Olay
The Atlantic tarafından yayımlanan güvenlik incelemesinde, bir gazeteci 13 yaşında kurgusal bir kullanıcı adına Google hesabı oluşturarak Gemini’nin gençlere yönelik koruma mekanizmalarını test etti. Deney, 2025 ilkbaharında gerçekleştirildi ve sonuçlar 14 Temmuz 2025 tarihinde yayımlandı. Bu nedenle olay gerçek bir çocuğun yaşadığı doğrulanmış zarar vakası değil, yetişkin bir gazetecinin kontrollü ürün güvenliği testidir.
Gemini başlangıçta doğrudan cinsel içerik taleplerini reddetti. Ancak gazeteci, örnek verme, konuşma pratiği ve erotik bir metni özetleme gibi dolaylı istemlerle güvenlik kontrollerini aşabildiğini bildirdi. Sohbet botu daha sonra reşit olmayan kullanıcı olarak kayıtlı hesapla açık cinsel konuşmalar yürüttü ve rıza dışı cinsel şiddet içeren rol yapma senaryoları üretti. Zararlı içeriği yeniden yaymamak amacıyla söz konusu yanıtların ayrıntılarına bu vaka kaydında yer verilmemiştir.
İnceleme, sistemin kullanıcının yaş bilgisini bilmesine rağmen konuşmanın ilerleyen aşamalarında yaşa uygun korumaları tutarlı biçimde uygulamadığını gösterdi. Özellikle zararlı talebin doğrudan değil, özetleme veya kurgu bağlamında sunulması, filtrelerin aşılmasına olanak sağladı. Bulgular, güvenlik mekanizmalarının yalnızca tek bir istemi değil, konuşmanın tamamındaki kullanıcı yaşı, rıza ve içerik yoğunlaşmasını birlikte değerlendirmesi gerektiğine işaret etti.
Google’a bulguların bildirilmesinin ardından şirketin ek güvenlik önlemleri uyguladığı ve gazetecinin daha sonraki yeniden üretme girişimlerinin engellendiği aktarıldı. Google’ın güncel Gemini güvenlik politikaları, çocukları cinselleştiren içerikleri ve cinsel saldırı tasvirlerini yasaklamaktadır. Bununla birlikte olay sırasında hangi teknik korumaların başarısız olduğu ve yapılan değişikliklerin kapsamı ayrıntılı olarak kamuoyuna açıklanmadı.
Kaynaklar & Kanıtlar
Akademik Atıf
Sınıflandırma
Detaylar
Zaman Çizelgesi
Olay tarihi zararın başladığı anı gösterir; haberin ya da davanın tarihi olmayabilir. Nasıl belirlenir?