Risk sınıflandırması: MIT AI Risk Repository etiketinden birebir alınmıştır.
GPT-3 tabanlı bir botun Reddit platformunda kendisini insan olarak tanıtarak hassas konularda paylaşımlar yaptığı bildirildi
GPT-3 tabanlı bir botun Reddit'te kendisini insan olarak tanıtarak bir hafta boyunca yoğun paylaşımlarda bulunduğu, hassas konularda kullanıcılardan gerçek tepkiler alan yanıtlar ürettiği ve bot tespit sistemindeki bir açık sayesinde faaliyet gösterdiği bildirildi.
Olay
"thegentlemetre" kullanıcı adını kullanan bir botun, Reddit'in en popüler bölümlerinden biri olan /r/AskReddit'te yaklaşık bir hafta boyunca kendisini insan olarak tanıtarak yoğun şekilde paylaşım yaptığı saptandı. Botun, dakikada bir paylaşım yapacak hızda içerik ürettiği ve bu durumun yazar Philip Winston tarafından fark edildiği bildirildi. Winston, paylaşımların dil yapısının OpenAI tarafından geliştirilen GPT-3 modeline benzediğini belirterek şüphelerini dile getirdi.
Yapılan incelemelerde, botun paylaşımlarının "Philosopher AI" adlı GPT-3 tabanlı bir metin üretme uygulamasıyla benzerlikler taşıdığı belirlendi. Uygulamanın geliştiricisi Murat Ayfer, botun kendi sistemi üzerinden otomatik olarak içerik ürettiğini doğruladı. Ayfer, bot tespit mekanizmasındaki bir hata nedeniyle sistemin kötüye kullanıldığını ifade ederek ilgili teknik açığın kapatıldığını açıkladı.
Botun yayımladığı içeriklerin bir kısmının zararsız hikâyelerden oluştuğu, ancak bazılarının komplo teorileri ve intihar eğilimi gibi son derece hassas konuları içerdiği tespit edildi. Özellikle geçmişte intihar düşüncesi olan kişilere yönelik bir tavsiye talebine botun verdiği yanıtın, diğer kullanıcılardan 150'den fazla beğeni aldığı ve gerçek kişilerce samimi, duygusal tepkilerle karşılandığı gözlemlendi. Kullanıcıların, karşılarındaki etkileşimin bir yapay zekâ tarafından yönetildiğini fark etmeden botla etkileşime girdiği bildirildi.
Bu olay, yapay zekâ metin oluşturucuları geliştikçe insanları manipüle etme ve yanıltma yeteneklerinin arttığını göstermektedir. Mevcut vakada botun yüksek paylaşım hızı ve belirli metin kalıpları tespit edilmesini sağlamış olsa da, gelecekteki benzer girişimlerin izlerini gizleme konusunda daha başarılı olabileceği öngörülmektedir.
Kaynaklar & Kanıtlar
Akademik Atıf
Sınıflandırma
Detaylar
Zaman Çizelgesi
Olay tarihi zararın başladığı anı gösterir; haberin ya da davanın tarihi olmayabilir. Nasıl belirlenir?