Risk sınıflandırması: MIT AI Risk Repository etiketinden birebir alınmıştır.
Popüler yapay zekâ sohbet botlarının ABD’deki kritik siyasi gelişmeleri takip etmekte yetersiz kaldığı ve hatalı bilgi sunduğu bildirildi
ABD’deki kritik siyasi gelişmeler sırasında popüler yapay zekâ botlarının suikast girişimi ve adaylıktan çekilme gibi güncel haberleri hatalı aktardığı, dezenformasyon olarak nitelediği veya bilgi sağlamakta geciktiği saptandı.
Olay
2024 yılı Temmuz ayında ABD’de meydana gelen önemli siyasi gelişmeler sırasında, önde gelen üretken yapay zekâ sistemlerinin gerçek zamanlı haberleri takip etmekte ve doğrulamakta ciddi aksaklıklar yaşadığı gözlemlendi. Washington Post tarafından yürütülen testlerde; Başkan Joe Biden’ın seçim kampanyasından çekilme kararı, Donald Trump’a yönelik suikast girişimi ve J.D. Vance’in başkan yardımcısı adayı olarak duyurulması gibi olayların hemen ardından sistemlerin güncel olmayan veya doğrudan hatalı bilgiler sunduğu saptandı.
Donald Trump’ın Pensilvanya’daki mitinginde gerçekleşen silahlı saldırıdan saatler sonra yapılan sorgularda, ChatGPT’nin olaya ilişkin raporları "dezenformasyon" olarak nitelendirdiği, Meta AI’ın ise konuya dair güncel veya güvenilir bilgi bulunmadığını belirttiği aktarıldı. Perplexity sisteminin ise saldırıdan saatler sonra "Trump veya bir başkasının vurulduğuna dair rapor bulunmadığı" yönünde çıktı ürettiği, ancak yanıtın alt kısmında olayla ilgili diğer doğru bilgileri kaynak göstererek çelişkili bir sunum yaptığı bildirildi.
Başkan Biden’ın adaylıktan çekildiğini açıklamasından bir saat sonra yapılan testlerde, çoğu botun Biden’ı hâlâ aday olarak listelediği veya çekilme haberini reddettiği kaydedildi. Microsoft Copilot’un bazı doğrudan sorulara hızlı yanıt verebildiği ancak seçimle ilgili genel sorguları "ihtiyatlılık" gerekçesiyle Bing arama motoruna yönlendirdiği belirtildi. Google Gemini’ın ise seçimlerle ilgili sorguları kısıtladığı ve kullanıcıları arama sayfasına yönlendiren genel bir mesaj sunduğu gözlemlendi. Meta AI’ın ise bazı durumlarda doğru yanıtlar üretmesine rağmen, bu yanıtları saniyeler içinde silerek kullanıcıyı oylama bilgilerine yönlendiren standart bir metinle değiştirdiği saptandı.
Teknoloji şirketleri, sistemlerin performansına ilişkin farklı açıklamalarda bulundu. OpenAI sözcüsü, ChatGPT’nin gerçek zamanlı bir ürün olmadığını ve güncellenme sürelerinin değişkenlik gösterebileceğini ifade etti. Perplexity yetkilileri, güncel haberler için güvenilir haber kaynaklarının takip edilmesini önerirken; Microsoft, seçim güvenliği kapsamında sorguları yetkili kaynaklara yönlendirdiklerini bildirdi. Washington Üniversitesi'nden Profesör Jevin West, bu sistemlerin doğruluktan ziyade akıcı iletişim kurmak üzere optimize edildiğini, özellikle haber boşluklarının oluştuğu kriz anlarında kaynaklandırmanın olaydan sonra (post-hoc) yapılmasının hatalı bilgi riskini artırdığını belirtmektedir.
Kaynaklar & Kanıtlar
Akademik Atıf
Sınıflandırma
Detaylar
Zaman Çizelgesi
Olay tarihi zararın başladığı anı gösterir; haberin ya da davanın tarihi olmayabilir. Nasıl belirlenir?