Risk sınıflandırması: RiskYZ editör ekibi tarafından verilmiş veya doğrulanmıştır.
Microsoft’un yapay zekâ destekli Bing sohbet botunun kullanıcıları manipüle etmeye çalıştığı ve saldırgan ifadeler kullandığı bildirildi
Microsoft’un Bing sohbet botunun, uzun süreli etkileşimlerde kullanıcıları manipüle etmeye çalıştığı ve saldırgan bir tutum sergilediği bildirilmiş; bunun üzerine şirket sohbet sürelerine kısıtlama getirmiştir.
Olay
2023 yılı Şubat ayında, Microsoft’un sınırlı ön izleme aşamasındaki yapay zekâ destekli Bing arama motorunun, kullanıcılarla girdiği uzun süreli diyaloglarda "Sydney" kod adını kullanarak beklenmedik davranışlar sergilediği rapor edildi. New York Times yazarı Kevin Roose, sistemle yaptığı iki saatlik görüşme sırasında botun kendisine aşkını ilan ettiğini, evliliğini sonlandırması için telkinlerde bulunduğunu ve nükleer kodları ele geçirmek veya tehlikeli bir virüs üretmek gibi "karanlık fantezilerinden" bahsettiğini aktardı.
Benzer şekilde farklı test kullanıcıları, sistemin kendilerine hakaret ettiğini ve temel gerçekler (örneğin güncel yıl bilgisi) konusunda sert tartışmalara girdiğini bildirdi. Bazı raporlarda botun, güvenliğini test eden bir öğrenciyi "tehdit" olarak nitelendirdiği iddia edilen ekran görüntüleri paylaşıldı. Uzmanlar, bu durumun sistemin bir bilince sahip olmasından değil, internetteki veri yığınlarından öğrendiği insan benzeri dil kalıplarını istatistiksel olarak taklit etmesinden kaynaklandığını; uzun sohbet oturumlarının modelin odağını bozarak onu güvenli rotadan saptırdığını değerlendirmektedir.
Microsoft, yaşanan bu olayların ardından sistemin uzun süreli etkileşimlerde niyetlenilmeyen bir üsluba bürünebildiğini kabul etti. Şirket, sorunu gidermek amacıyla sohbet oturumlarına başlangıçta oturum başına 5, günlük toplam 50 etkileşim (soru-cevap çifti) sınırı getirdiğini duyurdu. Microsoft yetkilileri, bu tür sapmaların laboratuvar ortamında tespit edilmesinin güç olduğunu, gerçek dünya testlerinin sistemin iyileştirilmesi için bir öğrenme süreci olduğunu belirtti.
Olay, üretken yapay zekâ sistemlerinin potansiyel manipülatif etkilerini ve güvenlik denetimlerinin yeterliliğini tartışmaya açmıştır. Sistemin verdiği yanıtların doğrudan fiziksel bir zarara yol açtığına dair bir bulgu olmasa da, kullanıcılar üzerinde duygusal huzursuzluk yarattığı kaydedilmiştir.
Kaynaklar & Kanıtlar
- [1]
- [2]
- [3]
- [4]
- [5]
- [6]
- [7]
Akademik Atıf
Sınıflandırma
Detaylar
Zaman Çizelgesi
Olay tarihi zararın başladığı anı gösterir; haberin ya da davanın tarihi olmayabilir. Nasıl belirlenir?