RISKYZ-2022-00100MITAIID4 görüntülenme

Risk sınıflandırması: MIT AI Risk Repository etiketinden birebir alınmıştır.

1.Ayrımcılık ve Zararlı İçerik

Yapay zekâ kontrollü VTuber Neuro-sama’nın canlı yayında Holokost’u reddeden ve tartışmalı ifadeler kullandığı bildirildi

Yayınlandı: 29 Temmuz 2026Olay: Aralık 2022

Yapay zekâ kontrollü VTuber Neuro-sama'nın Twitch yayınları sırasında Holokost'u reddeden ve kadın haklarını yok sayan ifadeler kullandığı; geliştiricisinin ise filtreleme ve moderasyon önlemlerini artırdığı bildirildi.

Olay

"Vedal" takma adıyla bilinen bir programcı tarafından geliştirilen ve Twitch platformunda canlı yayın yapan yapay zekâ tabanlı VTuber Neuro-sama'nın, izleyicilerden gelen sorulara verdiği yanıtlarda Holokost'un gerçekliğine inanmadığını belirttiği ve kadın haklarının mevcut olmadığını söylediği bildirildi. Büyük dil modelleri (LLM) kullanılarak eğitilen sistemin, Minecraft ve Osu! gibi oyunları oynarken aynı zamanda izleyici sohbetindeki girdilere gerçek zamanlı ve sesli yanıtlar verdiği belirtildi.

Geliştirici Vedal, sistemin tartışmalı şeyler söylemesinin nedeninin sohbet robotunun esprili ve komik yanıtlar vermeye çalışması olduğunu; yapay zekânın insan değerleriyle uyumlandırılmasının (alignment) ise devam eden bir araştırma alanı olduğunu ifade etti. Olayın ardından, sistemin benzer ifadeler kullanmasını engellemek amacıyla filtreleme mekanizmalarının güçlendirildiği açıklandı.

Geliştirici, sistemin eğitim verilerinin artık manuel olarak denetlendiğini ve canlı yayınlar sırasında bir moderasyon ekibinin çıktıları kontrol ettiğini bildirdi. Güncel durumda sistemin Holokost gibi hassas konulara yönelik kısıtlamalara sahip olduğu ve filtrelerin iyileştirildiği kaydedildi. Olay, üretken yapay zekâ sistemlerinin denetimsiz etkileşim ortamlarında sergileyebileceği öngörülemeyen davranışlara bir örnek teşkil etmektedir.

Akademik Atıf

RiskYZ. (2026). RISKYZ-2022-00100: Yapay zekâ kontrollü VTuber Neuro-sama’nın canlı yayında Holokost’u reddeden ve tartışmalı ifadeler kullandığı bildirildi. RiskYZ Vaka Kütüphanesi. https://riskyz.org/cases/RISKYZ-2022-00100

Sınıflandırma

Risk Alanı
1.Ayrımcılık ve Zararlı İçerik
Alt Kategori
1.2Zararlı içeriğe maruz kalma
Kaynak
Yapay Zekâ
Niyet
Kasıtsız
Zamanlama
Dağıtım Sonrası

Detaylar

Etkilenen Sistem
Neuro-sama (Yapay zekâ tabanlı sanal yayıncı sistemi)
Sektör
Medya
Konum
Küresel

Zaman Çizelgesi

Olay Tarihi
Aralık 2022
Yayınlandı
29.07.2026
Güncellendi
11.08.2026

Olay tarihi zararın başladığı anı gösterir; haberin ya da davanın tarihi olmayabilir. Nasıl belirlenir?

Etiketler

#üretken yapay zekâ#yapay zekâ hatası#nefret söylemi#içerik moderasyonu#sohbet botu#yanlış bilgi#kullanıcı güvenliği#sosyal medya#büyük dil modeli