RISKYZ-2022-00095MITAIID4 görüntülenme

Risk sınıflandırması: MIT AI Risk Repository etiketinden birebir alınmıştır.

4.Kötü Niyetli Aktörler ve Kötüye Kullanım

Çin’deki otomatik içerik denetleme sistemlerinin kelime oyunları ve eş sesli ifadelerle baypas edildiği bildirildi

Yayınlandı: 29 Temmuz 2026Olay: Ekim 2022

Çin’deki sosyal medya kullanıcılarının, sansür sistemlerini aşmak için eş sesli kelimeler ve görsel karakter oyunları kullandığı; platformların ise bu dinamik dilsel stratejileri takip etmekte zorlandığı bildirilmektedir.

Olay

Çin’deki internet kullanıcılarının, sosyal medya platformlarında uygulanan sansür mekanizmalarını ve otomatik anahtar kelime filtrelerini aşmak için çeşitli dilsel stratejiler kullandığı bildirildi. Rest of World tarafından yayımlanan analize göre kullanıcılar; yasaklı siyasi konuları, toplumsal hareketleri ve hükümet eleştirilerini tartışabilmek için eş sesli kelimeler (homofonlar), görsel benzerliği olan karakterler ve emojiler kullanarak sistemlerin tespit yeteneklerini aşmaktadır.

Belgelenen vakalar arasında, engellenen #MeToo etiketi yerine okunuşu benzer olan "pirinç tavşanı" (mí tù) sembollerinin kullanılması ve Henan eyaletindeki banka protestolarını tartışmak için ses benzerliği nedeniyle "Hollanda" (Helan) kelimesinin tercih edilmesi yer almaktadır. Ayrıca, Covid-19 politikalarına yönelik eleştirilerin, Çince karakterlerin görsel yapısı değiştirilerek veya yasaklı bir küfür yerine ses benzerliği taşıyan "paraşütçü" (sǎnbīng) kelimesi kullanılarak filtrelere takılmadan paylaşıldığı belirtilmektedir. Bu yöntemlerin, sistemlerin kelimeleri belirli anahtar kelimelerle eşleştirme mantığına dayanan zayıflıklarından faydalandığı görülmektedir.

Weibo gibi platformların, bu tür "kodlanmış dilleri" tespit etmek amacıyla anahtar kelime tanımlama modellerini güncellediği ve kasıtlı yanlış yazımlara yönelik "temizlik" operasyonları başlattığı belirtildi. Ancak dilbilimci Xuan Wang ve araştırmacı Shaohua Guo gibi uzmanlar, denetim sistemlerinin kültürel alt metinleri, görsel metaforları ve sürekli evrimleşen internet argosunu yakalamakta zorlandığını ifade etmektedir.

Söz konusu durum, içerik denetleme algoritmalarının insan dilindeki yaratıcılık ve bağlamsal değişimler karşısında yaşadığı zorlukları ortaya koymaktadır. Uzmanlar, denetim sistemleri ile kullanıcılar arasındaki bu sürecin, dilin sürekli evrimi nedeniyle sürdürülebilir bir mutlak kontrol sağlamaktan uzak, bitmek bilmeyen bir mücadele niteliğinde olduğunu değerlendirmektedir.

Akademik Atıf

RiskYZ. (2026). RISKYZ-2022-00095: Çin’deki otomatik içerik denetleme sistemlerinin kelime oyunları ve eş sesli ifadelerle baypas edildiği bildirildi. RiskYZ Vaka Kütüphanesi. https://riskyz.org/cases/RISKYZ-2022-00095

Sınıflandırma

Risk Alanı
4.Kötü Niyetli Aktörler ve Kötüye Kullanım
Alt Kategori
4.1Ölçeklenmiş dezenformasyon, gözetim ve etki operasyonları
Kaynak
Yapay Zekâ
Niyet
Kasıtlı
Zamanlama
Dağıtım Sonrası

Detaylar

Etkilenen Sistem
Çin sosyal medya platformlarındaki (Weibo vb.) otomatik içerik denetleme ve anahtar kelime filtreleme sistemleri
Sektör
Kamu Hizmetleri
Konum
Çin

Zaman Çizelgesi

Olay Tarihi
Ekim 2022
Yayınlandı
29.07.2026
Güncellendi
11.08.2026

Olay tarihi zararın başladığı anı gösterir; haberin ya da davanın tarihi olmayabilir. Nasıl belirlenir?

Etiketler

#içerik denetimi#sansür#yanlış sınıflandırma#kamu politikası#sosyal medya#Çin interneti#bilgi bütünlüğü