RISKYZ-2023-00072MITAIID4 görüntülenme

Risk sınıflandırması: MIT AI Risk Repository etiketinden birebir alınmıştır.

4.Kötü Niyetli Aktörler ve Kötüye Kullanım

Büyük dil modellerinin yeraltı pazarlarındaki kötü amaçlı yapay zekâ servislerine temel teşkil ettiği iddia edildi

Yayınlandı: 29 Temmuz 2026Olay: Aralık 2023

Araştırmacılar, OpenAI ve Anthropic gibi şirketlerin büyük dil modellerinin, yeraltı pazarlarında siber suç amacıyla pazarlanan çeşitli kötü amaçlı servislerin (Malla) arka planında istismar edildiğini saptamıştır.

Olay

Indiana Üniversitesi Bloomington’dan araştırmacıların yayımladığı "Malla" başlıklı çalışmada, kötü niyetli faaliyetler için özelleştirilmiş yapay zekâ servislerinin yeraltı pazarlarındaki işleyişi incelenmiştir. Kasım 2022 ile Ekim 2023 tarihleri arasında dokuz yeraltı forumundan toplanan verilerle 212 gerçek dünya örneği (araştırmacıların deyimiyle 'Malla') tespit edilmiştir. Bu servislerin %93,4’ünün kötü amaçlı yazılım üretimi, %41,5’inin kimlik avı e-postaları ve %17,4’ünün dolandırıcılık siteleri oluşturma yeteneğine sahip olduğu saptanmıştır.

Raporda; BadGPT, FraudGPT ve EscapeGPT gibi araçların önemli bir kısmının teknik altyapısında OpenAI’ın GPT-3.5 ve GPT-4 modelleri ile Anthropic’in Claude modellerinin kötüye kullanıldığı öne sürülmüştür. WormGPT'nin ise GPT-J modeline dayandığı belirtilmiştir. Kötü niyetli aktörlerin, ticari modellerin güvenlik filtrelerini "jailbreak" yöntemleriyle aştığı veya Pygmalion-13B gibi açık kaynaklı modelleri modifiye ederek kullandığı saptanmıştır. Özellikle EscapeGPT ve DarkGPT'nin antivirüsleri atlatabilen kodlar üretebildiği, WolfGPT’nin ise ikna edici kimlik avı içeriklerinde başarılı olduğu aktarılmıştır.

Araştırmacılar, OpenAI’ın bu tür istismarlarda en sık hedef alınan sağlayıcı olduğunu ifade etmiştir. Ancak WormGPT ve FraudGPT gibi servisleri satın alma girişimlerinin bazen ödeme yapılmasına rağmen başarısız olduğu, bu durumun yeraltı pazarlarındaki dolandırıcılıklardan kaynaklanabileceği ve reklamı yapılan her servisin iddia edilen yeteneklere sahip olmayabileceği not edilmiştir.

Çalışmada, FlowGPT gibi platformların denetim eksikliğinin bu servislerin yayılmasına zemin hazırladığı vurgulanmıştır. Araştırmacılar, model geliştiricilerin güvenlik protokollerini güncellemeleri ve denetimsiz modellere erişimin bilimsel toplulukla sınırlandırılması gerektiğini tavsiye etmiştir.

Akademik Atıf

RiskYZ. (2026). RISKYZ-2023-00072: Büyük dil modellerinin yeraltı pazarlarındaki kötü amaçlı yapay zekâ servislerine temel teşkil ettiği iddia edildi. RiskYZ Vaka Kütüphanesi. https://riskyz.org/cases/RISKYZ-2023-00072

Sınıflandırma

Risk Alanı
4.Kötü Niyetli Aktörler ve Kötüye Kullanım
Alt Kategori
4.2Siber saldırılar, silah geliştirme ve kitlesel zarar
Kaynak
İnsan
Niyet
Kasıtlı
Zamanlama
Dağıtım Sonrası

Detaylar

Etkilenen Sistem
OpenAI (GPT-3.5, GPT-4), Anthropic (Claude), Pygmalion-13B, GPT-J ve bu modelleri temel alan kötü amaçlı servisler (Frau
Sektör
Bilişim
Konum
Küresel

Zaman Çizelgesi

Olay Tarihi
Aralık 2023
Yayınlandı
29.07.2026
Güncellendi
11.08.2026

Olay tarihi zararın başladığı anı gösterir; haberin ya da davanın tarihi olmayabilir. Nasıl belirlenir?

Etiketler

#üretken yapay zekâ#kötü amaçlı yazılım#kimlik avı#siber suç#OpenAI#ChatGPT#jailbreak#WormGPT#FraudGPT