RISKYZ-2025-00007MITAIID9 görüntülenme

Risk sınıflandırması: MIT AI Risk Repository etiketinden birebir alınmıştır.

3.Yanlış Bilgi

Bilimsel makalelerde ortaya çıkan anlamsız "vegetative electron microscopy" (bitkisel elektron mikroskobu) ifadesinin, yapay zekâ eğitim verisindeki bir kirlenmeden kaynaklandığı ileri sürüldü.

Yayınlandı: 26 Temmuz 2026Olay: Nisan 2025

Araştırmacılar, bilimsel makalelerde tekrarlanan anlamsız "vegetative electron microscopy" ifadesinin büyük dil modellerinin eğitim verisindeki bir kirlenmeden kaynaklandığını iddia etti.

Olay

Araştırmacılar, bilimsel yayınlarda tekrar tekrar karşılaşılan ve anlamsal olarak geçersiz olan "vegetative electron microscopy" ifadesinin kökenini araştırdıklarını ve bu hatanın 1950'li yıllara ait bilim metinlerinin dijitalleştirilmesi sırasında iki farklı sütundaki "vegetative" ve "electron microscopy" kelimelerinin yanlışlıkla birleştirilmesinden kaynaklandığını iddia etti. Farsça'da "vegetative" ve "taramalı" (scanning) kelimelerinin yalnızca bir nokta işaretiyle ayrıldığı, bu nedenle 2017 ve 2019 yıllarında yayımlanan bazı makalelerdeki bir çeviri hatasının ifadeyi yeniden canlandırmış olabileceği belirtildi.

2025 yılında yapılan testlerde, GPT-3, GPT-4, GPT-4o ve Claude 3.5 gibi büyük dil modellerinin, muhtemelen Common Crawl üzerinden eğitim verisine sızan bu kirlenme nedeniyle söz konusu anlamsız ifadeyi ürettiği bildirildi. Bu durumun, hatalı bir ifadenin yapay zekâ modelleri aracılığıyla bilimsel literatürde kalıcı hale gelme riskine işaret ettiği değerlendirildi. Elsevier gibi bazı yayıncıların ifadenin kullanımını savunduğu, buna karşın bilim camiasında ifadenin bir "dijital fosil" haline geldiği yönünde eleştiriler yöneltildiği aktarıldı.

Akademik Atıf

RiskYZ. (2026). RISKYZ-2025-00007: Bilimsel makalelerde ortaya çıkan anlamsız "vegetative electron microscopy" (bitkisel elektron mikroskobu) ifadesinin, yapay zekâ eğitim verisindeki bir kirlenmeden kaynaklandığı ileri sürüldü.. RiskYZ Vaka Kütüphanesi. https://riskyz.org/cases/RISKYZ-2025-00007

Sınıflandırma

Risk Alanı
3.Yanlış Bilgi
Alt Kategori
3.1Yanlış veya yanıltıcı bilgi
Kaynak
Yapay Zekâ
Niyet
Kasıtsız
Zamanlama
Dağıtım Sonrası

Detaylar

Etkilenen Sistem
GPT-3, GPT-4, GPT-4o, Claude 3.5 ve bu modellerin eğitiminde kullanılan Common Crawl veri kümesi
Sektör
Eğitim

Zaman Çizelgesi

Olay Tarihi
Nisan 2025
Yayınlandı
26.07.2026
Güncellendi
14.08.2026

Olay tarihi zararın başladığı anı gösterir; haberin ya da davanın tarihi olmayabilir. Nasıl belirlenir?

Etiketler

#yanlış bilgi#büyük dil modeli#eğitim verisi kirlenmesi#bilimsel yayıncılık#akademik dürüstlük#veri kalitesi