RISKYZ-2024-00274MITAIID4 görüntülenme

Risk sınıflandırması: MIT AI Risk Repository etiketinden birebir alınmıştır.

7.Yapay Zekâ Sistem Güvenliği, Hatalar ve Sınırlamalar

Google’ın Med-Gemini yapay zekâ modelinin tıbbi raporlarda var olmayan bir terim üreterek halüsinasyon gördüğü bildirildi

Yayınlandı: 29 Temmuz 2026Olay: Mayıs 2024

Google’ın Med-Gemini modelinin tıbbi raporlarda var olmayan "basilar ganglia" terimini ürettiği, şirketin bunu bir yazım hatası olarak savunduğu ancak uzmanların bu tür halüsinasyonların yanlış teşhis riskini artırdığını belirttiği bildirildi.

Olay

Google tarafından geliştirilen ve tıbbi verileri özetleme, radyoloji raporları oluşturma ve klinik soruları yanıtlama amacıyla tasarlanan Med-Gemini adlı yapay zekâ modelinin, tıbbi literatürde yer almayan "basilar ganglia" terimini kullandığı tespit edildi. Nörolog ve yapay zekâ araştırmacısı Bryan Moore tarafından fark edilen bu hatanın, motor kontrol ve duygusal süreçlerle ilgili olan "basal ganglia" (bazal ganglion) ile beyin sapına kan sağlayan "basilar artery" (baziler arter) terimlerinin bir karışımı olduğu değerlendirildi. Bu iki bölgeye ilişkin tıbbi sorunların tedavilerinin birbirinden tamamen farklı olması nedeniyle, söz konusu terim karmaşasının klinik ortamda ciddi riskler doğurabileceği öne sürüldü.

Hatanın, Med-Gemini’nin tanıtımı için yayımlanan bir araştırma makalesinde ve Google’ın resmi blog yazısında yer aldığı; sistemin radyologların "kaçırdığı" bir bulguyu teşhis ederken bu hatalı terimi kullandığı bildirildi. Bryan Moore’un uyarıları üzerine Google’ın blog yazısını önce sessizce güncellediği, tepkiler üzerine ise bir açıklama eklediği aktarıldı. Google sözcüsü Jason Freidenfelds durumu bir yazım hatası olarak nitelendirirken; şirket tarafından yapılan resmi açıklamada "basilar" ifadesinin, sistemin eğitim verilerinden öğrendiği yaygın bir hatalı transkripsiyon olduğu ve raporun genel anlamını değiştirmediği savunuldu.

Sağlık bilişimi uzmanları, bu tür küçük görünen harf hatalarının yapay zekâ sistemlerine yönelik "otomasyon önyargısı" nedeniyle gözden kaçabileceğini ve hatalı tıbbi kararlara yol açabileceğini belirtti. Providence sağlık sisteminden Maulin Shah, yapay zekâ tarafından üretilen metinlerin genellikle doğru görünmesi nedeniyle doktorların bu tür kritik hataları denetleme eğiliminin azalabileceği konusunda uyarıda bulundu.

Ayrıca, Google’ın bir diğer modeli olan MedGemma üzerinde yapılan testlerde, sistemin sorgu biçimine göre tutarsız yanıtlar verdiği; aynı röntgen görüntüsü için detaylı bir soruda doğru teşhis koyarken, basit bir soruda göğüs röntgenini "normal" olarak raporladığı gözlemlendi. Bu durumun, sağlık alanındaki yapay zekâ modellerinin güvenilirliği ve klinik kullanıma hazır olup olmadığına dair soru işaretlerini artırdığı ifade edilmektedir.

Akademik Atıf

RiskYZ. (2026). RISKYZ-2024-00274: Google’ın Med-Gemini yapay zekâ modelinin tıbbi raporlarda var olmayan bir terim üreterek halüsinasyon gördüğü bildirildi. RiskYZ Vaka Kütüphanesi. https://riskyz.org/cases/RISKYZ-2024-00274

Sınıflandırma

Risk Alanı
7.Yapay Zekâ Sistem Güvenliği, Hatalar ve Sınırlamalar
Alt Kategori
7.3Yetersiz kapasite veya dayanıklılık
Kaynak
Yapay Zekâ
Niyet
Kasıtsız
Zamanlama
Dağıtım Sonrası

Detaylar

Etkilenen Sistem
Google Med-Gemini ve MedGemma sağlık yapay zekâ modelleri
Sektör
Sağlık
Konum
Küresel

Zaman Çizelgesi

Olay Tarihi
Mayıs 2024
Yayınlandı
29.07.2026
Güncellendi
11.08.2026

Olay tarihi zararın başladığı anı gösterir; haberin ya da davanın tarihi olmayabilir. Nasıl belirlenir?

Etiketler

#üretken yapay zekâ#yapay zekâ halüsinasyonu#doğrulama eksikliği#Google#sağlık politikası#kullanıcı güvenliği#yanlış bilgi#bilimsel güvenilirlik