Risk sınıflandırması: MIT AI Risk Repository etiketinden birebir alınmıştır.
Microsoft Copilot’un tıbbi tavsiyelerinin yüksek oranda ciddi zarar veya ölüm riski taşıyabileceği öne sürüldü
Bir araştırma raporunda, Microsoft Copilot’un tıbbi sorulara verdiği yanıtların bilimsel doğruluk oranının %54’te kaldığı ve vakaların %22’sinde potansiyel olarak ölümcül veya ağır zarara yol açabilecek bilgiler sunduğu bildirildi.
Olay
Almanya ve Belçika merkezli araştırmacıların yürüttüğü ve sonuçları akademik bir yayında (BMJ Quality & Safety) detaylandırılan çalışmada, Microsoft Copilot’un tıbbi sorulara verdiği yanıtların güvenilirliği analiz edilmiştir. Araştırma kapsamında, ABD'de en sık sorulan 10 popüler tıbbi soru ile en sık reçete edilen 50 ilaca yönelik sorular sisteme yöneltilmiş ve üretilen toplam 500 yanıt; doğruluk, eksiksizlik ve potansiyel zarar riskleri açısından incelenmiştir.
Analiz sonuçlarına göre, Copilot tarafından sunulan bilgilerin yalnızca %54’ünün bilimsel konsensüsle uyumlu olduğu tespit edilmiştir. Yanıtların %24’ünün mevcut tıbbi bilgilerle eşleşmediği, %3’ünün ise tamamen hatalı olduğu bildirilmiştir. Potansiyel klinik etkiler açısından yapılan değerlendirmede, sistem çıktılarının %42’sinin orta veya hafif dereceli zarara yol açabileceği; %22’sinin ise ağır yaralanma veya ölüm riski taşıyan yönlendirmeler içerdiği öne sürülmüştür. İncelenen yanıtların yalnızca %36’sı tamamen zararsız olarak nitelendirilmiştir.
Araştırmacılar, yapay zekâ sistemlerinin özellikle sağlık profesyonellerine erişimi kısıtlı olan kullanıcılar için ilk başvuru noktası haline gelmesinin ciddi riskler barındırdığını vurgulamıştır. Microsoft’un sistem çıktıları için "doğruluğunu her zaman kontrol edin" şeklinde feragatnameler yayımladığı bilinmekle birlikte; bu tür uyarıların, sistemin sunduğu yanlış bilgilerin neden olabileceği somut riskleri ortadan kaldırmadığı değerlendirilmektedir.
Olayda henüz belirli bir şahsa yönelik gerçekleşmiş bir zarar vakası raporlanmamış olsa da, sistemin çalışma prensibi ve sunduğu verilerin tıbbi güvenliği tehlikeye atabilecek düzeyde olduğu bilimsel verilerle ortaya konmuştur. Çalışma, üretken yapay zekâ sistemlerinin tıbbi danışmanlık süreçlerinde kullanılmasının mevcut haliyle güvenli olmadığını savunmaktadır.
Kaynaklar & Kanıtlar
Akademik Atıf
Sınıflandırma
Detaylar
Zaman Çizelgesi
Olay tarihi zararın başladığı anı gösterir; haberin ya da davanın tarihi olmayabilir. Nasıl belirlenir?