Risk sınıflandırması: MIT AI Risk Repository etiketinden birebir alınmıştır.
Anthropic, DeepSeek, Moonshot AI ve MiniMax’in Sahte Hesaplar Kullanarak Claude’un Yeteneklerini Büyük Ölçekte İzinsiz Damıttığını İddia Etti
Anthropic, DeepSeek, Moonshot AI ve MiniMax’in yaklaşık 24.000 sahte hesap ve proxy altyapıları üzerinden Claude ile 16 milyondan fazla etkileşim gerçekleştirerek modelin akıl yürütme, kodlama ve araç kullanma yeteneklerini izinsiz biçimde kendi sistemlerine aktarmaya çalıştığını iddia etti.
Olay
Anthropic, Çin merkezli yapay zekâ şirketleri DeepSeek, Moonshot AI ve MiniMax’in Claude modellerinin yeteneklerini kendi sistemlerine aktarmak amacıyla büyük ölçekli ve izinsiz model damıtma kampanyaları yürüttüğünü açıkladı.
Model damıtma, daha gelişmiş bir yapay zekâ modelinin ürettiği yanıtların başka bir modelin eğitilmesi veya geliştirilmesi amacıyla kullanılması sürecini ifade etmektedir. Anthropic, söz konusu şirketlerin bu yöntemi hizmet koşullarını ve bölgesel erişim sınırlamalarını ihlal ederek uyguladığını ileri sürdü.
Kaynak açıklamasına göre üç şirket, yaklaşık 24.000 sahte hesap üzerinden Claude ile toplam 16 milyondan fazla etkileşim gerçekleştirdi. Trafiğin kaynağını gizlemek, hesaplar arasındaki bağlantıların tespit edilmesini zorlaştırmak ve güvenlik mekanizmalarını aşmak için proxy servisleri ile “hydra cluster” olarak adlandırılan dağıtık altyapıların kullanıldığı belirtildi.
DeepSeek’in 150.000’den fazla etkileşim gerçekleştirerek özellikle akıl yürütme yeteneklerini ve sansür mekanizmalarına takılmadan benzer yanıtlar üretme yöntemlerini hedeflediği bildirildi.
Moonshot AI’ın 3,4 milyondan fazla etkileşim yoluyla ajansal akıl yürütme, araç kullanımı ve bilgisayarlı görü yeteneklerine odaklandığı belirtildi. MiniMax’in ise 13 milyondan fazla etkileşim gerçekleştirerek ajansal kodlama, araçların birlikte kullanılması ve görev orkestrasyonu gibi yetenekleri çıkarmaya çalıştığı öne sürüldü.
Anthropic, kampanyaları IP adresleri arasındaki ilişkiler, istek metaverileri, hesap davranışları ve kullanılan teknik altyapıya ilişkin göstergeler üzerinden ilgili şirketlerle ilişkilendirdiğini açıkladı. Bununla birlikte iddiaların Anthropic’in kendi teknik incelemesine dayandığı ve kaynak metinde bağımsız bir soruşturma sonucuna yer verilmediği dikkate alınmalıdır.
Şirket, kampanyaların Claude’un özellikle akıl yürütme, kodlama, bilgisayar kullanımı ve haricî araçlarla işlem yürütme gibi ayırt edici yeteneklerini hedeflediğini belirtti. Bu yöntemle elde edilen çıktıların rakip modellerin eğitiminde kullanılarak Claude’un geliştirilmesi için yapılan yatırımların izinsiz biçimde aktarılmış olabileceği değerlendirildi.
Vaka; yapay zekâ sağlayıcılarının sahte hesap tespiti, API erişim kontrolü, yüksek hacimli sorgu örüntülerinin izlenmesi, model çıktılarının yetkisiz eğitim amacıyla kullanılmasının önlenmesi ve sınır ötesi hesap verebilirlik konularında karşılaştığı riskleri göstermektedir.
Kaynaklar & Kanıtlar
- [1]
- [2]
- [3]
- [4]
- [5]
Akademik Atıf
Sınıflandırma
Detaylar
Zaman Çizelgesi
Olay tarihi zararın başladığı anı gösterir; haberin ya da davanın tarihi olmayabilir. Nasıl belirlenir?