Anthropic'ten Çinli Yapay Zeka Firmalarına Yönelik Damıtma Saldırıları Raporu
Yayınlanan yeni rapor, ABD sınır model yeteneklerini hedef alan Çin merkezli yapay zeka şirketlerinin yürüttüğü kapsamlı operasyonları gözler önüne serdi.
Anthropic tarafından Perşembe günü yayınlanan yeni bir rapor, Alibaba, Moonshot AI ve DeepSeek gibi Çin merkezli yapay zeka şirketlerinin ABD sınır modellerinin yeteneklerini ele geçirmek amacıyla kalıcı damıtma saldırıları düzenlediğini ortaya koydu.
Damıtma Saldırılarının Kapsamı ve Hedefleri
Anthropic, son aylarda şiddetlenen rekabet ortamında yetkisiz laboratuvarların savunmaları aşmak için giderek daha gelişmiş yöntemler geliştirdiğini belirtti.
Raporda, tespit edilen kampanyaların Claude modelinin ajanlık ve araç kullanımı, kodlama, veri analizi ile mantıksal akıl yürütme gibi en değerli yeteneklerini hedef aldığı vurgulandı.
Milyonlarca Etkileşim ve Büyük Ölçekli Kampanyalar
Anthropic, damıtma saldırılarıyla bağlantılı olarak beş ayrı kampanya kapsamında yaklaşık 200 milyon etkileşim gözlemlediğini rapor etti.
Bu saldırılar, modellerin yanıtlarındaki düşünce zincirini çıkararak daha küçük bir modeli genel akıl yürütme yeteneği konusunda eğitmeyi amaçlıyor.
Alibaba Kaynaklı En Büyük Toptan Damıtma Operasyonu
Saldırı denemelerinin büyük bir kısmı, Anthropic tarafından bugüne kadar gözlemlenen en büyük toptan damıtma çabası olarak nitelendirilen Alibaba bağlantılı kampanyadan geldi.
Mayıs ve Temmuz 2026 arasında bu kampanyaya atfedilen 151 milyon etkileşim gözlemlenirken, faaliyetler günlük üç milyon etkileşime ulaştı.
Moonshot AI ve Askeri Odaklı İstekler
Kimi modelinin üreticisi Moonshot AI tarafından yürütülen bir başka kampanya, isteklerin doğrudan Çin ordusundan yönlendirildiğini gösterdi.
On günlük bir süre zarfında çoğunlukla Opus modelini hedef alan yaklaşık 300 bin istek Claude sistemine iletildi.