Anthropic, son yaptığı açıklamada yedi farklı Çin merkezli laboratuvarın Claude modeline karşı büyük ölçekli yasa dışı distilasyon saldırıları gerçekleştirdiğini belirtti. Bu laboratuvarlar arasında Alibaba, Moonshot, DeepSeek, Z.ai (Zhipu olarak da bilinir) ve MiniMax yer alıyor.
Bilgi Distilasyonu Nedir?
Bilgi distilasyonu, makine öğrenimi alanında yaygın bir eğitim yöntemidir. Bu teknik, büyük ve güçlü bir yapay zeka modelinin "öğretmen" rolünü üstlenerek daha küçük ve daha az yetenekli bir "öğrenci" modelini eğitmesi anlamına gelir. Ancak, yasa dışı distilasyon, bir modelin yeteneklerini izinsiz olarak çıkartarak başka bir modelde çoğaltma girişimidir. Bu tür saldırılar genellikle sahte hesaplar kullanılarak gerçekleştirilir.
Yasa Dışı Saldırıların Yöntemleri
Anthropic, bu laboratuvarların Claude modeline erişim sağlamak için proxy hizmetleri aracılığıyla kullanıcı taleplerini yönlendirdiğini ifade etti. Bu yöntemle, sahte kimlikler ve çalıntı kredi kartları kullanarak binlerce yeni hesap oluşturuluyor. Ayrıca, bu laboratuvarlar, kullanıcıların izni olmadan U.S. frontier modelleri ile gerçekleştirilmiş etkileşimlerin transkriptlerini üçüncü taraf satıcılardan satın alabiliyor.
Örnek Yasa Dışı Saldırılar
Anthropic, Şubat 2026'dan bu yana altı farklı yasa dışı distilasyon kampanyası tespit etti. Bu kampanyalardan bazıları şunlardır:
- GTG-16002: Moonshot AI, 23 milyon etkileşim kaydetti ve bu süreçte kullanıcı taleplerini Claude'a yönlendirdi.
- GTG-16001: DeepSeek, aynı şekilde 12.1 milyon etkileşim gerçekleştirdi.
- GTG-16006: Zhipu, 3.4 milyon etkileşim kaydederek Claude'un mantık izlerini kullandı.
- GTG-16008: Xiaomi, kendi modellerinden kullanıcı konuşmalarını Claude'a yönlendirdi.
- GTG-16012: SenseTime, üçüncü taraf veri satıcılarından kullanıcı etkileşim transkriptleri satın aldı.
- GTG-16003: MiniMax, kendi proxy ağını kurarak Anthropic ve OpenAI modellerine erişim sağladı.
Koruma Önlemleri
Anthropic, yasa dışı distilasyonu önlemek amacıyla, kullanıcıların kimliklerini doğrulamadığı durumlarda, yasaklı bölgelerden (Çin, İran, Rusya) gelen satıcı hesaplarını kapatıyor. Ayrıca, Claude modelinin iç mantığını özetlemesi için güncellemeler yaparak, çalıntı transkriptlerin sonraki eğitimlerde kullanılmasını zorlaştırıyor.
Son olarak, Anthropic, kendi modellerini kullanarak vatandaşlarını gözetlemeye çalışan hesapları kapattığını ve bazı laboratuvarların biyolojik silahlar destekleyecek şekilde hastalık araştırmaları yaptığına dair suçlamalarla karşı karşıya kaldığını belirtti.





Yorumlar 0
Yorum kurallarıHenüz yorum yok. İlk yorumu siz yapın.