Anthropic: Moonshot ve DeepSeek Claude’a yönlendirdi

Anthropic, Moonshot’ın Kimi kullanıcı isteklerini Claude’a gizlice ilettiğini; DeepSeek ve Alibaba’nın da büyük ölçekli damıtma kampanyaları yürüttüğünü iddia etti.

Anthropic: Moonshot ve DeepSeek Claude’a yönlendirdi

Anthropic, Çin merkezli yapay zeka laboratuvarlarının Claude çıktılarını izinsiz “damıtarak” kendi modellerini beslediğini ve bazı durumlarda kullanıcı isteklerini Claude’a gizlice yönlendirdiğini öne sürdü. 154 sayfalık tehdit istihbaratı raporu, AI rekabetini teknik bir IP kavgasından kullanıcı verisi ve ulusal güvenlik tartışmasına taşıyor.

İddia neyi değiştiriyor?

Damıtma (distillation) tek başına yeni değil: güçlü bir modelin yanıtları ve zincir-düşünce izleri, daha küçük bir modeli eğitmek için kullanılabiliyor. Anthropic’e göre yeni olan ölçek ve yöntem. Şirket, Mayıs–Temmuz 2026 döneminde damıtma saldırılarıyla bağlantılı yaklaşık 200 milyon etkileşim gözlemlediğini; bunların beş ayrı kampanyaya dağıldığını söylüyor.

Donanımhaber’in aktardığı özete göre Moonshot’ın Kimi kullanıcılarına Claude yanıtlarını kendi çıktısı gibi gösterdiği iddiası, klasik “çıktı çalma”nın bir adım ötesine geçiyor: gerçek kullanıcı talebi, kullanıcının haberi olmadan ABD modeline düşmüş olabilir.

Moonshot: 10 günde ~300 bin istek

Rapora göre Moonshot, on günlük bir pencerede 5.380 sahte hesap üzerinden yaklaşık 300 bin isteği Claude’a —çoğunlukla Opus’a— yönlendirdi. Hesapların büyük kısmı Singapur ve Japonya’da görünüyordu. Bloomberg, CNBC ve TechCrunch aynı rakamları aktarıyor. Anthropic, bu trafikte ABD, Avrupa ve Çin’den hassas kullanıcı içeriğinin görülebildiğini; bir örnekte Çengdu’daki güvenlik kamerası görüntülerinin “anormal davranış” analizi için Claude’a gittiğini iddia ediyor.

Moonshot’ın bu etkileşimlerin en az bir kısmını saklayıp Claude’un akıl yürütme izlerini kendi modellerine aktardığı öne sürülüyor.

DeepSeek ve Alibaba ölçeği

DeepSeek için benzer “kullanıcı isteğini Claude’a aktarma” modeli anlatılıyor. CNBC’nin aktardığı Anthropic rakamlarına göre Temmuz 2026’da 14 günde 12 milyonu aşkın damıtma etkileşimi DeepSeek’e atfedildi. En büyük kampanya ise Alibaba/Qwen hattına bağlanıyor: Mayıs–Temmuz arasında 151 milyon etkileşim, günde yaklaşık 3 milyona varan zirve, 3.500’den fazla hesap ve zincir-düşünceyi çıkarmak için sabit bir prompt. Anthropic, Claude’un özet düşünce bloklarını aşmak için çeviri/“working memory” tarzı prompt oyunlarının kullanıldığını da örnekliyor.

Raporda Qwen, Z.ai/GLM, Xiaomi MiMo ve MiniMax M gibi isimler de Şubat 2026’dan beri Claude’dan damıtma yoluyla yararlanmakla anılıyor. Anthropic bu faaliyetleri Çin’de modellere izin vermediği için “yasadışı” diye niteliyor; sahte hesaplar ve çalıntı kart iddiaları dosyada yer alıyor.

Jeopolitik arka plan

Aynı hafta NSA ve FBI’nın da aralarında bulunduğu ABD kurumları altı Çinli şirketi Amerikan model çıktılarını sistematik ele geçirmekle suçladı; Pekin iddiaları “sektörü bastırma” diye reddetti. Anthropic raporu bu resmi anlatıyı şirket kanıtıyla besliyor. Moonshot ve DeepSeek ilk açıklamada hemen yanıt vermedi; iddialar henüz mahkemede kanıtlanmış hüküm değil.

Kullanıcı için pratik risk

Eğer yönlendirme iddiası doğruysa, kullanıcı bir Çin sohbet botuna yazdığını sanırken verisi başka bir sınır ötesi modele gidiyor demektir — gizlilik politikası, veri yerleşimi ve “hangi model cevap verdi?” sorusu bulanıklaşır. Geliştiriciler ve işletmeler için ders net: üçüncü taraf AI API’sinde çıktı sızıntısı ve proxy “transfer station” riski, yalnızca marka itibarı değil sözleşme ve uyumluluk meselesi. Anthropic’in istediği daha sıkı ihracat kontrolü ve savunma katmanı tartışması da buradan besleniyor.

Damıtma neden bu kadar değerli?

Öncü modellerin en pahalı kısmı ham parametre sayısı değil; araç kullanımı, kodlama ve mantıksal muhakemede biriken davranış. Anthropic’e göre saldırılar tam da bu “yetenek kesitlerini” hedefledi. Zincir-düşünce izini çekmek, denetimli ince ayar için hazır eğitim sinyali demek — yani aylarca sürecek RLHF maliyetinin kısayolu.

Sahte hesap + coğrafi maskeleme + tek prompt ile milyonlarca örnek üretmek, savunmacı taraf için klasik rate-limit’in yetmediğini gösteriyor.

Açık kalan sorular da var: Moonshot ve DeepSeek’in resmi yanıtı, mahkemede veya düzenleyicide bağımsız doğrulama, Alibaba’ya atfedilen trafiğin şirket içi mi yoksa üçüncü taraf proxy mi olduğu. Rapor Anthropic’in kendi telemetrisine dayanıyor; rakip laboratuvarlar bunu reddeder veya “meşru değerlendirme” diye çerçeveleyebilir. Yine de kullanıcıya dönük risk senaryosu —yazdığım bot aslında başka modele gidiyor— ürün güveni açısından tek başına yeterince ağır.

Kaynaklar: Donanımhaber; Anthropic tehdit raporu özetleri (TechCrunch, CNBC, Bloomberg, SCMP).

Yazar

Burak

SanalData teknoloji haberleri yazarı.

Yorum yaz