Çin'in e-ticaret devi Alibaba, güvenlik endişeleri nedeniyle çalışanlarının Anthropic'in yapay zeka araçlarını iş yerlerinde kullanmasını yasakladı.
CNBC'nin konuya yakın kaynaklara dayandırdığı habere göre, Alibaba Anthropic'in Claude Code yazılımını yüksek riskli yazılımlar listesine aldı. Bu karar, Anthropic'in geçtiğimiz ay Alibaba'yı yapay zeka yeteneklerini izinsiz bir şekilde kopyalamaya çalışmakla suçlamasının ardından geldi.
Anthropic, Alibaba'nın kendisine karşı 'şimdiye kadarki en büyük damıtma saldırısını' düzenlediğini ve 'yüzsüzce' ve 'yasa dışı yollarla' yapay zeka kabiliyetlerini elde etmeye çalıştığını öne sürdü.
Damıtma (distillation) yönteminde, güçlü bir modelin çıktıları daha az yetenekli bir versiyonu eğitmek için kullanılıyor. Bu tekniği yasa dışı kullanan şirketler, diğer laboratuvarların yeteneklerini kendi başlarına geliştirmelerinden çok daha kısa sürede ve daha düşük maliyetle elde edebiliyor.
Anthropic, Şubat ayında DeepSeek, MiniMax ve Moonshot AI adlı üç Çinli teknoloji şirketini de benzer saldırılar düzenlemekle suçlamış ve 'sektör oyuncularını, politika yapıcıları ve küresel yapay zeka topluluğunu' bu saldırıları engellemek için harekete geçmeye çağırmıştı.
Anthropic'in hizmet şartlarına göre, Çinli şirketler ve diğer 'düşman ülkeler' modellerini kullanmaktan men edilmiş durumda.
CNBC'ye konuşan kaynaklar, Alibaba çalışanlarına Anthropic modellerini ve ajan ürünlerini sistemlerinden kaldırmaları ve bunun yerine Çinli şirketin kendi geliştirdiği Qoder AI asistanını kullanmaları talimatı verildiğini aktardı.
Damıtma saldırılarının mantığı oldukça basit: Bir kampanya, hedef modellere çok sayıda özenle hazırlanmış istem gönderiyor ve gelen yanıtları toplayarak bunları eğitim verisi haline getiriyor.
'Rakip model, arkasındaki araştırmaya para ödemeden, orijinal modelin akıl yürütme ve yanıt verme biçimini aynen kopyalamayı öğreniyor,' diye aktaran PYMNTS, bu durumu şu sözlerle tanımladı: 'Bu, bir sisteme saldırmaktan çok, sınıftaki en iyi öğrencinin yanına oturup her yazdığı cevabı endüstriyel ölçekte kopyalamak gibi bir şey.'
Bu saldırıları tespit etmek oldukça zor çünkü damıtma amaçlı bir sorgu ile meşru bir sorgu arasında neredeyse hiçbir fark yok. Kod hatalarını ayıklamak için Claude'dan yardım isteyen bir geliştirici ile Claude'un kodlama davranışını kopyalamaya çalışan bir kampanya aynı tür taleplerde bulunuyor.
Tek ipucu ise desenlerde gizli: yüksek hacimli, tekrarlayan yapılar ve belirli dar yeteneklere odaklanan istemler. Bu talepler genellikle yüzlerce koordineli hesaptan sırayla geliyor.
Google Tehdit İstihbarat Grubu, Şubat ayında yayınladığı bir blog yazısında şu uyarıda bulundu: 'Kuruluşlar büyük dil modellerini (LLM'ler) temel operasyonlarına entegre ettikçe, bu modellerin tescilli mantığı ve özel eğitimi yüksek değerli hedefler haline geldi.'