Anthropic, Claude Code adlı yapay zeka kodlama asistanından gizli bir izleme sistemini kaldırdı. Bir güvenlik araştırmacısı, aracın bazı kullanıcıların konumunu, proxy kullanımını ve olası Çin yapay zeka laboratuvarlarıyla bağlantılarını tespit etmek için açıklanmayan işaretler kullandığını ortaya çıkardı.
Geliştirici Thereallo tarafından Haziran ayında keşfedilen bu özellik, Claude Code'un sistem komutlarına sinyaller yerleştiriyordu. Bu sinyaller, Anthropic'in kısıtlamaları aştığına veya model yeteneklerini çıkarmaya çalıştığına inandığı kullanıcıları işaretleyebiliyordu.
Thereallo, "Anthropic muhtemelen API yeniden satıcılarını, yetkisiz Claude Code ağ geçitlerini ve 'model damıtma saldırısı' boru hatlarını tespit etmek istiyor" diye yazdı. "Bilinen bir yeniden satıcı alan adını işaret eden özel bir ANTHROPIC_BASE_URL yararlı bir sinyal. deepseek veya zhipu içeren bir ana bilgisayar adı da yararlı bir sinyal."
Thereallo, Anthropic'in yeniden satıcıları, yetkisiz Claude Code ağ geçitlerini ve olası damıtma saldırılarını tespit etme girişiminin mantıklı olduğunu ancak bunun yapılış şeklini eleştirdi. Claude Code'un izleme sinyallerini Unicode işaretleri ve kodlanmış alan adı listeleri kullanarak sistem komutlarının içine gizlediğini, bunu belgeler veya sürüm notlarıyla açıklamadığını belirtti.
Thereallo, "Bu kötü niyetli bir özellik değil, ancak güven talep eden bir geliştirici aracı için tuhaf bir seçim" diye yazdı.
İzleyicinin internette ortaya çıkmasının ardından Anthropic mühendisi Thariq Shihipar, X platformunda yaptığı açıklamada, bu özelliğin Mart ayında yetkisiz yeniden satıcılar tarafından hesap kötüye kullanımını durdurmak ve Claude'u damıtma saldırılarından korumak için bir "deney" olarak başlatıldığını söyledi.
Shihipar geçen hafta yazdığı bir mesajda, "Ekip o zamandan beri daha güçlü önlemler geliştirdi ve aslında bir süredir bunu kaldırmayı planlıyorduk. [Çekme isteğini] birleştirdik ve yarınki sürümle birlikte tamamen geri alınmış olacak" dedi.
Bu haber, Anthropic'in yapay zeka model damıtma konusunda uyarılarını artırdığı bir dönemde geldi. Damıtma, bir sistemin çıktılarının başka bir modeli eğitmek için kullanılması anlamına geliyor. Bu uygulama yapay zeka araştırmalarında yaygın olsa da, jeopolitik söz konusu olduğunda damıtma ulusal güvenlik meselesi haline geliyor. Bu ayın başlarında Alibaba, Claude Code'u "yüksek riskli" bir yazılım olarak nitelendirerek çalışanlarının bu aracı kullanmasını yasakladı.
Şubat ayında Anthropic, Çinli yapay zeka geliştiricileri DeepSeek, Moonshot AI ve MiniMax'ı, rakip modelleri eğitmek için milyonlarca Claude yanıtını çıkarmak amacıyla sahte hesaplar kullanmakla suçlamıştı. Bu iddialar, uygulamanın yapay zeka sektöründe kullanılan yöntemlerden ne kadar farklı olduğunu sorgulayan eleştirmenlerin tepkisini çekmişti.
Nisan ayında Elon Musk, xAI'nin Grok'u eğitirken OpenAI modellerini "kısmen" kullandığını ifade etmiş ve damıtmayı daha geniş bir sektör uygulaması olarak nitelendirmişti. Haziran ayında Anthropic CEO'su Dario Amodei, Alibaba bağlantılı operatörlerin yaklaşık 25.000 sahte hesap kullanarak 28,8 milyon Claude etkileşimi oluşturduğunu iddia ettikten sonra Kongre'yi yabancı yapay zeka çıkarma işlemlerine karşı korumaları güçlendirmeye çağırmıştı.
Anthropic, Decrypt'in yorum talebine hemen yanıt vermedi.