Anthropic, en yeni Claude modellerinin ürettiği tüm metinlere fark edilmeyen bir filigran eklemeye başladı. Bu değişiklik, 2 Ağustos 2026 tarihinde Avrupa Birliği'nde piyasaya sürülen modeller için geçerli oldu ve Anthropic, uygulamanın tüm dünyaya yayılacağını duyurdu.
Şirket bu planı, AB Yapay Zeka Yasası'nın şeffaflık üzerine hazırlanan Uygulama Kurallarını imzaladıktan sonra yayımladığı bir destek makalesinde detaylandırdı. Yani Anthropic bu adımı tam anlamıyla gönüllü olarak atmıyor. Bu filigran, sohbet botundan API'ye, Claude Code'dan AWS, Google Cloud ve Microsoft Foundry gibi bulut ortaklarına kadar Claude'un kullanıldığı her platforma yansıyacak.
Anthropic konuyla ilgili açıklamasında, "Desteklenen bir Claude modeli metin ürettiğinde, doğrudan metnin içine fark edilemez bir filigran işliyor. Bunu göremezsiniz ve Claude'un yanıtının anlamını, kalitesini veya okunabilirliğini değiştirmez" dedi. Açıklamada ayrıca, "Filigran metnin bir parçası olduğu için, metin kopyalanıp başka bir yere yapıştırıldığında onunla birlikte taşınır ve bazı düzenlemelerden sonra bile varlığını sürdürebilir" ifadeleri yer aldı.
Durum, kullanıcıların genellikle aklına gelen standart yöntemlerden biraz daha karmaşık. Desteklenen bir Claude modeli metin yazarken, görünür hiçbir etiket olmadan bu fark edilemez filigranı doğrudan kelimelerin arasına işliyor. İşaretleme metnin bir parçası olduğu için kopyala-yapıştır işleminden sağ çıkıyor ve Anthropic'in de kabul ettiği gibi bazı düzenlemelerden sonra bile varlığını sürdürebiliyor. Dosyalar ise ikinci bir katman daha alıyor: C2PA açık standardı altında imzalanmış meta veriler. Bu, bir dosyayı kimin ürettiğini ve sonradan değiştirilip değiştirilmediğini kaydeden dijital bir sevkiyat manifestosu gibi düşünülebilir.
Yöntem gizli tutuluyor
Anthropic, filigranın tam olarak nasıl oluşturulduğunu açıklamadı. Destek makalesinde bu işlemin model seviyesinde, yani model bununla eğitiliyor, ve metne özgü, yani bir meta veri oluşturucu gibi harici bir araç değil, olduğunu belirtiyor. Ancak algılama belgeleri ve kesin teknik henüz yayımlanmadı.
Araştırmacılar, bunun istatistiksel bir imza olduğunu tahmin ediyor. Model, kelime seçimlerini Google'ın SynthID Text'te kullandığı yaklaşımla aynı aileden olan hafif ve algılanabilir bir önyargıya doğru itiyor. Anthropic algılayıcıyı yayımlayana kadar bu sadece bir tahmin olarak kalacak.
Ancak bu durum gizlilik meraklılarını geri adım attırmıyor ve bazı uzmanlar şimdiden Anthropic'in gizli filigranlama sistemini kırma yöntemleri üzerinde çalışıyor. GitHub'da 106 yıldız alan mikiane/claude-watermark-cleaner projesi, görünmez Unicode karakterlerini temizliyor ve ardından token desenini bozmak için metni Claude dışı bir modelle yeniden yazıyor.
Daha büyük bir proje olan ve GitHub'da 4.600 yıldız toplayan guillaumemeyer/watermarks-remover ise Claude metin işaretlerinin yanı sıra PNG, JPEG, SVG, PDF ve DOCX dosyalarındaki C2PA ve SynthID sınıfı sinyalleri de söküyor. Projenin yazarları, istatistiksel bir metin işaretinin kökeni kanıtlamanın güvenilir bir yolu olmadığını savunuyor ve kullanıcıları çoğunlukla kendi yazılarını temizlemek için ikinci bir model geçişine harcamaya itiyor. Anthropic kendi algılayıcısını ve eşik değerlerini piyasaya sürene kadar hiçbir kaldırma işlemi garanti edilemez.
Anthropic'in kendi geçmişi, gizlilik konusundaki bu tepkiyi daha da keskinleştiriyor. Şirket, mart ayında araştırmacıların bazı kullanıcıların konumunu ve proxy kullanımını açıklanmayan Unicode işaretleriyle etiketlediğini ortaya çıkarmasının ardından, gizli bir Claude Code izleyicisini kaldırmıştı. Bu izleyici, şu anda filigran planının da merkezinde yer alan o sessiz işaretleme tekniğini kullanıyordu.
Bu işaret, Claude'un metne el attığını kanıtlıyor ancak tüm metni onun yazdığını göstermiyor. Bu nedenle, orijinal bir yazıya küçük bir ekleme yapılmasıyla tamamen yapay zeka tarafından üretilen bir metni aynı şekilde değerlendiriyor. Paragrafınızı düzeltmesi veya çevirmesi için Claude'a istek gönderdiğinizde, çıktı hala bu sinyali taşıyabiliyor. Anthropic, yoğun düzenlemelerin filigranı silebileceğini ve işaretin eksik olmasının metni bir insanın yazdığını kanıtlamayacağını açıkça belirtiyor.
ABD'de sunulan bir yasa tasarısı olan COPIED Act de aynı fikri destekliyor. Tasarı, platformların kaynağını takip edebilmesi için yapay zeka içeriğini filigranlamanın standart bir yolunu öneriyor. Claude'un şantaj sorununda görüldüğü gibi, şirketin modelleri dokundukları metinlerle ne yaptıkları konusunda şimdiden yoğun bir incelemeye maruz kalıyor.
Anthropic, herkesin işareti doğrulamasını sağlayacak algılama araçlarını ne zaman yayımlayacağını henüz açıklamadı.