
Gruber, Anthropic'in tüm Claude metinlerini 'filigranlama' planını eleştiriyor
Daring Fireball'dan John Gruber, Anthropic'in tüm Claude metinlerine istatistiksel filigran yerleştirme planını yazının bozulması olarak niteliyor ve tespit anahtarının yalnızca şirkette olduğunu vurguluyor.
Daring Fireball blogunun yazarı John Gruber, Anthropic'in dünya genelinde Claude modellerinin ürettiği tüm metinlere istatistiksel "filigran" yerleştirme planına dair ayrıntılı bir eleştiri yayımladı ve tekniği yazının bozulması olarak nitelendirdi. Şirket sistemi, Temmuz 2026'da yaklaşık 190 imzacıyla birlikte imzaladığı AB Yapay Zekâ Üretimi İçerikte Şeffaflık Uygulama Kuralları'na uymak için devreye alıyor.
Filigran nasıl çalışıyor
Anthropic başlangıçta yalnızca Claude'un "metnin içine doğrudan, algılanamayan bir filigran ördüğünü" söylemiş, mekanizmayı açıklamamıştı. Daha sonra yayımlanan "How Claude's Text Watermark Works" yazısı steganografik bir yöntem tanımlıyor: model bir sonraki tokeni seçtiği her noktada, seçenekleri gizli bir anahtara göre belirlenimci biçimde "yeşil" ve "kırmızı" listelere ayrılıyor ve yeşil listedeki sözcüklerin seçilme olasılığı bir miktar artıyor. Tespit aşamasında ise bir metnin rastlantının öngöreceğinden fazla yeşil liste sözcüğü içerip içermediğine bakılıyor — uzunlukla güvenilirliği artan istatistiksel bir test. İşaretleme 200 tokenı (yaklaşık 150 sözcük) aşan üretilmiş metinlere uygulanıyor ve Anthropic'e göre bölge bazında güvenilir biçimde sınırlandırılamadığı için lansmandan itibaren küresel olarak geçerli.
İtirazlar
Gruber'in temel argümanı, hiçbir eş anlamlının tam olarak aynı anlamı taşımadığı; dolayısıyla token seçiminin — az da olsa — daha zayıf seçeneklere doğru saptırılmasının metni tasarım gereği bozduğu yönünde. Ayrıca işaretleri üreten ve tespit eden gizli anahtarın yalnızca Anthropic'te olduğunu vurguluyor: Kullanıcılar hiçbir şeyi kendileri doğrulayamıyor, okurlar ise kanıtlanamaz "AI yazdı" suçlamalarıyla karşılaşabiliyor. Teknik sözcük seçimine dayandığı için kopyala-yapıştırdan etkilenmiyor ve atıf yapılan bir makaleye göre çeviriden bile sağ çıkabiliyor; eleştirmenler aldatmaya kararlı birinin metni basitçe bir yeniden ifadelendirme aracından geçireceğini belirtiyor. Benzer itirazları Michael Lopp, Jeff Gamet ve James Padolsey dile getirdi; Padolsey'e göre Anthropic'in model düzeyindeki uygulaması yasanın gerektirdiği asgari düzeyden daha geniş.
Daha geniş bağlam
Google'ın benzer sistemi SynthID hâlihazırda Gemini metinlerine uygulanıyor; DeepMind ekibinin Nature makalesinde, filigranlı ve filigransız trafikte beğeni ve beğenmeme oranlarının yüzde 0,01 ve yüzde 0,02 farkla ayrıldığı, bunun da istatistiksel olarak anlamsız bulunduğu bildirildi. Gruber bu kanıtı, sözcük seçimindeki bozulmayı yakalamak için fazla kaba bularak reddediyor; yine de yöntemin matematiğinin ilginç olduğunu kabul ediyor. OpenAI, kaynak sinyallerini metin dâhil tüm modalitelere yaymayı hedeflediğini, bunun tüm kullanıcılar için zorunlu olup olmayacağını belirtmeden açıkladı. Olay, metin şeffaflığı kurallarının AB dışındaki yazarları nasıl etkileyeceğine dair bir test vakasına dönüştü.
SiTech — AI destekli web geliştirme
Hızlı ve modern web siteleri kuruyor, AI'yı gerçek iş akışlarına taşıyoruz. Projeniz veya sorunuz mu var? Yardımcı olmaktan mutluluk duyarız.