Blockchain & Kripto

Claude Fable 5 Zayıflatılmadı, Yönlendirici Sadece Paranoyak

Claude Fable 5 Zayıflatılmadı, Yönlendirici Sadece Paranoyak
Malta'da Hem Öğren Hem Çalış

Kısa Özet

BridgeBench'in hata ayıklama puanı Claude Fable 5 için 86.2'den 25.9'a düştü—ancak bu çöküş modelin aptallaşmasından değil, güvenlik sınıflandırıcısının çoğu görevi Opus 4.8'e yönlendirmesinden kaynaklandı.

Arena.AI binlerce kör insan tercihi oylaması yaptı ve Fable 5'in performansının Haziran versiyonuna göre çoğunlukla aynı olduğu, hatta bazı kategorilerde—doküman ve uzman metin—iyileşme olduğu görüldü.

Anthropic, yeni sınıflandırıcıların rutin kodlama ve hata ayıklamada yanlış pozitifler üreteceğini kabul etti ve sistemin zamanla iyileştirileceğini ancak bir zaman çizelgesi vermedi.

Claude Fable 5, 1 Temmuz'da yeniden çevrimiçi oldu ve sosyal medyadaki yorumlar hiç de iyi değildi: bozuk, zayıflatılmış, lobotomi yapılmış, düşük performanslı, aynı model değil.

Bütün gün Fable 5'i kullanıyorum, Opus ile yaptığım işe devam ediyorum.

Bulgular doğru: Tamamen zayıflatılmış.

Politika bir kez daha sivil teknolojik ilerlemeyi mahvetti.

— BharadwajC (@bwjbuild) 2 Temmuz 2026

Kullanıcılardan gelen eleştiriler çok yüksek sesliydi. Ardından iki benchmark platformu—BridgeBench AI ve Arena AI—aynı gün zıt sonuçlarla veri yayınladı. Biri çıktılarda ciddi kalite düşüşü bulurken, diğeri farkların fark edilmeyecek kadar küçük olduğunu bildirdi.

Her ikisi de kendi açısından haklı.

Kısa versiyon: Model aptallaşmadı. Önündeki bekçi çok daha agresif hale geldi. Bu ayrım, Fable'ı ne için kullandığınıza bağlı olarak büyük fark yaratıyor.

BridgeBench Aslında Neyi Ölçtü

BridgeMind—bir AI değerlendirme platformu—1 Temmuz'da Fable 5'in geri döndüğü gün tam kodlama paketini yeniden çalıştırdı.

BridgeBench gerçek dünya kodlama görevlerini hata ayıklama, yeniden düzenleme ve halüsinasyon direnci gibi kategorilerde 0–100 arasında puanlıyor. Sonuçlar kağıt üzerinde çok kötüydü: Hata ayıklama 86.2'den 25.9'a, yeniden düzenleme 73.6'dan 38.4'e ve halüsinasyon direnci 75.9'dan 61.7'ye geriledi.

FABLE 5 ZAYIFLATILMIŞ OLARAK GERİ DÖNDÜ.

BridgeBench'te Claude Fable 5'in 1 Temmuz sürümünü yeniden çalıştırdık.

Sonuçlar acımasız:

Hata Ayıklama: 86.2 → 25.9
Yeniden Düzenleme: 73.6 → 38.4
Halüsinasyon: 75.9 → 61.7

Yeni güvenlik önlemleri çok fazla görevde devreye giriyor ve Opus'a geri dönüyor…

— BridgeMind (@bridgemindai) 2 Temmuz 2026

İşin püf noktası metodolojide. 12 TypeScript hata ayıklama görevinden sadece üçü aslında Fable 5'e ulaştı. Kalan dokuzu Anthropic'in yeni güvenlik sınıflandırıcısı tarafından durduruldu ve Claude Opus 4.8'e yönlendirildi—ve BridgeBench her yönlendirmeyi sıfır olarak puanlıyor, çünkü cevap veren model değerlendirilen model değil.

Sınıflandırıcı, Fable'ın yeniden kullanıma sunulmasının bir koşulu olarak devreye alındı. Amazon tarafından bildirilen ve Fable 5'in yazılım güvenlik açıklarını tanımlayıp göstermesini sağlayan jailbreak tekniğini engellemek için eğitilmişti. Çalışıyor. Ama aynı zamanda engellememesi gereken birçok şeyi de yakalıyor. TypeScript'te hata ayıklamak, sınıflandırıcıya 'güvenlik işi' gibi görünüyor ve yönlendirme sürekli devreye giriyor.

Arena.AI Aslında Neyi Ölçtü

Arena.AI, farklı bir mercekten aynı soruyu sordu. Platform, metin, görüntü, belge, kod ve ajan kategorilerinde binlerce kör insan tercihi oylaması topluyor ve modelleri satrançtan türetilen Elo puanlama sistemiyle sıralıyor. İki model anonim olarak karşılaştığında insanlar bir kazanan seçiyor ve puan, altyapı yönlendirmesini değil, algılanan gerçek kaliteyi yansıtıyor.

Topluluk, Claude Fable 5'in son yeniden dağıtımından önce ve sonra nasıl karşılaştırıldığını soruyordu.

Yeni uç noktada binlerce oy topladık—Metin, Görüntü, Belge, Kod ve Ajan Alanları—ve işte erken bir puan önizlemesi.

Şimdiye kadar puanlar çoğunlukla aynı görünüyor…

— Arena.ai (@arena) 2 Temmuz 2026

Önceki ve sonraki karşılaştırma, Fable 5'in büyük ölçüde yerini koruduğunu gösterdi. Önyüz kodu 1650'den 1623 Elo'ya düştü—Arena'nın belirttiğine göre bu fark, veri birikmeye devam ettikçe güven aralığı içinde. Belge performansı 34 puan arttı. Uzman metin 25 puan yükseldi. Yaratıcı yazma 9 puan hafifçe arttı. Düşüş gösteren kategoriler—Kodlama -18, Zor sorular -3—tam da sınıflandırıcının Fable cevap vermeden önce müdahale etme olasılığının en yüksek olduğu kategoriler.

Başka bir deyişle, Fable 5 görevi gerçekten üstlendiğinde, hâlâ Fable 5 gibi performans gösteriyor. X'teki (eski adıyla Twitter) hayal kırıklığı daha kötü bir modelle ilgili değil, daha çok sık sık cevap veren modelin ödenen model olmamasıyla ilgili.

Kim Etkileniyor, Kim Etkilenmiyor

Yaratıcı yazma, belge analizi, araştırma ve uzman düzeyinde metin sorguları yapan genel kullanıcılar büyük olasılıkla çok az farklılık görecek veya hiç fark etmeyecek. Arena.AI, bu kategorilerde performansın sabit veya iyileştiğini gösteriyor. Eğer bir iyileşme varsa, özellikle sonuçları tam olarak ölçmenin zor olduğu yaratıcı yazma gibi öznel, niteliksel görevlerde fark edilemeyecek kadar küçük olabilir.

Yani temelde yazarlar, araştırmacılar ve analistler bekledikleri Fable 5'i alacak. Geliştiriciler ise farklı bir hikaye.

Güvenlikle ilgili alanlarda çalışan herkes—bellek yönetimi kodlaması, 'güvenlik açığı', 'istismar', 'hook' ve hatta 'düzelt' gibi kelimelere dokunan her şey—düzenli olarak yönlendirmeyle karşılaşacak.

BridgeBench'in çöküşü ile Arena'nın istikrarı arasındaki fark, görev türüne dayanıyor. BridgeBench paketini tam olarak yeni sınıflandırıcıyı tetikleyen türden kod onarımı ve hata ayıklama sorularıyla yüklüyor. Arena'nın insan seçmenleri çok daha geniş bir yelpazede soru soruyor ve çoğu bir güvenlik katmanına istismar kodu gibi görünmüyor.

Üniversite Destekli Dil Okulu

Kaynak: Decrypt