PolyBeats'in takibine göre, tahmin piyasası Polymarket'te son 15 dakikada "claude-opus-4-6-thinking, 13 Haziran 2026'ya kadar en iyi AI modeli olacak mı?" sorusuna verilen "hayır" olasılığı %27,2'den %52,2'ye yükseldi ve alım tarafındaki toplam işlem hacmi 711 dolar oldu.
Anthropic, 9 Haziran'da Claude Fable 5'i piyasaya sürdü ve bugün LM Arena sıralamasında yer aldı; performansı claude-opus-4-6-thinking'in altında kaldı. Wired ve Wall Street Journal'ın 11 Haziran tarihli haberine göre, Anthropic, Claude'u kullanarak rakip modeller eğittiği tespit edilen hesaplara karşı "sessiz düşürme" planlıyordu: kullanıcıya haber vermeden doğrudan Fable 5'in performansını düşürmek veya istem değişikliği, model yönlendirmesi gibi yöntemlerle çıktıyı zayıflatmak.
Geliştiriciler ve AI araştırma topluluğu, bunun üçüncü taraf değerlendirmelerine ve açık kaynak araştırmalarına gizlice müdahale etmek anlamına geldiğini, özellikle dış güvenlik değerlendirme kuruluşlarının hangi yetenek seviyesindeki modeli test ettiklerini doğrulayamayacaklarını eleştirdi.
Ardından Anthropic kamuoyu önünde özür diledi ve stratejisini değiştirerek bu tür senaryolarda gizli performans düşürmeyi kaldırdı; bunun yerine daha şeffaf bir uyarı veya reddetme mekanizması getirdi: Sistem, kullanıcının yüksek yetenekli bir AI oluşturduğunu veya rakip bir model eğittiğini tespit ederse, talebi açıkça reddedecek veya kullanıcıyı düşük yetenekli bir modele yönlendirecek. Bu değişiklik, Fable 5'in kamuya açık değerlendirmelerinin güvenilirliğini artırabilir ve topluluğun, modelin gerçek yeteneklerine yakın bir şekilde sıralamada rekabet edeceğine inanmasını sağlayarak, piyasada varsayılan olarak lider kabul edilen claude-opus-4-6-thinking'i doğrudan etkileyebilir.
---------------------------------
Geleceği daha erken görmek için @PolyBeats_Bot'u takip edin.
See tomorrow, today. Follow @PolyBeatsEN
