Ana Sayfa
AI AI
Flaş
Derinlik
Etkinlikler
BlockBeats Pro
Daha Fazla
Finans
Özel
Blok Zinciri Ekosistemi
Giriş
Podkastlar
Veri
OPRR
#
BTC
$96,000
5.73%
ETH
$3,521.91
3.97%
HTX
$0.{5}2273
5.23%
SOL
$198.17
3.05%
BNB
$710
3.05%
lang
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe

"Daha iyi bir modele ihtiyacım yok": Reddit'teki popüler bir gönderi altında AI'nın çeşitli yüzleri

Bu makaleyi okumak için 11 Dakika
Bir amiral gemisi ürünü için, yetenek sıçramasına odaklanan "güvenlik için ödenen kullanılabilirlik bedeli", kullanıcıların satın alma kararını verirken belirleyici bir faktör haline geliyor.
Orijinal Başlık: «'Daha İyi Bir Modele İhtiyacım Yok': Reddit'te Viral Olan Gönderinin Altındaki AI Yorumları»
Orijinal Yazar: Cuma, Derin Teknoloji TechFlow


Anthropic az önce kağıt üzerinde kusursuz bir karnenin altına imza attı.


9 Haziran'da yayınlanan Claude Fable 5, şirketin halka açık ilk Mythos seviyesi modeli oldu. Gerçek yazılım mühendisliği görevleri için referans alınan SWE-Bench Pro'da %80,3 başarı elde ederek, bir önceki amiral gemisi Opus 4.8'i yaklaşık 11 puan, GPT-5.5'i ise 20 puandan fazla geride bıraktı.


Ancak kullanıcıların tepkisi soğuk duş etkisi yarattı.


Yayınlanmasından üç gün sonra, r/artificial bölümünde (haftalık 305 bin ziyaretçi) viral olan bir gönderinin başlığı şöyleydi: «Claude Fable bana daha iyi bir modele ihtiyacım olmadığını fark ettirdi.»


Gönderiyi yapan Axi0m-22, Fable'ı bir süre güvenlik araştırmaları ve günlük işler için kullandığını, ardından neredeyse hemen kod yazmak için Opus'a, ufak tefek işler için Haiku'ya geri döndüğünü söyledi. Bir benzetme yaptı: Bu, iPhone 14'le iPhone 17'nin tanıtımını izlemek gibi, «Yenisinin daha iyi olduğunu biliyorsun ama aklından geçen şu: Boşver, benimki iyi işte.»



Beğeni rekoru kıranlar «yeterlilikçiler»: Model yorgunluğu ana duygu haline geldi


En çok beğenilen yorum 42 beğeni aldı: «Daha büyük bağlam penceresi dışında, Opus 4.5'ten beri daha güçlü bir modele ihtiyaç duymuyorum.»


Bir diğer kullanıcı hyprlab'ın ifadesi 13 beğeni topladı: «Daha fazla token tüketen bir modele geçmenin iş akışıma bir faydasını görmüyorum, Opus 4.8'in yüksek yoğunluk modu fazlasıyla yeterli.»


Bu tür yorumların arkasında ortak bir maliyet hesabı yatıyor.


Fable 5'in API fiyatlandırması, milyon giriş token başına 10 dolar olup, Opus 4.8'in neredeyse iki katı. Kullanıcı siromega37 doğrudan söyledi: «Token tüketimi daha yüksek ama yatırım getirisi yok. Bence bir plato dönemi görüyoruz ve balon sonunda patlayacak.»


Kullanıcı hobopwnzor daha sistematik bir yorum yapıyor: "Bir süredir S eğrisinin zirvesindeyiz. Son dönemdeki ilerlemeler daha çok araç çağırma ve çevre mühendisliğinden geliyor, modelin kendi yeteneklerinden değil."


Güvenlik Korkulukları En Büyük Eleştiri Noktası: "Kullanmak İstediğiniz Şeylerin %90'ı Doğrudan Reddediliyor"


"Yeterli olması" sadece bir duygu durumuysa, güvenlik korkuluklarına yönelik şikayetler somut bir ürün sorununa işaret ediyor.


Anthropic'in resmi açıklamasına göre, Fable 5, yalnızca sınırlı sayıda kuruma açık olan Mythos 5 ile aynı temel modeli paylaşıyor. Fark, Fable'ın bir güvenlik sınıflandırıcısıyla donatılmış olması: siber güvenlik gibi yüksek riskli alanlarla ilgili talepler engelleniyor ve Opus 4.8'e yönlendiriliyor. Şirket, bu mekanizmanın oldukça muhafazakar ayarlandığını, ortalama olarak oturumların %5'inden azında tetiklendiğini ve masum talepleri yanlışlıkla etkileyebileceğini belirtiyor.


Bu Reddit başlığı altında, tetiklenme oranının hissedilen seviyesi açıkça %5'in çok üzerinde. 17 beğeni alan kullanıcı jradoff, Fable'dan kodunun güvenliğini kontrol etmesini istediğini, ancak "güvenlikle ilgili bir şeyden bahsedildiğinde neredeyse her zaman reddettiğini" ve Opus'a geri döndüğünü söylüyor. 12 beğeni alan başka bir yorum daha sert: "Yapmak istediğiniz şeylerin %90'ı reddediliyor, bu da onu işe yaramaz hale getiriyor."


Ücretli kullanıcıların öfkesi daha da büyük. 200 dolarlık abonelik katmanındaki kullanıcı kaitava şöyle yazıyor: "İki kat kullanım ücreti ödüyorum, bir güvenlik denetimi yapmasını istiyorum ve Opus'a düşürülüyorum. Artık onunla ilgili her şeyden nefret ediyorum, OpenAI'in yetişmesini bekliyorum."


Yetenek sıçraması vaat eden amiral gemisi bir ürün için, "güvenlik uğruna ödenen kullanılabilirlik bedeli", kullanıcıların satın alma kararını belirleyen temel faktör haline geliyor.


Karşıt Görüşler: Ağır Görev Kullanıcılarının Deneyimi "Gece ve Gündüz Gibi"


Popüler başlık altında muhalif sesler de yok değil ve bu karşıt görüşün profili oldukça net: Görev ne kadar ağırsa, değerlendirme o kadar yüksek.


Kullanıcı Phylaras'ın yorumu 15 beğeni alıyor: "Fable benim için gerçek bir fark yarattı. Büyük bağlam pencereleri gerektiren karmaşık görevlerde, daha önce fark edilmemiş hataları yakaladı." Yüksek enerji fiziği simülasyonları üzerinde çalıştığını söyleyen bir kullanıcı, tek bir simülasyon modelinin 8000 ila 10.000 satır kod ve yüzlerce etkileşimli model içerebildiğini belirterek, "Bağımsız ve sürekli çalışabilen, çevre detaylarını anlayan bir modele sahip olmak benim için çok değerli" diyor.



En sert eleştiri kullanıcı Navetz'den geldi: "Açıkçası, bu modeli kullanan biri bu tür gönderilerin saçmalık olduğunu düşünecektir. Bana göre o kadar zeki ki sanki bambaşka biri, durmadan kullanıyorum. Teknik olmayan arkadaşlarıma şöyle açıklıyorum: Bu, üniversiteli bir oyuncudan direkt NBA başlangıç kadrosuna geçmek gibi."


Bazıları ise daha dengeli bir kullanım önerdi. Kullanıcı ready-eddy, Fable'ı günlük "inşaatçı" olarak değil, "planlayıcı ve onarıcı" olarak kullanmayı tavsiye etti, tabii para yakmayı umursamıyorsanız. Başka bir yorum daha çok bir kullanım kılavuzu gibiydi: Fable ile tablo hesaplamak yanlış model seçimi, Haiku ile 16 ajanlı karmaşık görevler yürütmek de aynı şekilde yanlış model seçimi. "Doğuştan kötü model yoktur, sadece yanlış senaryoda kullanılan model vardır."


Puanlar ve Hissiyat Ayrıştıktan Sonra, Açık Yapay Zeka Daha mı Güçlü Olacak?


Bu tartışmadaki en ilginç yorumlardan biri, konuyu üründen endüstri yapısına taşıdı.


Kullanıcı KedMcJenna bir "Açık Yapay Zeka Donma Teorisi" ortaya attı: Sıradan insanların erişebileceği modeller, muhtemelen sonsuza kadar mevcut seviyelerinde kalacak; şirket ve hükümet elitleri ise giderek daha güçlü özel modeller almaya devam edecek. "En azından Mythos'u biliyoruz, muhtemelen hiç duymayacağımız daha güçlü modeller de var."


Bu yorum bir gerçeğe işaret ediyor: Mythos 5 gerçekten de halka açık değil, şu anda yalnızca Project Glasswing programı aracılığıyla siber savunma kurumlarına ve kritik altyapı işletmelerine sunuluyor.


Puanları ve kamuoyu tepkisini bir araya koyduğumuzda, sonuçlar çelişkili değil.


Kıyaslama testleri yeteneklerin üst sınırını ölçerken, Reddit'teki en çok beğenilen yorumlar günlük ihtiyaçların tavanını yansıtıyor. Çoğu kullanıcının görevleri Opus 4.6 döneminde zaten karşılanmışken, daha güçlü modeller yalnızca fizik simülasyonu, aşırı uzun bağlam gibi uç senaryolarda kendini kanıtlayabiliyor. Model üreticileri artık "yapılıp yapılamayacağı" sorusuyla değil, "kimin ihtiyacı var, ne kadar ödemeye razı, ne kadar güvenlik sürtüşmesine katlanabilir" sorularıyla karşı karşıya.


Yayınlanmasının üzerinden üç gün geçen Fable 5, puan tablosunda ve kamuoyu alanında tamamen farklı iki karneler aldı. Hangisinin gerçeğe daha yakın olduğu, Anthropic'in güvenlik sınıflandırıcısını ne kadar hızlı ayarlayacağına ve ağır kullanıcıların cüzdan oylarına bağlı.


Orijinal Bağlantı


BlockBeats Resmi Topluluğuna Katılın:

Telegram Abonelik Grubu: https://t.me/theblockbeats

Telegram Sohbet Grubu: https://t.me/BlockBeats_App

Twitter Resmi Hesabı: https://twitter.com/BlockBeatsAsia

Kütüphane Seç
Kütüphane Ekle
İptal
Tamamla
Kütüphane Ekle
Sadece kendime görünür
Herkese Açık
Kaydet
Düzeltme/Rapor
Gönder