动察 Beating AI hızlı haber: Kâr amacı gütmeyen yapay zeka değerlendirme kuruluşu ARC Prize, ARC-AGI-4'ü duyurdu. Yeni nesil benchmark, öncelikli olarak "özerk açık uçlu inovasyonu" test edecek; yani yapay zekanın kendi başına keşfedip keşfedemeyeceğini, yeni fikirler ortaya koyup koyamayacağını, hatta yeni icatlar ve keşifler yapıp yapamayacağını görecek.
Spesifik sorular, puanlama yöntemi ve yayın tarihi henüz açıklanmadı. ARC Prize yalnızca, insanların şu anda açık uçlu inovasyonda hâlâ yapay zekanın açık ara önünde olduğunu ve bunun bilimsel ve teknolojik ilerlemeyi en çok iten yeteneklerden biri olduğunu söyledi.
Bu duyuru ayrıca Dario Amodei'nin yeni yayımlanan yapay zeka yavaşlatma makalesine atıfta bulundu. ARC Prize, açık kaynağın hâlâ yapay zeka ilerlemesinin temeli olduğunu vurgulayarak, sektörün koordineli yavaşlama adına açıklığı azaltmasına ve öncü yapay zekayı birkaç kurumun elinde toplamasına karşı çıktı.
ARC-AGI her zaman dünyanın en zor AGI değerlendirmesi olarak anıldı. ARC-AGI-3 yayımlandığında insanlar %100 puan alırken, öncü yapay zeka yalnızca %0,51 alabildi. En yeni GPT-6 Astra büyük ölçüde yetişti, ancak birleşik Standard harness altında yalnızca %62,7 alabildi; OpenAI'nin kendi Provider Adapter'ı bağlandıktan sonra ancak %99,9'a ulaştı.
ARC Prize şimdi bir sonraki eşiği "yapay zeka kendi başına inovasyon yapabilir mi" noktasına taşımaya hazırlanıyor.
