动察 Beating AI hızlı haber: Shanghai Jiao Tong Üniversitesi, Tsinghua, ByteDance, Xiaohongshu, Shanghai AI Lab ve diğer ekiplerle birlikte "The Last AI Built by Humans" başlıklı derleme makalesini yayımladı. 491 ilgili araştırmayı gözden geçirerek giderek genişleyen "AI kendini evrimleştirme" kavramına daha sıkı bir sınır çizmeye çalışıyor.
Makale, özyinelemeli kendini iyileştirmeyi (RSI) 5 seviyeye ayırıyor. L1 yalnızca insanların önceden belirlediği iyileştirme sürecini yürütür; L2 nasıl değiştirileceğine kendisi karar verebilir; L3 bir sonraki turda ne öğrenileceğine bile kendisi karar verebilir; L4 gerçek çalışma sırasındaki geri bildirimlere göre hafızayı, becerileri, kodu veya harness'ı sürekli değiştirir ve bu değişikliklerin sonraki görevleri etkilemesini sağlar; L5'e gelindiğinde, bir sonraki iyileştirme turunu üreten arama yöntemi, değerlendirici ve araştırma stratejisinin kendisi de değiştirilebilir ve bir sonraki tura devredilebilir.
Dolayısıyla sadece "kendi kodunu değiştirebilmek" yeterli değil. Örneğin bir Coding Agent kendi kaynak kodunu yeniden yazabiliyorsa, ancak bir sonraki neslin nasıl seçileceği, hangi kriterlere göre puanlanacağı ve hangi değişikliklerin kalacağı hâlâ insan tarafından sabitlenmişse, bu yalnızca kendini değiştirebildiğini kanıtlar; henüz tam özyinelemeli kendini iyileştirmeyi kavramış sayılmaz.
Makale ayrıca en üst seviye olan L5'i iki katmana ayırıyor. Birinci katman "biçimsel özyineleme": AI artık sonraki iyileştirmelerden sorumlu mekanizmayı değiştirebiliyor ve bir sonraki turun bunu kullanmaya devam etmesini sağlayabiliyor. İkinci katman ise "gerçekten değiştikçe güçlenme": değiştirilen mekanizmanın benzer kaynaklar ve bağımsız değerlendirmeler altında gerçekten daha güçlü bir sonraki nesil üretmesi gerekiyor.
491 makalenin %43,8'i L1, %31,6'sı L2 olarak sınıflandırıldı; L5 yalnızca 29 makale, yani %5,9. Çok sayıda araştırma aslında hâlâ insanların tasarladığı iyileştirmeleri yürütmeye ve otomatik olarak değişiklik yöntemleri bulmaya odaklanıyor; "nasıl iyileştirileceği" mekanizmasının kendisini AI'ya devreden çalışmalar çok az. L5'e ulaşılsa bile, uzun vadede istikrarlı biçimde avantaj biriktirme henüz kanıtlanmış değil.
Bu makale esas olarak RSI alanına bir sınıflandırma çerçevesi kazandırıyor. L1'den L5'e kadar olan seviyeler yazarların önerdiği ölçütler olup henüz sektör tarafından genel kabul görmüş bir birleşik derecelendirme değil. Makale aynı zamanda akademik makaleleri, teknik raporları, resmi blogları ve açık kaynak sistemleri de kapsıyor; çünkü öncü RSI uygulamalarının birçoğu henüz resmi makalelere girmemiş durumda.

