动察 Beating AI hızlı haber: Google araştırma ekibi Dream-RSI'yı yayınladı; bu sistem, bir AI Agent bir tur görevi tamamladıktan sonra geçmişteki başarı ve başarısızlıkları "rüya" olarak kullanmasını sağlıyor. Sistem her denemeyi ve sonucu kaydediyor, ardından bu eski kayıtlarla farklı yaklaşımları simüle ediyor; örneğin önce hangi yolun deneneceği, ne zaman vazgeçileceği, aynı anda birden fazla çözümün denenip denenmeyeceği gibi. Sonuçlar daha önce çalıştırıldığı için bu simülasyonların görevi yeniden yürütmesine gerek kalmıyor.
Sistem bu simülasyonlardan daha iyi performans gösteren yaklaşımları seçip doğrudan bir sonraki tura uyguluyor. Yeni turda daha fazla başarı ve başarısızlık kaydediliyor, bunlar tekrar "rüya" olarak kullanılıp strateji geliştirilmeye devam ediyor. Böylece turdan tura ilerleyen bu süreç, makalenin "özyinelemeli kendini geliştirme" dediği şey oluyor. Şu anda altta yatan modelin kendisi değişmiyor; gerçekte iyileştirilen şey Agent'ın "bir sonraki adımda ne yapacağı" yöntemi.
Makale bu yöntemi algoritma, matematiksel optimizasyon ve GPU kernel dahil 8 görevde test etti. Gemini 3.1 Pro ile yapılan bir algoritma görevinde, sabit yaklaşıma kıyasla Agent çağrıları 550'den 317'ye düştü ve sonuçta bulunan program daha hızlı çalıştı.
