动察 Beating AI hızlı haber: LLM eğitimi ve CPU biçimsel doğrulama üzerine çalışmış mühendis Jay Kruer, OpenAI'ın on binlerce Agent ile Navier-Stokes problemini çözmesinin, yapay zekanın artık bilgi çalışanlarının yerini bağımsız olarak alabileceği anlamına gelmediğini yazdı.
Ana gerekçesi çok basit: Matematik problemlerinin net cevapları vardır ve Lean ile otomatik olarak kontrol edilebilir. Gerçek hayattaki programlama, araştırma ve kurumsal işlerde hedefler çoğu zaman belirsizdir ve sonucun doğru olup olmadığını doğrudan yargılayabilecek bir program yoktur.
Güvenilir otomatik kontrol olmadan, insanların sürekli olarak yapay zekayı gözetlemesi gerekir. Görev kurallarını yeterince katı bir şekilde yazmak ise pahalı alan uzmanları gerektirir. Kruer'e göre, bu denetim ve kabul maliyeti, işin insan tarafından yapılmasından bile daha yüksek olabilir.
Bu nedenle mevcut LLM'leri "hileli stajyer" olarak adlandırıyor: Çok yetenekli, hızlı çalışıyor, ancak işleri kendi başına yönetmesine henüz güvenilemez.
