动察 Beating AI hızlı haberi: GitHub, Copilot'a HydraFusion adında çok modelli bir orkestrasyon sistemi ekledi. Önce görevin nasıl yapılması gerektiğini belirliyor, ardından farklı modelleri çağırıyor.
Şu anda üç yöntem mevcut: Basit görevler tek bir modele doğrudan devredilir; karmaşık görevlerde önce daha düşük maliyetli bir model dener, sonuç yetersizse daha güçlü bir modele yükseltilir; doğrulama gerektiğinde ise bir model önce işi yapar, farklı bir aileden başka bir model özellikle hataları bulur ve ardından ilk model düzeltmeleri yapar.
GitHub, bunu üç programlama ajanı kriterinde Claude Opus 5 ile karşılaştırdı. TerminalBench 2.1'de 4,9 puan daha yüksek, DeepSWE'de 1,5 puan daha düşük, CheckpointBench'te ise yalnızca 0,1 puan daha düşük ve neredeyse eşit; maliyetler ise sırasıyla %67, %36 ve %65 azaldı.
Bu yaklaşım, Sakana AI'nin Fugu'suna çok benziyor. İkisi de "hangi modeli seçeceğim" sorusunu "birden fazla modeli nasıl organize edeceğim" sorusuna dönüştürüyor. Fark şu: Fugu, eğitilmiş bir komuta modelidir ve farklı ajanları nasıl çağıracağını öğrenir, hatta kendini bile yinelemeli olarak çağırabilir; HydraFusion ise şu anda hâlâ Single, Cascade ve Critique olmak üzere üç sabit yürütme modu arasında seçim yapıyor ve daha çok çok modelli zamanlamayı doğrudan Copilot'a entegre etmek gibi.
HydraFusion, tüm GitHub Copilot paketlerinde araştırma önizlemesi olarak açıldı ve şu anda Copilot CLI'nin deneysel özelliklerinde etkinleştirilmesi gerekiyor. GitHub ayrıca, şu an için tek seferde net bir şekilde ifade edilen tek turlu programlama görevlerine en uygun olduğunu, çok turlu uzun görevlerin ise optimize edilmeye devam ettiğini hatırlatıyor.
