BlockBeats haberine göre, 18 Ağustos'ta MaxForAI'nin açıklamasına göre, bugün X platformunda popüler olan AI projesi J-Space Cognition Suite topluluk tarafından sorgulandı ve tanıtılan DeepSeek V4 test sonuçlarının tekrarlanamadığı iddia edildi. Proje daha önce V4 Flash'ın J-Space ile GLM-5.3'e yetişebileceğini, V4 Pro'nun ise birden fazla Agent Benchmark'ta Fable 5'i geçebileceğini, aynı zamanda hızın 2,53 kat ve Token verimliliğinin 2,21 kat arttığını iddia etmişti.
GitHub kullanıcısı GoForceX, Terminal Bench 2.1'in 87 soruluk alt kümesini kullanarak yüksek eşzamanlılıkla yeniden test yaptı ve J-Space ile ilgili modüllerin yüklendiğini doğruladı. Sonuçlar, J-Space eklendikten sonra Benchmark puanlarının hafifçe düştüğünü, Token kullanımı ve maliyetlerin arttığını gösterdi; bu, projenin iddia ettiği performans, hız ve Token verimliliği artışının tam tersi yönündeydi.
Topluluk daha sonra projenin tam değerlendirme yapılandırmasını, soru bazında sonuçları, çalışma günlüklerini, orijinal süreleri ve Token tüketimi gibi verileri kamuya açıklamasını talep etti. Şu anda proje yalnızca özet sonuçları paylaşıyor ve bu kesin verileri doğrulamak için yeterli tam orijinal deney kayıtlarını henüz sunmadı. Dikkat çekici olan, sorgulamalarla karşı karşıya kalan proje yazarı, ilgili verilerin "gerçekten abartılı olduğunu" kabul etti ve gerçek iyileştirmenin yaklaşık 1,6 ila 3 kat arasında olduğunu söyledi. Şu ana kadar yazar, topluluk sorgulamalarına resmi bir yanıt vermedi ve bazı ilgili sorgulama Issue'ları silindi.
