动察 Beating AI hızlı haberi: GLM-5.3 Flash'ın yayınlanmasının ardından Zhipu, daha önce kamuya açıklanmamış bir detayı doğruladı: Ox Alpha'nın anonim test dönemindeki trafiğin tamamı, Çin'in yerli AI çipleri tarafından sağlanan çıkarım hesaplama gücüyle işlendi.
Ox Alpha, OpenRouter'da 6 tam doğal gün içinde 23,2 trilyon token işledi; bu, aynı dönemdeki DeepSeek-V4-Flash'ın 2 katından fazla. OpenCode daha önce arka planda günde 100 trilyon token ücretsiz kota sağlama kapasitesine sahip olduklarını bile belirtmişti.
Zhipu, aynı Çin yerli donanımı üzerinde uçtan uca çıkarım performansını başlangıçtaki seviyenin 3 katına optimize ettiklerini ve artık donanım verimliliği ile tek token maliyetinin ana akım NVIDIA GPU'larına yakın seviyeye ulaşabildiğini söyledi.
SemiAnalysis bu noktayı özellikle vurguladı. Daha önce dışarıdakiler günde 100 trilyon token arz kapasitesini görünce, bu ölçeğin yalnızca üst düzey laboratuvarların ve NVIDIA GPU'larının kaldırabileceğini tahmin ediyordu. Ancak sonuçta baştan sona tamamen Çin yerli çipleri kullanıldı.
