动察 Beating AI hızlı haberi: NVIDIA CEO'su Jensen Huang bu sabah, GPT-6 Astra eğitiminin yaklaşık 100.000'den fazla Grace Blackwell GPU kullandığını ve NVLink72 ile yüksek hızlı birbirine bağlı bir küme oluşturduğunu açıkladı. Ayrıca bir sonraki partide 400.000 GPU'nun devreye gireceğini ancak belirli model ve sahiplik bilgisi vermediğini söyledi.
Astra'yı referans aldığımızda, Çin'in önde gelen model şirketlerinin açık hesaplama gücü hâlâ belirgin bir fark gösteriyor. ByteDance şu anda en yakın konumda; bu yıl Malezya üzerinden yaklaşık 36.000 B200 bağladı. Bu çipler, Astra'nın kullandığı GB200 ile aynı Blackwell nesline ait, ancak hesaplama gücü yurt dışında dağıtılmış durumda. ByteDance bu yıl Çin içi kümelerini tanıtırken ağırlıklı olarak hâlâ Hopper mimarisinin Çin'e özel sürümleri olan H20 ve H800'ü kullanıyor.
Kimi'nin yakın zamanda Alibaba üzerinden yaklaşık 20.000 Hopper GPU elde ettiği ortaya çıktı. Bloomberg kaynaklarına göre bunların H200 olduğu belirtildi, ancak Alibaba H200 modeli iddiasını reddetti. H200, önceki nesil Hopper'a ait; B200 ise Blackwell'e yükseltildi. GB200 ise Grace CPU ile Blackwell GPU'yu birleştiriyor ve NVL72, 72 GPU'yu aynı yüksek hızlı bağlantı alanına yerleştirebiliyor.
DeepSeek, V4'ün tam eğitim donanımını açıklamadı. Sızan Liang Wenfeng yatırımcı toplantısı transkriptine göre, şirketin Mayıs ayında yaklaşık 20.000 H eşdeğeri hesaplama gücü vardı ve çoğu yeni teslim edilmişti; sonraki alımların "temelde NVIDIA" olacağı belirtildi. Huawei'nin DeepSeek'e sağladığı 950 üretim kapasitesi yaklaşık 16.000 adet. Liang Wenfeng, bu yerli kartların yaklaşık 4.000 Nvidia B serisine eşdeğer olduğunu ve yalnızca mevcut nesil model eğitimi için yeterli olduğunu söyledi.
Astra'nın kullandığı Blackwell de artık NVIDIA'nın en yeni nesli değil. Vera Rubin tam seri üretime geçti. NVIDIA tahminlerine göre, Rubin büyük MoE modellerini eğitmek için gereken GPU sayısını Blackwell'in dörtte birine düşürebilir.
Kamuya açık kaynaklarda, hiçbir Çinli şirket tek bir model eğitimi için 100.000 aynı nesil ileri GPU kullandığını açıklamadı. Bu nedenle, Çin ve ABD'deki AI şirketleri arasındaki görünür fark artık yalnızca kart sayısı değil; hangi nesil karta erişebildikleri ve tek bir modele aynı anda kaç kart yoğunlaştırabildikleriyle ilgili.
