Ana Sayfa
AI AI
Flaş
Derinlik
Etkinlikler
BlockBeats Pro
Daha Fazla
Finans
Özel
Blok Zinciri Ekosistemi
Giriş
Podkastlar
Veri
OPRR
#
BTC
$96,000
5.73%
ETH
$3,521.91
3.97%
HTX
$0.{5}2273
5.23%
SOL
$198.17
3.05%
BNB
$710
3.05%
lang
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe

100 bin Blackwell ile eğitilen GPT-6 Astra, Çin'in büyük modellerinde hesaplama gücü farkı nerede?

动察 Beating AI hızlı haberi: NVIDIA CEO'su Jensen Huang bu sabah, GPT-6 Astra eğitiminin yaklaşık 100.000'den fazla Grace Blackwell GPU kullandığını ve NVLink72 ile yüksek hızlı birbirine bağlı bir küme oluşturduğunu açıkladı. Ayrıca bir sonraki partide 400.000 GPU'nun devreye gireceğini ancak belirli model ve sahiplik bilgisi vermediğini söyledi.


Astra'yı referans aldığımızda, Çin'in önde gelen model şirketlerinin açık hesaplama gücü hâlâ belirgin bir fark gösteriyor. ByteDance şu anda en yakın konumda; bu yıl Malezya üzerinden yaklaşık 36.000 B200 bağladı. Bu çipler, Astra'nın kullandığı GB200 ile aynı Blackwell nesline ait, ancak hesaplama gücü yurt dışında dağıtılmış durumda. ByteDance bu yıl Çin içi kümelerini tanıtırken ağırlıklı olarak hâlâ Hopper mimarisinin Çin'e özel sürümleri olan H20 ve H800'ü kullanıyor.


Kimi'nin yakın zamanda Alibaba üzerinden yaklaşık 20.000 Hopper GPU elde ettiği ortaya çıktı. Bloomberg kaynaklarına göre bunların H200 olduğu belirtildi, ancak Alibaba H200 modeli iddiasını reddetti. H200, önceki nesil Hopper'a ait; B200 ise Blackwell'e yükseltildi. GB200 ise Grace CPU ile Blackwell GPU'yu birleştiriyor ve NVL72, 72 GPU'yu aynı yüksek hızlı bağlantı alanına yerleştirebiliyor.


DeepSeek, V4'ün tam eğitim donanımını açıklamadı. Sızan Liang Wenfeng yatırımcı toplantısı transkriptine göre, şirketin Mayıs ayında yaklaşık 20.000 H eşdeğeri hesaplama gücü vardı ve çoğu yeni teslim edilmişti; sonraki alımların "temelde NVIDIA" olacağı belirtildi. Huawei'nin DeepSeek'e sağladığı 950 üretim kapasitesi yaklaşık 16.000 adet. Liang Wenfeng, bu yerli kartların yaklaşık 4.000 Nvidia B serisine eşdeğer olduğunu ve yalnızca mevcut nesil model eğitimi için yeterli olduğunu söyledi.


Astra'nın kullandığı Blackwell de artık NVIDIA'nın en yeni nesli değil. Vera Rubin tam seri üretime geçti. NVIDIA tahminlerine göre, Rubin büyük MoE modellerini eğitmek için gereken GPU sayısını Blackwell'in dörtte birine düşürebilir.


Kamuya açık kaynaklarda, hiçbir Çinli şirket tek bir model eğitimi için 100.000 aynı nesil ileri GPU kullandığını açıklamadı. Bu nedenle, Çin ve ABD'deki AI şirketleri arasındaki görünür fark artık yalnızca kart sayısı değil; hangi nesil karta erişebildikleri ve tek bir modele aynı anda kaç kart yoğunlaştırabildikleriyle ilgili.

举报 Düzeltme/Rapor
Düzeltme/Rapor
Gönder
Kütüphane Ekle
Sadece kendime görünür
Herkese Açık
Kaydet
Kütüphane Seç
Kütüphane Ekle
İptal
Tamamla