动察 Beating AI hızlı haber: DeepSeek, V4.1 Flash'ı resmen yayınladı. Yeni modelin toplam parametre sayısı 552B (552 milyar) olup, tamamen yeni bir Causal-Encoder-Decoder mimarisi kullanıyor ve görüntü anlamayı yerel olarak destekliyor. Aynı zamanda DeepSeek'in bu yeni mimari serisindeki şu anki en küçük modelidir.
Bu mimari, girdi ve çıktıyı ayrı ayrı işliyor. Girdiyi okurken yalnızca 8B (8 milyar) parametre etkinleştiriliyor, yanıt üretirken 16B (16 milyar) etkinleştiriliyor. DeepSeek, bunun 552B'lik büyük bir modelin bile çıkarım maliyetini düşürmesini sağladığını söylüyor. Yeni ön eğitim ve daha büyük ölçekli pekiştirmeli öğrenmenin ardından V4.1 Flash, resmi kıyaslama testlerinde V4 Pro'yu geçmiş durumda.
Önbellek de büyük ölçüde sıkıştırıldı. Önceki nesle kıyasla V4.1 Flash'ın HBM bellek ihtiyacı 1/4'e, SSD depolama ihtiyacı 1/8'e düştü; bu esas olarak uzun bağlam ve Agent'ın tekrarlanan çağrılarındaki maliyeti azaltmak için kullanılıyor.
V4.1 Flash eş zamanlı olarak API'de de yayında; model adını deepseek-flash olarak değiştirerek çağırabilirsiniz.
