动察 Beating AI hızlı haberi: DeepSeek'in yeni bir görsel modeli olan deepseek-v4-flash-vision-exp su yüzüne çıkmaya başladı. Toplulukta bazı kişiler API üzerinden çalıştırmayı başardı ve doğrudan görsel yükleyip soru sorabiliyor. Daha doğrudan bir sinyal ise, DeepSeek Harness bugün bu modeli varsayılan model dizinine ekledi ve açıkça görsel girişini desteklediğini işaretledi. İlgili kod PR'ının başlığı tam olarak "publish the vision model" (görsel modeli yayınla). Şu anda DeepSeek henüz resmi bir duyuru yapmadı ve resmi API dokümantasyonunda da henüz görünmüyor.
DeepSeek aslında uzun süredir görsel tanıyabiliyor. Web ve uygulama, görsel tanıma modunu zaten kullanıma sunmuştu. Daha önce DeepSeek görsel ekibinin yayınladığı araştırma, V4-Flash'a dayanıyordu ve modelin noktaları ve sınır kutularını doğrudan akıl yürütme zincirine eklemesini sağlıyordu; bu, modelin görsele "işaret ederken" aynı anda görsel CoT akıl yürütmesini tamamlaması anlamına geliyordu.
Bu yayının da önceden ipuçları vardı. İki gün önce DeepSeek Harness RC.8, resmi DeepSeek adaptörüne yerel görsel girişini yeni eklemişti. Uygulama notları o sırada deepseek-v4-flash-vision-exp'i zaten yazmıştı, ancak kasıtlı olarak varsayılan model dizinine koymamıştı; gerekçe, model uç noktasının hazır olmasını beklemekti.
İki gün sonra bu kısıtlama resmi olarak kaldırıldı. Harness v0.1.1-rc.1, deepseek-v4-flash-vision-exp'i varsayılan görsel model olarak listeledi. Daha önce "uç noktanın hazır olmasını bekliyoruz" deniyordu, şimdi doğrudan resmi model listesine girdi ve yeni görsel model yakında yayınlanacak.
