动察 Beating AI hızlı haber: Meta, görsel segmentasyon modeli SAM 3.1'i resmi olarak Model API'ye entegre etti. Geliştiriciler bir görsel veya video ile birlikte "kırmızı bisiklet" gibi bir ifade girdiğinde, ilgili nesneyi doğrudan bulup sınırlayıcı kutu ve piksel düzeyinde maske döndürebiliyor. Videoda aynı hedefi baştan sona takip edebiliyor; bu da otomatik sansürleme, efekt ekleme gibi işleri kolaylaştırıyor.
Meta, bu yılın mart ayında SAM 3.1'in açık ağırlıklı sürümünü zaten yayınlamıştı. SAM 3'e kıyasla en büyük yükseltmesi Object Multiplex; eskiden birden fazla hedef tek tek işlenirken, artık aynı anda en fazla 16 hedef işlenebiliyor. Meta'nın testlerinde, bir H100'ün çok hedefli video işleme hızı saniyede 16 kareden 32 kareye çıktı; 128 hedef takip edilirken hız yaklaşık olarak SAM 3'ün 7 katına ulaştı.
Önceden geliştiricilerin ağırlıkları kendilerinin indirmesi, GPU ve dağıtım ortamı hazırlaması gerekiyordu; artık doğrudan Meta'nın barındırdığı API kullanılabiliyor. Görsel segmentasyonu her 1000 görsel için 2,5 dolar, video ise her 1000 kare için 0,2 dolar olarak ücretlendiriliyor; ayrıca doğrudan OpenAI SDK ile entegre edilebiliyor.
Ancak API sürümü şu an yalnızca metin istemlerini kabul ediyor; açık ağırlıklı sürüm ise kutu, nokta gibi görsel istemlerle hedef belirlemeye de olanak tanıyor. Video API'si kare başına en fazla 16 nesne takip edebiliyor.
