Ana Sayfa
AI AI
Flaş
Derinlik
Etkinlikler
BlockBeats Pro
Daha Fazla
Finans
Özel
Blok Zinciri Ekosistemi
Giriş
Podkastlar
Veri
OPRR
#
BTC
$96,000
5.73%
ETH
$3,521.91
3.97%
HTX
$0.{5}2273
5.23%
SOL
$198.17
3.05%
BNB
$710
3.05%
lang
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe

MiniMax, H3 mimarisine dayalı görüntü üretim modelini tanıttı: görüntü üretimi ve düzenleme tek bir modelle yapılabilir.

Önemli bir gelişme olarak, 动察 Beating tarafından yapılan takibe göre, MiniMax H3 ekibi Reddit AMA oturumunda özel bir görüntü modeli geliştirdiklerini ve ağırlıkları açık kaynak olarak yayınlamayı planladıklarını açıkladı. Bu model, metinden görüntü üretme ve genel görüntü düzenlemeyi tek bir modelde birleştirecek ve şu anda eğitim sonrası optimizasyon aşamasında.

Bu model, H3 ile aynı mimari yaklaşımı paylaşıyor. H3'ün VAE Kodlayıcısını kullanacak ve görüntü üretimi için ayrı bir VAE Çözücü tasarlayacak. MiniMax'ın öngördüğü iş akışı, önce görüntü modeliyle ilk kareyi üretmek, ardından bunu H3'e devrederek videoyu oluşturmaya devam etmek.

Ekip ayrıca, H3'ün zaten belirli bir görüntü üretme ve düzenleme potansiyeli gösterdiğini belirtti. Daha önce modeli yalnızca "ilk kare + metin açıklaması" temelinde son kareyi tahmin etmek üzere eğitmişlerdi ve görüntü düzenleme için özel bir eğitim yapmamışlardı, ancak model çeşitli görüntü düzenleme değerlendirmelerinde güçlü bir sıfır atış yeteneği sergiledi. Bu, MiniMax'ın bu mimariyi görüntü modeline genişletmeye devam etmesinin önemli bir gerekçesi.

Düzeltme/Rapor
Gönder
Kütüphane Ekle
Sadece kendime görünür
Herkese Açık
Kaydet
Kütüphane Seç
Kütüphane Ekle
İptal
Tamamla