Beating'in izlemesine göre, ByteDance Seed, ses oluşturma modeli Seed Audio 1.0'ı yayınladı. Bu model, tek bir prompt ile aynı anda diyalog, ses efektleri ve ortam sesleri üretebiliyor ve seslerin zaman çizelgesine göre girişini kontrol edebiliyor.
Model, metin ve referans ses girişini destekliyor ve zaman kontrol hassasiyeti 100ms. Tek seferde yaklaşık 2 dakikalık ses üretebiliyor ve ayrıca uzatılarak karakter ses tonunun tutarlı kalması sağlanabiliyor.
Seed Audio 1.0, 20'den fazla dili destekliyor. Aynı ses tonu diller arasında aktarılabiliyor ve ayrıca ton ve duygu değiştirilebiliyor.
Resmi değerlendirmelere göre, çoğu senaryoda ses kullanılabilirliği %90'ın üzerinde. Çoğu dilin doğallık MOS puanı 4'ün üzerinde. Model, Volcano Ark Deneyim Merkezi'nde yayına alındı ve API erişimine açıldı.
