Ana Sayfa
AI AI
Flaş
Derinlik
Etkinlikler
BlockBeats Pro
Daha Fazla
Finans
Özel
Blok Zinciri Ekosistemi
Giriş
Podkastlar
Veri
OPRR
#
BTC
$96,000
5.73%
ETH
$3,521.91
3.97%
HTX
$0.{5}2273
5.23%
SOL
$198.17
3.05%
BNB
$710
3.05%
lang
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe

StepAudio 3 tanıtıldı: Sesli akıl yürütme ve gerçek zamanlı diyalogda çift birincilik

动察 Beating AI hızlı haber: Jieyue Xingchen, StepAudio 3'ü yayınladı ve Realtime, ASR, TTS, Gen ile Music olmak üzere beş ses modelini birden kullanıma sundu.


Artificial Analysis'in iki ses değerlendirmesinde StepAudio 3 Realtime birinci sırada yer aldı. Conversational Dynamics'te %98,9 puanla Qwen Audio 3.0 Realtime Plus'ın %98,4'ünün ve GPT-Realtime-2 High'ın %95,3'ünün önüne geçti; Speech Reasoning'de ise %99,7 puanla yine birinci oldu. İlki esas olarak modelin duraklamaları, sırayla konuşmayı, kullanıcı kesintilerini ve "hı hı", "evet" gibi onaylamaları işleyip işleyemediğini ölçerken, ikincisi modelin sesi doğrudan anlayıp akıl yürütmeyi tamamlayıp tamamlayamadığını test ediyor.


ASR de Artificial Analysis'in akışsız ses tanıma listesinde %1,7 WER (kelime hata oranı) ile Fun-Realtime-ASR-preview ile birlikte birinci sırada yer aldı. Ayrıca StepAudio 3 Gen, insan sesi, ses efektleri, ortam sesleri ve müziği tek seferde üretebiliyor ve senaryoya göre bir bütün halinde düzenleyebiliyor.


Beş model şu anda Jieyue'nin ses ürün hattına dahil edilmiş durumda.

举报 Düzeltme/Rapor
Düzeltme/Rapor
Gönder
Kütüphane Ekle
Sadece kendime görünür
Herkese Açık
Kaydet
Kütüphane Seç
Kütüphane Ekle
İptal
Tamamla