StepFun rilis lima model suara, tingkat kesalahan kata capai 1,7%
StepFun merilis lima model StepAudio 3 sekaligus, unggul di beberapa papan peringkat Artificial Analysis, dengan ASR mencatat tingkat kesalahan kata 1,7%.
4 artikel terverifikasi tentang Pengenalan Suara, produk, dan perkembangan industri.
StepFun merilis lima model StepAudio 3 sekaligus, unggul di beberapa papan peringkat Artificial Analysis, dengan ASR mencatat tingkat kesalahan kata 1,7%.
Model ASR open source Xiaomi mengisolasi suara satu penutur target dari ucapan yang tumpang tindih, error rate 12,29% untuk tiga pembicara sekaligus.
Eksperimen diagnostik Hume AI terhadap 11 model pengenalan suara terkemuka menemukan bahwa model dengan skor benchmark tertinggi justru paling sering mengulang teks referensi yang salah, bukan mendengar audio secara akurat.
Tencent merilis Hy ASR 3.0 preview dengan angka WER, cakupan dialek, dan batas API Tencent Cloud.