Model Suara Tetap Menyebut Angka yang Sudah Dibisukan
Eksperimen diagnostik Hume AI terhadap 11 model pengenalan suara terkemuka menemukan bahwa model dengan skor benchmark tertinggi justru paling sering mengulang teks referensi yang salah, bukan mendengar audio secara akurat.