Số liệu không có trong âm thanh, mô hình giọng nói vẫn đọc ra
Thử nghiệm của Hume AI trên 11 mô hình ASR cho thấy điểm WER thấp nhất thường trùng với tỷ lệ lặp lại lỗi văn bản tham chiếu cao nhất, đặt câu hỏi về cách chọn mô hình giọng nói cho sản xuất.