Des chiffres absents de l'audio, le modèle vocal les récite quand même
Un test de Hume AI sur 11 modèles ASR montre que le taux d'erreur le plus bas coïncide souvent avec le taux le plus élevé de reproduction des erreurs du texte de référence, un signal d'alarme pour le choix des modèles vocaux.