階躍五款語音模型齊發 詞錯率壓至1.7%
階躍星辰同日推出五款 StepAudio 3 語音模型,Realtime、Speech Reasoning 等多項指標登上 Artificial Analysis 榜首,ASR 詞錯率低至 1.7%。
收錄 語音識別 相關產品動態與產業觀察,共 4 篇文章。
階躍星辰同日推出五款 StepAudio 3 語音模型,Realtime、Speech Reasoning 等多項指標登上 Artificial Analysis 榜首,ASR 詞錯率低至 1.7%。
小米開源語音識別模型CocktailASR-1,鎖定多人同時說話中的目標說話者,三人混說字錯率12.29%,遠低於同場競品的76%至121%。
Hume AI 對 11 款主流語音辨識模型的診斷實驗發現,公開榜單分數愈高的模型,愈可能是在複誦資料集本身寫錯的參考文字,而非真的聽得更準。
騰訊混元發布 Hy ASR 3.0 preview,公開 WER、方言覆蓋與騰訊雲 API 限制。