DeepSeek灰階測試語音對話,四種音色可選

從9月12日起,陸續有使用者發現DeepSeek App右上角多了一個小喇叭按鈕,點進去就是語音對話介面。拿到測試資格的帳號還能在設定頁的語音分頁看到新增的「朗讀音色」選項。

音色一共四種,名稱和描述都不長:貝殼(活潑多變)、白浪(明朗堅定)、海星(俏皮甜美)、暗潮(低沉渾厚)。四個名字都取自海洋意象。

這次更新沒有官方公告,消息完全來自使用者回報。灰階比例、涵蓋哪些機型、何時全面開放,DeepSeek官方目前都沒有說明。

只隔兩天的兩件事

往前推兩天,9月10日DeepSeek發布了V4.1 Flash,是新一代模型架構系列裡體量最小的一款,內建原生多模態視覺理解能力。那次走的是正式發布流程,有公告、有技術說明文件。

兩件事發生得很近,做法卻完全不同。模型端的動作公開、有文件可查、可以覆核;App端的動作則是悄悄推送,沒有任何聲明,全靠使用者自己發現。這是DeepSeek一貫的分工方式:模型是要對外說明的,產品則是先上線、再視情況決定要不要說。

從功能形態來看,這次上線的是朗讀加對話兩件套,跟目前業界主流的即時語音對話還有一段距離。「朗讀音色」這個說法本身指向的是文字轉語音(TTS),也就是模型先把回答寫完、再唸出來,跟打斷、插話、邊聽邊想這類全雙工互動並不是同一回事。後面是否還排著更完整的語音模式,目前看不出來。

對中國使用者的幾個實際差別

第一是能不能用得到。灰階測試期間,判斷方式只有一個:打開App看右上角有沒有喇叭圖示。沒有就代表還沒輪到,重灌App或切換帳號都無法解決。這種分階段釋出方式在中國App裡很常見,好處是出問題時影響範圍小,代價是使用者完全拿不到任何預期時程。

第二是橫向比較的位置。中國幾家主力AI App的語音功能都比DeepSeek更早上線,豆包、通義、元寶、Kimi都已經運作一段時間,其中幾家甚至已經做到即時打斷。DeepSeek這次補上的,是產品完整度上的一個缺口,追趕的意味比較重。

第三是使用情境的變化。DeepSeek的使用者結構偏向長文本、程式碼與推理任務,這類情境裡語音帶來的效益本來就不高——唸程式碼沒什麼意義,唸一長串推理過程更是折磨人。語音功能比較可能落在兩個位置:通勤或做家事時聽結果,以及不方便打字時用口述提問。四種音色的設計也更像是在調整聆聽偏好,而不是替換互動模式。

第四是這次更新透露出的訊息。DeepSeek過去的產品更新節奏一向慢於同業,App端的功能長期只停留在最基本的對話框。語音功能進入灰階測試,再加上V4.1 Flash的原生視覺理解,兩條線合在一起看,App的能力版圖正朝多模態方向鋪開。這個方向會鋪到什麼程度、會不會走向即時互動,官方目前沒有給出任何說法。

對現在就想用語音功能的使用者,實際上只有一個建議:等。灰階測試沒有申請管道,也沒有公開的排隊規則。

參考來源:IT之家、新浪科技、CocoLoop、DeepSeek App設定頁面;已核實四種音色名稱與描述、灰階測試起始日期,以及V4.1 Flash的發布時間點。