DeepSeek灰度语音对话,四种音色可选

9 月 12 日起,陆续有用户发现 DeepSeek App 右上角多了一个小喇叭按钮,点进去是语音对话。拿到测试资格的账号还能在设置页的语音一栏看到新增的“朗读音色”选项。

音色有四种,名字和描述都不长:贝壳(百变活泼)、白浪(明朗坚定)、海星(俏皮甜美)、暗潮(低沉浑厚)。四个词都取自海。

这轮更新没有官方公告,消息来自用户反馈。灰度比例、覆盖机型、什么时候全量,DeepSeek 官方目前没有说明。

隔两天的两件事

往前数两天,9 月 10 日 DeepSeek 发过 V4.1 Flash,是新模型结构系列里体量最小的一款,带原生多模态视觉理解。那一次走的是正式发布流程,有公告、有技术说明。

两件事挨得近,做法完全不同。模型侧的动作公开、有文档、可复核;App 侧的动作悄悄推、无声明、靠用户自己发现。这是 DeepSeek 一贯的分工:模型是要说的,产品是先做的。

从功能形态看,这次上的是朗读加对话两件套,跟目前主流的实时语音对话还有距离。“朗读音色”这个措辞本身指向的是文本转语音,也就是模型先写完再念出来,跟打断、插话、边听边想那一类全双工交互不是一回事。有没有更完整的语音模式在后面排队,目前看不出来。

对国内用户的几个实际差别

第一是能不能用上。灰度期间判断方式只有一个:打开 App 看右上角有没有喇叭。没有就是没轮到,重装和切账号都不解决问题。这种投放方式在国内 App 里很常见,好处是出问题影响面小,代价是用户拿不到任何预期时间。

第二是横向的位置。国内几家主力 AI App 的语音功能上得都比这个早,豆包、通义、元宝、Kimi 都已经跑了一段时间,其中几家还做到了实时打断。DeepSeek 补这一块,补的是产品完整度上的一个缺口。

第三是使用场景的变化。DeepSeek 的用户结构偏向长文本、代码和推理任务,这类场景里语音的收益本来不高,念代码没什么意义,念长推理过程更折磨人。语音在这里更可能落在两个位置:通勤和做家务时听结果,以及不方便打字时口述问题。四个音色的设计也更像是听感偏好的调节,不是交互模式的替换。

第四是这轮更新暴露的一点信息。DeepSeek 过去的产品更新节奏慢于同行,App 侧的功能长期只保留最基本的对话框。语音进灰度,加上 V4.1 Flash 的原生视觉理解,两条线合起来看,App 的能力表正在往多模态那一侧铺。铺到什么程度、会不会往实时交互走,官方没有给过任何口径。

对现在就想用语音的用户,实际建议只有一条:等。灰度没有申请通道,也没有公开的排队规则。

参考来源:IT之家、新浪科技、CocoLoop、DeepSeek App 设置页;核验四种音色名称与描述、灰度起始日期及 V4.1 Flash 的发布节点。