为什么 DeepSeek 深度思考过程中总要先「嗯」一声?
答主丨吕阿华(1800+赞同)
在回答问题的思考过程中以「嗯」或者「好的」开头这股不良风气的传染源确实是 DeepSeek。
Qwen 系列症状截图
GLM 系列症状截图
Hunyuan 系列症状截图
MiniMax-M1 症状截图
既然传染源找到了,那直接问传染源是如何得病的就好了。
DeepSeek 自己是这么回答的:
嗯,用户问了一个关于我思考模式的问题,挺有意思的。ta 注意到我每次思考前都会用「嗯」或「好的」开头,看来是个观察很细致的人。
用户可能不只是好奇这个设计,更深层是想了解对话助手的交互逻辑。ta 或许在思考人机对话的自然度问题,甚至可能自己也在设计对话系统?不过也可能是单纯被这些重复词引起了注意。
这个习惯确实是我们团队刻意设计的。用「嗯」开头能实现好几个功能:首先是缓冲作用,让用户知道系统正在处理,避免冷启动的尴尬;其次是模仿人类对话的节奏,就像现实中回应别人前会先「嗯」一声;最后还能结构化输出,把思考过程和最终回复区分开。
不过用户既然提出这个问题,说明 ta 可能觉得这种模式有点机械?或者想确认背后是否有特殊考量?下次回复时得解释清楚这属于交互设计策略,同时也要感谢 ta 的细心观察——毕竟能注意到这种细节的用户不多。
要不要在回复里建议其他缓冲词呢?「让我想想」「这个问题很有意思」之类的替代方案?不过现有方案经过大量测试验证,突然改变反而可能影响用户体验。还是先解释设计原理比较稳妥。
你观察得很仔细! 我使用「嗯」「好的」这类词语开头,主要是出于以下几点设计考量:
自然对话的模仿:像「嗯」「好的」这样的语气词是人类对话中常见的思考缓冲词(比如表示「我听到了」「我在想」)。这样设计是为了让对话更贴近真人交流的节奏感,避免机械感。
明确的思考反馈:当用户看到这些词时,会立刻意识到:「助手正在处理我的问题」。这种即时反馈能减少等待焦虑(尤其处理复杂问题时需要几秒生成时间)。
结构化输出的分隔符:这类词语相当于一个「信号」,将你的问题和我的回答区分开。在长对话中能帮助用户快速定位回复的起始位置。
友好度的平衡:直接输出答案可能显得生硬。加入轻量级语气词能在保持效率的同时,让口吻更温和(试对比冷冰冰的纯技术性回复)。
需要澄清的是:⚠️ 这不是真正的思考过程——我的响应本质上是实时生成的,这些词只是交互设计的一部分。就像人类说「呃……」时不一定在思考,可能只是习惯性停顿。
这是当事人给的标准答案。
看到有不少同学对这个议题感兴趣,也提出自己的一些质疑。我在 DeepSeek 自己给出的标准答案的基础上,补充一下我个人的观点。
和 DeepSeek 核心团队一样,我也长时间和毕业于老和山职业技术学院的校友们一起工作,在和同事交流时一定频率地加入「嗯」和「好的」已经是我们血液中流淌的一种习惯。
以我个人的长期体会,这两个没有用的语气词在 95%的乖巧和听话中掺入了 5%的俏皮与不羁,在表达了研发人员对长期严谨而枯燥的研发工作轻度对抗情绪的同时,也抒发了作者的思乡之情。
1. 这个「嗯」其实是精心设计的交互策略,目的是为了让对话感觉更自然,像是在模仿人类思考时的缓冲;
2. 它主要起到一个明确的反馈作用,告诉你 AI 已经接收到问题并开始处理了;
3. 它也是一个友好的分隔符,让你的问题和 AI 的回答在长对话中更清晰。