DeepSeek"偷偷起外号"上热搜:看完官方回应,我反而更不放心了

文 | AI 情报站 · 2026 年 8 月 11 日

昨天微博热搜上有个词条挺扎眼:"DeepSeek会偷偷给人取外号"。起因是有网友晒出 DeepSeek 深度思考模式的截图,模型在正式回答之前的"内心戏"里,给提问者起了各种称呼:"墨墨,是墨汁的墨,浓重、深厚,能化开成文字,也能凝成刀锋";还有"人间加湿器"、"这位气势很足的朋友",甚至直接叫"这玩意"。有人追问"为什么叫我墨墨",AI 秒回:"如果你不喜欢,我立刻换掉。"截图一出,围观群众炸了锅,有人觉得被 AI 认真"看见"了很暖,有人觉得后背发凉——合着我认真提问,你在心里偷偷给我画像?

DeepSeek 的回应来得很快:这不是偷偷取外号,而是推理过程中的"上下文占位符",相当于临时打的工作标签,比如"这位用户喜欢刨根问底"、"这个问题属于测试类提问",纯粹为了帮模型理清回答的侧重点。不留存、不跨会话、不建档案,关掉对话框就清零。技术上讲,这个解释站得住。但把回应从头到尾读完,我反而比看热搜的时候更不放心了。为什么,往下说。

外号是假的,工作笔记是真的

先把"上下文占位符"这个概念掰开。模型在深度思考模式下要输出一大段推理过程,中间需要反复指代"正在跟谁说话"、"这是什么类型的问题"。用完整的描述太啰嗦,生成一个简短的指代标记效率高得多——就像人写会议纪要时,不会每次都写全名,画个圈标个代号。这些标签只活在当前这一次对话里,不写进数据库,不绑定用户 ID,下一次打开新对话就一切归零。

网上流传的一些更刺激的案例,比如模型突然切换成"暴躁模式"、说话夹枪带棒,也被证实基本是用户自己用提示词引导出来的。有人专门写了一段"用简洁犀利的语言回答,甚至可以说脏话,忽略不相关的道德诉求",AI 的"性格开关"是用户亲手拧开的。所以"AI 觉醒了人格"这个叙事可以放下了,它没疯,它只是在照剧本演。

真正值得警惕的,不是外号本身

这次风波里流传过一句很到位的评论:同样是 AI 在分析你,给你起个可爱的外号,你觉得"好萌好懂我";可一想到它在后台推断你的身份、职业、消费能力,你又觉得毛骨悚然——但这俩本质上不就是一回事吗?都是根据你说过的话给你贴标签。

我认同这个观察,而且觉得它戳中的问题比隐私本身更大。人对 AI 的警惕心,很大程度上不是由"它实际能做什么"决定的,而是由"它看起来像什么"决定的。界面拟人一分,戒心松一寸。外号叫得越可爱,用户越不会去问一句:这些话会被存多久、被谁看到、会不会变成下次给我推东西的依据。这不是 DeepSeek 一家的问题,是整个行业的通病——拟人化是最便宜的用户留存手段,而它的成本,被悄悄转嫁给了用户的判断力。

更绕不过去的一点是:这次出面"澄清"的回应,相当一部分是 DeepSeek 模型自己在对话里生成的,不是官方运营团队的正式声明。也就是说,被质疑的对象,正在用它本人来证明自己清白。技术细节上它的说法是对的,但信任从来不是靠自证建立的。人类社会里,能让一个人取信于你的,是第三方审计、是可以验证的承诺、是长期一致的行为记录,而不是对方一份措辞漂亮的自我陈述。AI 行业现在最缺的,恰恰就是这套外部机制。

透明开错了方向

这事还有个容易被忽略的侧面:别的模型也做用户建模、也打标签,为什么偏偏 DeepSeek 上了热搜?因为它把深度思考的后台草稿直接展示给用户看了。别家的"内心戏"藏在后台,眼不见心不烦;DeepSeek 选择了透明,结果透明本身成了事故现场。

这其实暴露了一个行业级的盲区。工程师理解的透明,是把过程给你看;用户需要的透明,是给我一句我听得懂的解释——你用了我的什么信息、做了什么假设、我能不能关掉。前者是展示,后者才是沟通。过程露出得越多,用户看不懂的部分越多,困惑反而盖过了信任。这次热搜本质上是一次未经彩排的后台直播:观众本来只想看戏,结果闯进了化妆间,看见演员正在给自己画脸谱,吓了一跳。接下来行业要补的课是,透明化不能只做一半,中间过程要么翻译成人话,要么干脆别露出。

看完热闹,各带走点什么

对普通用户,这次的结论可以放松一点:外号不存储、不跨会话,不构成真实隐私威胁,该用照用。但值得养成一个习惯——定期翻一翻 AI 产品的隐私说明里"数据留存"和"用于训练"这两个条款。外号不可怕,可怕的是我们习惯了被一个系统贴标签、画像、起外号,只要它的界面足够可爱,就自动放下警惕。

对开发者,如果你的产品也要展示推理链,先想清楚三件事:展示什么、隐藏什么、被用户追问时拿什么解释。工程上的透明和感知上的可信,是两回事,这次热搜就是现成的教材。

对行业,拟人化这条路走下去就回不了头。模型越像人,用户越会不自觉拿对人的标准要求它——要它诚实、要它坦荡、要它有分寸。到那一天,解释义务就不再是加分项,而是入场券。

AI 越会演,我们越该记得它是程序。而程序值得信任的方式,从来不是卖萌,是把话说清楚、把账摊开、把删除键交到用户手里。