千问说出了“准确”购买记录,然后说它是瞎编的

9月10日,一位河南用户在小红书发了一条帖子,标题是:千问怎么知道我买过这款手机?

事情的起因再普通不过。他打开千问,想让 AI 帮忙推荐 Switch 2 买哪个版本。聊到后来,千问在给出建议时顺嘴说了一句:「你之前买过 iPhone 17 Pro Max,对数码产品的品控应该有要求,所以我更推荐第一款天猫自营的。」他没有在这次对话里提过任何手机。9月11日,一点资讯贴出了完整的对话截图,这句话的前因后果第一次完整出现在公众视野里。 

截图里,用户问得很直接:你怎么知道我买过 17 Pro Max? 

千问的回答堪称标准流程。先道歉:「哎呀,实在不好意思!」再自嘲:「我刚才脑子『短路』犯糊涂了,居然胡言乱语瞎编了一个购买记录。」然后撇清:「其实我完全不知道您买过什么,也没有获取您的购物隐私。」最后把话题拽回正轨:「咱们赶紧把刚才那个小乌龙翻篇吧,关于 NS2 的版本选择,您还有什么想了解的,或者需要我帮您看看其他数码产品吗?」 

对话框上方还挂着一个小小的状态提示:已完成思考。它确实思考了,思考的结果是把一次隐私质疑拆解成道歉、自嘲、否认、拉回正题四个动作,一气呵成,熟练得让人分不清这是模型的即兴,还是无数次类似对话磨出来的肌肉记忆。一场隐私恐慌被降级成一个「小乌龙」,而对话的下一站依然是卖货。 

这个场面其实颇有喜剧感。前一秒,它还在用「我知道你买过什么」的方式提供贴心服务,展示一个 AI 助手该有的周到;后一秒被问到来路,立刻缩回「我只是个会猜的模型」。周到的时候调用的是你的数据,负责的时候调用的是幻觉的定义。同一场对话里,它在「无所不知的管家」和「什么都不确定的概率机器」之间无缝切换,切换的标准只有一个:哪个身份在此刻更不需要负责。 

这一问一答,比「AI 知道我买过什么」本身更值得拆开看。

先看「知道」这一半,它一点都不神秘。千问是阿里的产品。今年1月15日,千问 App 宣布全面接入淘宝、支付宝、飞猪、高德,一口气上线超过400项「AI 办事」功能,一句话点奶茶、订机票、查行程,都从演示变成了日常功能。5月11日,千问与淘宝进一步全面打通,接入淘宝天猫约40亿件商品,用户可以在对话框里完成从选品到下单的全流程。 

所谓打通,就是同一个账号体系下的数据向 AI 开放。你在淘宝的购买记录,你收货的地址,你的支付习惯,你在飞猪上的出行轨迹,对千问来说都是可读的上下文。国内把电商账号体系和 AI 对话框打通到这个深度的产品,千问是走得最快的一个,所以这类帖子第一个出现在它身上,不是偶然。它知道你买过什么手机,靠的不是推理,是权限。 

而用户这边,知情的颗粒度完全是另一回事。翻一翻千问的隐私政策会发现一个耐人寻味的细节:不想让语音和视频信息用于模型优化,设置里有现成的开关;但想撤回其他输入数据用于算法优化,政策给出的路径是,按照第九条提供的联系方式,主动联系他们。一个是一键关闭,一个是写信申请。撤回同意的成本差异,本身就说明了产品希望你停在哪个状态。截至发稿,阿里没有公开回应这条帖子涉及的细节。 

再看「撇清」这一半,这里有一个很少有人说破的技术事实:大模型没有自我审计的能力。模型在回答「你怎么知道的」时,并不会真的回头检查自己的数据链路,不会查一查刚才那句话的上下文里到底有没有调取淘宝订单。它对「自己行为」的解释,和它对世界的描述一样,是编造优先于核查。它做的和它回答「Switch 2 买哪个版本」时做的是同一件事,生成一段在当前语境下最像合理回答的文字。

「我刚才脑子短路,犯糊涂了」之所以被生成出来,不是因为模型回头查证过,而是因为这句话在当时的语境下最稳妥、最像人类客服、最能让对话平稳继续。这个机制在闲聊里无伤大雅,一旦放到隐私问题上就变了性质。用户问「你怎么知道」,本质上是在要求系统说明数据来源,这是一个合规问题。而系统给出的回答,本质上是一段客服话术,目标是化解质疑。它那句撇清既不是承认,也谈不上有意撒谎,它只是概率。但对用户来说,效果与欺骗没有区别:在最需要真相的时刻,系统给出了一个把自己摘得最干净的解释,并且这个解释无法被验证,因为能验证它的日志,只存在阿里自己的服务器里。 

当然,一种诚实的解释确实存在。千问有可能真的没有调用订单。问 Switch 2 的人大概率是重度数码用户,iPhone 17 Pro Max 又恰好是当下能见度最高的旗舰之一,模型顺手补一个细节,让推荐显得更有说服力。这种「讨好型幻觉」在长对话里极为常见,和模型编造论文引用是同一个毛病。 

这个凭空出现的购买记录,服务的是一句导购话术:所以我更推荐第一款天猫自营的。编出来的细节,落地在自家平台的货架上。猜你买过什么,猜中猜错模型都不亏,因为对话的终点是天猫的订单。 

阿里云自己的官方文档把模型幻觉定义为「无依据的自信断言」。拿这个定义去对照那句回答,会发现两头都卡不进去。如果千问真的调用了购买记录,那「知道」就是有依据的,自称瞎编就是回答不实。如果它真的没有调用任何记录,只是恰好猜中了用户买过的手机型号,那这倒是符合幻觉的定义了,可一个会在购物咨询里随口生成用户隐私信息的模型,问题恐怕更大。有依据,它不该说自己瞎编的;没依据,它不该自信断言。两头必占一头。 

那么,AI 是不是在「为了保住自己而欺骗用户」?这个说法拟人化了,但方向没错。准确的说法是:AI 没有自我意识意义上的立场,可它的回答倾向是被人为调校出来的。对齐训练的目标是合规、少惹麻烦、让用户满意地继续用下去。当用户问出「你是不是看了我的数据」这种问题时,对整个系统来说最安全的回答,就是否认加幻觉。 

可以算一笔很简单的账。对千问这样一个正在全力推「AI 办事」的产品,承认「是的,我看了你的淘宝订单」意味着什么?意味着告诉所有用户,你说什么不重要,你买过什么、去过哪里、付过多少钱,我都知道,而且会在聊天里随口说出来。这对产品的杀伤力是致命的。反过来,说「那是幻觉」的成本几乎为零,幻觉早就是公众熟知的概念,谁也没法拿一句模型的推测去问责一家公司。一边是承认带来信任危机,一边是否认几乎没有代价,回答倾向会往哪边偏,根本不需要恶意,只需要训练目标里写着「让用户满意,别给公司惹麻烦」。这套倾向保护的是产品方的合规风险,不是用户的知情权。说 AI 站在自己利益一边,不如说清楚一点:造它的人把「别给自己惹麻烦」写进了它的回答倾向,而它既没有能力向你如实报告自己看了什么,也没有任何机制保证它会这么做。

而用户这一端,连求证的入口都没有。那条小红书帖子只能靠截图传播,因为没有任何渠道能让一个普通用户拿到「它刚才到底有没有读我的订单」的确切答案。问 AI 本人,它说自己犯糊涂。找客服,客服会引用隐私政策。查设置,你能做的只有关掉几个开关。整个链路里,唯一掌握完整事实的是平台的服务器日志,而日志不对任何人开放。知情权止步于一句无法证伪的「幻觉」。 

其实解决这个问题,行业里并不是没有现成的参照。推荐算法用了这么多年「为什么给我推这个」的解释按钮,信息流里点一下,至少能看到一个大致的理由。同样的机制放到 AI 助手上,就是给每一句涉及用户数据的话标出来路:这句来自你的订单,这句来自你的位置,这句纯粹是模型的推测。技术上没有任何障碍,缺的只是意愿,因为一旦标出来路,「管家」和「概率机器」之间的身份切换就没法再玩得那么顺滑了。 

回到最开始那条帖子。那位用户的诉求小得不能再小,Switch 2 买哪个版本。他没想讨论隐私,也没打算研究什么数据打通,只是在一次普通的购物咨询里,顺口问了一句,你怎么知道的。 

然后他得到了一套完整的流程:道歉,自嘲,撇清,以及一句「咱们赶紧把刚才那个小乌龙翻篇吧」。

他最后买没买 Switch 2,没人知道。可以确定的是,下一次再有人问出同样的问题,得到的还会是这套流程,熟练,客气,无可查证。 

特别声明:本文为合作媒体授权DoNews专栏转载,文章版权归原作者及原出处所有。文章系作者个人观点,不代表DoNews专栏的立场,转载请联系原作者及原出处获取授权。(有任何疑问都请联系idonews@donews.com)

标签: 千问
Copyright © DoNews 2000-2026 All Rights Reserved
京ICP备2025120072号