问 AI 「两千元以内的扫地机器人哪款好」,和问「某某品牌扫地机器人怎么样」,是两类完全不同的问题。前者是在要一份候选名单,后者是在核实一个已知的名字。这篇文章说的购物类问题,指的是前一类。

千问在这类问题上的材料来源,2026年发生了一次大的变化。

通义千问商品推荐的依据,官方说了什么

2026年5月11日,阿里巴巴宣布千问与淘宝全面打通。按官方公告,千问 App 接入了淘宝和天猫超过40亿件商品,用户可以通过对话浏览、比较、下单和管理物流。公告还写明,这项能力基于淘宝完整的商品目录和数十亿条用户评价训练,并会参考用户的历史订单给出符合偏好的推荐。

这几句话透露的信息比看上去多。它说明在购物场景里,千问手边有一个现成的、结构化的商品库,还有大量评价和个人订单数据。一个品牌的商品在淘宝天猫上的资料写成什么样,很可能直接进入这一类回答。

需要说清楚的是公告没说的部分。它没有公开推荐的排序规则,没有说明商品标题、参数、评价各自占多大分量,也没有说明站外品牌如何处理。凡是声称知道千问推荐算法细节的说法,都应当先问一句出处。

40亿件以上千问接入的淘宝天猫商品数量阿里巴巴2026
159722亿元2025年全国网上零售额国家统计局
26.1%2025年实物商品网上零售额占社会消费品零售总额比重国家统计局

国家统计局的数字说明了这件事的分量:2025年全国网上零售额159722亿元,实物商品网上零售额占社会消费品零售总额的比重是26.1%。购物问题越来越多地先问 AI,影响的是一个很大的盘子。

购物类问题的 AI 回答,和品牌问题不是一回事

直接点名品牌的问题,我们称为品牌词问题。用户已经知道这个品牌,是来核实的,目标是答案准确。购物类问题不同,用户手里还没有名单,目标是被放进名单。

问题类型例子回答主要依赖品牌能影响的部分
品牌核实某某品牌的空气炸锅质量怎么样关于该品牌的评价与公开资料事实准确、各渠道一致
品类推荐两千元以内的扫地机器人哪款好商品库、属性与价格、评价商品属性写全、价格信息清楚
属性比较这两款洗碗机哪个更省水双方可比较的参数参数以文本呈现、命名一致
场景适配租房用的小冰箱怎么选适用场景与限制条件的描述如实写出适合谁、不适合谁

个性化给测量带来了一个真实的难题。既然推荐会参考历史订单,品牌方用自己的常用账号问出来的结果,就不一定是潜在客户看到的结果。测量时应当尽量排除这层干扰,否则很容易把个性化的结果误读成可见度的变化。

通义千问推荐品牌时,商品信息该怎么写

先说研究。Pfrommer 等人在 EMNLP 2024 发表的研究,用真实的消费品网站构建数据集,考察大模型驱动的对话式搜索怎样给商品排序。他们发现,不同的大模型在看重商品名称、页面内容和上下文位置上差别很大。同一篇研究也证明了,用注入式文本操纵排序的攻击,可以迁移到真实的对话式搜索引擎上。

前一个发现说明,不存在对所有模型都有效的一套写法。后一个发现是警告而不是方法:操纵手段有效,恰恰意味着平台会持续修补,靠它换来的位置不会稳。

可以长期成立的写法没有那么神秘。商品的关键属性写成文本,最好是表格,每行一个属性,各商品之间的属性命名保持一致。Schema.org 的 Product 类型提供了品牌、GTIN 编码、报价、评分和附加属性等字段,适合给页面上真实可见的信息做标注。标注页面上看不到的属性,不是优化,是误导。

我们的通义千问平台页记录了一个测试中观察到的倾向:同样的属性放在表格里比写在段落里更容易被用上。这是可以观察到、会随版本变化的倾向,不是阿里巴巴的官方说明,值得用自己的商品验证一次。

「最」和「第一」为什么在商品页里是负资产

商品页里常见的「行业领先」「销量第一」「最佳选择」,在 AI 回答里几乎派不上用场。它们没有可比较的内容,模型无法把它拆成「这款适合谁」这样的答案。

它们还有监管风险。国家市场监督管理总局2023年发布的《广告绝对化用语执法指南》,把广告法第九条第三项所说的绝对化用语界定为「国家级」「最高级」「最佳」以及含义相同或近似的用语。指南也列出了例外,比如仅用于同一品牌商品的自我比较,或者依据国家标准、行业标准认定的商品分级用语,并能说明依据。

同一款商品在几个渠道上架,名称和参数要对齐

一款商品常常同时出现在品牌官网、天猫旗舰店、几家经销商店铺和测评文章里。名称各写各的,参数口径不一,有的写额定功率,有的写最大功率,对任何一个要做比较的系统来说,这都像是几件不同的商品。

《电子商务法》第十七条要求电子商务经营者全面、真实、准确、及时地披露商品或者服务信息。这是法定义务,也恰好是 AI 回答最用得上的那种材料。

比较实际的做法,是维护一份商品主数据:规范名称和常见别名、型号、核心参数及其测试口径、适用场景和明确不适用的场景。官网和各店铺的详情页都从这份数据出发,渠道伙伴也拿到同一份。它不需要新的系统,一张维护得当的表格就够,难的是每次改版和上新时都有人去更新它。

这个方向上品牌影响不了的部分

平台推荐的排序规则、个性化的权重、站内广告与自然推荐的关系,都不在品牌能控制的范围内,公告也没有说明。品牌能做的,是让自己的商品在被检索到的时候,有足够清楚、足够一致的材料可用。

测量也有它的边界。用固定问题集测到的,最多是一个没有购物历史干扰的账号看到的情况,它能反映趋势,却代表不了每一个真实买家的屏幕。这一点在购物类问题上比在其他问题上更明显。

参考来源