千问的引用是“可开关”的:从 enable_source 到角标标注

2026年9月19日

千问的引用是“可开关”的:从 enable_source 到角标标注

很多人以为,AI 回答里带不带来源,是模型"心情问题"。看过阿里云百炼的联网搜索文档之后,你会发现至少在千问这条线上,引用是可以被开发者在请求里配置的。

先看文档给出的前提:"大模型的训练数据存在知识截止日期,无法回答实时问题。启用联网搜索后,模型可从网络获取实时数据。"这句话解释了联网存在的理由,也顺便说明了一件事:如果不开启联网,模型只能靠训练过的旧知识回答你。

图:千问的引用是“可开关”的:从 enable_source 到角标标注 · 核心结构导图
图:千问的引用是“可开关”的:从 enable_source 到角标标注 · 核心结构导图

引用来源和角标标注,是两件事

文档把"获取并标注引用来源"拆成了两个动作。第一,设置 enable_source: true,响应里的 search_info 字段会返回搜索结果列表;第二,在 enable_source 已经打开的前提下再开启角标标注,模型正文里才会出现指向出处的标记。文档的原话是"通过角标标注引用出处,增强信息可追溯性"。

这两个动作分开,是有实际意义的:拿到来源列表,代表你可以在自己的产品里列出参考链接;开启角标标注,代表读者能顺着正文里的标记点回原始出处。对做内容的人来说,前者决定"你的链接会不会被展示",后者决定"你的内容会不会被当成某个结论的依据"。

协议选错,来源可能拿不到

同一份文档里有一张功能差异表,值得逐行看:DashScope 协议支持全部功能;而 OpenAI 兼容协议因为协议本身的限制,不支持搜索来源返回和角标标注。也就是说,如果你的系统用 OpenAI 兼容方式调用千问,即便联网搜索能用,你也拿不到那份来源清单。

这一点很容易被忽略。很多团队的调用方式是从别的模型迁移过来的,参数能跑通就上线了,直到做"引用监测"时才发现没有来源数据可存。做 GEO 或者做内容效果归因的团队,建议在技术选型阶段就把这件事确认清楚。

对企业的三个具体提醒

  • 把你希望被引用的结论,写成"能单独摘出来"的段落。模型在生成答案时需要的是可直接引用的句子,而不是一大段铺垫。
  • 每个关键页面给出清晰的出处信息:主体是谁、数据来自哪里、更新时间是什么时候。角标标注最终指向的是页面,页面必须扛得住核对。
  • 如果做自有产品,尽量把来源数据落库。今天能拿到来源列表,明天才有做归因分析的可能。

公开文档把机制写到这里,再往下(比如检索怎么排序、哪些站点权重更高)就没有公开依据了。这部分我会在另一篇里专门讲清楚边界,不在这里替官方下结论。

引用可见性,直接影响你的品牌监测

做品牌监测的团队常遇到一个尴尬:模型回答里提到了你,但你拿不到那条来源,也就无法判断"它引用的是哪一页、哪一句话"。如果来源数据能落库,复盘就变得具体——是官网产品页被引用了,还是某篇行业报道被引用了;是结论句被摘走了,还是数据表被用上了。这些信息决定了下一轮内容该往哪写。

所以建议把"引用可见性"当成一个独立指标来管理:这周有多少次回答提到了品牌、其中多少次带来源、来源指向哪些页面。数据不一定完美,但方向比感觉可靠。

三分钟自查

  • 确认调用协议:是 DashScope 还是 OpenAI 兼容方式;
  • 确认请求参数:enable_source 是否为 true,响应里有没有 search_info
  • 确认前端展示:拿到来源列表后,页面有没有真正把出处展示给读者。

参考来源

  • 阿里云百炼《联网搜索》:https://help.aliyun.com/zh/model-studio/web-search