为什么有些 AI 平台没有引用来源?
「这个平台没有引用」和「这个平台的引用数是 0」不是一回事。把它们混在一起,会算出一个看起来精确、实际错误的数字。
更新于 2026-09-14
两种「没有」,含义完全不同
第一种:这次回答确实没有引用任何网页。 比如问题本身不需要检索,模型直接凭已有知识作答。这时「引用数 = 0」是一个真实的观测结果。
第二种:平台没有把引用展示出来,或者我们这次拿不到。 这时「0」不是观测结果,而是没有观测到。它和第一种的区别,就像「体温正常」和「没量体温」。
产品里对这两种情况的处理是分开的:第二种标记为「不可观测」,不计入引用类指标的分母;第一种才计入。
把不可观测当成 0,会发生什么
假设你在六个平台上跑同一批问题。其中两个平台不展示引用,四个展示。如果按「所有平台的平均引用率」来算,那两个平台会以 0 参与——结果就是所有平台的引用率被一起拉低,而且拉低的比例取决于你选了几个不展示引用的平台。
这个数字看上去很精确(比如「引用率 12.4%」),但它其实在测量「我这次选了几个平台」,而不是在测量「AI 引用了我多少」。更麻烦的是:换一批平台,这个数字就变了,而没有任何一处会提示你原因。
所以我们的口径是:引用类指标只在能观测到引用的平台上计算,并且每次都把「哪些平台不可观测」写在旁边。分母小了要说明,不能悄悄换。
这条规则来自一个更大的原则
同一个原则在产品里贯穿到底:没有数据时显示「暂无数据」,绝不显示 0。 一个假的 0 比一个空白更糟——空白会让人去问,0 会让人下结论。
同样的处理还出现在这些地方:某个问题下没有任何成功回答时,提及率显示「暂无数据」而不是 0%;某项指标在当前套餐里不可用时,显示「不可观测」而不是空着或者填 0。
边界
「不可观测」的判断依据是平台响应本身:这次响应里有没有可获取、可解析的引用记录。我们不会通过其他渠道去推测某个平台「本来应该」有多少引用。
平台的行为会变。同一个平台今天不展示引用,明天可能展示;这会让两批数据不可比。遇到这种情况我们会在采样记录里标注口径断点,而不是把两批直接混算。
常见追问
- 某些平台一直显示不可观测,是不是工具坏了?
- 通常不是。是否在回答中展示引用由平台自己决定,也可能与这次提问有没有触发联网检索有关。如果某个平台在你这里长期不可观测,可以联系我们核对一下后台的平台配置与调用情况。
- 那我的引用率到底该看哪个数?
- 看「能观测到引用的平台」上的那个数,并且同时看它下面的样本量和不可观测平台清单。任何没有标明分母和范围的引用率都没有意义。