Blog

什么叫好的引用率?——来自逾百万条 AI 引用数据的基准报告

好的引用率没有统一数字。ChatGPT、Google AI Mode 和 Perplexity 的引用行为差异很大,基准必须按平台分别设定。

  • 好的引用率没有统一数字。ChatGPT、Google AI Mode 和 Perplexity 的引用行为差异很大,基准必须按平台分别设定。

相关文章

好的引用率没有统一数字。ChatGPT、Google AI Mode 和 Perplexity 的引用行为差异很大,基准必须按平台分别设定。


摘要

AI 搜索团队往往不清楚应该追踪哪些指标,也缺乏可参照的基准。这个领域太新,几乎还没有形成通行标准。

本研究希望回答一个问题:什么叫好的引用率——即在 ChatGPT、谷歌 AI Mode 和 Perplexity 的 AI 回答中,表现优秀的内容被引用的频率应该是多少?

通过对逾百万条引用数据的分析,本文提供了具体的基准数据和实操指引,帮助你从今天就开始改善 AI 分析工作。


一、先搞清楚:检索(Retrieval)与引用(Citation)的区别

这是 AI 搜索中最容易混淆的概念之一。

  • 检索(Retrieval):一个网页被 LLM 提取到候选列表中,即进入了模型在生成答案时可能使用的候选来源集合。

  • 引用(Citation):该网页被实际使用,并在 AI 回答中被明确标注为来源。

这两项指标之间的关系,就是引用率(Citation Rate)。

对于希望自己的页面被明确引用的品牌和媒体机构来说,确保内容被"引用"而非只被"检索",是 AI 可见性策略的重要目标。


二、什么是好的引用率?

DeepAlign AI 引用率基准品牌配图

为了给各团队提供易于参照的基准,本研究对来自标准化数据集的逾百万条引用进行了分析——数据在查询意图上均匀分布,所有提示词均为非品牌词,目的是提供一个平衡的整体视角。

分析维度包括:AI 平台差异(引用率是否因平台而异);提示词意图差异(引用率是否因查询意图而变化);内容类型差异(LLM 是否对某些类型的内容有引用偏好)。

ChatGPT:慷慨的引用者

在所有数据集中,31% 的 URL 落入"高引用率"区间(引用率 2.0 及以上),意味着每次 AI 回答中,该 URL 平均被引用超过两次。这 31% 的 URL 贡献了全部引用量的 59%。

ChatGPT 整体引用慷慨,但被高频引用的页面所获得的优势极为集中。

建议 AI 团队将 ChatGPT 的基准引用率目标设定为 2.0 及以上。

谷歌 AI Mode:一视同仁的引用者

谷歌 AI Mode 的情况截然不同:超过 90% 的 URL 的引用率低于 1.0,来源分布相对均衡,引用率区间也比 ChatGPT 窄得多。

引用率在 1.0 至 1.5 区间的 URL 仅占 3%,却贡献了 12% 的引用量——这是值得争取的甜区。

建议 AI 可见性团队将谷歌 AI Mode 的目标引用率设定为 1.1 至 1.5;超过 1.5 属于优秀表现,但 1.1–1.5 是一个公平且可实现的目标。

Perplexity:两极分化的引用者

Perplexity 呈现出高度两极分化的格局:64% 的 URL 从未被引用(值得注意的是,Perplexity 会在侧边栏显示这些来源,但在实际回答中引用它们的概率要低得多);而仅有 6% 的 URL 落入引用率 2.0 及以上的高引用区间,却贡献了将近一半的全部引用量。这说明 Perplexity 对少数 URL 有极强的偏好性集中引用。

建议将 Perplexity 的基准引用率目标设定为 1.5 至 2.0。由于大量内容落在低引用或零引用区间,建议与 ChatGPT 和谷歌 AI Mode 的数据交叉比对——你的内容在那两个渠道可能已经表现良好。


三、提示词对引用率的影响

本研究分析的四类提示词意图:

  • 信息类(Informational):用户希望了解某事,例如"太阳能如何运作?"

  • 导航/本地类(Navigational/Local):用户查找特定网站或附近地点,例如"附近的咖啡店"、"银行登录页面"

  • 商业类(Commercial):用户在购买前做比较研究,例如"2025 年最佳跑鞋"

  • 交易类(Transactional):用户已准备好采取行动,通常是购买,例如"在线购买跑鞋"

信息类和商业类意图的表现尤为突出:约 10–11% 的 URL 落入高引用率区间(2.0+),但这些 URL 贡献了全部引用量的 37%。

对于这两类意图——用户寻求信息或比较产品时——LLM 更倾向于反复引用同一网页。这意味着,如果你的内容能在这类查询中脱颖而出,获得的引用优势会被极大放大。

导航/本地类和交易类意图则不同:这类查询通常涉及多个产品页面或服务商页面,高引用集中现象并不突出。


四、哪些内容类型被引用最多?

我们希望回答:是否有某些内容类型,在所有查询意图中都受到 LLM 的偏爱?

ChatGPT

列表类内容(Listicles)表现尤为亮眼:它们占全部 URL 的近五分之一,且 52% 的列表类内容引用率超过 2 次——属于高引用类型中比例最高、同时存在规模也最大的内容类型。产品页面的存在规模虽大,但引用率表现相对普通。

谷歌 AI Mode

谷歌 AI Mode 中没有任何内容类型落入"高存在、高引用"区间,大多数内容类型聚集在低引用区间。引用率最高的是品类页面(Category Pages),占高引用区间约 10%,而 ChatGPT 中列表类内容占比高达 52%。

谷歌 AI Mode 对品牌官方来源(品类页、产品页)有一定的偏好,这可能反映出 AI Mode 更倾向于均匀引用不同来源,而不是集中依赖单一信源。

Perplexity

Perplexity 的分布同样极为集中,只有约 6% 的 URL 落入高引用率区间。列表类内容和文章在有存在感的内容中表现相对较好,但数字依然远低于 ChatGPT。

关键启示不是"只做列表内容",而是:Perplexity 对高表现内容的筛选标准极为严格。


五、各平台基准汇总

数据表明,引用率在不同 AI 平台间存在显著差异:ChatGPT 引用慷慨,谷歌 AI Mode 保守且一致,Perplexity 将引用高度集中在少数来源。

了解你的内容在每个平台上的位置,是提升 AI 可见性的第一步。将以下数字作为起始基准,再根据你所在行业和目标受众所使用的主要 AI 平台加以调整:

ChatGPT:2.0 及以上

Google AI Mode:1.1 至 1.5

Perplexity:1.5 至 2.0

如果你还不清楚自己的内容在这些平台上的表现,AI 搜索追踪工具可以为你提供清晰的起点数据,帮助你对照基准找到改进方向。

返回博客列表