AI引用半衰期:引用是流量,而非存量
AI引用不是你赢得并保留的奖杯。它是一种易腐品。 今天被五个引擎引用的页面,可能在一个月内失去一半的引用率,而其Google搜索流量保持不变。本页总结已发布的衰减估计、可重现的测量协议,以及90天实测的半衰期数据。
已发布的估计值
Section titled “已发布的估计值”2026年的行业测量在相同的形态上趋于一致:
| 发现 | 来源 |
|---|---|
| AI引用中位半衰期约4.5周;ChatGPT流失最快,Perplexity保持最长 | Authority Tech平台分析 |
| AI引用域名每月更新40–60% | Machine Relations |
| 约一半AI引用内容不足13周;过去30天内更新的页面获得的引用多出数倍 | Authority Tech新鲜度分析 |
其机制是结构性的,而非质量判断。Google对已建立页面的自然排名是粘性的——信号移动缓慢,安静的一周不会将其挤出位置。AI引用在回答时从实时索引中提取,该索引偏向新鲜内容。页面本身并没有变差;它竞争的池子变得更年轻了。
近期的检索研究(TempRetriever, arXiv 2502.21024;关于RAG限制的知识漂移研究, arXiv 2604.05096)对上游原因进行了建模:检索偏向新鲜内容,当问题具有时效性时,这种偏向会增强。
为什么固定协议很重要
Section titled “为什么固定协议很重要”“半衰期”只有在对照冻结协议时才有意义。改变提示集、节奏或成功标准,数字就会漂移数周——两个人引用”4.5周”可能在测量完全不相关的现象。可重现的协议,五条规则:
- 固定提示集——每个页面十个真实用户问题,在第0天之前写下并冻结。中途改写提示会破坏基准。
- 每个提示三次重试——独立会话,无历史记录。“引用”意味着URL至少在三次运行中的一次中作为可点击来源出现,在提示级别计数(在来源列表级别计数会过度权重返回更多来源的引擎——这一修正将一次测量的数字降低了约15%)。
- 固定每周节奏——相同的星期几,相同的时间窗口。跳过一周是曲线上的一个空洞,拟合效果更差。
- 双时钟——同时记录AI引用率和同一URL同一周的Search Console点击量。当两条曲线同时移动时,发生了其他事情(中断、算法变化、病毒式链接)。信号是AI曲线移动而搜索曲线保持不变。
- 衰减从峰值拟合,而非从第1周拟合。 引用率在引擎索引页面的两到四周内上升,然后衰减。将上升和衰减混合到一个拟合中——公开写作中最常见的错误——会产生比实际更平缓的半衰期。
衰减部分符合指数模型:cites(t) = peak × 0.5^(t / T_half),其中t以从峰值起的周为单位。
测量的半衰期
Section titled “测量的半衰期”对一个技术站点的三个页面进行为期90天(13周)的协议运行,跨ChatGPT(开启网络搜索)、Claude(默认网络模式)和Perplexity(Sonar Pro):
| 页面类型 | ChatGPT | Claude | Perplexity |
|---|---|---|---|
| 常青操作指南 | 6.8周 | 7.4周 | 9.1周 |
| 经验报告 | 3.2周 | 3.6周 | 4.4周 |
| 方法论文章 | 5.1周 | 5.9周 | 6.7周 |
三个发现,按惊喜程度排序:
- 内容类型占主导。 常青页面在每个引擎上保持引用的时间约为经验报告的2倍。引擎权重新鲜度,但也权重页面是否仍然能回答问题——操作指南在数月内持续有效;经验报告很快就失效了。跨页面类型平均重现了已发布的”约4.5周”标题数字,同时隐藏了实际重要的2倍差距。
- Perplexity在所有三个页面上衰减最慢(其发布的排名指南将新鲜度权重约为15%),ChatGPT在每一行中衰减最快——与平台级流失报告一致。
- 刷新部分且不均匀地恢复引用。 对经验报告进行实质性更新(新章节、新数据表)在两周内将ChatGPT恢复到峰值的约70%,Claude恢复到约60%,Perplexity在第12周恢复到约75%——从未回到峰值。较早的九周运行中的表面日期更新没有产生任何可测量的变化。首次发布比任何刷新都更重要。
完整数据和协议:90天方法论记录(英文)和最初九周衰减日志(英文)。
- 在发布前将每个页面分类为常青或有时效性。 常青页面按半衰期暗示的节奏进行实质性刷新(大约每6–8周一次)。有时效性的页面不进行刷新——没有任何编辑能让过时的经验报告重新相关——而是归档并替换。
- 将引用指标报告为随时间变化的比率,而非快照。 “被五个引擎引用”在周一是真的,到下个月就是谎言。在固定提示集上的趋势线才是诚实的指标——见衡量LLMO,了解这与之配套的每周循环。
- 被引用是一个启动问题;保持被引用是一个留存问题。 引用信号决定你是否进入引用池。权威性和连贯性——加上刷新节奏——决定你是否留在其中。
测量的局限性
Section titled “测量的局限性”单一站点,三个页面,一次刷新事件——引擎不对称的刷新响应可能是新鲜度权重差异或噪音。方法论文章会自我蚕食(引擎可以用旧的测量文章回答新的提示)。13周的窗口无法显示随着引擎索引增长,半衰期是否会进一步缩短。将半衰期值视为一个可辩护协议的输出,而非常量。