LEARN

按 UA 分流的预渲染是个陷阱

Y形管道分流流动,一臂充满密集发光粒子,另一臂中空,象征不同用户代理获取不同内容返回体
按用户代理分流的预渲染使AI爬虫拿到空壳而浏览器正常,需对比UA返回体发现问题

一句话说明

按 user agent 分流的预渲染会让 AI 检索爬虫拿到空壳,而页面在浏览器里完全正常 —— 这类问题只有对比不同 UA 的返回体才能发现。

有些站点按 user agent 决定返回什么:给已知搜索引擎返回预渲染的完整 HTML,给其他请求返回需要执行脚本才能填充的骨架。AI 检索爬虫往往落在「其他」那一类,于是拿到空壳。

我们的判断

这是我们见过最贵的一类配置错误:所有内容投入的收益都被这一层吃掉,而团队看着页面正常、看着排名还在,完全不会怀疑到这里。检出成本只有一条命令,值得所有站点先查一遍。

01

为什么会出现这种配置

历史原因:早期为了让不执行 JavaScript 的搜索引擎能读到内容,很多站点加了「给爬虫返回预渲染版本」的分流。

白名单是按当时已知的 UA 写的。新出现的 AI 检索爬虫不在名单里,落进默认分支,拿到的是需要执行脚本才有内容的骨架。

02

怎么检出

用不同 UA 请求同一个 URL,比较返回体大小与是否包含正文。差异明显就是分流。

同时在服务端日志里看这些 UA 的返回码与返回体大小 —— 200 但体积很小是典型特征。

结构化数据也要顺便查:它必须出现在服务端返回的 HTML 里,由前端脚本注入的那种不跑脚本就看不到。

03

正确做法

不按 UA 分流,对所有请求返回同一份可读的 HTML。服务端渲染或静态生成都可以。

如果确实需要保留预渲染,白名单要包含检索型爬虫,并且**加一条常态检查** —— 名单会过期,新平台会出现。

资料出处

  1. [1]Optimizing your website for generative AI features on Google Search.Google 搜索中心.2026-05-15

更新于 2026-08-10