LEARN
关键内容不要依赖客户端渲染

一句话说明
抓取方读的是服务器返回的 HTML;由脚本注入的内容与结构化数据,对不执行 JavaScript 的抓取方等于不存在。
抓取方读的是服务器返回的 HTML。关键内容由浏览器执行脚本后才出现时,不执行脚本的抓取方拿到的就是空的。结构化数据同理 —— 由前端脚本注入的那种,它看不到。
我们的判断
这一条不需要权衡:正文与结构化数据都应该出现在服务端返回的 HTML 里。前端框架的默认行为常常不满足这一点,所以要主动验证,不能假设。
01
最常见的两处失效
正文靠客户端渲染:页面在浏览器里正常,`curl` 出来只有骨架。
结构化数据由脚本注入:它只存在于脚本执行后的 DOM 里,服务端返回的 HTML 里没有对应标签。这一条尤其隐蔽 —— 用浏览器的结构化数据测试工具(会执行脚本)能看到,抓取方看不到。
02
一条自查命令
对页面做一次不执行脚本的请求,然后在返回内容里找两样东西:正文里的一段原句,以及 `application/ld+json`。两者都能找到才算通过。
多语言多域名站点每个域名各查一次 —— 同一份代码在不同部署下的表现可能不同。
03
和「为 AI 改写内容」的区别
让内容出现在服务端返回的 HTML 里,属于基础可访问性,不是为 AI 特别改写。
Google 的官方指南把「AI 专用改写」与「为 AI 做内容分块」列为不必要,但可爬取的 HTML 是另一回事 —— 那是所有检索的前提。
资料出处
- [1]Optimizing your website for generative AI features on Google Search.Google 搜索中心.2026-05-15
更新于 2026-08-10