LEARN
一份可勾选的检查清单

一句话说明
检查清单按四层排:能不能被抓、有没有被检索到、内容与证据、承接 —— 每项都要有可验证的判据。
按四层排:能不能被抓、有没有被检索到、内容与证据、以及承接。每一项都要有判据 —— 不能靠「感觉做了」。
我们的判断
清单的价值在判据,不在项目数。「已优化内容」不是判据,「随机抽 10 页,每页都有带出处的统计数据与可引述首句」才是。
第一层:能不能被抓
检索型爬虫已放行 —— 判据:服务端日志里有对应 UA 的 200 请求。
CDN 层未额外拦截 —— 判据:日志里请求到达源站。
关键内容不依赖客户端渲染 —— 判据:不执行脚本请求页面,能找到正文原句。
结构化数据在服务端返回的 HTML 里 —— 判据:同一次请求能 grep 到 application/ld+json。
第二层:有没有被检索到
站点地图声明本域名自己的全部可收录页 —— 判据:地图里的域名与页面域名一致,且不含会 301 的地址。
没有同意图重复页 —— 判据:任意两页的目标问题不能用一句话同时概括。
hreflang 的 x-default 固定指向一个版本 —— 判据:各语种页面的 x-default 一致。
第三层与第四层:内容与承接
每页有三件套 —— 判据:随机抽 10 页,每页都有带出处的统计数据、引用来源与可引述首句。
每页一个明确立场 —— 判据:能一句话说出这页的判断是什么。
AI 渠道单独分组 —— 判据:分析后台里能看到独立的 AI 渠道,不在「直接访问 / 其他」里。
有基线且带口径存档 —— 判据:能拿出问题集原文、平台清单、测量日期。
可以不做的
llms.txt:Ahrefs 对 137,000 个域名的研究显示 2026 年 5 月 97% 零请求,Google 明确不用。放一个成本很低,但不算完成项。
为 AI 专门改写内容、为 AI 做内容分块:Google 官方指南列为不必要。
本页用到的数据
30–40%
加统计数据 / 引用来源 / 引述后的可见度相对提升
出处:Princeton GEO 论文,KDD 2024,GEO-bench 10,000 条查询,2024
97%
已发布 llms.txt 的域名中 2026 年 5 月零请求的比例
出处:Ahrefs,137,000 个域名,2026
资料出处
- [1]Optimizing your website for generative AI features on Google Search.Google 搜索中心.2026-05-15
- [2]GEO: Generative Engine Optimization.Aggarwal 等,KDD 2024.2024
更新于 2026-08-10