LEARN

一份可勾选的检查清单

四圈同心验证环,各环有独特孔径标准;仅通过所有环的粒子汇聚成中心密集团,象征检查清单的四层可验证判据。
检查清单按四层排列(能否被抓、是否被检索到、内容与证据、承接),每项均需可验证判据,其价值在于判据,项目数量并非关键。

一句话说明

检查清单按四层排:能不能被抓、有没有被检索到、内容与证据、承接 —— 每项都要有可验证的判据。

按四层排:能不能被抓、有没有被检索到、内容与证据、以及承接。每一项都要有判据 —— 不能靠「感觉做了」。

我们的判断

清单的价值在判据,不在项目数。「已优化内容」不是判据,「随机抽 10 页,每页都有带出处的统计数据与可引述首句」才是。

01

第一层:能不能被抓

检索型爬虫已放行 —— 判据:服务端日志里有对应 UA 的 200 请求。

CDN 层未额外拦截 —— 判据:日志里请求到达源站。

关键内容不依赖客户端渲染 —— 判据:不执行脚本请求页面,能找到正文原句。

结构化数据在服务端返回的 HTML 里 —— 判据:同一次请求能 grep 到 application/ld+json。

02

第二层:有没有被检索到

站点地图声明本域名自己的全部可收录页 —— 判据:地图里的域名与页面域名一致,且不含会 301 的地址。

没有同意图重复页 —— 判据:任意两页的目标问题不能用一句话同时概括。

hreflang 的 x-default 固定指向一个版本 —— 判据:各语种页面的 x-default 一致。

03

第三层与第四层:内容与承接

每页有三件套 —— 判据:随机抽 10 页,每页都有带出处的统计数据、引用来源与可引述首句。

每页一个明确立场 —— 判据:能一句话说出这页的判断是什么。

AI 渠道单独分组 —— 判据:分析后台里能看到独立的 AI 渠道,不在「直接访问 / 其他」里。

有基线且带口径存档 —— 判据:能拿出问题集原文、平台清单、测量日期。

04

可以不做的

llms.txt:Ahrefs 对 137,000 个域名的研究显示 2026 年 5 月 97% 零请求,Google 明确不用。放一个成本很低,但不算完成项。

为 AI 专门改写内容、为 AI 做内容分块:Google 官方指南列为不必要。

本页用到的数据

30–40%

加统计数据 / 引用来源 / 引述后的可见度相对提升

出处Princeton GEO 论文,KDD 2024,GEO-bench 10,000 条查询,2024

97%

已发布 llms.txt 的域名中 2026 年 5 月零请求的比例

出处Ahrefs,137,000 个域名,2026

资料出处

  1. [1]Optimizing your website for generative AI features on Google Search.Google 搜索中心.2026-05-15
  2. [2]GEO: Generative Engine Optimization.Aggarwal 等,KDD 2024.2024

更新于 2026-08-10