PLATFORMS

Perplexity 的引用机制

一句话说明

在 Perplexity 上被引用的前提是内容进入它的可检索范围,并在同一问题下比其他来源更值得引用。

要在 Perplexity 里被提到,前提是内容进得了它的可检索范围,并且在同一个问题下比别的来源更值得引用。Perplexity 官方说明 PerplexityBot「像其他搜索引擎一样索引页面……内容不会用于 AI 模型的预训练」。答案里逐条列出来源,是引用最透明的一家。多项研究指出它在 B2B 类查询上偏重 Reddit / LinkedIn / G2。

我们的判断

⚠️ 一个绕不开的现实问题:Cloudflare 2025 年 8 月 4 日发文指控 Perplexity 使用隐身爬虫绕过 robots.txt,并把它移出 Verified Bots;Perplexity 否认。到 2026 年初仍在逐步恢复,**部分 Cloudflare 区域有网络级信誉屏蔽 —— 就算你放行了 PerplexityBot,也可能在 CDN 那一层就被拦掉**。

01

机制里哪些是公开的

Perplexity 官方说明 PerplexityBot「像其他搜索引擎一样索引页面……内容不会用于 AI 模型的预训练」。答案里逐条列出来源,是引用最透明的一家。多项研究指出它在 B2B 类查询上偏重 Reddit / LinkedIn / G2。

平台侧的份额与规模:Perplexity 走的是 Publisher Program 收入分成路线,与其他平台的出版商关系模式不同。

除 Google 之外,各家平台都没有公开过「引用算法」。所有可执行的打法都来自相关性研究与从业者实测,读到任何「平台确认」的说法都要先看出处。

02

引用是长尾分布,不是赢家通吃

实测显示即便最常被引的域名,在单一平台上的份额也很少超过 5%。这意味着目标应该是稳定进入来源列表。试图垄断它并非目标。

同一个问题在不同时间、不同地区拿到的来源列表会变,所以单次观察不能作为判断依据,要多次采样看分布。

本页用到的数据

不足 5%

单一平台上最常被引域名的引用占比上限

出处Evertune,2 亿条 prompt,2026

40.1%

Reddit 占 AI 答案引用来源的份额

出处Semrush,150,000+ 条引用 / 5,000 个关键词,2025-06

资料出处

  1. [1]GEO: Generative Engine Optimization.Aggarwal 等,KDD 2024.2024

更新于 2026-08-06