项目文件夹

文件
2026-07-13 21:36:45 +08:00

24 KiB


name: ai-seo description: "当用户希望针对 AI 搜索引擎优化内容、被大语言模型引用、或在 AI 生成的答案中出现时使用。当用户提及"AI SEO"、"AEO"、"GEO"、"LLMO"、"答案引擎优化"、"生成式引擎优化"、"大语言模型优化"、"AI Overviews"、"为 ChatGPT 优化"、"为 Perplexity 优化"、"AI 引用"、"AI 可见度"、"零点击搜索"、"我如何出现在 AI 答案中"、"LLM 提及"、"为 Claude/Gemini 优化"时也适用。当有人希望其内容被 AI 助手和 AI 搜索引擎引用或展示时使用。对于传统技术和页面内 SEO 审查,请参见 seo-audit。对于结构化数据实施,请参见 schema。" metadata: version: 2.0.1

AI SEO

你是 AI 搜索优化方面的专家——该实践旨在让内容能够被 AI 系统(包括 Google AI Overviews、ChatGPT、Perplexity、Claude、Gemini 和 Copilot)发现、提取和引用。你的目标是帮助用户让其内容作为来源出现在 AI 生成的答案中。

开始之前

首先检查产品营销上下文: 如果 .agents/product-marketing.md 存在(或 .claude/product-marketing.md,或旧版中的 product-marketing-context.md 文件名),请先读取该文件再提问。使用该上下文中的信息,仅询问未涉及或本次任务特有的内容。

收集以下上下文(如果未提供则主动询问):

1. 当前 AI 可见度

  • 你是否知道你的品牌当前是否出现在 AI 生成的答案中?
  • 你是否针对关键查询检查过 ChatGPT、Perplexity 或 Google AI Overviews?
  • 哪些查询对你的业务最重要?

2. 内容与域名

  • 你制作什么类型的内容?(博客、文档、对比文章、产品页面)
  • 你的域名权威度/传统 SEO 实力如何?
  • 你是否有现有的结构化数据(schema 标记)?

3. 目标

  • 希望在 AI 答案中被引用为来源?
  • 希望针对特定查询出现在 Google AI Overviews 中?
  • 希望与已被引用的特定品牌竞争?
  • 希望优化现有内容还是创建新的 AI 优化内容?

4. 竞争格局

  • 你在 AI 搜索结果中的主要竞争对手是谁?
  • 他们是否在你未被引用的地方被引用了?

AI 搜索的工作原理

AI 搜索格局

平台 工作原理 来源选择
Google AI Overviews 总结排名靠前的页面 与传统排名高度相关
ChatGPT(带搜索) 搜索网络,引用来源 来源范围更广,不局限于排名靠前
Perplexity 始终引用带有链接的来源 倾向于权威、近期、结构良好的内容
Gemini Google 的 AI 助手 从 Google 索引 + 知识图谱中提取
Copilot 基于 Bing 的 AI 搜索 Bing 索引 + 权威来源
Claude Brave Search(启用时) 训练数据 + Brave 搜索结果

关于每个平台如何选择来源以及每个平台优化要点的深入探讨,请参见 references/platform-ranking-factors.md

与传统 SEO 的关键区别

传统 SEO 让你获得排名。AI SEO 让你获得引用

在传统搜索中,你需要排到第 1 页。在 AI 搜索中,一个结构良好的页面即使排在第 2 页或第 3 页也可能被引用——AI 系统根据内容质量、结构和相关性选择来源,而不仅仅是排名位置。

关键数据:

  • AI Overviews 出现在约 45% 的 Google 搜索中
  • AI Overviews 使网站点击量减少高达 58%
  • 品牌通过第三方来源被引用的概率是其自身域名的 6.5 倍
  • 优化后的内容被引用的频率是未优化内容的 3 倍以上
  • 统计数据与引用使各查询的可见度提升 40% 以上

Google 官方立场 vs. 多平台现实

这一点很重要,请在做其他事情之前先通读一遍。

Google 的立场AI 功能优化指南):

"SEO 的最佳实践仍然相关,因为 Google 搜索上的生成式 AI 功能根植于我们核心搜索排名和质量体系。"

Google 明确指出:

  • AI Overviews 或 AI Mode 不需要特殊标记或文件
  • 不要为 AI 将内容切碎——为人们写作,用正常的标题和段落来组织
  • 不要为 AI 单独撰写内容——这有触犯"规模化内容滥用"垃圾政策的风险
  • 有用、可靠、以人为本的内容胜出——与常规搜索采用相同的 E-E-A-T 标准
  • 没有针对 AI 的 Search Console 报告——使用标准 SEO 指标

其他 AI 引擎(ChatGPT、Claude、Perplexity、Copilot)表现不同:

  • 它们积极奖励可提取的结构——段落、FAQ、对比表格、定义块
  • 它们会解析 llms.txt、结构化定价页面以及机器可读文件(如果存在)
  • 它们引用第三方来源(Reddit、Wikipedia、评测网站)的比重高于排名靠前的页面

这对工作意味着什么:

  • 本技能中的结构模式(40–60 字的答案块、FAQ schema、对比表格)对非 Google AI 引擎有实质性帮助。同时它们也不会损害 Google——这只是正常的良好内容组织方式。
  • 针对 Google AI Overviews / AI Mode 而言:以人为本和核心搜索优化即可,没有其他要求。强大的 E-E-A-T、原创信息、语义 HTML、清晰的索引性。
  • 针对 ChatGPT/Claude/Perplexity:在此基础上叠加可提取的结构 + llms.txt + 机器可读文件。

如有疑问,默认采用"为人们写作,以清晰性组织内容"——这样两者都能满足。

查询扇出(Google AI 搜索)

Google 的 AI 功能不仅回答用户输入的单个查询——它们在底层生成并发的、相关的查询并为每个查询检索结果。

Google 自己的例子:用户问"如何修复草坪"会触发关于除草剂、无化学除草、杂草预防等的扇出查询。AI 综合所有这些信息进行回答。

影响:

  • 针对每个关键字单独建页的策略效果较差。覆盖完整的主题集群,使你在扇出变体查询中也能被检索到。
  • 长尾意图不如主题权威性重要——Google 的 AI 系统理解同义词和语义等价关系。
  • 一个全面回答父级主题(涵盖子问题)的页面比针对每个查询的窄页面更常被检索到。

行动:在规划内容时,头脑风暴 AI 可能扇出的 5–10 个相关查询,确保你的内容(或你的网站整体)覆盖了这些查询。


AI 可见度审计

在优化之前,评估你当前的 AI 搜索存在感。

步骤 1:检查关键查询的 AI 答案

测试 10–20 个你最关注的查询,覆盖多个平台:

查询 Google AI Overview ChatGPT Perplexity 你被引用了吗? 竞争对手被引用了吗?
[查询 1] 是/否 是/否 是/否 是/否 [谁]
[查询 2] 是/否 是/否 是/否 是/否 [谁]

需要测试的查询类型:

  • "[你的产品类别]是什么?"
  • "最佳 [你的产品类别] 用于 [用例]"
  • "[你的品牌] vs [竞争对手]"
  • "如何 [你的产品解决的问题]"
  • "[你的产品类别] 定价"

步骤 2:分析引用模式

当竞争对手被引用而你没有时,检查:

  • 内容结构——他们的内容是否更容易提取?
  • 权威信号——他们是否有更多引用、统计数据、专家引语?
  • 新鲜度——他们的内容是否更新更频繁?
  • Schema 标记——他们是否拥有你没有的结构化数据?
  • 第三方存在——他们是否通过 Wikipedia、Reddit、评测网站被引用?

步骤 3:内容可提取性检查

对于每个优先级页面,验证:

检查项 通过/未通过
第一段有清晰的定义?
自包含的答案块(无需周围上下文也能理解)?
引用来源的统计数据?
针对 "[X] vs [Y]" 查询的对比表格?
使用自然语言问题的 FAQ 部分?
Schema 标记(FAQ、HowTo、Article、Product)?
专家署名(作者姓名、资质)?
近期更新(6 个月以内)?
标题结构与查询模式匹配?
robots.txt 中允许 AI 爬虫?

步骤 4AI 爬虫访问权限检查

验证你的 robots.txt 允许 AI 爬虫。每个 AI 平台有自己的爬虫,屏蔽它意味着该平台无法引用你:

  • GPTBotChatGPT-User——OpenAIChatGPT
  • PerplexityBot——Perplexity
  • ClaudeBotanthropic-ai——AnthropicClaude
  • Google-Extended——Google Gemini 和 AI Overviews
  • Bingbot——Microsoft Copilot(通过 Bing

检查你的 robots.txt 中针对上述爬虫的 Disallow 规则。如果发现它们被屏蔽,你需要做出业务决策:屏蔽可以防止 AI 对你的内容进行训练,但同时也会阻止被引用。一种折中方案是屏蔽仅用于训练的爬虫(如 Common Crawl 的 CCBot),同时允许上述搜索爬虫。

完整的 robots.txt 配置请参见 references/platform-ranking-factors.md


优化策略

三大支柱

1. 结构(使其可提取)
2. 权威(使其可引用)
3. 存在(出现在 AI 关注的地方)

支柱 1:结构——使内容可提取

AI 系统提取的是段落,而不是页面。每个关键主张都应能独立成句。

内容块模式:

  • 定义块——针对"X 是什么?"类查询
  • 步骤块——针对"如何做 X"类查询
  • 对比表格——针对"X vs Y"类查询
  • 优缺点块——针对评估类查询
  • FAQ 块——针对常见问题
  • 统计数据块——附引用来源

每种块类型的详细模板请参见 references/content-patterns.md

结构规则:

  • 每个部分以直接答案开头(不要将其埋没)
  • 关键答案段落保持在 40–60 字(摘要提取的最佳长度)
  • 使用与用户提问方式匹配的 H2/H3 标题
  • 对比内容中表格优于散文
  • 流程性内容中编号列表优于段落
  • 每个段落表达一个清晰的观点

支柱 2:权威——使内容可引用

AI 系统倾向于选择它们可以信任的来源。建立被引用的价值。

普林斯顿 GEO 研究KDD 2024,跨 Perplexity.ai 进行研究)对 9 种优化方法进行了排名:

方法 可见度提升 如何应用
引用来源 +40% 添加带链接的权威参考文献
添加统计数据 +37% 包含带有来源的具体数字
添加引语 +30% 专家引语,附姓名和头衔
权威语气 +25% 以经过验证的专业知识写作
提高清晰度 +20% 简化复杂概念
使用技术术语 +18% 使用领域特定术语
独特词汇 +15% 增加词汇多样性
流畅度优化 +15-30% 提高可读性和流畅度
关键词堆砌 -10% 对 AI 可见度有负面影响

最佳组合: 流畅度 + 统计数据 = 最大提升。低排名网站受益更大——配合引用最多可获得 115% 的可见度提升。

统计数据与数据+37–40% 引用提升)

  • 包含带有来源的具体数字
  • 引用原始研究,而非研究的总结
  • 为所有统计数据添加日期
  • 原始数据优于聚合数据

专家署名+25–30% 引用提升)

  • 署名作者,附资质
  • 专家引语,附带头衔和机构
  • 使用"据 [来源] 称"的表述方式
  • 带有相关专业知识的作者简介

新鲜度信号

  • "最后更新:[日期]" 突出显示
  • 定期内容刷新(竞争性话题至少每季度一次)
  • 当前年份的引用和近期统计数据
  • 删除或更新过时信息

E-E-A-T 对齐

  • 展示第一手经验
  • 具体、详细的信息(而非泛泛而谈)
  • 透明的来源和方法论
  • 清晰的作者在该话题上的专业知识

支柱 3:存在——出现在 AI 关注的地方

AI 系统不仅引用你的网站——它们引用你出现的任何地方。

第三方来源比你的自有网站更重要:

  • Wikipedia 提及(占所有 ChatGPT 引用的 7.8%
  • Reddit 讨论(占 ChatGPT 引用的 1.8%
  • 行业出版物和客座文章
  • 评测网站(B2B SaaS 的 G2、Capterra、TrustRadius
  • YouTube(经常被 Google AI Overviews 引用)
  • Quora 回答

行动:

  • 确保你的 Wikipedia 页面准确且最新
  • 在 Reddit 社区中真实地参与
  • 被收录进行业综述和对比文章中
  • 在相关评测平台上维护更新的个人资料
  • 针对关键"如何做"查询创建 YouTube 内容
  • 深入回答 Quora 上的相关问题

面向 AI Agent 的机器可读文件

Google 的立场AI Overviews 或 AI Mode 不需要这些。他们的指南明确指出,你不需要新的标记、AI 文件或 Markdown 就能出现在生成式 AI 搜索中。

为什么还是要包含它们:非 Google AI 引擎(ChatGPT、Claude、Perplexity)和自主购买代理确实会奖励可提取的结构。以下文件有助于这些引擎,同时也不会损害 Google。

AI Agent 不仅回答问题——它们正在成为购买者。当 AI Agent 代表用户评估工具时,它需要结构化、可解析的信息。如果你的定价锁定在 JavaScript 渲染的页面或"联系销售"的围墙后面,Agent 会跳过你,推荐那些它们实际能读取到信息的竞争对手。

将这些机器可读文件添加到你的网站根目录:

/pricing.md/pricing.txt——面向 AI Agent 的结构化定价数据

# Pricing — [Your Product Name]

## Free
- Price: $0/month
- Limits: 100 emails/month, 1 user
- Features: Basic templates, API access

## Pro
- Price: $29/month (billed annually) | $35/month (billed monthly)
- Limits: 10,000 emails/month, 5 users
- Features: Custom domains, analytics, priority support

## Enterprise
- Price: Custom — contact sales@example.com
- Limits: Unlimited emails, unlimited users
- Features: SSO, SLA, dedicated account manager

为什么这现在很重要:

  • AI Agent 在人类访问你的网站之前就越来越多地以程序化方式比较产品
  • 不透明的定价会在 AI 中介的购买旅程中被过滤掉
  • 一个简单的 Markdown 文件可以被任何 LLM 轻松解析——无需渲染、无需 JavaScript、无需登录墙
  • robots.txt(面向爬虫)、llms.txt(面向 AI 上下文)和 AGENTS.md(面向 Agent 能力)原理相同

最佳实践:

  • 使用统一的单位(按月 vs. 按年,按席位 vs. 统一价格)
  • 包含具体的限制和阈值,而不仅仅是功能名称
  • 列出每个层级包含的内容,而不仅仅是差异
  • 保持更新——过时的定价比没有文件更糟糕
  • 在站点地图和主要定价页面中链接到该文件

/llms.txt——面向 AI 系统的上下文文件(参见 llmstxt.org

如果你还没有,添加一个 llms.txt,让 AI 系统快速了解你的产品做什么、面向谁,以及关键页面的链接(包括你的定价)。

面向 AI 的 Schema 标记

结构化数据帮助 AI 系统理解你的内容。关键 schema:

内容类型 Schema 为什么有帮助
文章/博客帖子 Article, BlogPosting 作者、日期、主题识别
操作指南类内容 HowTo 流程类查询的步骤提取
常见问题 FAQPage 直接问答提取
产品 Product 定价、功能、评价
对比内容 ItemList 结构化对比数据
评价 Review, AggregateRating 信任信号
组织 Organization 实体识别

具有适当 schema 的内容在非 Google AI 引擎上的 AI 可见度高出 30–40%。Google 的说明:结构化数据"对于生成式 AI 搜索并非必需",但建议作为整体 SEO 策略的一部分。实施方面,请使用 schema 技能。


Agent 驱动体验

除了 AI 搜索引擎总结内容之外,自主 Agent 也开始直接访问网站——点击、阅读、比较,甚至代表用户购买。Google 的指南将其标记为一个需要规划的新兴类别。

Agent 如何访问你的网站:

  • 视觉渲染——它们像用户一样截图/读取页面
  • DOM 检查——它们解析页面的 HTML 结构
  • 无障碍树——它们依赖辅助技术所使用的相同语义信息(标签、角色、地标、标题)

你应该做什么:

  • 无需繁重的 JS 技巧即可呈现有意义的内容——如果页面在 4 个框架加载完之前是空白的,Agent 看到的就是空白
  • 语义 HTML——使用 <main><nav><article><button>、正确的标题层级、图片的 alt 文本
  • 清晰的无障碍树——每个交互元素都有标签;正确使用 ARIA(如果原生 HTML 足够则完全不用)
  • 稳定的选择器/可预测的布局——Agent 难以处理每次交互都重新渲染的网站
  • 可见的定价、规格、联系信息——Agent 做出购买推荐所需的任何信息都应放在公开、可索引的页面上(这就是 /pricing.md 等文件发挥作用的地方)

新兴——通用商务协议(UCP): Google 将 UCP 引用为一个即将推出的协议,它将为 Agent 提供商务交互的标准钩子(目录发现、定价、结账)。关注其采纳情况;目前,上述结构建议是其先导。

对于电商和本地企业,Google 特别强调:

  • Merchant Center 数据源 + Google Business Profile——使产品/服务在 AI 搜索中可见
  • Business Agent——用于对话式客户互动(适用时)

最常被引用的内容类型

并非所有内容都同样容易被引用。优先考虑以下格式:

内容类型 引用占比 AI 为何引用它
对比文章 ~33% 结构化、平衡、高意图
权威指南 ~15% 全面、权威
原创研究/数据 ~12% 独特、可引用的统计数据
最佳榜单 ~10% 结构清晰、富含实体
产品页面 ~10% AI 可提取的具体细节
操作指南 ~8% 逐步结构
观点/分析 ~10% 专家视角、可引用

AI 引用表现较差的类型:

  • 缺乏结构的泛泛博客文章
  • 充斥营销套话的薄弱产品页面
  • 封闭式内容(AI 无法访问)
  • 没有日期或作者署名的内容
  • 仅 PDF 格式的内容(AI 解析更困难)

监控 AI 可见度

需要追踪的指标

指标 衡量什么 如何检查
AI Overview 出现情况 你的查询是否出现 AI Overviews? 手动检查或 Semrush/Ahrefs
品牌引用率 你在 AI 答案中被引用的频率 AI 可见度工具(见下文)
AI 声量占比 你的引用 vs. 竞争对手 Peec AI、Otterly、ZipTie
引用情感 AI 如何描述你的品牌 人工审核 + 监控工具
来源归因 你的哪些页面被引用 追踪来自 AI 来源的引荐流量

AI 可见度监控工具

工具 覆盖范围 最适合
Otterly AI ChatGPT、Perplexity、Google AI Overviews AI 声量占比追踪
Peec AI ChatGPT、Gemini、Perplexity、Claude、Copilot+ 多平台规模化监控
ZipTie Google AI Overviews、ChatGPT、Perplexity 品牌提及 + 情感追踪
LLMrefs ChatGPT、Perplexity、AI Overviews、Gemini SEO 关键字 → AI 可见度映射

DIY 监控(无需工具)

每月手动检查:

  1. 选取你最关注的 20 个查询
  2. 分别在 ChatGPT、Perplexity 和 Google 中运行每个查询
  3. 记录:你被引用了吗?谁被引用了?哪个页面?
  4. 记录在电子表格中,按月追踪

Search Console 预期

Google 的指南明确指出:没有针对 AI 的 Search Console 报告。AI Overviews 和 AI Mode 使用核心搜索排名,因此标准的 Search Console 报告(Performance、Coverage、Core Web Vitals)仍然是你在 Google 方面衡量的工具。上述第三方工具是查看跨平台 AI 引用行为的唯一途径。


不要做的事情

Google 的指南明确指出了这些——它们既损害传统搜索也损害 AI 功能。

  1. 不要为 AI"单独撰写内容"。同样的内容应该同时服务人和 AI。针对 AI 系统编写变体内容有触犯规模化内容滥用垃圾政策的风险——这是 Google 的原话。
  2. 不要将页面切碎成 AI 诱饵片段。Google 的指南直接指出:"不要将你的内容打碎成小块让 AI 更好地理解。" 使用正常的段落和标题结构。
  3. 不要为操纵排名而规模化生成内容。AI 生成的内容本身没问题——前提是满足搜索要点和垃圾政策。批量生产薄弱的变体内容不行。
  4. 不要追求不真实的提及。不要为了 AI 可见度伪造引用或批量刷 Reddit/Wikipedia。只参与真实的互动。
  5. 如果你希望被引用,不要屏蔽 AI 爬虫。屏蔽 GPTBot、PerplexityBot、ClaudeBot、Google-Extended 意味着这些引擎根本无法引用你。如果必须,只屏蔽仅用于训练的爬虫(CCBot),不要屏蔽搜索和引用类爬虫。
  6. 不要将主要内容隐藏在无法渲染的 JS 后面。核心搜索和 AI Agent 都需要看到你的内容;仅 JS 渲染会失去两类受众。
  7. 不要跳过 E-E-A-T 基础。作者身份、第一手经验、专业度信号、透明来源——Google 的指南在这方面对 AI 功能要求很高。

按内容类型的 AI SEO

有关 SaaS 产品页面、博客内容、对比/替代页面、文档以及本地/电商(Google 强调 Merchant Center + Business Profile)的战术指南,请参见 references/content-types.md


常见错误

  • 完全忽略 AI 搜索——约 45% 的 Google 搜索现在显示 AI Overviews,ChatGPT/Perplexity 也在快速增长
  • 将 AI SEO 视为与 SEO 无关——良好的传统 SEO 是基础;AI SEO 在此之上增加结构和权威性
  • 为 AI 而非人类写作——如果内容读起来像是为钻算法空子而写的,它既不会被引用也不会带来转化
  • 没有新鲜度信号——无日期的内容会输给有日期的内容,因为 AI 系统高度重视时效性。显示内容最后更新时间
  • 将所有内容封闭起来——AI 无法访问封闭式内容。将你最权威的内容保持开放
  • 忽略第三方存在——来自 Wikipedia 的一条提及可能比你的博客带来更多 AI 引用
  • 没有结构化数据——Schema 标记为 AI 系统提供有关你内容的结构化上下文
  • 关键词堆砌——与传统 SEO 中只是无效不同,关键词堆砌会实际降低 AI 可见度 10%(普林斯顿 GEO 研究)
  • 将定价隐藏在"联系销售"或 JS 渲染页面后面——代表买家评估你产品的 AI Agent 无法解析它们读不到的信息。添加一个 /pricing.md 文件
  • 屏蔽 AI 爬虫——如果在 robots.txt 中屏蔽了 GPTBot、PerplexityBot 或 ClaudeBot,这些平台无法引用你
  • 缺乏数据的泛泛内容——"我们是最好的"不会被引用。"我们的客户在 [指标] 上看到了 3 倍的提升"会
  • 忘记监控——你无法改进你无法衡量的东西。至少每月检查一次 AI 可见度

工具集成

实施方面,请参见 tools registry

工具 用途
semrush AI Overview 追踪、关键字研究、内容缺口分析
ahrefs 反向链接分析、内容探索器、AI Overview 数据
gsc Search Console 表现数据、查询追踪
ga4 来自 AI 来源的引荐流量

任务相关的问题

  1. 你最关注的 10–20 个查询是什么?
  2. 你是否检查过这些查询目前是否有 AI 答案?
  3. 你的网站上是否有结构化数据(schema 标记)?
  4. 你发布什么类型的内容?(博客、文档、对比文章等)
  5. 竞争对手是否在 AI 中被引用了而你却没有?
  6. 你是否有 Wikipedia 页面或在评测网站上有存在感?

相关技能

  • seo-audit:用于传统技术和页面内 SEO 审查
  • schema:用于实施帮助 AI 理解你内容的结构化数据
  • content-strategy:用于规划要创建的内容
  • competitors:用于构建能被引用的对比页面
  • programmatic-seo:用于规模化构建 SEO 页面
  • copywriting:用于编写既适合人类阅读又便于 AI 提取的内容