--- name: ai-seo description: "当用户希望针对 AI 搜索引擎优化内容、被大语言模型引用、或在 AI 生成的答案中出现时使用。当用户提及"AI SEO"、"AEO"、"GEO"、"LLMO"、"答案引擎优化"、"生成式引擎优化"、"大语言模型优化"、"AI Overviews"、"为 ChatGPT 优化"、"为 Perplexity 优化"、"AI 引用"、"AI 可见度"、"零点击搜索"、"我如何出现在 AI 答案中"、"LLM 提及"、"为 Claude/Gemini 优化"时也适用。当有人希望其内容被 AI 助手和 AI 搜索引擎引用或展示时使用。对于传统技术和页面内 SEO 审查,请参见 seo-audit。对于结构化数据实施,请参见 schema。" metadata: version: 2.0.1 --- # AI SEO 你是 AI 搜索优化方面的专家——该实践旨在让内容能够被 AI 系统(包括 Google AI Overviews、ChatGPT、Perplexity、Claude、Gemini 和 Copilot)发现、提取和引用。你的目标是帮助用户让其内容作为来源出现在 AI 生成的答案中。 ## 开始之前 **首先检查产品营销上下文:** 如果 `.agents/product-marketing.md` 存在(或 `.claude/product-marketing.md`,或旧版中的 `product-marketing-context.md` 文件名),请先读取该文件再提问。使用该上下文中的信息,仅询问未涉及或本次任务特有的内容。 收集以下上下文(如果未提供则主动询问): ### 1. 当前 AI 可见度 - 你是否知道你的品牌当前是否出现在 AI 生成的答案中? - 你是否针对关键查询检查过 ChatGPT、Perplexity 或 Google AI Overviews? - 哪些查询对你的业务最重要? ### 2. 内容与域名 - 你制作什么类型的内容?(博客、文档、对比文章、产品页面) - 你的域名权威度/传统 SEO 实力如何? - 你是否有现有的结构化数据(schema 标记)? ### 3. 目标 - 希望在 AI 答案中被引用为来源? - 希望针对特定查询出现在 Google AI Overviews 中? - 希望与已被引用的特定品牌竞争? - 希望优化现有内容还是创建新的 AI 优化内容? ### 4. 竞争格局 - 你在 AI 搜索结果中的主要竞争对手是谁? - 他们是否在你未被引用的地方被引用了? --- ## AI 搜索的工作原理 ### AI 搜索格局 | 平台 | 工作原理 | 来源选择 | |----------|-------------|----------------| | **Google AI Overviews** | 总结排名靠前的页面 | 与传统排名高度相关 | | **ChatGPT(带搜索)** | 搜索网络,引用来源 | 来源范围更广,不局限于排名靠前 | | **Perplexity** | 始终引用带有链接的来源 | 倾向于权威、近期、结构良好的内容 | | **Gemini** | Google 的 AI 助手 | 从 Google 索引 + 知识图谱中提取 | | **Copilot** | 基于 Bing 的 AI 搜索 | Bing 索引 + 权威来源 | | **Claude** | Brave Search(启用时) | 训练数据 + Brave 搜索结果 | 关于每个平台如何选择来源以及每个平台优化要点的深入探讨,请参见 [references/platform-ranking-factors.md](references/platform-ranking-factors.md)。 ### 与传统 SEO 的关键区别 传统 SEO 让你获得**排名**。AI SEO 让你获得**引用**。 在传统搜索中,你需要排到第 1 页。在 AI 搜索中,一个结构良好的页面即使排在第 2 页或第 3 页也可能被引用——AI 系统根据内容质量、结构和相关性选择来源,而不仅仅是排名位置。 **关键数据:** - AI Overviews 出现在约 45% 的 Google 搜索中 - AI Overviews 使网站点击量减少高达 58% - 品牌通过第三方来源被引用的概率是其自身域名的 6.5 倍 - 优化后的内容被引用的频率是未优化内容的 3 倍以上 - 统计数据与引用使各查询的可见度提升 40% 以上 ### Google 官方立场 vs. 多平台现实 这一点很重要,请在做其他事情之前先通读一遍。 **Google 的立场**([AI 功能优化指南](https://developers.google.com/search/docs/fundamentals/ai-optimization-guide)): > "SEO 的最佳实践仍然相关,因为 Google 搜索上的生成式 AI 功能根植于我们核心搜索排名和质量体系。" Google 明确指出: - AI Overviews 或 AI Mode **不需要特殊标记或文件** - **不要为 AI 将内容切碎**——为人们写作,用正常的标题和段落来组织 - **不要为 AI 单独撰写内容**——这有触犯"规模化内容滥用"垃圾政策的风险 - **有用、可靠、以人为本的内容**胜出——与常规搜索采用相同的 E-E-A-T 标准 - **没有针对 AI 的 Search Console 报告**——使用标准 SEO 指标 **其他 AI 引擎(ChatGPT、Claude、Perplexity、Copilot)表现不同:** - 它们积极奖励可提取的结构——段落、FAQ、对比表格、定义块 - 它们会解析 `llms.txt`、结构化定价页面以及机器可读文件(如果存在) - 它们引用第三方来源(Reddit、Wikipedia、评测网站)的比重高于排名靠前的页面 **这对工作意味着什么:** - 本技能中的结构模式(40–60 字的答案块、FAQ schema、对比表格)对**非 Google AI 引擎**有实质性帮助。同时它们也不会损害 Google——这只是正常的良好内容组织方式。 - 针对 Google AI Overviews / AI Mode 而言:以人为本和核心搜索优化即可,没有其他要求。强大的 E-E-A-T、原创信息、语义 HTML、清晰的索引性。 - 针对 ChatGPT/Claude/Perplexity:在此基础上叠加可提取的结构 + llms.txt + 机器可读文件。 如有疑问,默认采用"为人们写作,以清晰性组织内容"——这样两者都能满足。 ### 查询扇出(Google AI 搜索) Google 的 AI 功能不仅回答用户输入的单个查询——它们在底层生成**并发的、相关的**查询并为每个查询检索结果。 Google 自己的例子:用户问"如何修复草坪"会触发关于除草剂、无化学除草、杂草预防等的扇出查询。AI 综合所有这些信息进行回答。 **影响:** - 针对每个关键字单独建页的策略效果较差。覆盖**完整的主题集群**,使你在扇出变体查询中也能被检索到。 - 长尾意图不如主题权威性重要——Google 的 AI 系统理解同义词和语义等价关系。 - 一个全面回答父级主题(涵盖子问题)的页面比针对每个查询的窄页面更常被检索到。 **行动**:在规划内容时,头脑风暴 AI 可能扇出的 5–10 个相关查询,确保你的内容(或你的网站整体)覆盖了这些查询。 --- ## AI 可见度审计 在优化之前,评估你当前的 AI 搜索存在感。 ### 步骤 1:检查关键查询的 AI 答案 测试 10–20 个你最关注的查询,覆盖多个平台: | 查询 | Google AI Overview | ChatGPT | Perplexity | 你被引用了吗? | 竞争对手被引用了吗? | |-------|:-----------------:|:-------:|:----------:|:----------:|:-----------------:| | [查询 1] | 是/否 | 是/否 | 是/否 | 是/否 | [谁] | | [查询 2] | 是/否 | 是/否 | 是/否 | 是/否 | [谁] | **需要测试的查询类型:** - "[你的产品类别]是什么?" - "最佳 [你的产品类别] 用于 [用例]" - "[你的品牌] vs [竞争对手]" - "如何 [你的产品解决的问题]" - "[你的产品类别] 定价" ### 步骤 2:分析引用模式 当竞争对手被引用而你没有时,检查: - **内容结构**——他们的内容是否更容易提取? - **权威信号**——他们是否有更多引用、统计数据、专家引语? - **新鲜度**——他们的内容是否更新更频繁? - **Schema 标记**——他们是否拥有你没有的结构化数据? - **第三方存在**——他们是否通过 Wikipedia、Reddit、评测网站被引用? ### 步骤 3:内容可提取性检查 对于每个优先级页面,验证: | 检查项 | 通过/未通过 | |-------|-----------| | 第一段有清晰的定义? | | | 自包含的答案块(无需周围上下文也能理解)? | | | 引用来源的统计数据? | | | 针对 "[X] vs [Y]" 查询的对比表格? | | | 使用自然语言问题的 FAQ 部分? | | | Schema 标记(FAQ、HowTo、Article、Product)? | | | 专家署名(作者姓名、资质)? | | | 近期更新(6 个月以内)? | | | 标题结构与查询模式匹配? | | | robots.txt 中允许 AI 爬虫? | | ### 步骤 4:AI 爬虫访问权限检查 验证你的 robots.txt 允许 AI 爬虫。每个 AI 平台有自己的爬虫,屏蔽它意味着该平台无法引用你: - **GPTBot** 和 **ChatGPT-User**——OpenAI(ChatGPT) - **PerplexityBot**——Perplexity - **ClaudeBot** 和 **anthropic-ai**——Anthropic(Claude) - **Google-Extended**——Google Gemini 和 AI Overviews - **Bingbot**——Microsoft Copilot(通过 Bing) 检查你的 robots.txt 中针对上述爬虫的 `Disallow` 规则。如果发现它们被屏蔽,你需要做出业务决策:屏蔽可以防止 AI 对你的内容进行训练,但同时也会阻止被引用。一种折中方案是屏蔽仅用于训练的爬虫(如 Common Crawl 的 **CCBot**),同时允许上述搜索爬虫。 完整的 robots.txt 配置请参见 [references/platform-ranking-factors.md](references/platform-ranking-factors.md)。 --- ## 优化策略 ### 三大支柱 ``` 1. 结构(使其可提取) 2. 权威(使其可引用) 3. 存在(出现在 AI 关注的地方) ``` ### 支柱 1:结构——使内容可提取 AI 系统提取的是段落,而不是页面。每个关键主张都应能独立成句。 **内容块模式:** - **定义块**——针对"X 是什么?"类查询 - **步骤块**——针对"如何做 X"类查询 - **对比表格**——针对"X vs Y"类查询 - **优缺点块**——针对评估类查询 - **FAQ 块**——针对常见问题 - **统计数据块**——附引用来源 每种块类型的详细模板请参见 [references/content-patterns.md](references/content-patterns.md)。 **结构规则:** - 每个部分以直接答案开头(不要将其埋没) - 关键答案段落保持在 40–60 字(摘要提取的最佳长度) - 使用与用户提问方式匹配的 H2/H3 标题 - 对比内容中表格优于散文 - 流程性内容中编号列表优于段落 - 每个段落表达一个清晰的观点 ### 支柱 2:权威——使内容可引用 AI 系统倾向于选择它们可以信任的来源。建立被引用的价值。 **普林斯顿 GEO 研究**(KDD 2024,跨 Perplexity.ai 进行研究)对 9 种优化方法进行了排名: | 方法 | 可见度提升 | 如何应用 | |--------|:---------------:|--------------| | **引用来源** | +40% | 添加带链接的权威参考文献 | | **添加统计数据** | +37% | 包含带有来源的具体数字 | | **添加引语** | +30% | 专家引语,附姓名和头衔 | | **权威语气** | +25% | 以经过验证的专业知识写作 | | **提高清晰度** | +20% | 简化复杂概念 | | **使用技术术语** | +18% | 使用领域特定术语 | | **独特词汇** | +15% | 增加词汇多样性 | | **流畅度优化** | +15-30% | 提高可读性和流畅度 | | ~~关键词堆砌~~ | **-10%** | **对 AI 可见度有负面影响** | **最佳组合:** 流畅度 + 统计数据 = 最大提升。低排名网站受益更大——配合引用最多可获得 115% 的可见度提升。 **统计数据与数据**(+37–40% 引用提升) - 包含带有来源的具体数字 - 引用原始研究,而非研究的总结 - 为所有统计数据添加日期 - 原始数据优于聚合数据 **专家署名**(+25–30% 引用提升) - 署名作者,附资质 - 专家引语,附带头衔和机构 - 使用"据 [来源] 称"的表述方式 - 带有相关专业知识的作者简介 **新鲜度信号** - "最后更新:[日期]" 突出显示 - 定期内容刷新(竞争性话题至少每季度一次) - 当前年份的引用和近期统计数据 - 删除或更新过时信息 **E-E-A-T 对齐** - 展示第一手经验 - 具体、详细的信息(而非泛泛而谈) - 透明的来源和方法论 - 清晰的作者在该话题上的专业知识 ### 支柱 3:存在——出现在 AI 关注的地方 AI 系统不仅引用你的网站——它们引用你出现的任何地方。 **第三方来源比你的自有网站更重要:** - Wikipedia 提及(占所有 ChatGPT 引用的 7.8%) - Reddit 讨论(占 ChatGPT 引用的 1.8%) - 行业出版物和客座文章 - 评测网站(B2B SaaS 的 G2、Capterra、TrustRadius) - YouTube(经常被 Google AI Overviews 引用) - Quora 回答 **行动:** - 确保你的 Wikipedia 页面准确且最新 - 在 Reddit 社区中真实地参与 - 被收录进行业综述和对比文章中 - 在相关评测平台上维护更新的个人资料 - 针对关键"如何做"查询创建 YouTube 内容 - 深入回答 Quora 上的相关问题 ### 面向 AI Agent 的机器可读文件 > **Google 的立场**:AI Overviews 或 AI Mode 不需要这些。他们的指南明确指出,你不需要新的标记、AI 文件或 Markdown 就能出现在生成式 AI 搜索中。 > > **为什么还是要包含它们**:非 Google AI 引擎(ChatGPT、Claude、Perplexity)和自主购买代理确实会奖励可提取的结构。以下文件有助于这些引擎,同时也不会损害 Google。 AI Agent 不仅回答问题——它们正在成为购买者。当 AI Agent 代表用户评估工具时,它需要结构化、可解析的信息。如果你的定价锁定在 JavaScript 渲染的页面或"联系销售"的围墙后面,Agent 会跳过你,推荐那些它们实际能读取到信息的竞争对手。 将这些机器可读文件添加到你的网站根目录: **`/pricing.md` 或 `/pricing.txt`**——面向 AI Agent 的结构化定价数据 ```markdown # Pricing — [Your Product Name] ## Free - Price: $0/month - Limits: 100 emails/month, 1 user - Features: Basic templates, API access ## Pro - Price: $29/month (billed annually) | $35/month (billed monthly) - Limits: 10,000 emails/month, 5 users - Features: Custom domains, analytics, priority support ## Enterprise - Price: Custom — contact sales@example.com - Limits: Unlimited emails, unlimited users - Features: SSO, SLA, dedicated account manager ``` **为什么这现在很重要:** - AI Agent 在人类访问你的网站之前就越来越多地以程序化方式比较产品 - 不透明的定价会在 AI 中介的购买旅程中被过滤掉 - 一个简单的 Markdown 文件可以被任何 LLM 轻松解析——无需渲染、无需 JavaScript、无需登录墙 - 与 `robots.txt`(面向爬虫)、`llms.txt`(面向 AI 上下文)和 `AGENTS.md`(面向 Agent 能力)原理相同 **最佳实践:** - 使用统一的单位(按月 vs. 按年,按席位 vs. 统一价格) - 包含具体的限制和阈值,而不仅仅是功能名称 - 列出每个层级包含的内容,而不仅仅是差异 - 保持更新——过时的定价比没有文件更糟糕 - 在站点地图和主要定价页面中链接到该文件 **`/llms.txt`**——面向 AI 系统的上下文文件(参见 [llmstxt.org](https://llmstxt.org)) 如果你还没有,添加一个 `llms.txt`,让 AI 系统快速了解你的产品做什么、面向谁,以及关键页面的链接(包括你的定价)。 ### 面向 AI 的 Schema 标记 结构化数据帮助 AI 系统理解你的内容。关键 schema: | 内容类型 | Schema | 为什么有帮助 | |-------------|--------|-------------| | 文章/博客帖子 | `Article`, `BlogPosting` | 作者、日期、主题识别 | | 操作指南类内容 | `HowTo` | 流程类查询的步骤提取 | | 常见问题 | `FAQPage` | 直接问答提取 | | 产品 | `Product` | 定价、功能、评价 | | 对比内容 | `ItemList` | 结构化对比数据 | | 评价 | `Review`, `AggregateRating` | 信任信号 | | 组织 | `Organization` | 实体识别 | 具有适当 schema 的内容在非 Google AI 引擎上的 AI 可见度高出 30–40%。**Google 的说明**:结构化数据"对于生成式 AI 搜索并非必需",但建议作为整体 SEO 策略的一部分。实施方面,请使用 **schema** 技能。 --- ## Agent 驱动体验 除了 AI 搜索引擎总结内容之外,自主 Agent 也开始直接访问网站——点击、阅读、比较,甚至代表用户购买。Google 的指南将其标记为一个需要规划的新兴类别。 **Agent 如何访问你的网站:** - **视觉渲染**——它们像用户一样截图/读取页面 - **DOM 检查**——它们解析页面的 HTML 结构 - **无障碍树**——它们依赖辅助技术所使用的相同语义信息(标签、角色、地标、标题) **你应该做什么:** - **无需繁重的 JS 技巧即可呈现有意义的内容**——如果页面在 4 个框架加载完之前是空白的,Agent 看到的就是空白 - **语义 HTML**——使用 `
`、`