SEO 综合研究结论
本文是对本专题全部官方资料(见 resources.md 与 notes/ 各笔记)的横向综合。所有结论均可回溯到官方来源,标注见各笔记。
一、官方文档体系的整体框架
Google 官方 SEO 知识可以整理为四层,每层回答一个问题:
flowchart TB
L1[1 机制层 · 搜索引擎怎么工作]
L2[2 规则层 · 什么会被惩罚]
L3[3 质量层 · 什么会被奖励]
L4[4 工程层 · 具体怎么做]
L1 --> L2 --> L3 --> L4
| 层 | 回答的问题 | 核心文档 |
|---|---|---|
| 1. 机制层 | 搜索引擎怎么工作 | 搜索工作原理(抓取 → 索引 → 呈现)、排名系统指南 |
| 2. 规则层 | 什么会被惩罚 | 搜索要素、垃圾内容政策(20 类) |
| 3. 质量层 | 什么会被奖励 | 实用内容自评清单、质量评分者指南(E-E-A-T、YMYL、PQ/NM) |
| 4. 工程层 | 具体怎么做 | 新手指南、技术 SEO(robots/sitemap/canonical/结构化数据)、页面体验(Core Web Vitals) |
理解顺序建议也按这个次序:先懂机制,再守规则,再理解质量标准,最后落地工程细节。
二、贯穿全部官方文档的三个原则
- 不保证原则:满足全部要求也不保证被抓取、索引或展示;sitemap 提交是提示不是命令;canonical 标注是建议不是指令。官方文档反复出现这个措辞,意味着 SEO 的产出只能是提高概率。
- 目的判定原则:几乎所有质量与违规判定,判据都是「为谁而做」——为用户(people-first)还是为搜索引擎(search engine-first)。垃圾内容政策里 scaled content abuse 的判定看目的而非手段;评分者指南 PQ 评分第一步是判断页面目的;helpful content 文档称 Why 是「最重要的问题」。
- 信号而非因素原则:E-E-A-T 不是排名因素,评分者数据不进排名算法,不存在单一的页面体验排名系统。官方的一致表述是:排名系统使用大量信号,这些概念是信号要识别的目标,不是可直接优化的开关。
三、被官方明确否定的常见说法
以下每条都有官方原文出处(见对应笔记):
| 流行说法 | 官方立场 | 出处 |
|---|---|---|
| meta keywords 有用 | Google 搜索不使用关键字元标记 | 新手指南 |
| 存在最佳字数/字数影响排名 | 内容长度本身对排名不重要,不存在「首选字数」 | 新手指南、helpful content |
| E-E-A-T 是排名因素 | 官方明确「它不是」 | 新手指南、helpful content |
| 评分者能影响我的排名 | 单条评分不影响任何页面排名,评分数据不直接进入算法 | 评分者指南 §0.1 |
| robots.txt 能让页面从搜索结果消失 | 不是阻止收录的机制,应使用 noindex 或密码保护 | robots.txt 文档 |
| 同站重复内容会被处罚 | 无须担忧(复制他人内容另当别论) | 新手指南 |
| 域名里带关键词能提升排名 | 几乎无排名影响 | 新手指南 |
| heading 数量/顺序影响排名 | 对排名无关紧要 | 新手指南 |
| AI 生成内容会被降权 | 评估的是质量与实用性而非生产方式;但用 AI 大规模生成以操纵排名违反 scaled content abuse 政策 | 2023-02 官方博客、垃圾内容政策 |
| 付费能提升自然排名 | 排名完全程序化,不收费提升 | 搜索工作原理 |
四、几组必须区分的概念
- 抓取(crawling) vs 索引(indexing) vs 呈现(serving):三个独立阶段,分别有独立的失败原因和独立的控制手段(robots.txt 控制抓取;noindex/meta 规则控制索引与呈现)。混淆这三者是多数技术 SEO 错误的根源。
- E-E-A-T(内容质量概念) vs 排名信号(算法输入) vs 评分者数据(算法评估工具):三者相关但互不等同。
- 核心更新(core update) vs 垃圾内容更新(spam update):前者是核心排名系统的调整(原 helpful content、Panda、Penguin 等已并入),后者是垃圾检测系统(含 SpamBrain)的更新。权威时间线在 Search Status Dashboard,2024-12 后多数核心更新不再单独发博客。
- 现场数据(field data) vs 实验室数据(lab data):Core Web Vitals 排名采用的是真实用户第 75 百分位数据(CrUX);Lighthouse 分数是模拟环境,且测不了 INP。
五、时间线:近年的关键变化
| 时间 | 事件 |
|---|---|
| 2022-08 | Helpful content system 推出 |
| 2022-12 | E-A-T 增加 Experience,变为 E-E-A-T |
| 2023-02 | 官方发布 AI 生成内容立场:看质量不看生产方式 |
| 2024-03 | 核心更新:helpful content system 并入核心排名系统;新增三条垃圾内容政策(expired domain abuse、scaled content abuse、site reputation abuse) |
| 2024 | FID 被 INP 取代(Core Web Vitals) |
| 2024-12 | 多数核心更新改由 Search Status Dashboard 公告,不再单独发博客 |
| 2025-01 | 评分者指南 Lowest/Low 章节与垃圾内容政策对齐 |
| 2025-05 | 官方发布在 AI 搜索体验(AI Overviews 等)中表现良好的指南 |
| 2025-09 | 评分者指南最新版(2025-09-11,更新 YMYL 定义) |
| 2026-05/06 | 官方发布生成式 AI 优化资源;Search Console 上线生成式 AI 效果报告 |
六、可执行的实践清单(全部来自官方建议)
内容(优先级最高)
- 用 helpful content 文档的 12+4+5 条自评问题逐项检查核心页面(见实用内容笔记)。
- 每篇内容能回答 Who(显眼署名+作者背景)/ How(制作过程,AI 参与则加披露)/ Why(为用户而非为流量)。
- 展示第一手经验:实测数据、照片证明、实际使用记录。
- 标题描述性、不夸大;不为字数凑内容;不做无附加值的总结/改写。
技术(一次性做对)
- 确保 Googlebot 能访问与用户相同的资源(CSS/JS 不被屏蔽),用 Search Console 网址检查工具验证。
- 描述性 URL,主题相近页面归组到同一目录。
- 每页自引用 canonical,绝对路径;HTTPS。
- 超过约 500 页或新站外链少时提供 XML sitemap(≤50MB、≤50,000 URL)。
- robots.txt 只用于管理抓取流量;要阻止收录用 noindex 或密码保护。
- 用 JSON-LD 添加结构化数据,只标记用户可见内容,用 Rich Results Test 验证。
体验
- Core Web Vitals 达到良好阈值(LCP ≤ 2.5s、INP ≤ 200ms、CLS ≤ 0.1,按 75 分位真实用户数据)。
- 移动端正常显示;无侵入式插页广告;主内容与广告易区分。
红线(垃圾内容政策)
- 不买卖传权重链接;付费/合作链接加
rel="sponsored"或rel="nofollow";用户生成内容自动加 nofollow。 - 不批量生成以操纵排名为目的的内容(无论人写还是 AI)。
- 不在高权重站点托管与主业无关的第三方内容(site reputation abuse)。
- 不做隐藏文字、门页、伪装内容、欺骗性重定向。
监控
- 设置 Search Console;订阅 Search Status Dashboard 的 RSS 关注核心更新。
- 结构化数据效果用官方建议的对比测试法衡量(数月数据、无季节性波动的页面分组对比)。
- 更改后等待数周再评估效果,迭代实施。
七、对 AI 时代内容策略的官方口径
- 政策变量不是「AI 与否」,而是投入(effort)、原创性(originality)、附加价值(added value)、目的(purpose)四项。官方原话:“Using AI doesn’t give content any special gains. It’s just content.”
- AI 参与生产不是问题,「为操纵排名而大规模生产」才是问题(scaled content abuse,2024-03 起适用于自动化、人工与混合方式)。评分者指南明确「仅使用生成式 AI 工具不决定评级」,但规模化滥用一律评 Lowest。
- 官方建议(非强制)对 AI 参与的内容加披露声明,标准是「用户会想知道『它是如何创建的』」;不建议把 AI 列为作者。
- AI Overviews / AI Mode 的收录条件只有「被索引 + 可带 snippet 展示」,机制是 RAG + query fan-out;官方对 AEO/GEO 的定性是「仍然是 SEO」。llms.txt、chunking、AI 专用改写、特殊结构化数据均被官方明确否认有效。
- 退出搜索内 AI 功能而保留排名:用 nosnippet / max-snippet / data-nosnippet;Google-Extended 与此无关(它只控制 Gemini 训练与 grounding,不影响搜索收录与排名)。
- Search Console 已上线生成式 AI 效果报告(2026-06,灰度中),AI 搜索流量可被单独衡量;官方称含 AI Overviews 的结果页点击质量更高,建议以转化衡量价值。