SEO 专题 基于 Google 官方一手资料 codeflow.cc

SEO 综合研究结论

本文是对本专题全部官方资料(见 resources.md 与 notes/ 各笔记)的横向综合。所有结论均可回溯到官方来源,标注见各笔记。

一、官方文档体系的整体框架

Google 官方 SEO 知识可以整理为四层,每层回答一个问题:

flowchart TB
  L1[1 机制层 · 搜索引擎怎么工作]
  L2[2 规则层 · 什么会被惩罚]
  L3[3 质量层 · 什么会被奖励]
  L4[4 工程层 · 具体怎么做]
  L1 --> L2 --> L3 --> L4
回答的问题核心文档
1. 机制层搜索引擎怎么工作搜索工作原理(抓取 → 索引 → 呈现)、排名系统指南
2. 规则层什么会被惩罚搜索要素、垃圾内容政策(20 类)
3. 质量层什么会被奖励实用内容自评清单、质量评分者指南(E-E-A-T、YMYL、PQ/NM)
4. 工程层具体怎么做新手指南、技术 SEO(robots/sitemap/canonical/结构化数据)、页面体验(Core Web Vitals)

理解顺序建议也按这个次序:先懂机制,再守规则,再理解质量标准,最后落地工程细节。

二、贯穿全部官方文档的三个原则

  1. 不保证原则:满足全部要求也不保证被抓取、索引或展示;sitemap 提交是提示不是命令;canonical 标注是建议不是指令。官方文档反复出现这个措辞,意味着 SEO 的产出只能是提高概率。
  2. 目的判定原则:几乎所有质量与违规判定,判据都是「为谁而做」——为用户(people-first)还是为搜索引擎(search engine-first)。垃圾内容政策里 scaled content abuse 的判定看目的而非手段;评分者指南 PQ 评分第一步是判断页面目的;helpful content 文档称 Why 是「最重要的问题」。
  3. 信号而非因素原则:E-E-A-T 不是排名因素,评分者数据不进排名算法,不存在单一的页面体验排名系统。官方的一致表述是:排名系统使用大量信号,这些概念是信号要识别的目标,不是可直接优化的开关。

三、被官方明确否定的常见说法

以下每条都有官方原文出处(见对应笔记):

流行说法官方立场出处
meta keywords 有用Google 搜索不使用关键字元标记新手指南
存在最佳字数/字数影响排名内容长度本身对排名不重要,不存在「首选字数」新手指南、helpful content
E-E-A-T 是排名因素官方明确「它不是」新手指南、helpful content
评分者能影响我的排名单条评分不影响任何页面排名,评分数据不直接进入算法评分者指南 §0.1
robots.txt 能让页面从搜索结果消失不是阻止收录的机制,应使用 noindex 或密码保护robots.txt 文档
同站重复内容会被处罚无须担忧(复制他人内容另当别论)新手指南
域名里带关键词能提升排名几乎无排名影响新手指南
heading 数量/顺序影响排名对排名无关紧要新手指南
AI 生成内容会被降权评估的是质量与实用性而非生产方式;但用 AI 大规模生成以操纵排名违反 scaled content abuse 政策2023-02 官方博客、垃圾内容政策
付费能提升自然排名排名完全程序化,不收费提升搜索工作原理

四、几组必须区分的概念

  • 抓取(crawling) vs 索引(indexing) vs 呈现(serving):三个独立阶段,分别有独立的失败原因和独立的控制手段(robots.txt 控制抓取;noindex/meta 规则控制索引与呈现)。混淆这三者是多数技术 SEO 错误的根源。
  • E-E-A-T(内容质量概念) vs 排名信号(算法输入) vs 评分者数据(算法评估工具):三者相关但互不等同。
  • 核心更新(core update) vs 垃圾内容更新(spam update):前者是核心排名系统的调整(原 helpful content、Panda、Penguin 等已并入),后者是垃圾检测系统(含 SpamBrain)的更新。权威时间线在 Search Status Dashboard,2024-12 后多数核心更新不再单独发博客。
  • 现场数据(field data) vs 实验室数据(lab data):Core Web Vitals 排名采用的是真实用户第 75 百分位数据(CrUX);Lighthouse 分数是模拟环境,且测不了 INP。

五、时间线:近年的关键变化

时间事件
2022-08Helpful content system 推出
2022-12E-A-T 增加 Experience,变为 E-E-A-T
2023-02官方发布 AI 生成内容立场:看质量不看生产方式
2024-03核心更新:helpful content system 并入核心排名系统;新增三条垃圾内容政策(expired domain abuse、scaled content abuse、site reputation abuse)
2024FID 被 INP 取代(Core Web Vitals)
2024-12多数核心更新改由 Search Status Dashboard 公告,不再单独发博客
2025-01评分者指南 Lowest/Low 章节与垃圾内容政策对齐
2025-05官方发布在 AI 搜索体验(AI Overviews 等)中表现良好的指南
2025-09评分者指南最新版(2025-09-11,更新 YMYL 定义)
2026-05/06官方发布生成式 AI 优化资源;Search Console 上线生成式 AI 效果报告

六、可执行的实践清单(全部来自官方建议)

内容(优先级最高)

  • 用 helpful content 文档的 12+4+5 条自评问题逐项检查核心页面(见实用内容笔记)。
  • 每篇内容能回答 Who(显眼署名+作者背景)/ How(制作过程,AI 参与则加披露)/ Why(为用户而非为流量)。
  • 展示第一手经验:实测数据、照片证明、实际使用记录。
  • 标题描述性、不夸大;不为字数凑内容;不做无附加值的总结/改写。

技术(一次性做对)

  • 确保 Googlebot 能访问与用户相同的资源(CSS/JS 不被屏蔽),用 Search Console 网址检查工具验证。
  • 描述性 URL,主题相近页面归组到同一目录。
  • 每页自引用 canonical,绝对路径;HTTPS。
  • 超过约 500 页或新站外链少时提供 XML sitemap(≤50MB、≤50,000 URL)。
  • robots.txt 只用于管理抓取流量;要阻止收录用 noindex 或密码保护。
  • 用 JSON-LD 添加结构化数据,只标记用户可见内容,用 Rich Results Test 验证。

体验

  • Core Web Vitals 达到良好阈值(LCP ≤ 2.5s、INP ≤ 200ms、CLS ≤ 0.1,按 75 分位真实用户数据)。
  • 移动端正常显示;无侵入式插页广告;主内容与广告易区分。

红线(垃圾内容政策)

  • 不买卖传权重链接;付费/合作链接加 rel="sponsored"rel="nofollow";用户生成内容自动加 nofollow。
  • 不批量生成以操纵排名为目的的内容(无论人写还是 AI)。
  • 不在高权重站点托管与主业无关的第三方内容(site reputation abuse)。
  • 不做隐藏文字、门页、伪装内容、欺骗性重定向。

监控

  • 设置 Search Console;订阅 Search Status Dashboard 的 RSS 关注核心更新。
  • 结构化数据效果用官方建议的对比测试法衡量(数月数据、无季节性波动的页面分组对比)。
  • 更改后等待数周再评估效果,迭代实施。

七、对 AI 时代内容策略的官方口径

深度专研见 AI 生成内容政策AI 搜索功能。要点:

  1. 政策变量不是「AI 与否」,而是投入(effort)、原创性(originality)、附加价值(added value)、目的(purpose)四项。官方原话:“Using AI doesn’t give content any special gains. It’s just content.”
  2. AI 参与生产不是问题,「为操纵排名而大规模生产」才是问题(scaled content abuse,2024-03 起适用于自动化、人工与混合方式)。评分者指南明确「仅使用生成式 AI 工具不决定评级」,但规模化滥用一律评 Lowest。
  3. 官方建议(非强制)对 AI 参与的内容加披露声明,标准是「用户会想知道『它是如何创建的』」;不建议把 AI 列为作者。
  4. AI Overviews / AI Mode 的收录条件只有「被索引 + 可带 snippet 展示」,机制是 RAG + query fan-out;官方对 AEO/GEO 的定性是「仍然是 SEO」。llms.txt、chunking、AI 专用改写、特殊结构化数据均被官方明确否认有效。
  5. 退出搜索内 AI 功能而保留排名:用 nosnippet / max-snippet / data-nosnippet;Google-Extended 与此无关(它只控制 Gemini 训练与 grounding,不影响搜索收录与排名)。
  6. Search Console 已上线生成式 AI 效果报告(2026-06,灰度中),AI 搜索流量可被单独衡量;官方称含 AI Overviews 的结果页点击质量更高,建议以转化衡量价值。