搜索质量评分者指南(Search Quality Rater Guidelines)与 E-E-A-T 研究笔记
来源(全部为 Google 官方一手来源,已验证):
- 完整版指南 PDF(182 页,2025-09-11 版): https://static.googleusercontent.com/media/guidelines.raterhub.com/en//searchqualityevaluatorguidelines.pdf (本目录已存档:�P0�)
- 官方概览 PDF《Search Quality Rater Guidelines: An Overview》(36 页,2023-11 版): https://services.google.com/fh/files/misc/hsw-sqrg.pdf
- 官方博客(E-A-T → E-E-A-T,2022-12-15): https://developers.google.com/search/blog/2022/12/google-raters-guidelines-e-e-a-t
- 官方博客(2023-11 更新): https://developers.google.com/search/blog/2023/11/search-quality-rater-guidelines-update
注意:曾流传的概览页 URL
developers.google.com/search/docs/fundamentals/how-search-works/quality-raters现已 404。
一、评分者是谁、做什么
- Google 与约 16,000 名外部搜索质量评分者(external Search Quality Raters)合作,持续测量搜索结果质量。分布:北美约 7,000、EMEA 约 4,000、APAC 约 4,000、拉美约 1,000,覆盖 80+ 种语言。
- 评分者由外部供应商雇佣,必须通过指南考试才能上岗;评分不得基于个人观点、偏好、宗教信仰或政治立场。
- 评分任务两种形式:
- side-by-side 实验:对比「已实施拟议改动」与「未实施」的两组搜索结果并说明偏好;
- 按指南量表对结果集中的每个页面评分。
- 评估分两部分:Page Quality (PQ)——页面达成其目的的程度;Needs Met (NM)——结果对给定搜索的有用程度。
二、评分结果如何被使用(最重要的官方澄清)
指南 §0.1 原文(2025-09-11 版):
“No single rating can directly impact how a particular webpage, website, or result appears in Google Search, nor can it cause specific webpages, websites, or results to move up or down on the search results page. … Instead, ratings are used to measure how effectively search engines are working to deliver helpful content to people around the world.”
即:任何单条评分都不会直接影响任何网页的排名。聚合后的评分用于两件事:衡量排名系统是否在正常工作;为系统改进提供正反例。官方在 creating-helpful-content 文档中的对应表述:“Search raters have no control over how pages rank. Rater data is not used directly in our ranking algorithms.”
配套背景:Google 评估搜索改动的三种方式是 User Research、Live Experiments(通常从 0.1% 或更小流量开始的对照实验)、Search Quality Tests(评分者评估);仅 2022 年一年就实施了超过 4,725 项搜索改进。
三、指南结构(2025-09-11 版,182 页)
- Part 1: Page Quality Rating(约 85 页)
- 评分三步骤:① 判断页面真实目的(有害或欺骗性目的直接评 Lowest)→ ② 评估致害可能(有害/不可信/垃圾页面评 Lowest)→ ③ 按页面达成其目的的程度评分。
- 档位:Lowest / Low / Medium / High / Highest(滑块,可取 Lowest+、Low+ 等中间档)。
- §4 Lowest 覆盖:危害自己或他人、危害特定群体、有害误导信息、不可信网页、垃圾网页(含过期域名滥用、站点声誉滥用、规模化内容滥用——与垃圾内容政策一一对应,2025 年 1 月版明确做了对齐)。
- §5 Low 覆盖:缺乏 E-E-A-T、低投入/低原创/低附加值的主内容、灌水(filler)、干扰性广告、创作者信息不足、夸大或轻度误导。
- 术语:MC(Main Content 主内容)、SC(Supplementary Content 补充内容)、Ads(广告/变现内容)。
- 官方强调:页面类型不决定评分——“encyclopedia pages are not necessarily higher quality than humor pages”,必须先理解页面目的。
- Part 2: Understanding Search User Needs:理解查询、locale、多义查询、用户意图、结果块(result blocks)。
- Part 3: Needs Met Rating(约 60 页),五档:
档位 官方定义(要点) Fully Meets (FullyM) 特殊档:仅适用于意图明确指向某一特定结果的查询,且结果正是用户要找的那个 Highly Meets (HM) 对主导/常见/合理次要意图非常有帮助的结果 Moderately Meets (MM) 对主导/常见/合理次要意图有帮助的结果 Slightly Meets (SM) 帮助较小的结果,或只满足不太可能的次要意图 Fails to Meet (FailsM) 对几乎所有用户都完全无用(离题、只对应不可能的解读) - 附录:评分平台使用说明、变更日志。
四、YMYL(Your Money or Your Life)官方定义
指南 §2.3 原文要点:某些主题的内容「可能严重影响人的健康、财务稳定或安全,或社会的福祉」,这类主题称为 YMYL。判断时评估四类危害:
- YMYL Health or Safety:心理/身体/情绪健康及各类安全。
- YMYL Financial Security:损害个人养活自己和家庭的能力。
- YMYL Government, Civics & Society:公共利益议题、对公共机构的信任、选举与投票信息等。
- YMYL Other。
主题成为 YMYL 的两种原因:主题本身有害危险(自残、犯罪、暴力极端主义),或内容不准确就会致害(心梗症状、投资方法、地震应对、投票资格)。YMYL 是一个程度谱系;明确 YMYL 主题的页面在 PQ 评分中受到最严格审视,标准高于非 YMYL 页面。
五、E-E-A-T:官方定义与 Trust 的核心地位
E-E-A-T = Experience(经验)+ Expertise(专业知识)+ Authoritativeness(权威性)+ Trust(可信)。指南 §3.4 原文定义:
- Trust:页面准确、诚实、安全、可靠的程度。所需类型和程度因页面而异:网店需要安全支付和可靠客服;明确 YMYL 主题的信息页必须准确;以娱乐为目的、无致害风险的社交帖子可能不需要高 Trust。
- Experience:创作者对该主题是否有必要的第一手或生活经验(例:亲自用过产品的人写的评测 vs 没用过的人写的「评测」)。
- Expertise:创作者是否有必要的知识或技能(例:持证电工 vs 外行给出的家庭电路改造建议)。
- Authoritativeness:创作者或网站是否被公认为该主题的首选来源(例:办护照的官方政府页面)。
Trust 为核心,官方原文:
“Trust is the most important member of the E-E-A-T family because untrustworthy pages have low E-E-A-T no matter how Experienced, Expert, or Authoritative they may seem. For example, a financial scam is untrustworthy, even if the content creator is a highly experienced and expert scammer.”
Experience/Expertise/Authoritativeness 是支撑 Trust 评估的三个概念,可能重叠,不同主题所需组合不同。评估 E-E-A-T 的三条信息来源:网站/创作者自述(About us、个人主页)、他人评价(独立评测、引用、新闻报道)、页面上可见的内容本身。存在明显利益冲突(厂商自评、付费推广「评测」)则不可信。
E-A-T → E-E-A-T 的历史
2022-12-15 官方博客《Our latest update to the quality rater guidelines: E-A-T gets an extra E for Experience》(作者 Elizabeth Tucker)宣布加入 Experience。博文例子:想知道如何正确报税,需要会计专家的内容;想看报税软件评测,可能更想看有实际使用经验的人的论坛讨论。博文同时重申:这些不是根本性新理念,且指南「不直接影响排名」。
E-E-A-T 与排名的准确关系(避免以讹传讹)
综合官方表述:E-E-A-T 不是具体排名因素(新手指南原话「它不是」);排名系统使用的是一组能识别高 E-E-A-T 内容的信号;评分者用 E-E-A-T 评估搜索结果质量,评分数据不直接进入排名算法;YMYL 主题上,系统给予符合强 E-E-A-T 的内容更大权重。
六、版本历史(官方 Change Log)
| 版本日期 | 主要变更 |
|---|---|
| 2025-09 | 更新 YMYL 定义;补充示例;细节修订 |
| 2025-01 | Lowest/Low 章节与 Google 搜索垃圾内容政策对齐,增加示例;扩充 NM 次要意图评分指引 |
| 2024-02 | 更新不可信页面的特征,增加示例 |
| 2023-11 | 简化 NM 量表定义;为短视频等新内容形式增加现代化示例;扩充论坛/讨论页评分指引(官方博客:「不涉及任何重大或根本性变化」) |
| 2022-12 | E-A-T 增加 Experience,变为 E-E-A-T |
注:有第三方媒体称 2025-09 版加入了 AI Overviews 相关示例,但官方 Change Log 的措辞仅为「Added additional examples for clarity」,以官方措辞为准。