← Knowledge Notes
Global Growth / Knowledge note · Chinese

Google SEO 入门 + Search 工作原理 + Search Essentials

Google Search Central 入门层。Google 搜索 3 阶段(crawl/index/serve)/ Search Essentials 3 块(技术要求/垃圾政策/最佳实践)/ E-E-A-T 与 helpful content 自检 / 生成式 AI(AI Overviews + AI Mode)对 SEO 的影响 / 不必做的事(AEO/GEO/chunking/llms.txt 都是 myth)/ 招 SEO 顾问的避坑 / 网站上线、内容优化、链接、移动端、HTTPS 全清单

Source collection:Google 搜索与 SEO · Published here:2026-09-26 · Note updated:2026-09-26

SEO搜索引擎自然增长

Google Search Central docs 入门层(fundamentals/ + essentials/ + 顶层导航)整合。14 个英文源 + 14 个 zh-cn 机翻同源。

本 wiki 是 GSC 知识库的入口,深入主题去看 related 里列的 13 个姐妹 wiki。


1. Google Search 3 阶段(crawling / indexing / serving)

阶段 做什么 何时可能失败
Crawling 抓取 Googlebot 用程序从 URL 发现 → 访问下载页面文本/图片/视频 robots.txt 屏蔽 / HTTP 5xx 错误 / 登录墙
Indexing 索引 解析内容,判定重复页 vs 规范页(canonical),收集语言/地区/可用性信号,存入 Google index 低质量内容 / noindex robots meta / JS 渲染失败
Serving 服务 用户查询时,按数百因素返回最相关、最高质量的结果 内容与查询无关 / noindex meta 阻止 serving

关键不变量:

Why 重要: 大部分 SEO 问题诊断都回到"哪一阶段没过去"。Search Console 的 URL Inspection Tool 是检查这 3 阶段的官方工具(详见 Search Console + Analytics + Trends 三件套用法 (流量诊断 / 关键词调研 / Looker Studio))。


2. SEO 是什么、要不要做、谁来做

SEO = Search Engine Optimization,本质是帮搜索引擎理解你的内容 + 帮用户找到你。SEO 不是骗排名的黑魔法,Google 明确表态"there are no secrets here that'll automatically rank your site first"。

网站上线后的第 0 步:确认 Google 知道你

用 site: operator 查自己网站:

site:example.com
  • 有结果 → 你在 index 里,可以开始优化
  • 无结果 → 检查 technical requirements 是否过 + 等待自然发现(新站可能要几天到几周)

何时不需要专业 SEO

  • 本地小生意 + 内容简单 + 站点小 → 自己读完 fundamentals 系列就够
  • 已有 CMS(WordPress/Wix/Shopify)+ 默认设置基本 OK
  • 等不及结果的(SEO 通常 4 个月-1 年 才看到效果)

何时要请 SEO + 怎么挑

最适合时机:网站重新设计或新站启动前,让 SEO 从架构层介入。挑选 5 步:

  1. 承诺会真的实施 SEO 建议 — 否则别请,白花钱
  2. 面试 — 问过往案例、follow Google Search Essentials 吗、行业经验、沟通方式、是否会列出所有改动
  3. 查商业引荐 — 问过往客户是否好合作、是否带来正向结果
  4. 付钱要技术 + 搜索审计 — 给 ta read-only 的 Search Console 权限。不要给 write 权限。审计输出要有"现实可行的改进估算 + 工作量估算"。任何"保证 #1 排名"的都是骗子
  5. 决定是否签约

SEO 行业 8 大骗术

骗术 怎么识别
Shadow domain(影子域名) SEO 自己买的域名,通过 deceptive redirect 把用户导到你站。合作破裂时 ta 可以指给竞品
Doorway page(诱导页) 塞满关键词的中间页,实际上把 link juice 抽走给 SEO 的其它客户
Link scheme(链接交易) 买卖链接 / 互链 / 自动化外链 → 违反 spam policy,可能被人工 action
Guarantee #1 没有任何人能保证 Google 排名。这条 100% 是骗子
Special relationship with Google Google 不卖任何"特权",这条也是骗
Priority submit 不存在。提交方式只有 3 种:URL Inspection Tool / Sitemap / Indexing API(都你自己做)
Unsolicited email("贵站没被搜索引擎收录...") 跟"减肥神药"和"非洲王子转账"同档,直接删
Pay-per-rank with hidden fee 把你放进广告位而不是自然结果。问清"哪笔钱是 permanent inclusion vs temporary advertising"

举报:美国走 FTC(ftc.gov),其它国家走 econsumer.gov。


3. Search Essentials 三大块

Search Essentials 是 Google 要不要在 Search 显示你的最小要求集,3 块:

Technical requirements(3 条,几乎所有站点天然满足)

  1. Googlebot 没被屏蔽 — 没在 robots.txt 里 disallow、没有 login wall(详见 抓取与索引控制完全指南 (robots.txt / noindex / X-Robots-Tag / data-nosnippet / rel))
  2. 页面正常工作 — 返回 HTTP 200 (success),不是 4xx/5xx
  3. 页面有可索引内容 — 文本在 Google 支持的文件类型 里(HTML / PDF / 图片 / 视频 / Office 文档等)

重要:满足这 3 条不保证被 index。Google 还要看质量、是否重复、是否违反 spam policy。

Spam policies(24 条禁令,违反则降权/移除)

详见 §7 Spam policies 完整清单。

Key best practices(关键最佳实践 7 条)


4. Developer 视角的技术准备(get-started-developers 浓缩)

如果你是开发者,在写代码层面给 Google 一个搜索友好的网站:

检查项 怎么做
Google 看到的页面跟用户看到的一样吗 URL Inspection Tool / Rich Results Test
所有 URL 都能被 link 到吗 用 <a href> 元素;每个 piece of content 一个 URL;SPA 的每个 screen 给唯一 URL
用了 JS 吗 跟 JS SEO best practices(详见 JavaScript SEO 全套(基础 + 诊断 + Dynamic Rendering + Lazy Loading))
内容更新后 Google 知道吗 提交 sitemap + URL Inspection 请求重抓
文本是 Googlebot 能"看到"的吗 视觉内容要有文本对应(产品图列表要有文字描述);每页要有 descriptive title + meta description;用 semantic HTML;内容要在 DOM 里(CSS content: 属性 inserted 的文本不被 index)
Google 知道你有多版本(移动/桌面/多语言)吗 consolidate duplicate URLs / hreflang(详见 Canonical / 重定向 / 网站迁移完全指南 (含 HTTP 状态码全表 + 503 临时停业 playbook) 国际化 (hreflang/多语言/多地区) + 显式内容 (SafeSearch/Adult) 完全指南)
怎么控制 Google 不看到某些内容 login wall / robots.txt / noindex meta(三种机制各有适用场景,详见 抓取与索引控制完全指南 (robots.txt / noindex / X-Robots-Tag / data-nosnippet / rel))
怎么启用 rich result 加结构化数据(详见 Structured Data 完全总览 (框架 + 34 个 rich result type 一键查 + JSON-LD/Microdata/RDFa 选型))

最反直觉点: Google 可能看不到你以为它看得到的。最常见原因是:

  • JS 渲染的内容 Googlebot 不支持(老式 framework / 异步加载)
  • 资源(CSS/JS/图片)被 robots.txt block 了 → 渲染失败 → Google 以为页面是空白的
  • CSS content: property 插的文字不在 DOM 里 → 不被 index

每次怀疑都跑一遍 URL Inspection Tool → Live URL 看 Google 的实际视角。


5. Helpful content & E-E-A-T 自检

Google 排名系统奖励 helpful, reliable, people-first content。"helpful content" 是个抽象概念,Google 给了4 类自检问题 + 1 个Who/How/Why 框架:

内容质量自检(11 问)

  • 提供了原创信息 / 报道 / 研究 / 分析吗?
  • 提供了对话题完整、全面的描述吗?
  • 提供了超越显而易见的洞察分析吗?
  • 引用其它来源时,有没有避免直接抄/改写,加了实质性原创价值?
  • 标题准确描述内容、没夸张没标题党吗?
  • 你会想 bookmark / 分享 / 推荐这页吗?
  • 你会期待在印刷杂志/百科/书里看到这内容吗?
  • 跟搜索结果里其它页相比,提供了实质性额外价值吗?
  • 有拼写错误 / 风格问题吗?
  • 看着粗制滥造、急就章吗?
  • 是不是被大批量生产/外包给大量创作者(单页 vs 站没获得足够注意/打磨)?

专业性自检(4 问)

  • 内容呈现方式让人想信任吗(清晰来源 / 专业证据 / author 背景 / About 页)?
  • 别人调研你站,会觉得这是领域被广泛认可的权威吗?
  • 内容是有该领域专家或资深爱好者写/审过吗?
  • 有容易被验证的事实错误吗?

People-first(5 问)— 答 yes 表示对路

  • 有现成或目标受众,他们直接来你站会觉得有用吗?
  • 内容清晰展现第一手专业 / 深度知识(用过产品、去过地方)吗?
  • 站有清晰主要目的或聚焦吗?
  • 用户读完会觉得学到足够了、目标达成吗?
  • 用户读完会觉得满意吗?

Search-engine-first 警告(13 问)— 答 yes 表示走错方向

  • 内容主要是为了吸引搜索引擎访问吗?
  • 横跨多话题大量产出,指望其中某些会排得好?
  • 用大量自动化产出多话题内容?
  • 主要是总结别人怎么说,没加多少价值?
  • 写的是蹭热点而不是给现有受众?
  • 读者读完还要再搜一次找更好信息?
  • 写到特定 word count 因为"Google 喜欢 X 字"?(Google 没有理想 word count)
  • 进完全没专业知识的 niche只是因为流量?
  • 保证一个其实无答案的问题(比如某产品没确认的发布日期)?
  • 没实质改内容只改日期假装 fresh?
  • 大量加新内容 / 删旧内容,只是为了让站"显得 fresh"?(没用)

E-E-A-T 框架(Experience / Expertise / Authoritativeness / Trustworthiness)

  • 不是直接 ranking factor — Google 用很多信号去识别像有强 E-E-A-T的内容
  • Trust 最重要,其它三个是支柱
  • YMYL(Your Money or Your Life)话题(健康/金融/安全/福祉)对 E-E-A-T 更敏感,Google 加权更重
  • Quality raters 用 search quality rater guidelines 给反馈,rater 反馈不直接进算法,但帮 Google 验证算法效果

Who / How / Why 框架(最实用的自检)

维度 问什么 操作
Who 谁创作 访客一眼能看出 author 吗?有 byline 吗?byline 链到 author 介绍吗? 加准确的署名 + author bio + About 页
How 怎么做的 产品评测里:测了几个?测试结果?测试方法?有照片证据吗?自动化/AI 生成有透明披露吗? 在"How was this made?"合理被问的内容里加披露
Why 为什么写 最重要。是为了帮人 vs 为了骗搜索流量? "primarily to help people" 才对路。AI 大量生成骗排名 = 违反 scaled content abuse

6. 生成式 AI(AI Overviews + AI Mode)对 SEO 的影响

TL;DR: AI Overviews / AI Mode 等生成式 AI 功能仍基于 Google 的核心 Search ranking + quality systems。SEO 还是 SEO,不存在"AEO/GEO" 另外一套。

Google 用 2 个 AI 技术做生成式 search:

技术 做什么
RAG (Retrieval-Augmented Generation) = grounding 用核心 Search ranking 拉相关页面,review specific 信息生成回答,展示可点击链接
Query fan-out 模型生成一组相关 concurrent query,补充信息。比如"how to fix lawn full of weeds" 会展开 "best herbicides for lawns" / "remove weeds without chemicals" / "how to prevent weeds"

5 条对生成式 AI 仍有效的 SEO 最佳实践

  1. 创造 unique, valuable, non-commodity 内容

    • 提供 unique POV(第一手 review vs 总结他人 → 前者价值高)
    • non-commodity:对比 "7 Tips for First-Time Homebuyers"(commodity,谁都能写)vs "Why We Waived the Inspection & Saved Money: A Look Inside the Sewer Line"(non-commodity,独特经验/专家视角)
    • 结构良好(段落、headings),给人读不是给 AI 读
    • 加高质量 image + video(详见 富功能 / Discover / Images / Video / Page Experience / Web Stories / SXG / Paywall 完全指南)
    • 不要为每种可能 query 变体生成单独内容(违反 scaled content abuse)
    • 用 AI 辅助生成时,确保符合 Search Essentials + spam policy
  2. 维持清晰技术架构

  3. 优化本地 / 电商详情 — Merchant Center / Business Profile 信息齐(详见 Ecommerce SEO 完全指南 (6 Surface / 4 Launch 策略 / Merchant Center / 6 SD 类型 / Pagination 3 模式 / Review 13 准则))

Mythbusting: AI 时代你不需要做的事

Myth 实际
llms.txt 文件 / "AI 专用" markup 不需要。Google 没有特殊处理这类文件
"Chunking"(把内容切成小块给 AI 理解) 不需要。Google 能理解多话题页面
"为 AI 重写" 不需要。AI 懂同义词,你不必塞所有 long-tail 变体
追求"inauthentic mentions"(假提及) 没用。AI 依赖 high-quality 内容 + spam 检测系统两者
过度堆 structured data 给 AI 不必。SD 帮 rich result,但对生成式 AI 不是必需
AEO / GEO 这是营销话术。Google 视角下就是 SEO

Agentic experience(前瞻)


7. Spam policies 完整清单

违反任一条 → 降权 / 完全移出 search 结果 / manual action。

类别 简述 关键例子
Cloaking 伪装 给用户和搜索引擎呈现不同内容 给搜索引擎看旅游页,给用户看处方药
Doorway abuse 诱导页 创建针对特定 query 的中间页,把用户引到最终目的 多个 URL 微变种 / 多域名指向同一页
Expired domain abuse 过期域滥用 买过期域名,挂跟原域无关的内容借权重 政府机构旧域挂联盟营销 / 慈善医疗旧域卖商业医药
Hacked content 被黑内容 站被黑后被注入的恶意/垃圾内容 code injection / page injection / content injection / hidden redirect
Hidden text & link 隐藏文本/链接 仅为骗搜索引擎、不让人看到的内容 白底白字 / 图片背后的文字 / CSS off-screen / font-size 0 / opacity 0
Keyword stuffing 关键词堆砌 不自然地塞关键词 电话号码列表 / 城市地区罗列 / 同一短语反复
Link spam 链接垃圾 主要为操纵排名的链接行为 买卖链接 / 大量互链 / 自动化外链 / 给商品/服务换链接 / 优化锚文本的广告软文 / 论坛 signature 加优化锚文本
Machine-generated traffic 自动化流量 自动 query 抓 Google 结果 rank-checking scraping 工具
Malicious practices 恶意行为 malware / unwanted software / back-button hijacking 偷偷装家页改 / 泄露隐私 / 阻止后退
Misleading functionality 误导功能 假装提供服务实际不提供 假 app store credit 生成器 / 假 PDF 合并工具引到广告
<a id="scaled-content-abuse"></a>Scaled content abuse 规模化内容滥用 大量产出无价值页骗排名 AI 大量生成无价值页 / 抓 feed + 同义词替换 / 拼接他人内容 / 多站隐藏规模本质
Scraping 抓取转载 抓他站内容挂出去骗排名 转载不加价值 / 抄+同义词替换 / 媒体内容编译站
Site reputation abuse 站点声誉滥用 借宿主站已有权重发第三方内容(原本排不上) 教育站发付费贷款 review / 医疗站发"最佳赌场"广告 / 新闻站挂白标 coupon
Sneaky redirects 偷偷跳转 给搜索引擎和用户跳到不同内容 桌面正常 / 移动跳到垃圾域
Thin affiliation 薄联盟营销 复制商家描述/评论的联盟页,无原创 模板站 cookie-cutter 联盟内容
User-generated spam UGC 垃圾 用户产生的垃圾内容 论坛 spam / 博客评论 spam / 文件托管站垃圾上传
Legal removals 大量有效版权 takedown → 整站 demote 大量 DMCA 投诉
Personal info removals 大量个人信息 takedown(有 exploitative practice) → demote 信息曝光站
Policy circumvention 用子域 / 子目录 / 新站继续违规 → 加重惩罚
Scam & fraud 冒充官方 / 假联系信息 / 骗钱 冒充客服 / 假商家信息

例外:不算 site reputation abuse 的(避免误伤):

  • 通讯社 / press release service
  • 媒体之间内容 syndication
  • 论坛 / 评论区(UGC by design)
  • 专栏 / 观点 / 编辑稿
  • Advertorial / native advertising(目的是直接分享给读者)
  • Affiliate link(链接合规处理)
  • 第三方广告位
  • 直接从商家拉的 coupon

8. 网站日常维护清单(get-started 浓缩)

当你网站已在 Google 索引、想持续优化时:

控制 Google 怎么 crawl/index

子任务 怎么做 详见
理解 crawl/index/serve 全流程 读 §1 —
Duplicate content 设 canonical Canonical / 重定向 / 网站迁移完全指南 (含 HTTP 状态码全表 + 503 临时停业 playbook)
资源(image/CSS/JS)可访问 不被 robots.txt block + 匿名可访问 抓取与索引控制完全指南 (robots.txt / noindex / X-Robots-Tag / data-nosnippet / rel)
robots.txt block 重复内容 / 不重要资源(icon/logo);别用来 noindex 抓取与索引控制完全指南 (robots.txt / noindex / X-Robots-Tag / data-nosnippet / rel)
Sitemap 告诉 Google 哪些页重要 + 更新频率 + 非文本内容(image/video) Sitemap 完全指南 (XML / RSS / Text + image / video / news / hreflang 扩展 + sitemap index)
国际化 / 多语言 hreflang 国际化 (hreflang/多语言/多地区) + 显式内容 (SafeSearch/Adult) 完全指南
单 URL 迁移 301 permanent / 302 temporary Canonical / 重定向 / 网站迁移完全指南 (含 HTTP 状态码全表 + 503 临时停业 playbook)
整站迁移 301 + sitemap + Search Console 通知 Canonical / 重定向 / 网站迁移完全指南 (含 HTTP 状态码全表 + 503 临时停业 playbook)
404 处理 真返 404,不要 soft 404 Googlebot 抓取机制与索引控制完全指南 (URL/Links/Mobile-first/Meta/Testing/AMP)

链接 + crawl budget

帮 Google 理解内容

内容专用准则

Page experience(用户体验是 ranking factor)

控制搜索结果展示

详见 搜索结果视觉元素全景 (Visual Gallery / Title / Snippet / Favicon / Sitelinks / Featured / AI / Translated / Preferred):

  • title link / snippet 怎么写
  • favicon
  • publication date
  • 限制 snippet 长度或完全关闭

9. SEO 几个常见 myth(seo-starter-guide 末尾整理)

Myth 真相
Meta keywords tag 有用 Google 不用
关键词重复有用 不仅没用,过度还违反 spam policy
域名 / URL path 里塞关键词 排名上几乎无影响,只是 breadcrumb 显示
TLD(.com vs .org vs .asia)影响排名 只在 country-targeting 时是弱信号,其它不影响
内容长度有 magic number 没有理想长度,自然写就行,但变化用词能命中更多搜索
Subdomain vs subdirectory 哪个 SEO 好 商业决策,Google 不偏好
重复内容会被 penalty 不会(不算 violation),只是浪费 crawl 资源
Heading 顺序 / 数量影响排名 不影响排名(但对屏幕阅读器友好)
E-E-A-T 是 ranking factor 不是,是一组帮 Google 识别高质量内容的 conceptual framework

10. 推广 + 不要过度

最有效持久的方式是口碑 — 现有用户告诉朋友。需要前期投入社区参与积累。

其它合法推广:

  • 社交媒体
  • 社区参与
  • 线上/线下广告
  • 名片 / 信纸 / 海报印 URL
  • 给受众发 newsletter(已征得同意)

过度推广反受其害 — 用户疲劳 + 被搜索引擎认为操纵搜索结果。


11. 下一步 + 资源

官方学习路径(英文):

本 wiki 邻居(GSC docs 完整树):

Wiki 内容
Structured Data 完全总览 (框架 + 34 个 rich result type 一键查 + JSON-LD/Microdata/RDFa 选型) 33 种结构化数据全景(Product/Article/Recipe/Job/Movie 等)
搜索结果视觉元素全景 (Visual Gallery / Title / Snippet / Favicon / Sitelinks / Featured / AI / Translated / Preferred) snippet / sitelinks / title-link / featured / favicon 等 SERP 元素
富功能 / Discover / Images / Video / Page Experience / Web Stories / SXG / Paywall 完全指南 Discover / Images / Web Stories / video / Page Experience / Core Web Vitals
Google 排名系统 + Core/Spam Updates + 业务信息建立 core updates / spam updates / ranking systems guide
抓取与索引控制完全指南 (robots.txt / noindex / X-Robots-Tag / data-nosnippet / rel) robots.txt / robots meta / block-indexing / prevent-images / nofollow
Sitemap 完全指南 (XML / RSS / Text + image / video / news / hreflang 扩展 + sitemap index) sitemap 全套(build/image/video/news/large)
JavaScript SEO 全套(基础 + 诊断 + Dynamic Rendering + Lazy Loading) JS SEO basics / dynamic rendering / lazy loading / fix-search-js
Canonical / 重定向 / 网站迁移完全指南 (含 HTTP 状态码全表 + 503 临时停业 playbook) canonicalization / 301 / site move / URL structure
Googlebot 抓取机制与索引控制完全指南 (URL/Links/Mobile-first/Meta/Testing/AMP) Googlebot / HTTP errors / AMP / mobile-first / file types
Search Console + Analytics + Trends 三件套用法 (流量诊断 / 关键词调研 / Looker Studio) Search Console + GA + 流量下降诊断
安全 / Spam / Removal / 搜索运算符 完全指南 (malware + phishing + UGC + redacted + site:) security(malware/social engineering)+ search operators + prevent abuse
Ecommerce SEO 完全指南 (6 Surface / 4 Launch 策略 / Merchant Center / 6 SD 类型 / Pagination 3 模式 / Review 13 准则) 电商 SEO 全套 8 篇
国际化 (hreflang/多语言/多地区) + 显式内容 (SafeSearch/Adult) 完全指南 多语言 / 多区域 / 成人内容指南

外部世界:

  • 本机原档(raw HTML)在 ~/kb/sources/reference/google-search-central/<原路径>.raw.html.gz(gitignored,本地保留)
  • 周更增量由 gsc-crawler 每周一 03:00 launchd 触发,新增/变更页自动 mirror 到 ~/kb/inbox/gsc__*.md

2026-09 增补:如何判断第三方 SEO / GEO 工具的说法

2026-06-05 官方指导把传统 SEO、AEO(答案引擎优化)和 GEO(生成式引擎优化)的第三方建议放在同一套证据审查下。重点不是名称,而是建议是否说明了依据与适用条件。

  1. 先分清对方是在引用官方规则,还是分享自己的经验判断。经验可以有价值,但应明确标为基于数据或实践的观点,不能包装成“Google 说”。
  2. 将具体措施与官方搜索及生成式 AI 指导对照,再决定是否采用。生成 sitemap、设置索引指令、生成内容和预测排名是不同任务,不要用一个工具评分替代全部判断。
  3. 第三方工具无法访问 Google 内部排名数据。它提供的预测是自己的估计,不是 Google 内部信号,也无法保证排名效果。
  4. Google 不替第三方服务作评估;“Google 批准/认可”的暗示不能作为采购或实施依据。即使用了工具,也要在 Search Console 看第一方实际数据。

实操记录应同时留下建议、来源类型、预期变化与验证口径。这样即使实验无效,也能区分错误规则、实施问题与工具预测落空;不会把工具使用本身当成优化成功。

来源与关联资料