KEEL · 龙骨 · A CURRICULUM FOR THE AI ERA
SEO 基础:搜索引擎到底怎么工作 — keel 龙骨
SEO 基础 的参考信息:SEO 基础:搜索引擎到底怎么工作
一个网页从被写出来,到出现在搜索结果里,中间要经过六个环节:发现、抓取、渲染、索引、排序、呈现。每个环节都有自己的规则,你的页面能不能被搜到、以什么形态被搜到,取决于你是否满足了这个环节的准入条件。这门课只做一件事——把这六个环节的规则本身讲清楚。
这门课的立场很明确:SEO 里绝大多数被传成"玄学"的问题,都可以被还原成一句话——某个环节的规则没有被满足。排名掉了不是运气,是排序环节的某个信号变了;收录没了不是被针对,是索引环节的准入判据没过。学会这样定位,你就不再需要收藏一堆"SEO 技巧",而是能自己从现象反推原因。
这门课不写操作手册,它回答"为什么"而不是"点哪里"。全课程统一使用脱敏域名 xxxxxx.cn,示例服务器地址 203.0.113.10。
你会得到什么
- 一条完整的因果链:URL 从被发现到出现在 SERP,每一步谁在做决定、规则是什么
- 一张"症状 → 环节"的对照能力:看到"搜不到"能立刻判断该查哪一环
- 对关键概念的准确理解:抓取预算、canonical、两波索引、E-E-A-T、富摘要各自到底是什么
- 一组可以自己动手验证的判据(curl、robots.txt、关 JS 看正文、site: 查询),不依赖任何后台截图
- 明确区分官方确认的信号与行业推断,避免把 SEO 玄学当事实
七章的推进顺序
| 章节 | 核心问题 | 做完后你应该能验证 |
|---|---|---|
| 01 发现 | 搜索引擎怎么知道这个 URL 存在 | 能用链接图与 sitemap 解释一个新页面如何被找到 |
| 02 抓取 | 爬虫愿意花多少资源抓你的站 | 能读懂 robots.txt 与各状态码对爬虫的语义 |
| 03 渲染 | 爬虫看到的是不是你看到的 | 关掉 JS 后正文仍完整出现在 HTML 里 |
| 04 索引 | 抓到了为什么还是不显示 | 能区分「已发现未抓取/已抓取未索引/已索引」 |
| 05 排序 | 同样的内容为什么别人在前面 | 能分清官方确认信号与行业推断的边界 |
| 06 呈现 | 排名第一为什么没点击 | 能解释 SERP 形态与点击率之间的关系 |
| 07 全景复盘 | 六个环节怎么串成一条主线 | 能从任意 URL 复述它走到 SERP 的全过程 |
一个贯穿全书的自检
判据只有 site: 查询,不要用「搜原文」判断收录。
site:www.xxxxxx.cn
有结果 → 已索引,剩下的是排序与呈现问题(第 05、06 章);无结果 → 还没进索引,回到第 01–04 章查前提。这条判据会把你的注意力从"文案不好"拉回到"环节没过",这正是这门课想训练的判断力。
与其它板块的关系
- 前置:域名申请与 HTTPS 上线。HTTPS 是入场券:URL 里混着 http 会让 canonical 与 sitemap 出现两套地址,抓取环节直接开始浪费预算。
- 下游实操:SEO 收录与优化。那门课是上线后的提交流程与运维实操——技术地基检查、GSC/百度/Bing 提交、日志诊断、月度清单。它告诉你"该做哪些动作",本课告诉你"这些动作为什么有效、失效时落在哪个环节"。两门课的分工是:本课给规则,那门课给流程。
- 继续深入:SEO 拔高。当你要把 SEO 变成可度量、可规模化、可回滚的工程体系(抓取预算量化、日志事实表、结构化数据实体图谱、迁移回滚、AI 搜索新变量),在读完本课与《SEO 收录与优化》之后进入那一门。
- 上游:交付工程板块(CI 流水线与质量门禁)。第 03 章要的预渲染 HTML 是否每次发布都生效,落点在流水线里;理解规则之后,如何保证它不回退就成了工程问题。