KEEL · 龙骨 · A CURRICULUM FOR THE AI ERA
SEO 收录与优化 — keel 龙骨
SEO 收录与优化 的参考信息:SEO 收录与优化
上一门课结束时,你的站点已经能通过 https://www.xxxxxx.cn/learning/ 安全访问。
但"能访问"和"能被搜到"是两件事——这门课处理后者。
一个真实的起点:站点上线数周,把原文整段复制到搜索引擎里也搜不到自己。
诊断的结论是技术基建齐全,但从未向任何搜索引擎提交过,且当时还没有 HTTPS。
这不是内容质量问题,而是流程缺失——搜索引擎不会凭空知道一个新站点存在。
这门课的立场很明确:SEO 的主要工作不是"优化",而是"让抓取和索引的前提条件成立"。
绝大部分"搜不到"的问题,都出在前提条件上,而不是关键词密度或文案技巧。
全课程统一使用脱敏域名 xxxxxx.cn,站点根路径 /learning/。
你会得到什么
- 一套技术地基检查方法:可抓取性、SSR 正文、robots、sitemap、canonical、URL 结构
- 三个平台的完整提交流程(Google Search Console / 百度搜索资源平台 / Bing Webmaster Tools)
- 一套基于服务器日志的诊断方法:判断爬虫到底来没来、来了抓了什么、卡在哪
- 长期优化的动作清单:内容结构、内链、性能、结构化数据,以及 AI 爬虫时代的新变量
八章的推进顺序
| 章节 | 核心问题 | 做完后你应该能验证 |
|---|---|---|
| 01 技术地基 | 爬虫能不能抓到完整内容 | 关掉 JS 也能看到正文,robots/sitemap 正常 |
| 02 元数据与结构化数据 | 页面怎么向搜索引擎自我描述 | title/description/canonical/JSON-LD 齐全且一致 |
| 03 Google Search Console | 怎么让 Google 知道你 | 站点验证通过,sitemap 状态"成功" |
| 04 百度 / Bing / AI 爬虫 | 其他入口怎么办 | 百度验证通过或明确放弃;Bing 从 GSC 导入 |
| 05 日志诊断 | 爬虫到底来没来 | 能从访问日志统计出各爬虫的抓取量与命中路径 |
| 06 内容与内链 | 收录之后怎么变好 | 页面有清晰主题、内链成网、更新有节奏 |
| 07 性能与 CWV | 速度会不会拖后腿 | LCP/INP/CLS 达标,资源体积与缓存策略合理 |
| 08 长期运维 | 怎么维持不退化 | 有月度检查项与告警,收录量可观测 |
一个前置认知
判据只有 site: 查询,不要用"搜原文"来判断收录。
原文搜不到有两种可能:没被收录,或被收录但排名靠后。这两者的处理方式完全不同。
唯一可靠的判断方式是:
site:www.xxxxxx.cn
有结果 → 已收录,剩下的是排名问题;无结果 → 未收录,回到第 01 章检查前提。
与其它板块的关系
- 前置(原理):SEO 基础。那门课讲的是搜索引擎六个环节(发现/抓取/渲染/索引/排序/呈现)的规则与准入判据。本课是它的实操面:你在这里做的每一步(预渲染、robots、canonical、提交 sitemap、日志诊断),判据都来自那边的规则。分工是——基础课给规则,本课给流程。
- 后续(深水区):SEO 拔高。当站点规模变大、改版变频繁,本课的"清单式运维"会不够用:抓取需要量化、日志要变成事实表、迁移要可回滚、性能要变成门禁。本课的日志诊断、CWV、月度清单,在那边被升级成可度量、可规模化、可回滚的工程体系。
- 前置:域名申请与 HTTPS 上线。HTTPS 不是加分项而是入场券——URL 里混着 http 会让 canonical 与 sitemap 出现两套地址,第 01 章的"三处一致"直接不成立。
- 上游:交付工程板块(CI 流水线与质量门禁、构建打包与部署上线)。第 01 章要的预渲染 HTML、第 08 章的"发版四条约束",落点都在发布流程里;每次发版如果重走一遍 checklist,收录量就不会因为一次发版掉回去。
- 求职板块若你要把"站点被搜索引擎收录"写成实绩,本课程第 05 章的日志诊断与第 08 章的趋势表就是那套可核查的数据——比"我做过 SEO"这句空话有用得多。