KEEL · 龙骨 · A CURRICULUM FOR THE AI ERA
术语与判据速查表 — keel 龙骨
SEO 基础 的参考信息:术语与判据速查表
本页是《SEO 基础》的随身速查:把六个环节里最容易记混的概念、判据与命令集中在一处。正文解释见各章,这里只给"看到就能用"的对照。
一、六环节一句话定位
| 环节 |
一句话 |
失败的最典型信号 |
| 发现 Discovery |
搜索引擎第一次听说这个 URL |
页面完全搜不到 |
| 抓取 Crawling |
爬虫把 HTML 取回去 |
robots 报错 / 抓取量异常 |
| 渲染 Rendering |
HTML 里的正文被取出来 |
curl 源码里没有正文 |
| 索引 Indexing |
文本进了倒排索引 |
已抓取但未索引 |
| 排序 Ranking |
决定名次 |
收录了但排名很差 |
| 呈现 Serving |
决定结果卡片形态 |
排名好但没点击 |
二、抓取与索引:别记混的两组
| 你写的 |
效果 |
关键提醒 |
robots.txt 的 Disallow |
阻止抓取 |
不阻止索引,可能仍被收录 |
<meta name="robots" content="noindex"> |
阻止索引 |
必须能被抓到才能读到它 |
X-Robots-Tag: noindex |
阻止索引(非 HTML) |
响应头,比 meta 更早 |
301 |
永久,传权重 |
迁移用 |
302 |
临时,不传权重 |
别当 301 用 |
404 / 410 |
不存在 / 永久删除 |
及时从 sitemap 移除 |
503 |
暂不可用,爬虫会重试 |
维护窗口用,别用 200 |
429 |
请求过多,请退避 |
限流时正确反馈 |
三、索引状态的三种含义
| GSC 状态 |
含义 |
该查什么 |
| 已发现,尚未抓取 |
排队中 |
内链权重、抓取预算 |
| 已抓取,尚未编入索引 |
判为不值得收 |
薄内容、重复、质量 |
| 已编入索引 |
收进去了 |
改为关注排序与点击 |
| 重复网页(选择了别的规范页) |
被判重复 |
canonical 一致性 |
| 软 404 |
200 但内容像"没有" |
空模板、未登录返回 200 |
四、信号可信度对照(防止被玄学带偏)
| 说法 |
判定 |
| 外链数量与质量影响排名 |
官方确认 |
| 关键词密度有魔法值 |
行业推断且已被弱化 |
| 域名年龄是排名因素 |
官方否认 |
| 域名含关键词有加分 |
官方否认 |
| 结构化数据提升排名 |
官方否认(只影响展示) |
| HTTPS 是弱正向信号 |
官方确认 |
| 移动友好是信号 |
官方确认 |
| Core Web Vitals 影响排名 |
官方确认(页面体验组成) |
| 跳出率是直接排名因子 |
官方否认 |
五、常用自检命令
# 正文是否直出(>0 正常)
curl -s https://www.xxxxxx.cn/learning/courses/tools/lessons/1/ | grep -c '本章目标'
# robots 是否可访问(应为 200)
curl -s -o /dev/null -w "%{http_code}\n" https://www.xxxxxx.cn/robots.txt
# 未知路径应 404(防软 404)
curl -s -o /dev/null -w "%{http_code}\n" https://www.xxxxxx.cn/learning/nope/
# canonical 与 robots meta
curl -s https://www.xxxxxx.cn/learning/ | grep -oE '<link rel="canonical"[^>]*>|<meta name="robots"[^>]*>'
# 响应头里的 X-Robots-Tag
curl -sI https://www.xxxxxx.cn/learning/ | grep -i 'x-robots-tag'
# 结构化数据是否存在
curl -s https://www.xxxxxx.cn/learning/ | grep -c 'application/ld+json'
# 各爬虫抓取量(既有的日志诊断)
grep -oiE 'Googlebot|Bingbot|Baiduspider|Bytespider|GPTBot|ClaudeBot|PerplexityBot' \
/var/log/nginx/learning.access.log | sort | uniq -c | sort -rn
六、唯一可靠的收录判据
site:www.xxxxxx.cn
不要用"搜原文"判断收录——原文搜不到可能是没收录,也可能是收录了但排名靠后,两者处理方式完全不同。
七、症状 → 环节速查
| 症状 |
环节 |
| 新页面完全搜不到 |
发现 |
| 只有首页被收录 |
发现 / 渲染 |
| 某引擎计数为 0 |
发现 |
| robots.txt 报错 |
抓取 |
| 抓取量大但收录少 |
抓取 / 索引 |
curl 无正文 |
渲染 |
| 已抓取未索引 |
索引 |
| 收录了排名差 |
排序 |
| 排名好没点击 |
呈现 |
| 收录内容变成登录页 |
抓取(软 404) |
进入 keel 阅读