索引说明
GSC 的网页报告会把 URL 分到名为 \"Crawled - currently not indexed.\" 这样的状态类别里。下面说明每个状态的含义,以及哪些值得你花时间处理。
生命周期:discovered → crawled → indexed
- Discovered - Google 已经知道该 URL(来自站点地图、链接或 ping),但还没有下载该网页。
- Crawled - Googlebot 已经下载了该网页。
- Indexed - Google 已决定该网页值得保留在其可搜索数据库中。只有已编入索引的网页才能获得排名。
你的目标是让尽可能多的有价值 URL 一路走到“indexed”,同时尽量少为那些低价值 URL 操心。
你会看到的状态
Indexed
网页已在 Google 的索引中,可以出现在搜索结果里。这正是你要的。
Discovered - currently not indexed
Google 知道该 URL 存在,但甚至还没有抓取过。这通常说明 Google 认为你的网站不值得占用抓取预算。参见 Discovered - currently not indexed。
Crawled - currently not indexed
Google 已经抓取过,但认为不值得编入索引。这通常是质量信号——内容过薄、重复性过高,或与索引中已有网页过于相似。参见 Crawled - currently not indexed。
Page with redirect
URL 会重定向到另一个网页。通常没问题,但请确认目标页已被编入索引。参见 Page with redirect。
Soft 404
网页返回 200 OK 状态,但在 Google 看来是错误页或空页。修复方法是删除该页(真正的 404),或为其提供实质内容。参见 Soft 404 说明。
Duplicate - Google chose a different canonical
你告诉 Google URL A 是规范网址,但 Google 不同意,并改将 URL B 编入索引。参见 GSC 中的规范 URL。
Excluded by noindex tag
网页声明“不要索引我”。如果这是有意为之(管理页、感谢页),没问题。如果 noindex 标记出现在你实际上希望被编入索引的网页上,那就是问题所在。
哪些才重要?
按“值得排查”的优先级:
- 本应被编入索引的网页出现 "Excluded by noindex tag"——立即修复。
- 赚钱页面出现 "Crawled - currently not indexed"——通常是内容质量信号。
- "Discovered - currently not indexed" 大规模出现——抓取预算问题,通常通过加强内部链接并清理低价值网页来解决。
- 你在意的网页出现 Soft 404s——重写内容,或改成正确的 404。
拿不准时,用 URL 检查工具 针对具体 URL 查看 Google 的具体判断。
编入索引需要多久?
高权重网站的新内容可能在数小时内被编入索引,全新域名则可能需要数周。如果网页已上线 30+ 天仍未被编入索引,请在 URL Inspection 中使用 请求编入索引。完整背景见 Google 将网页编入索引需要多久?
不用打开后台也能监控
索引状态会悄然变化,所以往往发现得很晚。被跟踪的 URL 在掉出索引或停止被抓取时可以发出告警,并送达 Slack 或 Microsoft Teams。