IndexLaunch
← 全部指南

如何解读 Google Search Console 的索引覆盖率报告

对 Google Search Console 中每一种网址状态的通俗解读——哪些正常、哪些需要处理,以及各自应采取的修复方式。

在哪里查看

在 Search Console 中,为您的资源打开索引 → 网页。Google 会将它所知道的每一个网址分为两类:已编入索引(当前可出现在搜索结果中)和未编入索引,并进一步按原因细分。人们通常不知道该如何应对的,正是这些原因标签——其中大多数其实并不是错误。

属于正常情况、并非问题的原因

  • 被“noindex”标签排除——这是您自己告诉 Google 不要收录它。只有在您并非本意的情况下才值得检查(参见robots.txt vs noindex)。
  • 带有正确 canonical 标签的替代网页——一个重复页面正确地指向了您希望被收录的版本。这是按预期正常工作。
  • 带有重定向的网页——该网址转发到了别处,因此 Google 转而收录目标网址。对于永久重定向来说这是正常的;但如果这是一个您期望仍能直接访问的旧网址,就值得关注一下。

通常需要您做出决策的原因

  • 已发现 - 尚未编入索引——Google 知道该网址的存在,但尚未对其进行爬取。参见专门的指南
  • 已抓取 - 尚未编入索引——Google 抓取了该页面,并决定不予收录,通常是内容质量方面的信号。参见专门的指南
  • 没有用户指定 canonical 的重复内容——Google 发现了近似重复的页面,并自行选择了一个 canonical 版本,这未必是您想要的那个。可通过明确设置 canonical 标签解决——参见重复内容与 canonical 标签
  • 软 404——该页面返回了 HTTP 200,但在 Google 看来内容为空或存在问题。参见专门的指南
  • 被 robots.txt 屏蔽——值得检查该屏蔽是否是有意为之;参见robots.txt vs noindex

面对长列表时如何确定优先级

先按网址数量排序,再检查每个原因下的页面是否确实是您希望被收录的页面。“没有用户指定 canonical 的重复内容”下有一千个分页或筛选类网址,往往并不是什么问题;而“已抓取 - 尚未编入索引”下有二十个产品页面,则今天就值得排查。数量本身并不能说明紧迫程度——具体是哪些网址才能说明问题。

修复问题之后

即使您已经修复了根本原因,该报告本身也可能需要数天才能刷新某个网址的状态,因为它反映的是 Google 上一次的爬取结果,而非您当前的代码状态。对于已修复的单个网址,可使用“网址检查”工具的“请求编入索引”,或立即通过所有支持 IndexNow 的搜索引擎进行推送,而不必等待报告按自己的时间表自行更新。

希望您的下一个页面比单纯依靠自然爬取更快被发现?

IndexLaunch 会在您提交网址的那一刻,通过 IndexNow 将其直接推送给 Bing、Yandex、Seznam 和 Naver。

查看价格