并非搜索引擎抓取的每个页面都会进入索引。页面可能因为带有 noindex 指令、是归并到 canonical 下的重复页面、被 robots.txt 屏蔽,或者被认为内容单薄或无帮助而被排除。
一个健康的网站通常索引覆盖率在 70–80% 以上。较低的覆盖率——比如 30%——意味着尽管网站可以被抓取,但其中很大一部分对搜索者不可见。
低覆盖率的原因:
- noindex 标签应用范围过广(例如误用在模板页面上)
- 重复内容——分页页面、筛选 URL 或应规范化的会话参数变体
- 因质量问题被 Google 排除的单薄页面
- robots.txt 屏蔽了本应被索引的页面
SearchVitals 的检查内容:Crawl & Index 审计将抓取过程中发现的页面与 Search Console 索引数据进行比对,以计算覆盖率,并将较低的覆盖率标记为警告或严重发现项。