index
本地来源:seo-llm/SEO实战密码-markdown/第12章 SEO 工具/Google Search Console/_index.md
Google Search Console
Google Search Console 也是 SEO 必备工具,不仅做英文网站需要,即使做中文网站也建议注册,因为显示数据角度不同,可以帮助发现不同的问题。
Google Search Console(经常简称 GSC)的很多功能和百度资源平台类似,下面只举例几个有用且百度资源平台没有或使用方法不同的功能。
我个人觉得最有价值的是索引报告部分,类似于百度资源平台的“索引量”,但其提供了更多索引错误细节,如图 12-57 所示,GSC 列出了已编入索引和未编入索引的页面数及样例 URL。

图 12-57 GSC 的索引报告
未编入索引的页面还会按原因细分,并列出最多 1000 个样例 URL,从中能发现人工检查网站很难看到的问题,如图 12-58 所示。

图 12-58 GSC 列出的“未编入索引”原因
常见的未被索引的原因及处理方向如下。
- 已发现,尚未编入索引:通过 Sitemap.xml 的提交,Google 已经知道 URL 的存在,但还没有抓取,所以没有索引。如果数量大的话,检查是否页面下载太慢,已达到抓取份额上限?是否页面质量太低,使 Google 觉得没必要再抓取同类型页面?提交的 URL 是否都是真的需要索引的规范化版本网址?
- 已抓取,尚未编入索引:页面已经抓取,但还没索引。有可能是 Google 还没来得及索引,需要一段时间;也有可能页面质量太低,Google 决定不索引,这才是更麻烦的。
- 重复网页,网址已提交但未被选为规范网址:虽然在 Sitemap.xml 中提交了,但 Google 判断并不是规范化网址,因此不索引。需要按照 4.10 节中介绍的,检查是否其他方面存在矛盾信号,使 Google 判断错误?
- 重复网页,Google 选择的规范网页与用户指定的不同:和上面相似,而且虽然页面 canonical 标签指定自身是规范化网址,但 Google 并未遵守,而是选择了其他网址。检查 Google 选择的网址是否比自己指定的更合适?如果不是,是否有矛盾信号?
- 重复网页,用户未选定规范网页:页面没有 canonical 标签,Google 也判断不是规范化网址。这种页面就不应该存在,所有页面都应该有 canonical 标签。
- 备用网页(有适当的规范标记):本页面有指向其他网址的canonical 标签,Google遵守了标签,因此索引了 canonical 标签指向的目标页面。如果 canonical 标签写得正确,Google 也判断正确,存在这类网址是正常的,比如有对应 PC 版的独立移动站页面。
- 未找到(404):没有在 Sitemap.xml 中提交,但 Google 还是发现了这个网址,且返回 404 错误。这类页面不应该在网站上有入口,点击样例 URL,查看“引荐来源网页”(参考图 12-60),删除 404 页面的入口链接。
- 被 noindex 标记排除了:查看样例 URL,是不是有意这样做的?还是误加了 noindex 标签?既然不想被索引,页面是否有必要出现在网站上?
- 网页会自动重定向:自动转向到其他网址,因此 Google 索引了目标网址。这种网址过多的话,建议检查网站为什么还会出现这类网址?为什么不直接使用目标网址?
- 软 404:虽然页面返回 200 代码,但 Google 判断页面没有实质内容,大量网址内容相同,Google 称之为软 404,也不索引。典型的软 404 是服务器设置错误,页面删除后依然返回 200 代码,页面上只是写着“404 not found”之类的句子。下架产品页面也经常被判断为软 404。
- 已被 robots.txt 文件屏蔽:查看样例 URL,是否屏蔽正确?是否有大量可疑的搜索 URL?(参考 9.2.14 节)如图 12-59 所示,我的博客上数十万(实际上可能更多)被黑帽建构的垃圾搜索 URL,只能用 robots 文件屏蔽,除非网站取消搜索功能。
点击样例 URL 右侧的放大镜图标,GSC 会显示这个 URL 在 Google 数据库中的详细信息,包括:Google 是怎样发现 URL 的,是通过 Sitemap 还是内部链接(引荐来源页面)发现的,上次抓取的时间,抓取使用的蜘蛛,是否成功抓取,canonical 标签指向哪里,Google 是否遵守了 canonical 标签,为什么没有索引等,如图 12-60 所示。这些信息非常有助于判断到底哪里出了问题。

图 12-59 垃圾搜索 URL 样例

图 12-60 样例 URL 的详细信息
规模不大的网站出现少量未被索引的页面是正常的,但如果遇到如图 12-61 所示的这种大规模、大比例页面不被索引的网站,就说明网站内容、结构有严重问题,需要大幅调整。没有 GSC 提供的详细信息,人工很难发现问题或评估问题的严重程度。

图 12-61 GSC 显示的未被索引网页
索引数据也可以按不同 Sitemap.xml 分类显示,这就是为什么建议不同类型页面放在不同 Sitemap 文件中,有利于诊断网站各分类的问题。
索引部分揭示的通常是网站结构导致的问题,所以即使做中文网站,也建议查看GSC,网站的结构问题无论在 Google 还是在百度都是同样存在的,和用户是否使用 Google 并 没有什么关系。
GSC 的“效果”功能相当于百度资源平台的“流量和关键词”部分,点击量、展示量、平均点击率、平均排名除了文字显示,也以曲线显示,更为直观。筛选功能也更灵活直接,如图 12-62 所示的 GSC 流量效果功能,站长可以很方便地查看或对比特定目录、页面、关键词的搜索表现。另外,点击左上角“搜索类型”选项,GSC 可以分别显示网络(其实就是页面搜索)、图片、视频、新闻搜索的表现,默认选项是网络。这个功能对某些网站也比较有用,如图 12-63 所示,筛选/product/目录下的页面,对比图片和页面流量,实线是页面搜索,虚线是图片搜索,可以看到,某些网站来自图片的流量远大于来自页面的流量。

图 12-62 GSC 流量效果功能

图 12-63 对比图片流量和页面流量
近几年SEO 们都十分关注的数据少不了Core Web Vitals,核心网页指标,如图 12-64所示,GSC 分别显示 PC 和移动设备的 CWV 表现良好、需要改进、欠佳三种页面的数量及变化趋势。这三种页面的总数通常是远小于已索引页面数的,因为 GSC 只是抽样显示部分数据。SEO 了解比例及样例 URL 就足够了,绝对数字并不重要。

图 12-64 GSC 显示的核心网页指标
图 12-65 是 GSC 显示的 CWV 不达标的原因及样例 URL,包括预计 2024 年 3 月引入的 INP 指标。
外部链接查询是 GSC 的另一个重要功能。由于 GSC 只能查询自己网站,所以无法用于竞争程度评估、发现竞争对手外部链接来源等,更多的是查看自己网站外部链接构成是否健康,如图 12-66 所示是我的博客外部链接数据,总链接数惊人,GSC 显示的前 1000 个域名里有 990 个以上是镜像、寄生虫、博彩等作弊网站。不管是无意,还是有意负面 SEO 攻击,造成的结果是我的博客有着极为不健康的外部链接构成。

图 12-65 GSC 显示的 CWV 不达标原因

图 12-66 GSC 的外部链接数据
如果担心这些垃圾外部链接对网站有伤害,可以上传拒绝外部链接列表(Disavow links),告诉 Google 这些外部链接不是自己能控制的,请求在其算法里忽略这些外部链接,如图 12-67 所示。我的博客从来没有上传这个文件,因为我想观察 Google 到底能否自动正确判断,而且在 Google 拒绝外部链接对百度也不管用,就随它去吧。

图 12-67 上传拒绝外部链接文件
上传拒绝外部链接文件的界面并不在 GSC 里,而是在一个独立的页面,网址请参考补充资源页面。
Google 之所以隐藏这个功能,是因为 Google 认为除非特别必要,不然不应该使用这个功能。
限于篇幅,GSC 的其他功能在这里就不一一介绍了,读者在使用过程中如果遇到不太明白的功能,可以到我博客留言,我尽量解答。
本文档为站内渲染。原始文件本地路径:saas/source/seo-llm/SEO实战密码-markdown-第12章-SEO-工具-Google-Search-Console-_index-492087.md(仅本地保留,不入库不部署)