知识库首页 seo-llm 资料 _index.md

index

本地来源:seo-llm/SEO实战密码-markdown/第04章 网站结构优化/搜索引擎友好的网站设计/_index.md

搜索引擎友好的网站设计

如果我们从搜索引擎蜘蛛的角度去看待一个网站,其在抓取、索引和排名时会遇到

哪些问题呢?解决了下列问题的网站设计就是搜索引擎友好(search engine friendly)的。

  • 搜索引擎蜘蛛能不能找到网页

要让搜索引擎发现网站首页,就必须有外部链接连到首页,找到首页后,蜘蛛就能沿着内部链接找到更深的内容页,所以要求网站要有良好的结构,符合逻辑,并且所有页面可以通过可爬行的普通 HTML 链接到达。JavaScript 搜索引擎不一定会去执行,里面的链接就不能被跟踪爬行,就会造成收录问题。

网站所有页面与首页点击距离不能太远,最好控制在四五次点击之内。要想被搜索引擎收录,页面需要有最基本的权重,良好的网站链接结构可以适当传递权重,使尽量多的页面达到收录门槛。

  • 找到网页后能不能抓取页面内容

被发现的 URL 必须是可以被抓取的。带有过多参数的 URL、Session ID、整个页面是 Flash、框架结构(Frame)、可疑的转向、大量复制内容等都可能使搜索引擎对其敬而远之。

某些文件站长可能不希望它们被收录,除了不链接到这些文件,更保险的方法是使用robots 文件或meta robots 标签禁止抓取或索引,这两者在使用和效果上又有细微差异。

  • 抓取页面后怎样提炼有用信息

关键词在页面重要位置的合理分布、重要标签的撰写、HTML 代码精简、起码的兼容性等,可以帮助搜索引擎理解页面内容,提取有用信息。这部分内容在第 5 章再深入讨论。

只有搜索引擎能顺利找到所有页面,抓取这些页面并提取出其中真正有相关性的内容,网站才可以被视为是搜索引擎友好的。关于网站结构的优化,有一句话非常精辟: “良好引用,良好结构,良好导航”。网上转载这句话的人很多,据我所知,其最早应出自车东的博客。

搜索引擎不友好的网站比比皆是,尤其是一些中小企业网站。不过这样的网站不太好举例,没得到网站方的许可就将其当作负面案例讨论并不恰当。在写本书第一版时,我刚好看到一个会员询问为何搜索引擎不收录他们的内页。我点击看了一下,不由得感叹,这个网站简直是集搜索引擎不友好之大成,是个相当不错的反面教材。在得到网站所有者的正式许可后,我将其作为例子在书里做了简单介绍。

不过,现在已经数年过去了,案例网站也已经改版(虽然依然搜索引擎不友好),继续放在本书正文不大适合,所以我把案例做成 pdf 文件,感兴趣的读者可以在补充资源页面查看详情。

本文档为站内渲染。原始文件本地路径:saas/source/seo-llm/SEO实战密码-markdown-第04章-网站结构优化-搜索引擎友好的网站设计-_index-cf6bcf.md(仅本地保留,不入库不部署)