Nofollow

nofollow是HTML中可用于a、area及form元素的rel属性值,用于表示网页作者或发布者并不认可相关链接,或该链接主要源于商业关系。它为已有的超链接添加关系标记,本身不会创建链接,也不会阻止用户访问目标页面。

来源
在2005年,Googlewebspan团队的领导和Jason Shellen在Blogger.com引入了这个特定属性nofollow。

nofollow原本是用来控制博客上的垃圾评论,使用博客的人都已经意识到垃圾评论的严重。就像对社区的其他垃圾形式,评论垃圾spam影响到整个博客網誌社区,所以在2005年,Googlewebspan团队的领导和Jason Shellen设计了这个属性nofollow来解决这个问题。

nofollow的定义是在2005-2007年由作者声明版权的,受免版税的专利政策,W3C的专利政策20040205以及 IETF RFC 3667 、 RFC 3668 。作者打算将此规范提交给具有自由版权/许可政策的标准机构,例如GMPG,IETF和/或W3C。
简介
Google最初于2005年采用nofollow,主要用于抑制博客评论中的垃圾链接。当时,带有该值的链接通常不会被作为网页排名信号。2019年,Google宣布改变处理方式,将nofollow以及新引入的sponsored、ugc均视为是否考虑或排除链接的“提示”,而非绝对指令;该变化自2020年3月起也适用于抓取和索引环节。因此,不同搜索引擎仍可能以不同方式解释该属性。

与其他rel值的关系
rel属性可以同时包含多个以空格分隔的值。Google建议使用sponsored标记广告、赞助或其他有偿链接,并以ugc标记评论、论坛帖子等用户生成内容中的链接;若其他值均不适用,而发布者又不希望表达对目标页面的认可,则可使用nofollow。付费链接继续使用nofollow仍可接受,但Google更建议采用sponsored。这些标记只描述链接关系,目标页面仍可能通过网站地图或其他页面被发现;若要阻止页面进入Google索引,应使用noindex规则。

举例
discount drugs

不能做什么
nofollow不能阻止用户访问链接,也不能保证目标页面不被搜索引擎收录。robots.txt主要用于限制爬虫抓取;如需阻止页面被Google编入索引,应允许爬虫读取页面,并使用noindex规则。

搜索引擎的解释
nofollow 与普通链接的差异
“dofollow”并不是HTML标准定义的rel属性值,而是搜索引擎优化领域对未标注nofollow等关系值的普通链接的非正式称呼。nofollow不会阻止用户点击链接,也不保证搜索引擎不抓取目标页面;对Google而言,它是排名与抓取时参考的提示,普通链接则没有这一关系标记。

參見

  • PageRank
  • noindex
  • robots.txt
  • 搜索引擎优化
  • 网络爬虫

外部链接

參考資料

评论 (0)

  • 还没有评论,来抢沙发吧。