带nofollow属性的链接,仍然可能被抓取,也可能不被抓取;但它的主要作用是告诉搜索引擎不要把这根链接当作对目标页的投票。它不直接决定目标页是否被索引,也不直接决定目标页的排名。把这三个环节分开看,很多误解就会消失。
抓取是搜索引擎发现并读取URL内容的过程;索引是搜索引擎把读取到的内容分析、存储并决定是否纳入可检索库的过程;排名是用户搜索某个词时,搜索引擎从已索引内容中挑选并排序的过程。三者是先后依赖关系,不是同一件事。
一根链接上的nofollow,影响的是这根链接关系的传递方式,而不是目标页本身的抓取、索引和排名开关。目标页能不能被抓取,还取决于它是否被其他入口发现、是否被robots规则允许、服务器是否正常响应;能不能被索引,还取决于页面内容质量、重复度、是否有noindex等;能不能排名,还取决于查询意图、内容相关性和整体质量信号。
这个说法不准确。nofollow最早被用来处理不可信链接和付费链接,核心语义是“不要追踪这根链接,或不要传递权重信号”。但不同搜索引擎对nofollow的具体处理并不完全一致,有的会把它当作提示,有的可能仍会抓取目标URL,只是不把它当作排名投票。
所以,看到目标页被收录,不能反推nofollow无效;看到目标页没排名,也不能直接归因于nofollow。正确做法是把现象拆开:先确认目标URL是否被抓取,再确认是否被索引,最后才看某个查询下是否有排名。
假设你在自己网站的某个页面放了一根带nofollow的外链,想判断它是否影响了目标页。可以按下面顺序检查:
<a href="https://example.com" rel="nofollow">示例</a>。如果rel值拼写错误,属性不会生效。判断结果时要注意条件:如果目标页没有被索引,优先排查页面自身和站点规则,而不是先怀疑nofollow;如果目标页已被索引但没有排名,说明索引不是瓶颈,应继续看内容与查询匹配度。
nofollow适合用在你不愿为其背书、或属于付费/赞助性质的链接上。它不适合用来阻止搜索引擎抓取整个页面,也不适合用来控制目标页是否被索引。若你想阻止某根链接被追踪,应使用nofollow或更细的rel值;若你想阻止整个页面被索引,应使用页面级的noindex;若你想阻止整个站点或目录被抓取,应使用robots.txt。这三个工具的作用范围不同,不能互相替代。
下一步,挑一个你怀疑受nofollow影响的页面,先查它是否已被索引。若已索引,就不要再把nofollow当成收录问题的原因,转而检查该页面在目标查询下的内容相关性和竞争情况。