目前百度spider抓取新链接的途径有两个,一是主动出击发现抓取,二就是从搜索资源平台的链接提交工具中获取数据,其中通过主动推送功能“收”上来的数据最受百度spider的欢迎。
对于站长来说,如果链接很长时间不被收录,建议尝试使用主动推送功能,尤其是新网站,主动推送首页数据,有利于内页数据的抓取。
那么同学们要问了,为什么提交数据之后一直在线上看不到展现呢?其中涉及的因素包括很多方面,在spider抓取这个环节,影响线上展现的因素有:
1
网站封禁
如果一边封禁着百度蜘蛛,一边向百度提交数据,那么链接是无法成功收录和展现的。所以建议开发者及时解除封禁百度蜘蛛。
如何解除封禁百度蜘蛛可扫码查看《开发者如何解除封禁百度蜘蛛》:
2
质量筛选
百度spider进入3.0后,对低质内容的识别更加严格,尤其是时效性内容,从抓取这个环节开始进行质量评估筛选,过滤掉大量过度优化等页面,低质网页相比之前明显下降。
如何提升网站页面质量可扫码查看《百度APP移动搜搜落地页体验白皮书5.0》 :
3
抓取失败
抓取失败的原因很多,比如在办公室访问没有问题,百度spider却无法正常抓取访问。所以站点要随时注意在不同时间地点保证网站的稳定性。
4
网站安全
如果站点页面数量突然爆发式增长,会影响到优质链接的抓取收录。所以站点在保证访问稳定外,也要关注网站安全,防止被黑注入。
作者:百度搜索资源平台
来源:百度搜索资源平台