文章为什么被反复收录? 文章被百度反复收录的缘由及处理办法

问题现象:

点击进入链接,除了原网页,分别出现:

http://www.stcash.com/5273/comment-page-1

http://www.stcash.com/5273?replytocom=1989

前面一篇文章居然出现一个三级目录,后面一篇文章又类似于动态网页网址。我文章中是没有这两个链接地址的,查看网页源码,看出了一点端倪。

原因分析:

我发现了这两个?replytocom=1989网址的来源:文章评论链接

四个评论刚好对应四个replytocom,百度蜘蛛可能有一定的智能,四个replytocom网址中只收录了一个,但是又不够智能,没有区分出来评论链接和原文链接对应的文章内容是相同的。

comment-page-1网址同样是来源于评论链接,comment-page-1代表着评论页面的**页。如果我的评论比较多,比如说有1000条评论,那么一页肯定是显示不下去的,就会出现comment-page-2,comment-page-3......这就是评论分页功能,这个功能本质上是防止评论过多时,网页会被拉的很长,导致网页加载速度慢和用户体验差。但是不巧的是,百度蜘蛛依然不能识别出来这和原文

解决方法:

1、对于comment-page-1重复收录,有两种方式解决

1)在wordpress后台关闭评论分页

2)修改robots.txt,加上一句项目的代码

Disallow: /comment-page-

robots.txt在网站根目录,使用 网址/robots.tx就可以看到设置的结果了。如果根目录下没有这个文件

wp-includes/funtion中有这么一段代码:

  1. $output = "User-agent: *\n";
  2. $public = get_option( 'blog_public' );
  3. if ( '0' == $public ) {
  4.     $output .= "Disallow: /\n";
  5. else {
  6.     $site_url = parse_url( site_url() );
  7.     $path = ( !emptyempty$site_url['path'] ) ) ? $site_url['path'] : '';
  8.     $output .= "Disallow: $path/wp-admin/\n";
  9. }

$output .= "Disallow: $path/wp-admin/\n";  后面增加一句$output .= "Disallow: $path/comment-page-\n";

2、对于replytocom重复收录,设置robots.txt文件

Disallow:/*?replytocom=

或者是加上对于包含replytocom的所有链接都加上nofollow链接

  1. add_filter('comment_reply_link', 'add_nofollow', 420, 4);
  2. function add_nofollow($link$args$comment$post){
  3.   return str_replace("href=""rel='nofollow' href="$link);
  4. }

以上就是对文章被百度重复收录的原因及解决方法全部内容的介绍,更多内容请继续关注安达网络工作室

以上就是安达网络工作室对于《文章为什么被反复收录? 文章被百度反复收录的缘由及处理办法》的一些看法。更多内容请查看本栏目更多内容!

本文相关话题: 文章 百度 重复收录 百度收录
版权声明:本文为 安达网络工作室 转载文章,如有侵权请联系我们及时删除。
相关文章
在过来的十年 百度地图是如何一步步干掉了强悍的对手?

百度地图十年的成就,就是从无到有成长为稳居市场 的地图应用。那么在过去的十年 百度地图是如何一步步干掉...

要害词排名为什么下滑?网站要害词排名下滑排查办法

网站优化往往会出现关键词排名下降的现象,这是怎么回事呢?这种情况该怎么排查关键词排名下滑的原因呢?本...

操作一条外链需求多久?一条外链是如何做到日IP200的引流?

操作一条外链需要多久?一条外链是如何做到日IP200的引流?很多朋友都不是很清楚,所以就为大家详细介绍一下,...

seo优化之对题目的细节解决

今天小编为大家带来了seo优化之对标题的细节处理相关内容的介绍,感兴趣的朋友们可以跟着小编去下文了解一下...

什么是用户体验 怎样评估用户体验的好坏

今天小编为大家带来了什么是用户体验 怎么评价用户体验的好坏相关内容的介绍,感兴趣的朋友们可以跟着小编去...

如何用百度排查已收录页面网址的异样?四个方面找出收录页面在百度中的谬误

页面被百度收录了成千上万,但是你知道收录的这些页面有多少是错误页面嘛?有多少页面打不开嘛?你花时间去...

需求提交

客服服务