网页收录问题
1.如何让我的网站(独立网站或者blog)被百度收录?
百度会收录符合用户搜索体验的网站和网页。为促使百度Spider更快发现你的站点,你也可以向Baidu提交一下你的网站的入口网址。只需提交首页即可,无需提交详细的内容页面。百度的网页收录机制,只和网页价值有关,与jingjia排名等商业因素没有任何关联 http://www.yixiin.com/news/
2.如何让我的网页不被百度收录?
百度严格遵循搜索引擎Robots协议。你可以写一个Robots文件以限制你的网站全部网页或者部分目录下网页不被百度收录。如果你的网站是在被百度收录之后再设置Robots文件,则Robots文件通常在两周内生效,被文件限制的内容,将从百度搜索结果中移除。如果你的拒绝被收录需求非常急迫,也可以发邮件请求处理。
3.为什么我的网站内一些不设链接的私密性网页,甚至是需要访问权限的网页,也会被百度收录?
百度Spider对网页的抓取,是通过网页与网页之间的链接实现的。网页之间的链接类型,除了站点内部的页面链接之外,还有不同网站之间的互相链接。因此,某些网页即便通过你的网站内部链接无法访问到,但是,如果别人的网站上有指向这些页面的链接,那么这些页面还是会被搜索引擎所收录。百度Spider的访问权限,和普通用户是一样的。因此,普通用户没有权限访问的内容,Spider也没有权限访问。之所以看上去某些访问权限限制内容被百度收录,原因有两点:该内容在Spider访问时是没有权限限制的,但抓取之后,内容的权限发生了变化;该内容有权限限制,但是由于网站安全漏洞问题,导致用户可以通过某些特殊路径直接访问。而一旦这样的路径被公布在互联网上,则Spider就会循着这条路径抓出受限内容。如果你不希望这些私密性内容被百度收录,一方面可以通过Robots协议加以限制;另一方面,也可以联系百度进行解决。
4.我的网页为什么会从百度搜索结果中消失?
百度并不允诺所有网页都可从百度搜索到。如果你的网页长时间无法从百度搜索到,或者突然从百度的搜索结果中消失,可能的原因有:你的网站所在服务器不稳定,被百度暂时性去除。稳定之后,问题会得到解决;你的网页内容有不符合国家法律和法规规定的地方;你的网页不符合用户的搜索体验;其他技术性问题。以下的说法是错误的和毫无根据的:参与了百度jingjia排名但未续费,会从百度搜索结果中消失;参与了其他搜索引擎的广告项目,会从百度搜索结果中消失;与百度旗下网站产生了竞争,会从百度搜索结果中消失;从百度获得的流量太大,会从百度搜索结果中消失。
5.什么样的网页会被百度认为是没有价值而不被百度收录或者从现有搜索结果中消失?http://www.yixiin.com/quote/
百度只收录百度认为有价值的网页。任何网页在搜索结果中的去留变化,都是机器算法计算和调整的结果。