&">nbsp; 搜索引擎(search engine)是指根据一定的策略、运用特定的计算机程序搜集互联网上的信息,在对信息进行组织和处理后,为用户提供检索服务的系统。
从使用者的角度看,搜索引擎提供一个包含搜索框的页面,在搜索框输入词语,通过浏览器提交给搜索引擎后,搜索引擎就会返回跟用户输入的内容相关的信息列表。
在搜索引擎分类部分我们提到过全文搜索引擎从网站提取信息建立网页数据库的概念。搜索引擎的自动信息搜集功能分两种。一种是定期搜索,即每隔一段时间(比如Google一般是28天),搜索引擎主动派出“蜘蛛”程序,对一定IP地址范围内的互联网站进行检索,一旦发现新的网站,它会自动提取网站的信息和网址加入自己的数据库。
另一种是提交网站搜索,即网站拥有者主动向搜索引擎提交网址,它在一定时间内(2天到数月不等)定向向你的网站派出“蜘蛛”程序,扫描你的网站并将有关信息存入数据库,以备用户查询。由于近年来搜索引擎索引规则发生了很大变化,主动提交网址并不保证你的网站能进入搜索引擎数据库,因此目前最好的办法是多获得一些外部链接,让搜索引擎有更多机会找到你并自动将你的网站收录。
当用户以关键词查找信息时,搜索引擎会在数据库中进行搜寻,如果找到与用户要求内容相符的网站,便采用特殊的算法——通常根据网页中关键词的匹配程度,出现的位置/频次,链接质量等——计算出各网页的相关度及排名等级,然后根据关联度高低,按顺序将这些网页链接返回给用户。
数据显示,目前我国至少有将近两亿人使用搜索引擎,大到看病上学,小到吃饭购物,很多网民已经养成在决策时先上网搜搜的习惯。
但如今,有不少提供搜索服务的公司,由于商业利益所趋,人为干预搜索排行,或是在内容排名中掺杂广告,使得搜索内容远离公正,而这些公司本身也正遭遇信任危机。
大多数使用搜索引擎的人都曾有过这样不舒服的经历,明明自己要搜索找到某一事物的知识性介绍,结果搜出的内容都是广告,得费力翻好几个网页后才有相关的内容。
比如,用不同的搜索引擎搜索“糖尿病”一词,网民可能会在弹出的首页得到不同的搜索结果,有的搜出来的前几十条都是各类治疗糖尿病医院的链接,有些提供的前几条信息则是近期关于糖尿病的焦点新闻,抑或是关于糖尿病的医学解释。而事实上,即便公众就是想找一家治疗糖尿病的医院,也会不安地发现排行前几名的医院名不见经传。
在搜索引擎的公正性备受诟病的背景下,中国互联网协会今天举行论坛,希望业界企业能达成自律共识,提供公正的搜索结果。该协会副理事长高卢麟甚至说,搜索引擎的客观公正已经成为中国互联网行业健康发展的关键,因为搜索引擎是两三亿网民查询海量信息的主要窗口,直接影响人们认知世界的方式。
搜索公司屡受质疑
只要付费,提供搜索服务的公司就有可能屏蔽或删除客户不喜欢的负面信息,只要付费,不管你是谁,不管你的公司在哪里,规模有多大,都可以跻身到相关关键词搜索排名的头把交椅。