搜索引擎的工作原理
一、搜索引擎基本工作原理
了解搜索引擎的工作原理对我们日常搜索应用和网站提交推广都会有很大帮助。
........................................................................................
■ 全文搜索引擎
在搜索引擎分类部分我们提到过全文搜索引擎从网站提取信息建立网页数据库的概念。搜索引擎的自动信息搜集功能分两种。一种是定期搜索,即每隔一段时间(比如Google一般是28天),搜索引擎主动派出“蜘蛛”程序,对一定IP地址范围内的互联网站进行检索,一旦发现新的网站,它会自动提取网站的信息和网址加入自己的数据库。
另一种是提交网站搜索,即网站拥有者主动向搜索引擎提交网址,它在一定时间内(2天到数月不等)定向向你的网站派出“蜘蛛”程序,扫描你的网站并将有关信息存入数据库,以备用户查询。由于近年来搜索引擎索引规则发生了很大变化,主动提交网址并不保证你的网站能进入搜索引擎数据库,因此目前最好的办法是多获得一些外部链接,让搜索引擎有更多机会找到你并自动将你的网站收录。
当用户以关键词查找信息时,搜索引擎会在数据库中进行搜寻,如果找到与用户要求内容相符的网站,便采用特殊的算法——通常根据网页中关键词的匹配程度,出现的位置/频次,链接质量等——计算出各网页的相关度及排名等级,然后根据关联度高低,按顺序将这些网页链接返回给用户。
........................................................................................
■ 目录索引
与全文搜索引擎相比,目录索引有许多不同之处。
首先,搜索引擎属于自动网站检索,而目录索引则完全依赖手工操作。用户提交网站后,目录编辑人员会亲自浏览你的网站,然后根据一套自定的评判标准甚至编辑人员的主观印象,决定是否接纳你的网站。
其次,搜索引擎收录网站时,只要网站本身没有违反有关的规则,一般都能登录成功。而目录索引对网站的要求则高得多,有时即使登录多次也不一定成功。尤其象 Yahoo!这样的超级索引,登录更是困难。(由于登录Yahoo!的难度最大,而它又是商家网络营销必争之地,所以我们会在后面用专门的篇幅介绍登录 Yahoo雅虎的技巧)
此外,在登录搜索引擎时,我们一般不用考虑网站的分类问题,而登录目录索引时则必须将网站放在一个最合适的目录(Directory)。
最后,搜索引擎中各网站的有关信息都是从用户网页中自动提取的,所以用户的角度看,我们拥有更多的自主权;而目录索引则要求必须手工另外填写网站信息,而且还有各种各样的限制。更有甚者,如果工作人员认为你提交网站的目录、网站信息不合适,他可以随时对其进行调整,当然事先是不会和你商量的。
目录索引,顾名思义就是将网站分门别类地存放在相应的目录中,因此用户在查询信息时,可选择关键词搜索,也可按分类目录逐层查找。如以关键词搜索,返回的结果跟搜索引擎一样,也是根据信息关联程度排列网站,只不过其中人为因素要多一些。如果按分层目录查找,某一目录中网站的排名则是由标题字母的先后顺序决定(也有例外)。
目前,搜索引擎与目录索引有相互融合渗透的趋势。原来一些纯粹的全文搜索引擎现在也提供目录搜索,如Google就借用Open Directory目录提供分类查询。而象 Yahoo! 这些老牌目录索引则通过与Google等搜索引擎合作扩大搜索范围(注)。在默认搜索模式下,一些目录类搜索引擎首先返回的是自己目录中匹配的网站,如国内搜狐、新浪、网易等;而另外一些则默认的是网页搜索,如Yahoo。
二、三大主流搜索引擎
Google简体中文
http://www.google.com
Google 的使命是整合全球范围的信息,使人人皆可访问并从中受益。完成该使命的第一步就是 Google 的创始人 Larry Page 和 Sergey Brin 共同开发的全新的在线搜索引擎。该技术诞生于斯坦福大学的一个学生宿舍里,然后迅速传播到全球的信息搜索者。 Google 目前被公认为全球最大的搜索引擎,它提供了简单易用的免费服务,用户可以在瞬间返回相关的搜索结果。
在访问 Google 主页时,您可以使用多种语言查找信息、查看新闻标题、搜索超过 10 亿幅的图片,并能够细读全球最大的 Usenet 消息存档,其中提供的帖子超过 10 亿个,时间可以追溯到 1981 年。
2005年,Google高调进军中国市场,推出Google搜索中国版,命名为:谷歌搜索
http://www.google.cn
百度搜索
http://www.baidu.com
百度搜索引擎拥有目前世界上最大的中文搜索引擎,总量超过3亿页以上,并且还在保持快速的增长。百度搜索引擎具有高准确性、高查全率、更新快以及服务稳定的特点,能够帮助广大网民快速的在浩如烟海的互联网信息中找到自己需要的信息,因此深受网民的喜爱。
雅虎中国
http://www.yahoo.com.cn/
2005年11月9日 阿里巴巴公司在完成对雅虎中国的收购与整合之后,重新发布了进入中国市场7年之久的雅虎网站, 未来雅虎在中国的业务重点方向将全面转向搜索领域,这也是自8月11日阿里巴巴宣布收购雅虎中国时就从没改变的方向。阿里巴巴CEO马云表示: 阿里巴巴在搜索领域既有决心更有信心,在中国,雅虎就是搜索,搜索就是雅虎。
2006年8月,雅虎中国推出独立搜索引擎网站入口
http://www.yahoo.cn
1“百度”全球最大的中文搜索引擎,也是人们最常用的搜索引擎之一,常用于搜索网页、图片和mp3。搜索结果中广告、垃圾网站和死链比较多。
2、“Google”是功能强大,易用性最强的搜索网站,搜索速度快而且提供了最丰富的高级搜索功能。死链率比较高是Google最大的问题,中文网站检索的更新频率不够高,不能及时淘汰已经过时的链接。虽然通过“网页快照”功能,可以减少目标页面不存在的现象,但Google的“网页快照”功能在国内经常出现不可访问的问题,令用户无所适从。
3、“ 雅虎”中规中矩, 网页搜索表现不错,但死链率较高而且缺少一些应有的高级搜索功能。另外,该搜索的易用性有待提高,虽然在5月份升级后改善了网页的界面,严格控制搜索页面中的排名广告,规定每次搜索结果中的广告数量不能超过5个,但用户打开雅虎中国的首页时还是要受到一些影响。而且,对搜索结果的描述和在用户搜索过程中的提示说明也不太清晰、明了,离雅虎“关注用户体验”这一宣传口号,还有一定的距离。
分享到:
相关推荐
### 搜索引擎工作原理详解 #### 一、搜索引擎的基本概念 搜索引擎是互联网上提供自动搜索服务的一种工具,它能够帮助用户快速找到所需的信息资源。在实际应用中,搜索引擎的工作流程主要包括网页抓取(爬虫)、...
### 搜索引擎的工作原理与发展现状 #### 摘要与背景 搜索引擎作为互联网时代不可或缺的工具之一,在信息获取过程中扮演着重要角色。本文旨在介绍搜索引擎的基本概念,深入探讨其工作原理及类型,并分析当前搜索...
第二章 Web搜索引擎工作原理和体系结构.pdf第二章 Web搜索引擎工作原理和体系结构.pdf第二章 Web搜索引擎工作原理和体系结构.pdf第二章 Web搜索引擎工作原理和体系结构.pdf第二章 Web搜索引擎工作原理和体系结构.pdf...
谷歌搜索引擎工作原理简介.pdf谷歌搜索引擎工作原理简介.pdf谷歌搜索引擎工作原理简介.pdf谷歌搜索引擎工作原理简介.pdf谷歌搜索引擎工作原理简介.pdf谷歌搜索引擎工作原理简介.pdf谷歌搜索引擎工作原理简介.pdf谷歌...
以下是搜索引擎工作原理的详细解析: 第一步,**蜘蛛抓取页面**。搜索引擎使用自动化程序,通常被称为“蜘蛛”或“爬虫”,如Googlebot、baiduspider、Yahoo Slurp和Msnbot,来遍历互联网上的网页。这些蜘蛛按照...
全面介绍WEB搜索引擎,搜索引擎工作原理,搜索开发技术
### 搜索引擎工作原理概述 #### 一、搜索引擎定义及分类 搜索引擎是一种基于特定策略和技术手段,从互联网中抓取信息并对其进行整理、归类,最终向用户提供检索服务的工具。根据其工作方式的不同,搜索引擎可以...
### 搜索引擎工作原理及营销知识点解析 #### 一、搜索引擎的工作原理 1. **索引过程** - **分析索引系统程序**:搜索引擎首先通过爬虫程序抓取互联网上的网页,然后由分析索引系统程序对这些网页进行处理。 - **...
搜索引擎工作原理是互联网内容获取和展示的关键环节,对于网站收录情况有着直接影响。本文主要探讨了如何根据搜索引擎的工作机制来改善网站的收录状况,主要涉及以下几个方面: 首先,内链的合理部署至关重要。内链...
【2013年百度搜索引擎工作原理】 搜索引擎作为互联网的核心工具之一,其工作流程对于理解SEO(搜索引擎优化)至关重要。本文将深入解析2013年百度搜索引擎的主要工作环节,帮助读者了解信息如何被搜索引擎抓取、...
第九章 搜索引擎工作原理.pdf第九章 搜索引擎工作原理.pdf第九章 搜索引擎工作原理.pdf第九章 搜索引擎工作原理.pdf第九章 搜索引擎工作原理.pdf
高一信息技术搜索引擎工作原理.pdf高一信息技术搜索引擎工作原理.pdf高一信息技术搜索引擎工作原理.pdf高一信息技术搜索引擎工作原理.pdf高一信息技术搜索引擎工作原理.pdf高一信息技术搜索引擎工作原理.pdf高一信息...
详细刻画了Google搜索引擎的工作原理,包含的内容有网页抓取,分析系统,索引系统和查询系统四部分。
### 搜索引擎工作原理三个阶段简介 #### 一、爬行和抓取 搜索引擎的工作流程首先从爬行和抓取开始,这是整个搜索系统数据采集的基础。在这个阶段,搜索引擎会派出特殊的程序,俗称“蜘蛛”或“爬虫”,来访问...
信息检索:第九章 搜索引擎工作原理.ppt
搜索引擎基本工作原理 搜索引擎基本工作原理是我们日常搜索应用和网站提交推广的关键所在。了解搜索引擎的工作原理可以帮助我们更好地理解搜索引擎的运作机制,从而提高我们的搜索应用和网站推广效果。 搜索引擎的...