`
andyliuxs
  • 浏览: 138282 次
  • 性别: Icon_minigender_1
  • 来自: 武汉
社区版块
存档分类
最新评论

Google的秘密-PageRank

阅读更多

原文地址:http://www.kreny.com/pagerank_cn.htm,这里简单的介绍下,该文的主要内容,详细请看原文。

 

最近,搜索引擎 Google (http://www.google.com/)非常引人注目。Google 是基于现担任 CEO 的 Larry Page 和担任总经理的 Sergey Brin (2001年2月)在就读于美斯坦福大学研究生院时所开发的搜索引擎的一种检索服务。Google 从1998年9月开始服务,但 Netscape Communications 在 Google 的测试阶段就开始与其合作,美国 Yahoo! 公司也从2000年6月起将默认搜索引擎(美国 Yahoo! 不能检索时作为增补的搜索引擎)由原先合作的 Inktomi 转换为了 Google。日语版 Google 在2000年9月正式登场,现已被 BIGLOBE(NEC)所采用。 (注:2001年4月 Yahoo! JAPAN 和 @NIFTY,7月索尼,2002年1月 Excite 也相继与 Google 建立了协作关系)。

Google 被评价的优点不仅仅在于去除无用的(广告)标语构成单一页面的功能、独自的 Cache 系统、动态制成摘要信息、为实现高速检索而设置的分散系统(数千台规模的Linux群集器)等,而其中最大的优点正是它检索结果的正确性。一种能够自动判断网页重要性的技术「PageRank是(网页等级)」就是为此而设计的一种技术。 本文的目的就是以尽可能浅显易懂的语言来说明 PageRank 系统的概要和原理。

以下是 PageRank 的一篇基础文章。

Lawrence Page, Sergey Brin, Rajeev Motwani, Terry Winograd, 'The PageRank Citation Ranking: Bringing Order to the Web', 1998,
http://www-db.stanford.edu/~backrub/pageranksub.ps

为了更高效地计算 PageRank,以下是改良以后的一篇论文。

Taher H. Haveliwala, 'Efficient Computation of PageRank', Stanford Technical Report, 1999,
http://dbpubs.stanford.edu:8090/pub/1999-31

另外,以下是 PageRank 的演示用资料(PowerPoint)。

Larry Page, 'PageRank: Bringing Order to the Web',
http://hci.stanford.edu/~page/papers/pagerank/ (已失效)

接下来就对这两篇文章(另加一篇资料)进行基本说明。 首先,用简单的例子来解说 PageRank 的概念,再归结到使用超链接关系的排序系统来解决大规模疏松疏矩阵的特性值的问题。然后我们会接触一些在现实世界中应用基本模型时出现的问题和对应方法。接下来,为了探讨是否能够作为「个人化 PageRank」使用,进行对免费全文检索系统 Namazu 的安装实验并对其结果进行阐述。最后发表我对 PageRank 的个人见解。

另外,为了能够理解以下的说明内容,需要大学基础课程程度的数学知识(尤其是线形代数)。然而为使文科生也能够顺利读下去,尽可能地不用算式来说明问题,同时,为了加入笔者个人的见解,没有加入像原文那么多的算法和数字,也存在许多不够严密和欠正确的地方,事先在次声明。具体内容请参照原文。

PageRank(TM) 是美国 Google 公司的登记注册商标。

分享到:
评论

相关推荐

    Google的秘密PageRank彻底解说中文版

    ### Google的秘密PageRank彻底解说中文版 #### 一、PageRank基本概念 PageRank是由Google创始人拉里·佩奇(Larry Page)和谢尔盖·布林(Sergey Brin)发明的一种网页排名算法。它最初是作为斯坦福大学的一个研究...

    Google 的秘密

    Google 秘密 Google 的秘密- PageRank 彻底解说

    Google的秘密PageRank彻底解说中文版.doc

    ### Google的秘密PageRank彻底解说 #### 一、前言 Google作为全球领先的搜索引擎,自1998年由拉里·佩奇(Larry Page)和谢尔盖·布林(Sergey Brin)创立以来,一直以其卓越的搜索质量和广泛的适用性受到用户的...

    Google的秘密PageRank彻底解说中文版.rar

    Google 被评价的优点不仅仅在于去除无用的(广告)标语构成单一页面的功能、独自的 Cache 系统、动态制成摘要信息、为实现高速检索而设置的分散系统(数千台规模的Linux群集器)等,而其中最大的优点正是它检索结果的...

    LRT Power * Trust - PageRank替换「LRT Power*Trust – PageRank Replacement」-crx插件

    自从Google宣布不再更新PageRank以来,世界各地的SEO和网站管理员一直在寻找最佳替代品 LinkResearchTools开发了Google工具栏PageRank的完美替代品:LRT Power * Trust Extension LRT Power * Trust(以前称为CEMPER...

    Google Pagerank Inspector v1.0

    《Google Pagerank Inspector v1.0:探索网页排名的秘密》 在互联网的海洋中,搜索引擎是引导用户找到所需信息的灯塔,而Google作为全球最知名的搜索引擎之一,其PageRank算法则是衡量网页重要性的核心标准。本文将...

    Google Page rank 算法经典论文

    在众多搜索引擎中,Google以其高效、精准的搜索结果脱颖而出,而这一切的核心秘密在于其独特的PageRank算法。本文将对Google PageRank算法的经典论文进行深入解析,探讨其背后的线性代数原理。 #### 论文概览 这篇...

    搜主义:Google持续成长的秘密.txt

    ### 搜主义:Google持续成长的秘密 #### 一、引言与背景 Google作为全球领先的搜索引擎之一,其成功并非偶然。本文将深入探讨Google的成长之路及其背后的关键因素,旨在揭示Google持续成功的秘密。 #### 二、...

    pagerank详述

    ### PageRank详解:谷歌的秘密武器 #### 引言 在互联网时代,搜索引擎是人们获取信息的重要途径,而谷歌作为全球最流行的搜索引擎之一,其成功的关键在于PageRank算法。这一算法由谷歌创始人Larry Page和Sergey ...

    Google搜索引擎算法的秘密

    本文将深入探讨Google搜索引擎算法的秘密,揭秘它如何高效地索引、理解和排名网页,帮助用户找到最相关的信息。 首先,我们来了解Google搜索引擎的基础——PageRank算法。由Google创始人拉里·佩奇提出的PageRank,...

    搜主义Google持续成长的秘密

    1. **强大的搜索引擎技术**:Google的核心竞争力在于其先进的搜索算法,如PageRank,它通过链接分析确定网页的重要性,为用户提供更为精准的搜索结果。 2. **AdWords与AdSense广告系统**:Google的广告业务是其主要...

    数据库算法及Google搜索引擎算法的秘密

    Google是全球最广泛使用的搜索引擎,其搜索结果的排名主要由PageRank和其他多种因素决定。 1. **PageRank**:这是Google创始人Larry Page提出的一种衡量网页重要性的算法。PageRank通过计算网页之间的链接关系来...

Global site tag (gtag.js) - Google Analytics