Mysoo2 站内搜索引擎安装指南
百度阿拉丁平台剑指垂直搜索
谷歌测试在搜索建议中放广告
谷歌与百度的八年“暗战”
Google公布2008年度搜索排行榜
传戴尔PC将放弃谷歌选择微软Live搜索引擎
雅虎高级搜索专家陆奇将任微软数字部门高管
微软不娶雅虎 只想买搜索业务
微软退出搜索市场能对Google造更大伤害
雅虎打造BOSS垂直搜索引擎
谷歌百度口水战升级 比拼"谁更懂中文"
从百度“竞价门”看企业的社会责任感
山寨版搜索引擎“百谷虎”雷倒网友
雅虎搜索技术高管跳槽至微软
面对“搜索门” 百度公司力挽声誉
内容更新频率对SEO的影响


 ·个人网站如何利用ASP打造站内搜索引擎
 ·Google 的秘密- PageRa...
 ·PHP版搜索引擎技术核心揭密
 ·中文搜索引擎技术揭密:网络蜘蛛
 ·站在巨人的肩膀上,建立自己的站内搜索...
 ·全文信息检索介绍及算法分析
 ·全文检索引擎的技术指标(一)
 ·我的绝招:用JSP实现全文检索
 ·谈谈中文全文信息检索系统中的索引技术
 ·使用雅虎实现免费站内搜索




Google 的秘密- PageRank 彻底解说


 共8页  1  2  3  4  5  6  7  8 

1.前言

  最近,搜索引擎 Google (http://www.google.com/)非常引人注目。Google 是基于现担任 CEO 的 Larry Page 和担任总经理的 Sergey Brin (2001年2月)在就读于美斯坦福大学研究生院时所开发的搜索引擎的一种检索服务。Google 从1998年9月开始服务,但 Netscape Communications 在 Google 的测试阶段就开始与其合作,美国 Yahoo! 公司也从2000年6月起将默认搜索引擎(美国 Yahoo! 不能检索时作为增补的搜索引擎)由原先合作的 Inktomi 转换为了 Google。日语版 Google 在2000年9月正式登场,现已被 BIGLOBE(NEC)所采用。 (注:2001年4月 Yahoo! JAPAN 和 @NIFTY,7月索尼,2002年1月 Excite 也相继与 Google 建立了协作关系)。

  Google 被评价的优点不仅仅在于去除无用的(广告)标语构成单一页面的功能、独自的 Cache 系统、动态制成摘要信息、为实现高速检索而设置的分散系统(数千台规模的Linux群集器)等,而其中最大的优点正是它检索结果的正确性。一种能够自动判断网页重要性的技术「PageRank是(网页等级)」就是为此而设计的一种技术。 本文的目的就是以尽可能浅显易懂的语言来说明 PageRank 系统的概要和原理。

  以下是 PageRank 的一篇基础文章。

  Lawrence Page, Sergey Brin, Rajeev Motwani, Terry Winograd, 'The PageRank Citation Ranking: Bringing Order to the Web', 1998,

  http://www-db.stanford.edu/~backrub/pageranksub.ps

  为了更高效地计算 PageRank,以下是改良以后的一篇论文。

  Taher H. Haveliwala, 'Efficient Computation of PageRank', Stanford Technical Report, 1999,

  http://dbpubs.stanford.edu:8090/pub/1999-31

  另外,以下是 PageRank 的演示用资料(PowerPoint)。

  Larry Page, 'PageRank: Bringing Order to the Web',

  http://hci.stanford.edu/~page/papers/pagerank/ (已失效)

  接下来就对这两篇文章(另加一篇资料)进行基本说明。 首先,用简单的例子来解说 PageRank 的概念,再归结到使用超链接关系的排序系统来解决大规模疏松疏矩阵的特性值的问题。然后我们会接触一些在现实世界中应用基本模型时出现的问题和对应方法。接下来,为了探讨是否能够作为「个人化 PageRank」使用,进行对免费全文检索系统 Namazu 的安装实验并对其结果进行阐述。最后发表我对 PageRank 的个人见解。

  另外,为了能够理解以下的说明内容,需要大学基础课程程度的数学知识(尤其是线形代数)。然而为使文科生也能够顺利读下去,尽可能地不用算式来说明问题,同时,为了加入笔者个人的见解,没有加入像原文那么多的算法和数字,也存在许多不够严密和欠正确的地方,事先在次声明。具体内容请参照原文。

  PageRank(TM) 是美国 Google 公司的登记注册商标。

 共8页  1  2  3  4  5  6  7  8 

来源: www.kreny.com | 作者: Kreny,袁黄琳 | 发表时间: 2006-9-8 18:24:00

 

 


Copyright © 2000-2008 Mysoo.com.cn, All Rights Reserved Mysoo.com.cn 版权所有                                  把Mysoo添加到 Google   沪ICP备06051139