• 反向链接数 (单纯的意义上的受欢迎度指标)
• 反向链接是否来自推荐度高的页面 (有根据的受欢迎指标)
• 反向链接源页面的链接数 (被选中的几率指标)
首先最基本的是,被许多页面链接会使得推荐度提高。
也就是说「(被许多页面链接的)受欢迎的页面,必定是优质的页面」。
所以以反向链接数作为受欢迎度的一个指标是很自然的想法。
这是因为,“链接”是一种被看作「可以看看这个页面/这个页会有用」的推荐行为。
但是,值得骄傲的是 PageRank 的思考方法并没有停留在这个地方。
也就是说,不仅仅是通过反向链接数的多少,还给推荐度较高页面的反向链接以较高的评价。
同时,对来自总链接数少页面的链接给予较高的评价,而来自总链接数多的页面的链接给予较低的评价。
换句话说「(汇集着许多推荐的)好的页面所推荐的页面,必定也是同样好的页面」和「与感觉在被胡乱链接的链接相比,被少数挑选出的链接肯定是优质的链接」这两种判断同时进行着。
一方面,来自他人高水平网页的正规链接将会被明确重视,另一方面,来自张贴有完全没有关联性的类似于书签的网页的链接会作为「几乎没有什么价值(虽然比起不被链接来说好一些)」而被轻视。
因此,如果从类似于 Yahoo! 那样的 PageRank 非常高的站点被链接的话,仅此网页的 PageRank 也会一下子上升;相反地,无论有多少反向链接数,如果全都是从那些没有多大意义的页面链接过来的话,PageRank 也不会轻易上升。
不仅是 Yahoo!, 在某个领域中可以被称为是有权威的(或者说固定的)页面来的反向链接是非常有益的。
但是,只是一个劲地在自己一些同伴之间制作的链接,比如像「单纯的内部照顾」这样的做法很难看出有什么价值。
也就是说,从注目于全世界所有网页的视点来判断(你的网页)是否真正具有价值。
综合性地分析这些指标,最终形成了将评价较高的页面显示在检索结果的相对靠前处的搜索结构。
以往的做法只是单纯地使用反向链接数来评价页面的重要性,但 PageRank 所采用方式的优点是能够不受机械生成的链接的影响。
也就是说,为了提高 PageRank 需要有优质页面的反向链接。
譬如如果委托 Yahoo! 登陆自己的网站,就会使得 PageRank 骤然上升。
但是为此必须致力于制作(网页的)充实的内容。这样一来,就使得基本上没有提高 PageRank 的近路(或后门)。
不只限于PageRank (Clever 和 HITS 等也同样),在利用链接构造的排序系统中,以前单纯的 SPAM 手法将不再通用。这是最大的一个优点,也是 Google 方便于使用的最大理由。(虽然是最大的理由,但并不是唯一的理由。)
在这里请注意,PageRank 自身是由 Google 定量,而与用户检索内容的表达式完全无关。
就像后边即将阐述的一样,检索语句不会呈现在 PageRank 自己的计算式上。
不管得到多少的检索语句,PageRank 也是一定的、文件固有的评分量。
PageRank 的定性说明大致就是这样一些。
但是,为了实际计算排列次序、比较等级,需要更定量性的讨论。