Categories


Tags


HITS链接分析算法

  HITS链接分析算法

整理自网络ChatGPT产生之内容,文本内容不具备参考意义,程序内容及代码片段有且仅有借鉴意义。

  

HITS(Hyperlink-Induced Topic Search)是一种基于链接的搜索引擎排名算法,与其他排名算法如PageRank一样,它的主要目的是将用户查询与集合的文档匹配,使得最相关的文档被检索出来,排在前面。事实上,网页根据网页内部和外部因素来排序。HITS算法包括两个重要指标:Authority和Hub,体现网页的相关性,指导搜索引擎排序,即把相关性高的网页排在前面。

HITS算法首先将网络或文档抽象为一个有向图,称为链接网络。对于每个网页,给出其作者(Authority)和链接(Hub)。基于链接的HITS算法使用一个简单的迭代流程来更新Authority 和 Hub 指标的值:

1.首先通过将Authority 分配给所有链接节点,计算每个Hub所具有的Authority 权重。

2.接着,将Hub值分配给每个链接节点,计算每个Authority所拥有的Hub权重

3.这个迭代过程一直持续下去,直到稳定,也就是说,在计算Authority/Hub 的值的时候,其值改变的越来越小,这个阈值可以根据系统的需要来设定。

4.最后,将依据Authority/Hub 指标值排序得到的结果作为搜索引擎的排序结果返回给用户。

HITS算法有一定的局限性,其最大的缺点在于,HITS算法容易受垃圾链接(spam links)的影响。多数搜索引擎都在使用HITS算法前都要先审查排名结果,移除被标记为垃圾链接的网页,以确保搜索引擎的查询结果的真实性和可靠性。

Public @ 2023-03-02 20:00:02 整理自网络ChatGPT产生之内容,文本内容不具备参考意义,程序内容有且仅有借鉴意义。

Google PageRank(网页级别)介绍

Google的核心软件称为 PageRank(网页级别),这是由Google创始人 Larry Page 和 Sergey Brin 在斯坦福大学开发出的一套用于网页评级的系统,网页级别是所有Google网络搜索工具的基础。作为组织管理工具,网页级别利用了互联网独特的民主特性及其巨大的链接结构。实质上,当从网页 A 链接到网页 B 时,Google 就认为"网页 A 投了网页 B 一票&

Public @ 2012-10-28 15:39:07

Google的BERT算法更新

这篇帖子是去年(2019年)10月28号打的草稿,今天补充完成发出来。过去一年,关于搜索算法和SEO思维最大的新闻依然是这件事。2019年10月,Google公布上线BERT算法。什么是BERTBERT是Bidirectional Encoder Representations from Transformers的缩写,中文意思大概是“双向transformer编码器表达”,“transforme

Public @ 2018-08-23 15:54:59

HITS链接分析算法

HITS(Hyperlink - Induced Topic Search)链接分析算法诞生在1997年,该算法是由康奈尔大学中的一位博士提出,并且该算法沿用于全球多个搜索引擎当中。当然,不同的搜索引擎针对于该算法的侧重点和内部公式都有不一的算法结构调整,并且HITS算法也是链接分析中最为重要的基础算法之一。对于目前国内的整体搜索引擎而言,百度作为国内的搜索引擎领头羊,我会带着HITS的公开文档针

Public @ 2009-11-28 15:39:11

HITS链接分析算法

HITS(Hyperlink-Induced Topic Search)是一种基于链接的搜索引擎排名算法,与其他排名算法如PageRank一样,它的主要目的是将用户查询与集合的文档匹配,使得最相关的文档被检索出来,排在前面。事实上,网页根据网页内部和外部因素来排序。HITS算法包括两个重要指标:Authority和Hub,体现网页的相关性,指导搜索引擎排序,即把相关性高的网页排在前面。 HI

Public @ 2023-03-02 20:01:00

更多您感兴趣的搜索

0.438767s