一句话说清楚搜索引擎工作原理

家乡区县: 徐州市邳州市

从我们在搜索关键词,到给出搜索结果的过程,往往仅需几毫秒即可完成。那么搜索引擎是如何在浩如烟海的互联网资源中,以如此之快的速度将您的网站内容展现给用户?这背后蕴藏着什么样的工作流程和运算逻辑?事实上,搜索引擎的工作并非仅仅如同首页搜索框一样简单。搜索引擎为用户展现的每一条搜索结果,都对应着互联网上的一个页面。每一条搜索结果从产生到被搜索引擎展现给用户,都需要经过四个过程:抓取、过滤、建立索引和输出结果。
一、抓取
搜索引擎会通过系统的计算,来决定对你网站哪些内容施行抓取,以及抓取的内容和频率值。搜索引擎的计算过程会参考您的网站在历史中的表现,比如内容是否足够优质,是否存在对用户不友好的设置,是否存在过度的搜索引擎优化行为等等。
二、过滤
互联网中并非所有的网页都对用户有意义,比如一些明显的欺骗用户的网页,死链接页面等。这些网页对用户、站长和蜘蛛来说,都没有足够的价值,因此蜘蛛会自动对这些内容进行过滤,以避免为用户和您的网站带来不必要的麻烦。


三、建立索引库
蜘蛛对抓取回来的内容会逐一进行标记和识别,并将这些筛选合格的页面内容进行分词建立索引,什么是分词呢?简单说就是划分句子,比如“段亮个人博客-分享web前端和SEO技术的个人博客网站”,就会划分为段亮、段亮个人博客、SEO博客、个人博客。等等的组合;
四、输出结果
结合搜索引擎的算法,把用户输入的关键词,其进行一系列复杂的分析,并根据分析的结论在索引库中寻找与之最为匹配的一系列网页,按照用户输入的关键词所体现的需求强弱和网页的优劣进行打分,并按照最终的分数进行排列,展现给用户。

她真的姓刘(2015-06-09) 评论(0


文章内容由网友提供,不代表本站观点

如果您喜欢这篇文章,就送梧桐子“”支持吧!

已获得0个“