请问搜索引擎是怎么搜的?它的工作原理是什么?

作者&投稿:尧要 (若有异议请与网页底部的电邮联系)
搜索引擎是怎样搜索出其他网站的?它的工作原理是什么~


搜索引擎的工作原理总共有四步:
第一步:爬行,搜索引擎是通过一种特定规律的软件跟踪网页的链接,从一个链接爬到另外一个链
接,所以称为爬行。
第二步:抓取存储,搜索引擎是通过蜘蛛跟踪链接爬行到网页,并将爬行的数据存入原始页面数据库。
第三步:预处理,搜索引擎将蜘蛛抓取回来的页面,进行各种步骤的预处理。
第四步:排名,用户在搜索框输入关键词后,排名程序调用索引库数据,计算排名显示给用户,排名过程与用户直接互动的。
不同的搜索引擎查出来的结果是根据引擎内部资料所决定的。比如:某一种搜索引擎没有这种资料,您就查询不到结果。

扩展资料:
定义
一个搜索引擎由搜索器、索引器、检索器和用户接四个部分组成。搜索器的功能是在互联网中漫游,发现和搜集信息。索引器的功能是理解搜索器所搜索的信息,从中抽取出索引项,用于表示文档以及生成文档库的索引表。
检索器的功能是根据用户的查询在索引库中快速检出文档,进行文档与查询的相关度评价,对将要输出的结果进行排序,并实现某种用户相关性反馈机制。用户接口的作用是输入用户查询、显示查询结果、提供用户相关性反馈机制。
起源
所有搜索引擎的祖先,是1990年由Montreal的McGill University三名学生(Alan Emtage、Peter
Deutsch、Bill Wheelan)发明的Archie(Archie FAQ)。Alan Emtage等想到了开发一个可以用文件名查找文件的系统,于是便有了Archie。
Archie是第一个自动索引互联网上匿名FTP网站文件的程序,但它还不是真正的搜索引擎。Archie是一个可搜索的FTP文件名列表,用户必须输入精确的文件名搜索,然后Archie会告诉用户哪一个FTP地址可以下载该文件 。
由于Archie深受欢迎,受其启发,Nevada System Computing Services大学于1993年开发了一个Gopher(Gopher FAQ)搜索工具Veronica(Veronica FAQ)。Jughead是后来另一个Gopher搜索工具。
参考资料来源:百度百科-搜索引擎

搜索引擎基本工作原理

了解搜索引擎的工作原理对我们日常搜索应用和网站提交推广都会有很大帮助。

■ 全文搜索引擎
  搜索引擎的自动信息搜集功能分两种。一种是定期搜索,即每隔一段时间(比如Google一般是28天),搜索引擎主动派出“蜘蛛”程序,对一定IP地址范围内的互联网站进行检索,一旦发现新的网站,它会自动提取网站的信息和网址加入自己的数据库。

  另一种是提交网站搜索,即网站拥有者主动向搜索引擎提交网址,它在一定时间内(2天到数月不等)定向向你的网站派出“蜘蛛”程序,扫描你的网站并将有关信息存入数据库,以备用户查询。由于近年来搜索引擎索引规则发生了很大变化,主动提交网址并不保证你的网站能进入搜索引擎数据库,因此目前最好的办法是多获得一些外部链接,让搜索引擎有更多机会找到你并自动将你的网站收录。

  当用户以关键词查找信息时,搜索引擎会在数据库中进行搜寻,如果找到与用户要求内容相符的网站,便采用特殊的算法——通常根据网页中关键词的匹配程度,出现的位置/频次,链接质量等——计算出各网页的相关度及排名等级,然后根据关联度高低,按顺序将这些网页链接返回给用户。

■ 目录索引
  与全文搜索引擎相比,目录索引有许多不同之处。

  首先,搜索引擎属于自动网站检索,而目录索引则完全依赖手工操作。用户提交网站后,目录编辑人员会亲自浏览你的网站,然后根据一套自定的评判标准甚至编辑人员的主观印象,决定是否接纳你的网站。

  其次,搜索引擎收录网站时,只要网站本身没有违反有关的规则,一般都能登录成功。而目录索引对网站的要求则高得多,有时即使登录多次也不一定成功。尤其象Yahoo!这样的超级索引,登录更是困难。(由于登录Yahoo!的难度最大,而它又是商家网络营销必争之地,所以我们会在后面用专门的篇幅介绍登录Yahoo雅虎的技巧)

  此外,在登录搜索引擎时,我们一般不用考虑网站的分类问题,而登录目录索引时则必须将网站放在一个最合适的目录(Directory)。

  最后,搜索引擎中各网站的有关信息都是从用户网页中自动提取的,所以用户的角度看,我们拥有更多的自主权;而目录索引则要求必须手工另外填写网站信息,而且还有各种各样的限制。更有甚者,如果工作人员认为你提交网站的目录、网站信息不合适,他可以随时对其进行调整,当然事先是不会和你商量的。

  目录索引,顾名思义就是将网站分门别类地存放在相应的目录中,因此用户在查询信息时,可选择关键词搜索,也可按分类目录逐层查找。如以关键词搜索,返回的结果跟搜索引擎一样,也是根据信息关联程度排列网站,只不过其中人为因素要多一些。如果按分层目录查找,某一目录中网站的排名则是由标题字母的先后顺序决定(也有例外)。

  目前,搜索引擎与目录索引有相互融合渗透的趋势。原来一些纯粹的全文搜索引擎现在也提供目录搜索,如Google就借用Open Directory目录提供分类查询。而象 Yahoo! 这些老牌目录索引则通过与Google等搜索引擎合作扩大搜索范围(注)。在默认搜索模式下,一些目录类搜索引擎首先返回的是自己目录中匹配的网站,如国内搜狐、新浪、网易等;而另外一些则默认的是网页搜索,如Yahoo。


什么是搜索引擎?作用是什么?
搜索引擎(Search Engine)是指根据一定的策略、运用特定的计算机程序从互联网上搜集信息,在对信息进行组织和处理后,为用户提供检索服务,将用户检索相关的信息展示给用户的系统。搜索引擎包括全文索引、目录索引、元搜索引擎、垂直搜索引擎、集合式搜索引擎、门户搜索引擎与免费链接列表等。比如百度就是一款...

怎么用搜索引擎在一个指定的网站中搜索一个词?
在使用谷歌搜索引擎的时候,可以使用:site:限定搜索结果在某个域名或目录下,比如:网站优化site:googlenb.com即为:搜索googlenb.com网站中包含网站优化的相关页面。如果我们不加关键词通常返回的是这个网站收录的总条数,我们也可以搜索某个网站某个栏目收录了多少条,比如:site:googlenb.com\/info\/...

什么是搜索引擎?举例说明!
搜索引擎按其工作的方式分为两类:一类是分类目录型的检索,把因特网中的资源收集起来,由其提供的资源的类型不同而分成不同的目录,再一层层地进行分类,人们要找自己想要的信息可按他们的分类一层层进入,就能最后到达目的地,找到自己想要的信息;另一类是基于关键词的检索,这种方式用户可以用逻辑组合方式输入各种关键...

搜索引擎有哪些?
上面多是我们熟知的,而市场份额基本上也就没有了,至于其他的搜索引擎有很多,下面只找几个代表看看: 9.阿里云搜索 阿里巴巴公司下的搜索引擎,阿里云搜索返回的信息并不同于百度谷歌,作为电商企业旗下搜索引擎更趋于网购信息,想必阿里云搜索开发的目的就是提供给网购人群的一个专属搜索引擎。 10.即刻搜索,盘古搜索...

搜索引擎是什么?
搜索引擎是一个对互联网信息资源进行搜索整理和分类,并储存在网络数据库中供用户查询的系统,包括信息搜集、信息分类、用户查询三部分。工作原理 1.爬行:搜索引擎是通过一种特定规律的软件跟踪网页的链接,从一个链接爬到另外一个链接,像蜘蛛在蜘蛛网上爬行一样,所以被称为“蜘蛛”也被称为“机器人”...

搜索引擎是什么
搜索引擎是一个对互联网信息资源进行搜索整理和分类,并储存在网络数据库中供用户查询的系统,包括信息搜集、信息分类、用户查询三部分。工作原理 1.爬行:搜索引擎是通过一种特定规律的软件跟踪网页的链接,从一个链接爬到另外一个链接,像蜘蛛在蜘蛛网上爬行一样,所以被称为“蜘蛛”也被称为“机器人”...

百度搜索引擎地址是什么
百度搜索引擎的地址是:(http:\/\/www.baidu.com)。百度是中国最大的互联网搜索引擎公司,其搜索引擎地址简洁易记,只需在浏览器地址栏输入“www.baidu.com”即可访问。作为全球最大的中文搜索引擎之一,百度提供了强大的网页搜索、图片搜索、视频搜索、知道问答、贴吧讨论等功能,满足了用户...

如何使用搜索引擎
不过好在,百度对于用户常见的错别字输入,有纠错提示。您若输入“林心茹写真”,在搜索结果上方,会提示“您要找的是不是: 林心如写真”。查询词的主题关联与简练 目前的搜索引擎并不能很好的处理自然语言。因此,在提交搜索请求时,您最好把自己的想法,提炼成简单的,而且与希望找到的信息内容主题...

什么是搜索引擎?
还在傻傻分不清浏览器和搜索引擎的区别?快来了解一下吧 我记得我曾经看过一个帖子问百度和谷歌哪个搜索引擎强,下面一网友回复百度广告太多,谷歌又不会翻墙,所以我都是用UC浏览器,唔,据我所知,UC浏览器的默认搜索引擎是神马搜索,而且这个帖子问的是搜索引擎。说实话作为靠搜索引擎吃饭的我,有...

怎么才能快速找到一个网站呢?
要找到一个网站,可以通过搜索引擎、网站推荐、社交媒体、域名直接访问等多种方式。1. 使用搜索引擎:这是最常见且有效的方法。在搜索引擎中输入你想要查找的网站名称或关键词,搜索引擎会根据你的查询返回一系列相关网站。例如,如果你想要找到某个新闻网站,你可以在搜索引擎中输入该新闻网站的名称或相关...

芝罘区19716628005: 搜索引擎的工作原理是什么?
挚黎济悦: 搜索引擎的工作原理是:第一步:爬行搜索引擎是通过一种特定规律的软件跟踪网页的链接, 从一个链接爬到另外一个链接,像蜘蛛在蜘蛛网上爬行一样,所以被称为“蜘...

芝罘区19716628005: 搜索引擎是怎么工作的 -
挚黎济悦: 搜索引擎的基本工作原理包括如下三个过程:首先在互联网中发现、搜集网页信息;同时对信息进行提取和组织建立索引库;再由检索器根据用户输入的查询关键字,在索引库中快速检出文档,进行文档与查询的相关度评价,对将要输出的结果...

芝罘区19716628005: 请问搜索引擎是怎么搜的?它的工作原理是什么? -
挚黎济悦: 搜索引擎基本工作原理 了解搜索引擎的工作原理对我们日常搜索应用和网站提交推广都会有很大帮助. ■ 全文搜索引擎 搜索引擎的自动信息搜集功能分两种.一种是定期搜索,即每隔一段时间(比如Google一般是28天),搜索引擎主动派出...

芝罘区19716628005: 请问搜索引擎的工作原理是怎样的?
挚黎济悦: 用户输入关键词进行检索,搜索引擎从索引数据库中找到匹配该关键词的网页;为了用户便于判断,除了网页标题和URL外,还会提供一段来自网页的摘要以及其他信息

芝罘区19716628005: 搜索引擎的工作原理 -
挚黎济悦: 在搜索引擎分类部分我们提到过全文搜索引擎从网站提取信息建立网页数据库的概念.搜索引擎的自动信息搜集功能分两种.一种是定期搜索,即每隔一段时间(比如Google一般是28天),搜索引擎主动派出“蜘蛛”程序,对一定IP地址范围内...

芝罘区19716628005: 什么是搜索引擎?搜索引擎如何如何工作? -
挚黎济悦: 搜索引擎指自动从英特网搜集信息,经过一定整理以后,提供给用户进行查询的系统.英特网上的信息浩瀚万千,而且毫无秩序,所有的信息象汪洋上的一个个小岛,网页链接是这些小岛之间纵横交错的桥梁,而搜索引擎,则为你绘制一幅一目...

芝罘区19716628005: 搜索引擎的运作原理是什么? -
挚黎济悦: 全文搜索引擎 在搜索引擎分类部分我们提到过全文搜索引擎从网站提取信息建立网页数据库的概念.搜索引擎的自动信息搜集功能分两种.一种是定期搜索,即每隔一段时间(比如Google一般是28天),搜索引擎主动派出“蜘蛛”程序,对一...

芝罘区19716628005: 搜索引擎的工作原理是怎样的? -
挚黎济悦: 搜索引擎的原理,可以看做三步:从互联网上抓取网页→建立索引数据库→在索引数据库中搜索排序. 从互联网上抓取网页 利用能够从互联网上自动收集网页的Spider系统程序,自动访问互联网,并沿着任何网页中的所有URL爬到其它网页...

芝罘区19716628005: 搜索引擎的工作原理是什么? -
挚黎济悦: 具体说开很复杂 首先的工作 就是 网络蜘蛛来抓取互联网上的网页,然后分词,然后作词频统计,存入数据库,按照用户提交的关键词匹配数据库中的信息,然后显示在网页上就可以……

本站内容来自于网友发表,不代表本站立场,仅表示其个人看法,不对其真实性、正确性、有效性作任何的担保
相关事宜请发邮件给我们
© 星空见康网