搜索需要什么技术像百度,GOOGLE这样的搜索网站,它们用的是什爱问知识人

搜索需要什么技术

像百度,GOOGLE这样的搜索网站,它们用的是什么技术,还有自己想做个电脑内的搜索引擎,那又要什么技术.

无***

提交回答

好评回答

  用的是一种叫网络蜘蛛的技术
更多的资料你可以去搜索一下"网络蜘蛛"
网络蜘蛛即Web Spider，是一个很形象的名字。把互联网比喻成一个蜘蛛网，那么Spider就是在网上爬来爬去的蜘蛛。网络蜘蛛是通过网页的链接地址来寻找网页，从网站某一个页面（通常是首页）开始，读取网页的内容，找到在网页中的其它链接地址，然后通过这些链接地址寻找下一个网页，这样一直循环下去，直到把这个网站所有的网页都抓取完为止。
  如果把整个互联网当成一个网站，那么网络蜘蛛就可以用这个原理把互联网上所有的网页都抓取下来。 
    对于搜索引擎来说，要抓取互联网上所有的网页几乎是不可能的，从目前公布的数据来看，容量最大的搜索引擎也不过是抓取了整个网页数量的百分之四十左右。
  这其中的原因一方面是抓取技术的瓶颈，无法遍历所有的网页，有许多网页无法从其它网页的链接中找到；另一个原因是存储技术和处理技术的问题，如果按照每个页面的平均大小为20K计算（包含图片），100亿网页的容量是100×2000G字节，即使能够存储，下载也存在问题（按照一台机器每秒下载20K计算，需要340台机器不停的下载一年时间，才能把所有网页下载完毕）。
  同时，由于数据量太大，在提供搜索时也会有效率方面的影响。因此，许多搜索引擎的网络蜘蛛只是抓取那些重要的网页，而在抓取的时候评价重要性主要的依据是某个网页的链接深度。 
    在抓取网页的时候，网络蜘蛛一般有两种策略：广度优先和深度优先（如下图所示）。
  广度优先是指网络蜘蛛会先抓取起始网页中链接的所有网页，然后再选择其中的一个链接网页，继续抓取在此网页中链接的所有网页。这是最常用的方式，因为这个方法可以让网络蜘蛛并行处理，提高其抓取速度。深度优先是指网络蜘蛛会从起始页开始，一个链接一个链接跟踪下去，处理完这条线路之后再转入下一个起始页，继续跟踪链接。
  这个方法有个优点是网络蜘蛛在设计的时候比较容易。两种策略的区别，下图的说明会更加明确。 
。

寿***

2007-01-12 15:13:30

77 14 评论

提交评论

类似问题

换一换

1

问：搜索网站如何盈利？我们经常使用搜

答：楼上的说的很对是竟价的~~但是要是流量小的话那也是很难去做的~~ 别看现在弄的都挺大的其实真的正前的还是不多的~~ 不能否认的有很大的收益~~ 但是还要看看他的...详情>>
2 关于百度和google,它们两个回答2
3 百度搜索引擎的原理是怎么样的？？回答2
4 爱问知识人，百度知道，搜搜问问它回答2
5 在刑事案件中什么情况下用到协查通回答2
1

问：GOOGLE、百度等搜索引擎是怎

答：搜索引擎基本工作原理 ……（粘贴略）总的来说，当我们使用搜索引擎时，该引擎不是当时才到各个网站去检索内容，而是检索自己引擎数据库的信息。所以该数据库的大小及更...详情>>
2 谁知道网吧的还原精灵在哪？我怎么回答2
3 如何干掉网吧的还原精灵？如何干掉回答2
4 我们公司新制作的网站用搜索引擎搜回答2

互联网相关知识

搜索需要什么技术

搜索需要什么技术

像百度,GOOGLE这样的搜索网站,它们用的是什么技术,还有自己想做个电脑内的搜索引擎,那又要什么技术.
全部

类似问题

互联网相关知识

相关推荐

笔记本电脑永远是解决笔记本故障的卡片屏幕...

xp电脑显示屏调节屏幕亮度怎么调节_XP...

计算机不能重新启动所有时间重新启动如何解...

如果笔记本不能上网，我该怎么办

现在移民需要多少钱(留学移民要多少钱)

高迪安集团公司的实力怎么样？

有人了解高迪安集团这个公司吗？

高迪安集团旗下的人工智能产业发展好吗？

高迪安这个公司现在旗下现在主要有哪些产业...

高迪安之前开发的第一个新房是哪个楼盘？

热点检索

确定举报此问题

搜索需要什么技术

搜索需要什么技术 像百度,GOOGLE这样的搜索网站,它们用的是什么技术,还有自己想做个电脑内的搜索引擎,那又要什么技术.全部

类似问题

互联网 相关知识

相关推荐

热点检索

确定举报此问题

搜索需要什么技术

像百度,GOOGLE这样的搜索网站,它们用的是什么技术,还有自己想做个电脑内的搜索引擎,那又要什么技术.
全部

互联网相关知识