数据中心谷歌搜索按钮背后的秘密(本科范文)

谷歌搜索解析  时间:2021-01-25  阅读:()

论文范文

《谷歌搜索按钮背后的秘密》Word格式可编辑可修改

精心整理放心阅读欢迎下载

文档信息

谷歌搜索按钮背后的秘密

关于互联网及数据库及计算机方面的优秀学术论文范文关于互联网发表论文关于谷歌搜索按钮背后的秘密相关论文范文检索对写作互联网论文范文课题研究的大学硕士、本科毕业论文开题报告范文和文献综述及职称论文参考文献资料有帮助。

你知道2012奥运会是在伦敦举行但你知道2012伦敦奥运会的吉祥物是什么吗?你知道伦敦奥运会的主题歌是什么?由谁来演绎?不知道没关系谷歌会告诉你。

平淡搜索背后的奇异旅程

不到1秒的时间太过神速让我们以慢镜头回放的方式来仔细分解一下整个的搜索过程。

搜索引擎实际就是一个软件系统只不过它的主要功能都是在远端的网络服务器中完成.在浏览器中打开谷歌的主页.省略它就相当于谷歌搜索这款“软件”的用户界面.在搜索框中输入要查询的问题即平时所说的搜索关键词  比如输入“2012奥运会吉祥物” 然后按下搜索按钮将它提交到谷歌服务器程序中WebServer

服务器程序对提交的关键词并不立即进行搜索还要预先做一些处理最基本的是“切词” Sement  即把查询短语分成一个词的序列 比如“2012奥运会吉祥物”将被切分成“2012” 、 “奥运” 、

“吉祥物”等词.如果用户输入的查询短语中包括一些使用频率极高的虚词如“2012奥运会的吉祥物”中的“的”字它几乎在所有文档中都会出现N次所以没有什么查询意义预处理阶段会将这些字词自动删去。

“2012” 、 “奥运” 、 “吉祥物”等形成本次的查询词表被送入索引服务器IndexServer中.索引服务器类似一本书后面的关键词索引表它是谷歌服务器所保存的所有网页数据的索引.将本次查询的关键词与索引表进行比对匹配定位出所有包含了该关键词的页面在文档服务器网页数据库 DOCServer中的位置。

如何写互联网毕业论文

播放:30574次评论:3035人

最后进行一系列优化处理去掉垃圾网页过滤掉过度人为SEO

搜索引擎优化过的广告网页等尽可能将最优的查询结果返回到用户的屏幕上 以列表的形式呈现最基本的内容包括标题、文档摘要、 网页链接.通过摘要可以判断是否为自己需要的内容点击链接即可打开实际的网页了。

至此完成一次完整的搜索。

垃圾页面是怎样过滤掉的

上例中可以看出共搜索出59万多条的结果却只用了秒.不过谷歌一般只显示不到1000条结果许多相似网页会被智能过滤掉.搜索结果同时会被进行本地化处理本土站点在查询结果中优先出现。

所谓的垃圾页面就是其中包含的结果与我们所想要的内容相去甚远甚至根本没有关联的页面.比如搜索“2012奥运会的吉祥物” 显示的却是连篇累牍的李莲英问候老佛爷“吉祥”的清宫小说显然不是我们想要的结果.另外还有无穷无尽的重复内容这些只会浪费我们宝贵的时间。

谷歌对搜索结果有一个优先排名它是通过一套“算法”来实现实际上就是计算机基于一系列规则所执行的一套操作指令.它首先寻找“信号”或是线索通过这种线索确定在上百万的网页中哪种对你提出的搜索请求关联性最大.假如我们走进一家餐厅问一句“比分多少?”这未免让人莫明其妙但如果刚刚有一场奥运会足球赛事结束别人就会知道你想问的是什么这就是正常对话的基本语境.谷歌算法也会智能判断你搜索的“基本语境” 从而返回最符合你需要的结果。

秒背后的真相

每次搜索成千上百万条结果每天超过几亿人次的搜索每人每次的搜索不到1秒如此不可思议的工作量谷歌空间是如何做到的?这同样得益于谷歌一整套完善的搜索“算法”

当我们将搜索请求提交到谷歌的网络服务器服务程序会把这个查询分摊给成千上万台机器 以便它们能在同一时刻为此次搜索服务.这就好比以前是你自己一个人去杂货店买东西而现在则有1000个人同时帮你找东西然后把它扔到你的手推车里。

谷歌尽可能将互联网上的所有内容都存储到它的巨大数据库中虽然不太可能 所以我们一直以为是在搜索实际的互联网其实我们一直在搜索的是谷歌的数据库.不过因为它的数据更新非常快所以感觉上与搜索实际的互联网也没有太多的不同。

前面说到为了让搜索更快谷歌有专门的索引服务器如同为所有网页建立的“卡片目录”  网络服务器派出成千上万的“助手”同时帮你翻找这些卡片目录效率自然是惊人的快了.索引服务器把所有的结果汇编后文档服务器

当然这只是冰山一角实际的算法远比这复杂成千上万倍。

神速搜索后的“硬道理”

软件的神奇还需要硬件的配合.当输入关键词开始查询时不同的搜索请求会寻找最便捷的路线通过不同的路径沿着光线电缆和其他连接方式到达位于世界各地的谷歌数据中心.每个谷歌搜索请求从用户的电脑到谷歌的数据中心平均经历了2400公里路程.这些数据以接近光速传播 以每小时几亿英里的速度为你返回答案。

数据中心中存有大量电脑作为服务器它们存储着庞大的数据.许多中型至大型的公司都拥有或使用某类型的数据中心但对谷歌来说数据中心尤其重要它是谷歌各种网络服务的速度及安全的保证.谷歌数据中心遍布全球每当我们存取Gma i l、编辑文件、发布图片到Google+或者是在谷歌上搜寻资料都是在使用谷歌其中的某一个数据中心。

谷歌数据中心主要集中于美国本土.以谷歌Dalles 达尔斯数据中心为例它位于俄勒冈州的波特兰以东约80英里旁边是哥伦比亚河河上有座大坝—Dalles大坝大坝为数据中心提供电力 当数据中心满载运行时消耗的电力基本上是纽卡斯尔所有家庭用电量的总和。

Dalles数据中心有2座4层楼高的冷却塔 四个装备有巨大空调设施的仓库内放置着数十万台网络服务器这些服务器每天处理着数十亿条谷歌网站传递给世界各个角落的用户的数据。

谷歌数据中心的服务器被安置在标准的海运集装箱中每个集装箱可容纳1160台服务器这些服务器由谷歌自主设计。

谷歌的数据中心高度机密对外一致保持着神秘色彩所以外界所知的信息十分有限.谷歌 的数据中心说明也是低调而简约有兴趣的朋友可以进一步探寻 .省略/about/datacente。

参考文献推荐

自考本科如何考研

本科论文大纲格式

本科自考毕业

自考本科毕业论文致谢

东南大学自考本科

小自考本科有用吗

本科论文检测要求

可以自考本科的学校

本科论文怎么查重

成考药学本科

本文doc格式:谷歌搜索按钮背后的秘密【论文】

“谷歌搜索按钮背后的秘密”文档源于网络本人编辑整理。本着保护作者知识产权的原则仅供学习交流请勿商用。如有侵犯作者权益请作者留言或者发站内信息联系本人我将尽快删除。谢谢您的阅读与下载

极光KVM(限时16元),洛杉矶三网CN2,cera机房,香港cn2

极光KVM创立于2018年,主要经营美国洛杉矶CN2机房、CeRaNetworks机房、中国香港CeraNetworks机房、香港CMI机房等产品。其中,洛杉矶提供CN2 GIA、CN2 GT以及常规BGP直连线路接入。从名字也可以看到,VPS产品全部是基于KVM架构的。极光KVM也有明确的更换IP政策,下单时选择“IP保险计划”多支付10块钱,可以在服务周期内免费更换一次IP,当然也可以不选择,...

DiyVM:50元/月起-双核,2G内存,50G硬盘,香港/日本/洛杉矶机房

DiyVM是一家比较低调的国人主机商,成立于2009年,提供VPS主机和独立服务器租用等产品,其中VPS基于XEN(HVM)架构,数据中心包括香港沙田、美国洛杉矶和日本大阪等,CN2或者直连线路,支持异地备份与自定义镜像,可提供内网IP。本月商家最高提供5折优惠码,优惠后香港沙田CN2线路VPS最低2GB内存套餐每月仅50元起。香港(CN2)VPSCPU:2cores内存:2GB硬盘:50GB/R...

华纳云,3折低至优惠云服务器,独立服务器/高防御服务器低至6折,免备案香港云服务器CN2 GIA三网直连线路月付18元起,10Mbps带宽不限流量

近日华纳云发布了最新的618返场优惠活动,主要针对旗下的免备案香港云服务器、香港独立服务器、香港高防御服务器等产品,月付6折优惠起,高防御服务器可提供20G DDOS防御,采用E5处理器V4CPU性能,10Mbps独享CN2 GIA高速优质带宽,有需要免备案香港服务器、香港云服务器、香港独立服务器、香港高防御服务器、香港物理服务器的朋友可以尝试一下。华纳云好不好?华纳云怎么样?华纳云服务器怎么样?...

谷歌搜索解析为你推荐
电脑桌面背景图片电脑桌面壁纸在哪里?!美女桌面背景图片最漂亮的美女电脑壁纸哪里有?百度空间首页怎样登录百度博客腾讯空间首页怎么才能让自己QQ空间被腾讯推荐在QQ空间首页里面?聚酯纤维和棉哪个好聚酯纤维和棉哪个好迈腾和帕萨特哪个好新迈腾和新帕萨特哪个更好一点·哪个更实用一点 ···明白人给解释一下·三国游戏哪个好玩三国系列的游戏哪个好玩?无纺布和熔喷布口罩哪个好活性碳口罩和无纺布口罩有什么不同?oppo和vivo哪个好vivo好还是oppo手机好呢?云盘哪个好网络云盘哪个好用
美国linux主机 lamp 博客主机 mysql主机 流量计费 免费申请个人网站 什么是web服务器 阿里云邮箱怎么注册 comodo 卡巴斯基免费版 neobux 瓦工招聘 隐士ddos 主机配置 次时代主机 lighttpdwindows 网络时间服务器 我的世界免费服务器 英国伦敦大学 英国伦敦塔桥 更多