大型网站架构演化

news/2024/5/22 10:42:26/文章来源:https://blog.csdn.net/weixin_34275734/article/details/94733926

前言

一个成熟的大型网站(如淘宝、京东等)的系统架构并不是开始设计就具备完整的高性能、高可用、安全等特性,它总是随着用户量的增加,业务功能的扩展逐渐演变完善的,在这个过程中,开发模式、技术架构、设计思想也发生了很大的变化,就连技术人员也从几个人发展到一个部门甚至一条产品线(大型网站的架构不是设计出来的,而是演化出来的)。所以成熟的系统架构是随业务扩展而完善出来的,并不是一蹴而就;不同业务特征的系统,会有各自的侧重点,例如淘宝,要解决海量的商品信息的搜索、下单、支付,例如腾讯,要解决数亿的用户实时消息传输,百度它要处理海量的搜索请求,他们都有各自的业务特性,系统架构也有所不同(因事成人,而不是因人成事)。尽管如此,我们也可以从这些不同的网站背景下,找出其中共用的技术,这些技术和手段可以广泛运行在大型网站系统的架构中,下面就通过介绍大型网站系统的演化过程,来认识这些技术和手段。(没有银弹

如何应对高并发?

 

 

 

 

 

 

 

一、最开始的网站架构

最初的架构,应用程序、数据库、文件都部署在一台服务器上,如图:

 

 

PV  UV  IP

 

 

 

 

 

 

二、应用、数据、文件分离

随着业务的扩展,一台服务器已经不能满足性能需求,故将应用程序、数据库、文件各自部署在独立的服务器上,并且根据服务器的用途配置不同的硬件,达到最佳的性能效果。(水平扩展)

 

 

 

 

 

 

 

三、利用缓存改善网站性能(网站性能优化的第一步,就是使用缓存)

在硬件优化性能的同时,同时也通过软件进行性能优化,在大部分的网站系统中,都会利用缓存技术改善系统的性能,使用缓存主要源于热点数据的存在,大部分网站访问都遵循28原则(即80%的访问请求,最终落在20%的数据上),所以我们可以对热点数据进行缓存,减少这些数据的访问路径,提高用户体验。

 

 

缓存实现常见的方式是本地缓存、分布式缓存。当然还有CDN、反向代理、客户端缓存等。本地缓存,顾名思义是将数据缓存在应用服务器本地。本地缓存的特点是速度快,但因为本地空间有限所以缓存数据量也有限。分布式缓存的特点是,可以缓存海量的数据,并且扩展非常容易,速度按理没有本地缓存快,常用的分布式缓存是Membercache、Redis。

 

 

 

 

 

 

 

 

 

 

 

 

 

 

四、使用集群改善应用服务器性能

应用服务器作为网站的入口,会承担大量的请求,我们往往通过应用服务器集群来分担请求数。应用服务器前面部署负载均衡服务器调度用户请求,根据分发策略将请求分发到多个应用服务器节点(用户持久化)。

 

 

常用的负载均衡技术硬件的有F5,价格比较贵,软件的有LVS、Nginx、HAProxy。LVS是四层负载均衡,根据目标地址和端口选择内部服务器,Nginx和HAProxy是七层负载均衡,可以根据报文内容选择内部服务器,因此LVS分发路径优于Nginx和HAProxy,性能要高些,而Nginx和HAProxy则更具配置性,如可以用来做动静分离(根据请求报文特征,选择静态资源服务器还是应用服务器)。

 

五、数据库读写分离和分库分表

随着用户量的增加,数据库成为最大的瓶颈(木桶理论),改善数据库性能常用的手段是进行读写分离以及分表,读写分离顾名思义就是将数据库分为读库和写库,通过主备功能实现数据同步。分库分表则分为水平切分和垂直切分,水平切换则是对一个数据库特大的表进行拆分,例如用户表。垂直切分则是根据业务不同来切换,如用户业务、商品业务相关的表放在不同的数据库中。

 

 

 

 

 

六、使用CDN和反向代理提高网站性能

假如我们的服务器都部署在成都的机房,对于四川的用户来说访问是较快的,而对于北京的用户访问是较慢的,这是由于四川和北京分别属于电信和联通的不同发达地区,北京用户访问需要通过互联路由器经过较长的路径才能访问到成都的服务器,返回路径也一样,所以数据传输时间比较长。对于这种情况,常常使用CDN(互联网的第一心跳)解决,CDN将数据内容缓存到运营商的机房,用户访问时先从最近的运营商获取数据,这样大大减少了网络访问的路径。比较专业的CDN运营商有蓝汛、网宿。

而反向代理(FQ、客户端游戏代理,服务端代理),则是部署在网站的机房,当用户请求达到时首先访问反向代理服务器,反向代理服务器将缓存的数据返回给用户,如果没有没有缓存数据才会继续走应用服务器获取,也减少了获取数据的成本。反向代理有Squid,Nginx。

 

 

 

 

 

 

 

七、使用分布式文件系统

用户一天天增加,业务量越来越大,产生的文件越来越多,单台的文件服务器已经不能满足需求。需要分布式的文件系统支撑。常用的分布式文件系统有NFS,淘宝的TFS、google的GFS。

 

 

 

 

 

八、使用NoSql和搜索引擎

对于海量数据的查询,我们使用nosql数据库加上搜索引擎可以达到更好的性能。并不是所有的数据都要放在关系型数据中。常用的NOSQL有mongodb和redis,搜索引擎有Lucene

 

 

 

 

 

九、将应用服务器进行业务拆分

随着业务进一步扩展,应用程序变得非常臃肿,这时我们需要将应用程序进行业务拆分,如百度分为新闻、网页、图片等业务。每个业务应用负责相对独立的业务运作。业务之间通过消息进行通信或者同享数据库来实现(垂直切分、水平切分)。

 

 

 

 

 

十、搭建分布式服务

这时我们发现各个业务应用都会使用到一些基本的业务服务,例如用户服务、订单服务、支付服务、安全服务,这些服务是支撑各业务应用的基本要素。我们将这些服务抽取出来利用分部式服务框架搭建分布式服务。淘宝的Dubbo是一个不错的选择(服务注册、查找、通信、稳定)。

 

 

 

 

 

小结

大型网站的架构是根据业务需求不断完善的,根据不同的业务特征会做特定的设计和考虑,本文只是讲述一个常规大型网站会涉及的一些技术和手段。

 

 

 

 

 

何谓大数据(Hadoop)的分布式服务器,怎么理解分布式服务框架?

1.对于实际任务来说,横向的并行往往不是把数据文件分成若干份运算那么简单。
2.分布式要解决的问题往往是可以线性分割的。
3.现在分布式解决的主要问题其实还是对于大数据量的解决。

1、约束需要对外提供的功能,保证其以一个统一的方式来对外提供和获取;

转载于:https://www.cnblogs.com/zhengqian/p/8715372.html

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.luyixian.cn/news_show_761757.aspx

如若内容造成侵权/违法违规/事实不符,请联系dt猫网进行投诉反馈email:809451989@qq.com,一经查实,立即删除!

相关文章

js 网页 隐藏地址栏_微软开放新开源网站;一行代码错误:5亿美金没了;Chrome86继续隐藏URL...

导读:本文给各位安利几个对于开发者有用的资讯和经验,希望对大家有借鉴。微软上线新开源网站近年来,微软对开放源代码似乎是上了瘾,细数下来它陆陆续续开源了不少产品,而且还增加了很多更新频率。这不,它刚…

克隆网站工具_一款开源且超好用的网站克隆机 HTTrack

0x00 前言我们在学习前端的时候,总是会想着去学习其他人网站是如何制作的,或者我们遇到一些比较有用的知识点的时候,我们可能会选择通过 Ctrl C / Ctrl V 去扒下内容,然而我并非是鼓励这种扒网站的行为,不过只要是开…

Jmter接口网站压力测试工具使用记录

1.首先下载Jmeter 官方地址:http://jmeter.apache.org/ 2.安装Jmeter 把下载的文件进行解压,产生如下目录:打开bin文件夹下的jmeter.bat文件及进入程序的主界面窗体jmeter.log是日志文件。主意:需要配置java环境。3.jmter创建一个…

(大型网站之Nginx)图解正向代理、反向代理、透明代理

一、正向代理(Forward Proxy)一般情况下,如果没有特别说明,代理技术默认说的是正向代理技术。关于正向代理的概念如下: 正向代理(forward)是一个位于客户端【用户A】和原始服务器(origin server)【服务器B】之间的服务器【代理服务器Z】&…

从零开始建站(二) - 数据库与项目规划

简介: 这节来介绍个人网站项目的数据库字段选择与项目整体的规划,上一节讲了准备工作和环境搭建,就好比建一栋大楼,上节我们把材料买齐了,地基打好了,然后我们这节就是来思考一下我们要怎样利用这些材料&am…

vc++使用cookie登录网站

以http://www.idc816.com为例 效果图: 1)先登录获取cookie,再使用cookie获取用户信息 2)记录cookie,关闭程序后重新运行程序,直接获取用户信息 使用Fiddler抓包分析: 由于IWinHttpRequest对象会自动处理302跳转,但是服务器返回的cookie&#…

微信打开网站被提示已停止访问该网页该如何解决

2019独角兽企业重金招聘Python工程师标准>>> 今天早晨发现我们公司网站只要在微信和qq中打开,分别被微信提示:已停止访问该网页,该网站链接以及在qq上被提示危险网站,千万别访问,首先先看下微信中打开网址被微信拦截并…

大型网站技术架构(四)网站的高性能架构

2019独角兽企业重金招聘Python工程师标准>>> 网站性能是客观的指标,可以具体体现到响应时间、吞吐量、并发数、性能计数器等技术指标。 1、性能测试指标 1.1 响应时间 指应用执行一个操作需要的时间,指从发出请求到最后收到响应数据所需要的时…

大型网站技术架构(七)网站的可扩展性架构

2019独角兽企业重金招聘Python工程师标准>>> 扩展性是指对现有系统影响最小的情况下,系统功能可持续扩展或提升的能力。 设计网站可扩展架构的核心思想是模块化,并在此基础上,降低模块间的耦合性,提供模块的复用性。模…

电商网站模板_企业商城解决方案:微购物商城网站怎么做

随着互联网电商的发展,微购物商城也开始流行起来。这种商城网站可以避免商家被电商平台抽佣,商家自己也无需缴纳高额推广费,可以节约不少成本。如何做好一个购物商城网站?至少要保证这几点:1.用美观的建站系统千万不要…

配置侧边栏_用Python制作网站Django实操与开发环境配置

上篇文章简单介绍了Django的基础知识,本篇将进入实际操作部分,包括Django的运行环境、开发环境配置与新建项目等内容。由于篇幅原因,笔者不得不把Demo演示放到下一篇文章,望读者(如果有的话)见谅。笔者曾有过一句感叹:…

html怎么快速收录,5个小技巧让你的网站快速被收录

网站文章收录的越快,意味着网站的搜索引擎关注度越高,那如何快速的提高网站收录呢?今天就来讲一讲搜索引擎收录的小技巧。1、优化网站布局任何一个网站,不管是个人网站、企业网站还是门户网站,建站之时首先要确定的就是网站的整体…

Vue + Spring Boot从零开始搭建个人网站(一) 之 项目前端Vue.js环境搭建

前言: 最近在考虑搭建个人网站,想了想决定采用前后端分离模式 前端使用Vue,负责接收数据 后端使用Spring Boot,负责提供前端需要的API 就这样开启了我边学习边实践之旅 Vue环境搭建步骤: 1、安装node.js a)进入node.js…

记一次网站架构的搭建

文章目录节点规划主机名、防火墙、时钟源设置NFS配置配置nginx配置LVS配置php配置tomcat数据库配置配置MHAredis配置session会话共享配置思路: lvskeepalived实现四层负载均衡nginx做七层负载均衡和反向代理nfs做静态资源异地容灾tomcatphp做后端动态页面解析mysql…

[转载]网站建设公司赚钱的案例分析

去年年底我写过一篇文章《网站建设公司不挣钱的原因》,当时还罗列过很多不挣钱原因以及建议。现在我想用托尔斯泰的一句话:“赚钱的公司都是一样的,不赚钱的公司各有各的问题”。就在今年,2013年,遇到了一个建站公司的…

shell 获取gcc版本_网站漏洞修复对WordPress 致命漏洞注入shell

2019年8月刚开始,WordPress最新版本存在远程代码注入获取SHELL漏洞,该网站漏洞影响的版本是wordpress5.0.0,漏洞的产生是因为image模块导致的,因为代码里可以进行获取目录权限,以及文件包含功能,导致远程代…

html5多个图片位置_为什么你的网站那么慢?本篇将带你掌握前端HTML5性能优化的技巧...

点击上方 关注订阅黑码教主获取更多精彩内容性能之前端篇循环优化在多重嵌套循环的程序上,如果能分出出多个独立循环也比嵌套在一个循环体内来的更有益。优化循环的3种方式:减少每次迭代的开销、减少迭代的次数或者重新设计应用程序。在测试的时候仅可能…

django网站实例源码_以Django框架为例,搞清楚ORM是什么

ORM 的完整英文名称是:Object-Relation Mapping,翻译成中文就是:对象-关系映射。数据持久化当我们使用Django开发网站时,很重要的一件工作就是要把用户的数据保存起来,例如用户名、密码还有用户的文章等等内容&#xf…

scratch角色素材网站_和京京一起scratch编程--基础篇-背景-声音

“ 纸上得来终觉浅,绝知此事要躬行。”小马过河,是我小学二年级学过的一篇语文。这么多年来,我对该内容印象深刻,就像昨天刚学过一样。其文寓意切合我们本文的主题--纸上得来终觉浅,绝知此事要躬行。01—背景-声音天对…

锚文本链接用html怎么做,SEO网站链接怎么做 简单几步来教你做锚文本链接

1、打开Dreamweaver,找到选项来设置超链接,进行设置;2、点超链接设置后,会出现一个对话框,显示要设置的链接;3、两个链接都制作成功后,可以稍加修改,使网页更好看些,在两…