大型网站系统架构的演化

news/2024/5/13 13:58:16/文章来源:https://blog.csdn.net/smh821025/article/details/43737391

前言


   一个成熟的大型网站(如淘宝、京东等)的系统架构并不是开始设计就具备完整的高性能、高可用、安全等特性,它总是随着用户量的增加,业务功能的扩展逐渐演变完善的,在这个过程中,开发模式、技术架构、设计思想也发生了很大的变化,就连技术人员也从几个人发展到一个部门甚至一条产品线。所以成熟的系统架构是随业务扩展而完善出来的,并不是一蹴而就;不同业务特征的系统,会有各自的侧重点,例如淘宝,要解决海量的商品信息的搜索、下单、支付,例如腾讯,要解决数亿的用户实时消息传输,百度它要处理海量的搜索请求,他们都有各自的业务特性,系统架构也有所不同。尽管如此我们也可以从这些不同的网站背景下,找出其中共用的技术,这些技术和手段可以广泛运行在大型网站系统的架构中,下面就通过介绍大型网站系统的演化过程,来认识这些技术和手段。


一、最开始的网站架构


   最初的架构,应用程序、数据库、文件都部署在一台服务器上,如图:



二、应用,数据,文件分离


   随着业务的扩展,一台服务器已经不能满足性能需求,故将应用程序、数据库、文件各自部署在独立的服务器上,并且根据服务器的用途配置不同的硬件,达到最佳的性能效果。



三、利用缓存改善网站性能


  在硬件优化性能的同时,同时也通过软件进行性能优化,在大部分的网站系统中,都会利用缓存技术改善系统的性能,使用缓存主要源于热点数据的存在,大部分网站访问都遵循28原则(即80%的访问请求,最终落在20%的数据上),所以我们可以对热点数据进行缓存,减少这些数据的访问路径,提高用户体验。


   缓存实现常见的方式是本地缓存、分布式缓存。当然还有CDN、反向代理等,这个后面再讲。本地缓存,顾名思义是将数据缓存在应用服务器本地,可以存在内存中,也可以存在文件,OSCache就是常用的本地缓存组件。本地缓存的特点是速度快,但因为本地空间有限所以缓存数据量也有限。分布式缓存的特点是,可以缓存海量的数据,并且扩展非常容易,在门户类网站中常常被使用,速度按理没有本地缓存快,常用的分布式缓存是Memcached、Redis。


四、使用集群改善应用服务器性能


   应用服务器作为网站的入口,会承担大量的请求,我们往往通过应用服务器集群来分担请求数。应用服务器前面部署负载均衡服务器调度用户请求,根据分发策略将请求分发到多个应用服务器节点。


   常用的负载均衡技术硬件的有F5,价格比较贵,软件的有LVS、Nginx、HAProxy。LVS是四层负载均衡,根据目标地址和端口选择内部服务器,Nginx是七层负载均衡和HAProxy支持四层、七层负载均衡,可以根据报文内容选择内部服务器,因此LVS分发路径优于Nginx和HAProxy,性能要高些,而Nginx和HAProxy则更具配置性,如可以用来做动静分离(根据请求报文特征,选择静态资源服务器还是应用服务器)。


五、数据库读写分离和分库分表


   随着用户量的增加,数据库成为最大的瓶颈,改善数据库性能常用的手段是进行读写分离以及分表,读写分离顾名思义就是将数据库分为读库和写库,通过主备功能实现数据同步。分库分表则分为水平切分和垂直切分,水平切换则是对一个数据库特大的表进行拆分,例如用户表。垂直切分则是根据业务不同来切换,如用户业务、商品业务相关的表放在不同的数据库中。



六、使用CDN和反向代理提高网站性能


   假如我们的服务器都部署在成都的机房,对于四川的用户来说访问是较快的,而对于北京的用户访问是较慢的,这是由于四川和北京分别属于电信和联通的不同发达地区,北京用户访问需要通过互联路由器经过较长的路径才能访问到成都的服务器,返回路径也一样,所以数据传输时间比较长。对于这种情况,常常使用CDN解决,CDN将数据内容缓存到运营商的机房,用户访问时先从最近的运营商获取数据,这样大大减少了网络访问的路径。比较专业的CDN运营商有蓝汛、网宿。

   而反向代理,则是部署在网站的机房,当用户请求达到时首先访问反向代理服务器,反向代理服务器将缓存的数据返回给用户,如果没有没有缓存数据才会继续走应用服务器获取,也减少了获取数据的成本。反向代理有Squid,Nginx。




七、使用分布式文件系统


   用户一天天增加,业务量越来越大,产生的文件越来越多,单台的文件服务器已经不能满足需求。需要分布式的文件系统支撑。常用的分布式文件系统有NFS。



八、使用NoSql和搜索引擎


   对于海量数据的查询,我们使用nosql数据库加上搜索引擎可以达到更好的性能。并不是所有的数据都要放在关系型数据中。常用的NOSQL有mongodb和redis,搜索引擎有lucene。



九、将应用服务器进行业务拆分


   随着业务进一步扩展,应用程序变得非常臃肿,这时我们需要将应用程序进行业务拆分,如百度分为新闻、网页、图片等业务。每个业务应用负责相对独立的业务运作。业务之间通过消息进行通信或者同享数据库来实现。



十、搭建分布式服务


          这时我们发现各个业务应用都会使用到一些基本的业务服务,例如用户服务、订单服务、支付服务、安全服务,这些服务是支撑各业务应用的基本要素。我们将这些服务抽取出来利用分部式服务框架搭建分布式服务。淘宝的Dubbo是一个不错的选择。



小结


         大型网站的架构是根据业务需求不断完善的,根据不同的业务特征会做特定的设计和考虑,本文只是讲述一个常规大型网站会涉及的一些技术和手段。


该博文转载自http://www.cnblogs.com/leefreeman/p/3993449.html

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.luyixian.cn/news_show_871135.aspx

如若内容造成侵权/违法违规/事实不符,请联系dt猫网进行投诉反馈email:809451989@qq.com,一经查实,立即删除!

相关文章

大型网站架构演变和知识体系

原文链接:http://www.blogjava.net/BlueDavy/archive/2008/09/03/226749.html 之前也有一些介绍大型网站架构演变的文章,例如LiveJournal的、ebay的,都是非常值得参考的,不过感觉他们讲的更多的是每次演变的结果,而没有…

免费jsp空间建站攻略【eatj】【入门】【教程】

我的网站-免费jsp空间建站攻略 1 申请免费的jsp空间 1.1 进入 http://www.eatj.com 1.2 申请注册 1.3 注册成功 1.4 打开确认邮件,点击确认链接 1.5 确认成功 1.6 登录页面 1.7 登录 1.8 关键信息 2 网站设计 2.1 文件结构 2.2 web.xml 2.3 index.jsp 2.…

[转贴] 著名社交网站LinkedIn的Java架构技术

在JavaOne 2008的会议上,著名社交网站LinkedIn的开发者做了2个关于LinkedIn网站的架构技术的演讲,目前这两个演讲的PPT已经可以下载了。下载地址如下: LinkedIn - A Professional Social Network Built with Java™ Technologies and Agile …

XAMPP修改Apache默认网站目录htdocs

方法/步骤 打开文件xampp\apache\conf\httpd.conf 在httpd.conf文件中找到DocumentRoot "I:/xampp/htdocs" 步骤阅读 3 修改httpd.conf文件中的内容为DocumentRoot "D:/www" 4 在D盘新建一个www文件夹,重启apache,将文件移到w…

JSP+SQL企业门户网站

<% page language"java" contentType"text/html; charsetUTF-8" pageEncoding"UTF-8"%> 代码已经上传github&#xff0c;下载地址&#xff1a; https://github.com/21503882/companydoor <!DOCTYPE html PUBLIC "-//W3C//DTD…

java+mysql+servlet论坛网站BBS

管理员子系统功能划分 管理员子系统完成本论坛各种信息的管理与维护的功能&#xff0c;管理员子系统包括的主要功能模块有权限管理、发帖、回帖、修改个人用户信息、发帖状态设置。管理员子系统功能模块图如图4-1。 代码已经上传github&#xff0c;下载地址&#xff1a;https:/…

基于Spring+SpringMvc+Hibernate的JSP+MYSQL保健品销售网站

基于SpringSpringMvcHibernate的JSPMYSQL保健品销售网站 1.包含源程序&#xff0c;数据库脚本。代码和数据库脚本都有详细注释。 2.课题设计仅供参考学习使用&#xff0c;可以在此基础上进行扩展完善 代码已经上传github&#xff0c;下载地址 https://github.com/21503882/sa…

基于java的志愿者交流网站

技术&#xff1a;Java、JSP等 摘要&#xff1a; 随着社会的发展&#xff0c;人民自身素质水平的提高&#xff0c;志愿活动越来越成为大家实现自身价值&#xff0c;投身社会建设的一项主流活动。一项有意义的志愿活动不仅有利于人文社会的建设&#xff0c;还能使志愿者的综合素质…

基于Java的婴幼儿产品销售网站

技术&#xff1a;Java、JSP等 摘要&#xff1a; 婴幼儿产品销售是指各婴幼儿产品生产企业通过电子商务网站的形式&#xff0c;利用网络进行的多种形式销售。是将传统的线下商品销售业务通过与互联网的结合&#xff0c;形成线上线下双渠道的销售模式&#xff0c;即商家利用现有的…

java通过Cookie实现网站自动登录

第一步&#xff0c;登陆的时候如果选择了[自动登录]的选项&#xff0c;则需要在登陆成功后&#xff0c;附加下面的代码 应为一般网站都提供保存用户名的功能&#xff0c;所以我把这个写到了外面。只有密码是单独处理的。 其中的host就是你的域名 login.jsp Java代码 String …

如何搭建个人网站

首先&#xff0c;申明下本文所指的新人是指会上网站看网页&#xff0c;会自己聊QQ&#xff0c;会在新浪、网易等平台上写博客的人。当然你要说这个只要会上网的人都会了&#xff0c;是的&#xff0c;我所指的新人就是会上网的人。所以本文的技术含量不会很高&#xff0c;高手可…

网站大访问量如何应对(1)

作为一个合格的架构师&#xff0c;需要熟悉网络架构&#xff0c;服务器架构&#xff0c;其次才是应用程序开发。 1负载均衡&#xff0c;让一堆机器来对外提供服务 常见的负载均衡方案有很多&#xff0c;比如DNS域名解析&#xff0c;nginx反向代理&#xff0c;根据ISO七层网络模…

怎么反爬虫爬取网站信息

我们在爬取网站的时候&#xff0c;都会遵守 robots 协议&#xff0c;在爬取数据的过程中&#xff0c;尽量不对服务器造成压力。但并不是所有人都这样&#xff0c;网络上仍然会有大量的恶意爬虫。对于网络维护者来说&#xff0c;爬虫的肆意横行不仅给服务器造成极大的压力&#…

iis网站替换ssl证书注意事项

1.在iis中添加证书&#xff1b; 2.中级证书需要注册&#xff0c;添加详细信息&#xff1b; 3.更新网站证书&#xff1b; 4.防火墙的wap上需要更新证书&#xff0c;一定要注意&#xff1b;

22个免费的UI界面设计工具、资源及网站

1.原型界面制作工具Lumzy 官方地址&#xff1a;http://www.lumzy.com/ Lumzy是一个网站应用和原型界面制作工具。使用Lumzy&#xff0c;您可以轻松创建UI模型并即时发送到客户电脑中。 Lumzy还具有团队协作编辑工具。 2.在线工具Mockingbird 官方地址&#xff1a;https://go…

使用百度 google 搜索特定网站下的 文件类型

有不少朋友在上网的时候可能会遇到这样的困惑&#xff1a;如何搜索某一类的文件&#xff0c;而不是网页内容&#xff1f;如&#xff0c;我想搜索ppt文件&#xff0c;我想搜索某一个网站的ppt文件&#xff0c;该如何搜索呢&#xff1f; filetype可以帮到我们完成这一搜索问题。…

[R语言] 快速搭建网站——使用shiny实现聚类算法可视化

前言 建模的过程一向是枯燥乏味的&#xff0c;今天就让我们用R语言中丰富的可视化工具&#xff0c;自己搭建一个网站&#xff0c;实现聚类算法的可视化。源码已上传至我的资源空间&#xff0c;感兴趣的朋友可以在这里查看&#xff0c;一起学习、一起提高。网站效果如下&#x…

[R语言] 快速搭建网站——使用shiny实现时间序列预测过程可视化

前言 之前我们发布了一篇 “[R语言] 快速搭建网站——使用shiny实现聚类算法可视化” 的文章 参考这里&#xff0c;本文沿着同样的思路&#xff0c;去繁存简&#xff0c;更加简单实用的展示了时间序列预测的一般过程&#xff0c;算是用R语言实现数据分析可视化的另一个实例吧。…

推荐几个无版权的免费图片网站

文/方子龙 平常在写作和写博客时&#xff0c;需要找配图的时候&#xff0c;没找到免费无版权的图片&#xff0c;而且又不高清。我自己花时间收集整理一些免费无版权的图片网站&#xff0c;分享。 1. pixabay 惊人的免费图片—发现我们慷慨的社区分享的 0.1 百万张图片和视频。…

纯css 网站导航

这两天重新把前端的只是梳理了下&#xff0c;按照简约的设计理念做了几套样例&#xff0c;记录下&#xff0c;方便自己方便他人。先上结果图&#xff0c;一个很简单的网站导航&#xff0c;没有图片&#xff0c;没有JS 为了方便查看&#xff0c;css样式没有分开&#xff0c;下面…