大型网站系统架构演化之路

news/2024/5/10 11:31:22/文章来源:https://blog.csdn.net/LXB15959168136/article/details/49852649
  • 前言
  • 一、最开始的网站架构
  • 二、应用、数据、文件分离
  • 三、利用缓存改善网站性能
  • 四、使用集群改善应用服务器性能
  • 五、数据库读写分离和分库分表
  • 六、使用CDN和反向代理提高网站性能
  • 七、使用分布式文件系统
  • 八、使用NoSql和搜索引擎
  • 九、将应用服务器进行业务拆分
  • 十、搭建分布式服务
  • 小结

前言

一个成熟的大型网站(如淘宝、天猫、腾讯等)的系统架构并不是一开始设计时就具备完整的高性能、高可用、高伸缩等特性的,它是随着用户量的增加,业务功能的扩展逐渐演变完善的,在这个过程中,开发模式、技术架构、设计思想也发生了很大的变化,就连技术人员也从几个人发展到一个部门甚至一条产品线。所以成熟的系统架构是随着业务的扩展而逐步完善的,并不是一蹴而就;不同业务特征的系统,会有各自的侧重点,例如淘宝,要解决海量的商品信息的搜索、下单、支付,例如腾讯,要解决数亿用户实时消息传输,百度它要处理海量的搜索请求,他们都有各自的业务特性,系统架构也有所不同。尽管如此我们也可以从这些不同的网站背景下,找出其中共用的技术,这些技术和手段广泛运用在大型网站系统的架构中,下面就通过介绍大型网站系统的演化过程,来认识这些技术和手段。

一、最开始的网站架构

最初的架构,应用程序、数据库、文件都部署在一台服务器上,如图:

image

二、应用、数据、文件分离

随着业务的扩展,一台服务器已经不能满足性能需求,故将应用程序、数据库、文件各自部署在独立的服务器上,并且根据服务器的用途配置不同的硬件,达到最佳的性能效果。

image

三、利用缓存改善网站性能

在硬件优化性能的同时,同时也通过软件进行性能优化,在大部分的网站系统中,都会利用缓存技术改善系统的性能,使用缓存主要源于热点数据的存在,大部分网站访问都遵循28原则(即80%的访问请求,最终落在20%的数据上),所以我们可以对热点数据进行缓存,减少这些数据的访问路径,提高用户体验。

image

缓存实现常见的方式是本地缓存、分布式缓存。当然还有CDN、反向代理等,这个后面再讲。本地缓存,顾名思义是将数据缓存在应用服务器本地,可以存在内存中,也可以存在文件,OSCache就是常用的本地缓存组件。本地缓存的特点是速度快,但因为本地空间有限所以缓存数据量也有限。分布式缓存的特点是,可以缓存海量的数据,并且扩展非常容易,在门户类网站中常常被使用,速度按理没有本地缓存快,常用的分布式缓存是Memcached、Redis。

四、使用集群改善应用服务器性能

应用服务器作为网站的入口,会承担大量的请求,我们往往通过应用服务器集群来分担请求数。应用服务器前面部署负载均衡服务器调度用户请求,根据分发策略将请求分发到多个应用服务器节点。

架构4

常用的负载均衡技术硬件的有F5,价格比较贵,软件的有LVS、Nginx、HAProxy。LVS是四层负载均衡,根据目标地址和端口选择内部服务器,Nginx和HAProxy是七层负载均衡,可以根据报文内容选择内部服务器,因此LVS分发路径优于Nginx和HAProxy,性能要高些,而Nginx和HAProxy则更具配置性,如可以用来做动静分离(根据请求报文特征,选择静态资源服务器还是应用服务器)。

五、数据库读写分离和分库分表

随着用户量的增加,数据库成为最大的瓶颈,改善数据库性能常用的手段是进行读写分离以及分库分表,读写分离顾名思义就是将数据库分为读库和写库,通过主备功能实现数据同步。分库分表则分为水平切分和垂直切分,水平切分则是对一个数据库特大的表进行拆分,例如用户表。垂直切分则是根据业务的不同来切分,如用户业务、商品业务相关的表放在不同的数据库中。

架构3

六、使用CDN和反向代理提高网站性能

假如我们的服务器都部署在成都的机房,对于四川的用户来说访问是较快的,而对于北京的用户访问是较慢的,这是由于四川和北京分别属于电信和联通的不同发达地区,北京用户访问需要通过互联路由器经过较长的路径才能访问到成都的服务器,返回路径也一样,所以数据传输时间比较长。对于这种情况,常常使用CDN解决,CDN将数据内容缓存到运营商的机房,用户访问时先从最近的运营商获取数据,这样大大减少了网络访问的路径。比较专业的CDN运营商有蓝汛、网宿。

而反向代理,则是部署在网站的机房,当用户请求达到时首先访问反向代理服务器,反向代理服务器将缓存的数据返回给用户,如果没有缓存数据才会继续访问应用服务器获取,这样做减少了获取数据的成本。反向代理有Squid,Nginx。

架构5

七、使用分布式文件系统

用户一天天增加,业务量越来越大,产生的文件越来越多,单台的文件服务器已经不能满足需求,这时就需要分布式文件系统的支撑。常用的分布式文件系统有GFS、HDFS、TFS。

架构5.5

八、使用NoSql和搜索引擎

对于海量数据的查询和分析,我们使用nosql数据库加上搜索引擎可以达到更好的性能。并不是所有的数据都要放在关系型数据中。常用的NOSQL有mongodb、hbase、redis,搜索引擎有lucene、solr、elasticsearch。

架构6

九、将应用服务器进行业务拆分

随着业务进一步扩展,应用程序变得非常臃肿,这时我们需要将应用程序进行业务拆分,如百度分为新闻、网页、图片等业务。每个业务应用负责相对独立的业务运作。业务之间通过消息进行通信或者共享数据库来实现。

架构7

十、搭建分布式服务

这时我们发现各个业务应用都会使用到一些基本的业务服务,例如用户服务、订单服务、支付服务、安全服务,这些服务是支撑各业务应用的基本要素。我们将这些服务抽取出来利用分部式服务框架搭建分布式服务。阿里的Dubbo是一个不错的选择。

架构8

小结

大型网站的架构是根据业务需求不断完善的,根据不同的业务特征会做特定的设计和考虑,本文只是讲述一个常规大型网站会涉及的一些技术和手段。

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.luyixian.cn/news_show_905379.aspx

如若内容造成侵权/违法违规/事实不符,请联系dt猫网进行投诉反馈email:809451989@qq.com,一经查实,立即删除!

相关文章

Google分析中阻止垃圾SEO流量6种方法

当您担心假流量时,谁会关心假新闻?几年前,垃圾邮件是您电子邮件收件箱中的垃圾邮件。不久之后,电子邮件提供商创建了阻止垃圾邮件进入您的收件箱的过滤器,似乎您不必再担心它了。快乐的时光!但是,既然您已经拥有了一个网站,则垃圾邮件已重新成为您的雷,它正在追随您的…

今年应避免的网站营销错误

如果您希望您的企业拥有成功的互联网存在,会与您分享您在2019年应避免的7个营销错误。 如果没有网站,您就无法在当前的氛围中开展业务,并且您最需要该页面将访客转化为客户。以下七个提示可以帮助您使您的网站远离失败的境界。 您是否发现自己的网站流量充足,但客户却不是…

留意这5个黑帽SEO的迹象

黑帽SEO指的是帮助网站在谷歌排名更高的不道德行为。很多时候,一个网站甚至不知道它遭受黑帽搜索引擎优化 - 并因此而受到惩罚。 虽然黑帽可以暂时帮助谷歌的网站排名更高,搜索引擎最终会因为不良做法而降级。你需要知道如何识别黑帽SEO技术。以下是您网站和其他网站需要查看…

SEO的最佳URL结构是什么?

您的许多访问者都会通过点击链接访问您的网站,因此您可能想知道特定网页的实际网址中的内容是否真实重要。 您可能会惊讶地发现,当谈到现场搜索引擎优化时,您的网址看起来真的非常重要。 一、什么是URL结构? 您的网站URL作为您在网络上的地址。这是有人访问您网站页面的最…

通过关键词广告提高网站曝光和信任度

关键字广告和搜寻引擎优化 (SEO) 之间互相影响,协作使用时,可以达到更好的效果。 品牌曝光和信任 由于法例所限需要注明该片段为广告内容。一般人都知道广告是以钱换取曝光,对广告内容的信任程度会打折。但从心理学研究知道存在单纯曝光效应 Mere Exposure Effect,就是说…

关键词后计划时代的SEO成功4个技巧

如果您还没有收到或没有注意到,Google现在会限制关键字规划中的搜索量,以便为“每月支出较低”付费搜索的用户提供搜索量。这意味着,如果您没有在付费搜索上花费足够,那么“免费”工具对于确定有多少人搜索特定关键字实际上毫无用处。 对于许多使用该工具进行研究但没有资金…

SEO:HTML,XML网站地图介绍

站点地图有两种类型:HTML和XML。HTML网站地图主要是用来指导访问者的。XML网站地图可指导搜索引擎机器人,确保他们找到要索引的网站URL 。了解它们各自的优缺点将有助于您的搜索引擎优化。 XML网站地图 XML使信息机器可读。XML网站地图为搜索引擎提供了网站上URL的有效列表。…

您选择的虚拟主机类型会影响您的SEO?

标题 一、您的虚拟主机计划可以影响SEO吗? 谈到SEO,细节很重要。其中一个通常被忽视的细节是您选择的网络主机。通常,这是人们想到的最后一件事。 但是,您使用的托管类型会对您的排名产生重大影响。影响的程度取决于您网站的规模…

简单的小说阅读网站JavaWeb项目

暂时介绍一下这个项目目前有哪些功能 这是项目的主页 这是登录界面 这是注册页面 使用普通用户登录后 这是书酷界面 这是排行界面 这是书架界面 这是个人信息界面 这是书籍详情页 使用管理员登录后的用户信息界面 这是小说阅读页面 这是目录 这是一个音乐小插件&…

【实践】python 提取网站里面的汉字

提取网站里面的汉字 1、引入模块 requests(用于获取网站上的数据);json(用于解析json数据) # codingutf-8 import requests as r import json2、写入到txt a作为追加,不清空之前的数据 txt open("…

Struts,MVC 的一种开放源码实现用这种servlet和JSP框架管理复杂的大型网站

(转载自IBM developerWorks中国网站 java 专区,http://www-900.ibm.com/developerWorks/java/j-struts/index.shtml) Malcolm Davis顾问2001 年 2 月 内容: 简介 JSP 就是 servlet 别在我的 HTML 中使用太多的 Java MVC MVC Model 2 Struts 详细分析 Struts 邮件列表…

Struts,MVC 的一种开放源码实现用这种servlet和JSP框架管理复杂的大型网站

(转载自IBM developerWorks中国网站 java 专区,http://www-900.ibm.com/developerWorks/java/j-struts/index.shtml) Malcolm Davis顾问2001 年 2 月 内容: 简介 JSP 就是 servlet 别在我的 HTML 中使用太多的 Java MVC MVC Model 2 Struts 详细分析 Struts 邮件列表…

Struts,MVC 的一种开放源码实现用这种servlet和JSP框架管理复杂的大型网站

(转载自IBM developerWorks中国网站 java 专区,http://www-900.ibm.com/developerWorks/java/j-struts/index.shtml) Malcolm Davis顾问2001 年 2 月 内容: 简介 JSP 就是 servlet 别在我的 HTML 中使用太多的 Java MVC MVC Model 2 Struts 详细分析 Struts 邮件列表…

哪些权重7权重8的网站怎么做的!我的站就是这么做的!轻量级泛目录无需数据库适合所有网站所有cms只需要放在根目录即可

如题:哪些权重7 权重8的站都是怎么做上来的! 疫情期间大家都不好赚钱,出不了门,我偶尔让朋友看了一下我的站! 他也想做网站了,然后问我要插件!先上图 https://www.bilibili.com/video/BV1me41…

SEO,关键词扩充,文章自动生成,相关说明教程

比如说你的文章标题是:怎么写好一篇作文(好作文怎么写) ​ 编辑切换为居中 添加图片注释,不超过 140 字(可选) 通过插件获取标题然后 获得更多相关词 ​ 编辑切换为居中 添加图片注释,不超…

趋势迷-趋势网-网站源码打包下载源码开源无需数据库qushimi.com

趋势迷 趋势网 网站源码是一个php开发的程序! 全站无需数据库! 添加一点关键词即可甩手! 现 整站打包 开源无加密 无授权! 无论是 学习 还是运营 养站 都适合!!!! 直接服务器 打…

2022个人博客网站搭建笔记

历时11天我的第一个博客网站上线了。作为一个善于“反思”的中国人,当然要给自己来一把复盘和总结了。然后这篇笔记我就鸽了好几天,嘤嘤嘤。 www.ganggangfalcon.xyz 其实说实话,博客网站的搭建难度不大,比较耗时的地方在于网站的…

如何实现“Ipv6网站在线检测工具”

随着IPv6的普及,很多网站已经支持IPv6的访问,我们公司很多客户就要求网站支持IPv6,我们目前是推荐客户使用阿里云的IPv6的产品来实现。但是客户问题就来了,怎么检测网站支持IPv6访问呢,目前我们使用国家IPv6发展检测平…

如何用个人电脑利用ipv6搭建网站

如何用个人电脑利用ipv6搭建网站 需要的工具写在前面的话第一步第二步 需要的工具 一台拥有ipv6地址的个人电脑(Windows版) 没啦 ^ - ^ 写在前面的话 小白文章,请大佬指正 随着现在ipv6技术的普及,越来越多的电脑,…

本地做个注册会员的网站(非网络

做网站,先得有工具.我用的是Adobe DreamWeaver CS6. 做数据库表格,也得有工具,我用的是Microsoft Access 2007 做上面两者的连接,用的是DSP 还有自己的服务器IIS~~好吧不是6.0..系统自带的OJZ 第一步:建表 打开Access. 然后就按下图的1,2,3来操作 创建完之后,在菜单找到【…