让知识连接你我
投稿赚钱
当前位置: 首页 > Linux > 大型网站的业务系统架构演化之路,讲解这类技术和手段
  • 101
  • 微信分享

    扫一扫,在手机上查看

大型网站的业务系统架构演化之路,讲解这类技术和手段

2019.09.19 16:57 276 浏览 举报

  一个成熟稳重的大型网站(如淘宝、天猫、腾讯等)的系统架构并非是刚开始布置时就具有完美的高性能、高可用、高伸缩式等特征的,那是伴随着访问量的增多,业务流程功能模块的扩充慢慢转变健全的,在这个流程中,开发模式、技术架构、布置观念也产生了挺大的转变,就连专业人员也从几个人进步到一个部门以至于一条产品策略。因此成熟稳重的系统架构是伴随着业务流程的扩充而不断完善的,并非是 一成不变;差异业务流程特征的系统,会有各有的侧重点,比如说淘宝要解决大量的产品信息的检索、提交订单、支付方式;比如说腾讯要解决数亿用户的实时信息传送;百度它要解决大量的检索请求;它们都是有各有的业务流程特征,系统架构也各有不同。即便如此我们还可以从这类差异的网站情况下,找到当中同用的技术,这类技术和手段通常运用在大型网站系统的架构中,接下来就运用讲解大型网站系统的演化过程,来了解这类技术和手段。

  一、刚开始的网站架构

  最开始的架构,应用程序、数据库、文档都部署在一台服务器上,如图:

website_architecture_1.png

  大型网站系统架构进化之路大型网站系统架构进化之路

  二、运用、数据、文档剥离

  伴随着业务流程的扩充,一台服务器早已无法考虑性能需求,故将应用程序、数据库、文档各有部署在独立自主的服务器上,而且运用服务器的用处配置差异的硬件,保持良好的性能效果。

website_architecture_2.png

  三、运用缓存改进网站性能

  在硬件提升性能的另外,另外也运用软件开展性能提升,在大部分的网站系统中,都要运用缓存技术改进系统的性能,应用缓存关键源于热点数据的具有,大部分网站访问都遵循28原则(即80%的访问请求,最后落在20%的数据上),因此我们能够对热点数据开展缓存,降低这类数据的访问路径,保持良好网站用户体验。

website_architecture_3.png

  缓存通常的保持方式是本地缓存、分布式缓存。自然也有CDN、反向代理等,这个后面再讲。本地缓存,顾名思义是将数据缓存在应用服务器本地,能够具有内存中,还可以具有文档,OSCache便是最常用的本地缓存组件。本地缓存的特征是速度快,但因此本地空间不足因此缓存数据量也不足。分布式缓存的特征是,能够缓存大量的数据,而且扩充比较容易,在门户类网站中经常被应用,速度按理都没有本地缓存快,最常用的分布式缓存是Memcached、Redis。

  四、使用集群改善应用服务器性能

  应用服务器作为网站的入口,会承担大量的请求,我们往往通过应用服务器集群来分担请求数。应用服务器前面部署负载均衡服务器调度用户请求,根据分发策略将请求分发到多个应用服务器节点。

website_architecture_4.png

  常用的负载均衡技术硬件的有F5,价格比较贵,软件的有LVS、Nginx、HAProxy。LVS是四层负载均衡,根据目标地址和端口选择内部服务器,Nginx和HAProxy是七层负载均衡,可以根据报文内容选择内部服务器,因此LVS分发路径优于Nginx和HAProxy,性能要高些,而Nginx和HAProxy则更具配置性,如可以用来做动静分离(根据请求报文特征,选择静态资源服务器还是应用服务器)。

  五、数据库读写分离和分库分表

  随着用户量的增加,数据库成为最大的瓶颈,改善数据库性能常用的手段是进行读写分离以及分库分表,读写分离顾名思义就是将数据库分为读库和写库,通过主备功能实现数据同步。分库分表则分为水平切分和垂直切分,水平切分则是对一个数据库特大的表进行拆分,例如用户表。垂直切分则是根据业务的不同来切分,如用户业务、商品业务相关的表放在不同的数据库中。

website_architecture_5.png

  六、使用CDN和反向代理提高网站性能

  假如我们的服务器都部署在成都的机房,对于四川的用户来说访问是较快的,而对于北京的用户访问是较慢的,这是由于四川和北京分别属于电信和联通的不同发达地区,北京用户访问需要通过互联路由器经过较长的路径才能访问到成都的服务器,返回路径也一样,所以数据传输时间比较长。对于这种情况,常常使用CDN解决,CDN将数据内容缓存到运营商的机房,用户访问时先从最近的运营商获取数据,这样大大减少了网络访问的路径。比较专业的CDN运营商有蓝汛、网宿。

website_architecture_6.png

  而反向代理,则是部署在网站的机房,当用户请求达到时首先访问反向代理服务器,反向代理服务器将缓存的数据返回给用户,如果没有缓存数据才会继续访问应用服务器获取,这样做减少了获取数据的成本。反向代理有Squid,Nginx。

  七、使用分布式文件系统

  用户一天天增加,业务量越来越大,产生的文件越来越多,单台的文件服务器已经不能满足需求,这时就需要分布式文件系统的支撑。常用的分布式文件系统有GFS、HDFS、TFS。

website_architecture_7.png

  八、使用NoSql和搜索引擎

  对于海量数据的查询和分析,我们使用nosql数据库加上搜索引擎可以达到更好的性能。并不是所有的数据都要放在关系型数据中。常用的NOSQL有mongodb、hbase、redis,搜索引擎有lucene、solr、elasticsearch。

website_architecture_8.png

  九、将应用服务器进行业务拆分

  随着业务进一步扩展,应用程序变得非常臃肿,这时我们需要将应用程序进行业务拆分,如百度分为新闻、网页、图片等业务。每个业务应用负责相对独立的业务运作。业务之间通过消息进行通信或者共享数据库来实现。


  十、搭建分布式服务

  这时我们发现各个业务应用都会使用到一些基本的业务服务,例如用户服务、订单服务、支付服务、安全服务,这些服务是支撑各业务应用的基本要素。我们将这些服务抽取出来利用分部式服务框架搭建分布式服务。阿里的Dubbo是一个不错的选择。

website_architecture_10.png

本文首次发布于开创者素材 ,转载请注明出处,谢谢合作!

相关文章推荐