
从字面来看,构建应该是多方位,多角度考虑的建设行为,是一个综合的过程。
在网站构建过程中,我们应该考虑哪些
1、网站的速度
2、网站的美观
3、网站的用户体验
4、网站的安全
5、网站和企业需求的匹配度
6、网站的生存周期
7、选择好的服务商
互联网有一项著名的8秒原则:客户在访问网站时,假如下载需要太长时间,他们就会放弃访问。据调查有近50%的用户由于网页速度不稳定或页面下载速度过慢,而停止访问曾经推崇的网站。
指我们网站打开的速度怎么样,是用1s就能打开,还是需要5S,甚至更长。
如果很短的话,比如:05S,那么恭喜您,你的网站的速度是很不错的。高于3-5秒,就是很不理想的值了,假如时间超过8秒浏览者就会感到不耐烦甚至就直接封闭网页了。
网站的速度和哪些信息有关呢?
一、网页内容的大小;
网页内容所包括的文本、产品的(静态的,动态的)、视频、Flash文件等。这里涉及到浏览器的原理,浏览器的技术原理就是将网页下载到客户本地缓存,然后通过浏览器解析源码,以浏览器窗口编译出用户可以正常阅读的和文字,因此,网页文件的大小决定了网站是否能快速打开。
二、网络带宽
网络的带宽包括对接点和客户端两个位置,对接点指的是出口端(如电信对网通的对接点),另一个就是浏览者自己本身的带宽;
三、DNS解析时时间:
包括往返解析的次数及每次解析所花费的时间,它们两者的积就是DNS(何谓DNS)解析所消耗的时间;很多人忽视DNS的因素,其实,DNS对网站解析速度也是非常重要的。
四、服务器和客户端机器的配置:
包括服务器端与客户机整个硬件配置程度,同样的网络环境下,酷睿四核的服务器的运算能力肯定要强一些,毫无疑问的;同样的网络环境下,你用一台赛扬的机器和酷睿四核处理器的电脑,打开同样的网页,速度, 后者肯定要快的多。
综合以上四点,可得到网页访问总时间的计算公式:
网页打开时间=网页内容大小/最小带宽+解析次数每次解析时间+服务器处理时间+客户端解析时间
从上面的计算公式可以看到,通过进步网络的带宽可以降低网页时间,但要留意,网络中的瓶颈不一定是用户的接进点,而很可能是不同网络运营商之间的对接点。
对于同一个用户下载同一个页面,第一项 即页面的大小与网络最小带宽的比值是基本一致的。第三项处理时间是指服务器和用户的PC机的处理能力,该项随着网站服务器的负载而变化,所以网站的服务器处理能力越强,其响应的时间相对也会更好,在相同条件下,公式的第二项将会对响应时间产生重要的影响。这里面的服务器处理时间,都趋近一致了。
而我们所做的就是尽量地往减少DNS在解析过程中所花费的时间,由于只有缩短网站与用户之间的间隔是进步访问速度的一个最有效的方法,将用户要访问的内容推送到离用户最近的地方,让他们的访问如同访问本地。
企业网站页面显示的速度取决于众多的因素,包括服务器性能、网络传输质量、网站出口带宽、网页架构、网页内容包括涉及到的和视频的大小等等。
从国外访问国内服务器上的网站主要面临以下题目:
1、由于网站访问量增加,服务器CPU资源不足导致的处理能力不足;
2、随着用户访问量的增多,网站出现了网站页面显示速度慢题目;
3、由于中国国家总出口带宽的不足,导致从海外访问中国境内的网站非常的慢,网站打开慢,就导致潜伏客户的流逝。
4、随着网站著名度的进步,网站受攻击的可能性越来越大;网站著名度进步,对网站安全性的需求也越来越高。假如是电子商务网站,会尤其重视网站的安全加密浏览等功能。
扁平or树型:一说到网站结构,大家都会提到扁平结构和树型结构,言必称“结构扁平化”,这些指的是物理结构,即基于内容聚合的目录及文件位置决定的结构。其实对于百度搜索引擎来说,只要结构合理、有逻辑性、内容有规律可循都可以,都是友好的。
链接结构:相对于物理结构,就要说到逻辑结构:即通过内部链接形成的链接结构,逻辑结构才是搜索引擎最关注的。对于一个网站来说,网页仅仅可以通过首页——目录1——目录2一层一层follow到是远远不够的,一个优秀的链接结构应该是网状的。
首页链接应该链向重要的频道页,频道页再链向下面的节点页或普通页面。同时,频道页、节点页和普通页面都应该可以链回到首页
无论哪些页面之间互相链接,都需要一个描述恰当的锚文本
链接不要放在JS、FLASH等搜索引擎不可见的位置,使用做链接入口应该完善alt标签
百度搜索引擎目前仅支持对部分JS和FLASH进行解析,绝大多数放在JS和FLASH里的链接都是获取不到的
为重要页面留更多入口。百度搜索引擎认为,获得更多内部投票的网页相对来说更加重要
“离首页越近”的网页,越容易受到百度重视。这个“近”指的是页面离首页的点击距离。即使URL所在目录层级较深,只要在首页有入口,百度也认为这是一个非常重要的页面。
不要产生可怕的孤岛页面。虽然百度在提交入口、社会化挖掘方面做了许多工作,但链接抓取依然是百度获得新页面的最重要渠道
程序员们都希望能通过自己的努力学习,技术提升,拿到更好的收入,技术提升和高收入虽然不是轻易就能实现的,但总是有章可循。
一个成熟的大型网站(如淘宝、京东等)的系统架构并不是开始设计就具备完整的高性能、高可用、安全等特性,它总是随着用户量的增加,业务功能的扩展逐渐演变完善的,在这个过程中,开发模式、技术架构、设计思想也发生了很大的变化,就连技术人员也从几个人发展到一个部门甚至一条产品线。所以成熟的系统架构是随业务扩展而完善出来的,并不是一蹴而就;不同业务特征的系统,会有各自的侧重点,例如淘宝,要解决海量的商品信息的搜索、下单、支付,例如腾讯,要解决数亿的用户实时消息传输,百度它要处理海量的搜索请求,他们都有各自的业务特性,系统架构也有所不同。尽管如此我们也可以从这些不同的网站背景下,找出其中共用的技术,这些技术和手段可以广泛运行在大型网站系统的架构中,下面就通过介绍大型网站系统的演化过程,来认识这些技术和手段。
一、最开始的网站架构
最初的架构,应用程序、数据库、文件都部署在一台服务器上,如图:
二、应用、数据、文件分离
随着业务的扩展,一台服务器已经不能满足性能需求,故将应用程序、数据库、文件各自部署在独立的服务器上,并且根据服务器的用途配置不同的硬件,达到最佳的性能效果。
三、利用缓存改善网站性能
在硬件优化性能的同时,同时也通过软件进行性能优化,在大部分的网站系统中,都会利用缓存技术改善系统的性能,使用缓存主要源于热点数据的存在,大部分网站访问都遵循28原则(即80%的访问请求,最终落在20%的数据上),所以我们可以对热点数据进行缓存,减少这些数据的访问路径,提高用户体验。
缓存实现常见的方式是本地缓存、分布式缓存。当然还有CDN、反向代理等,这个后面再讲。本地缓存,顾名思义是将数据缓存在应用服务器本地,可以存在内存中,也可以存在文件,OSCache就是常用的本地缓存组件。本地缓存的特点是速度快,但因为本地空间有限所以缓存数据量也有限。分布式缓存的特点是,可以缓存海量的数据,并且扩展非常容易,在门户类网站中常常被使用,速度按理没有本地缓存快,常用的分布式缓存是Memcached、Redis。
四、使用集群改善应用服务器性能
应用服务器作为网站的入口,会承担大量的请求,我们往往通过应用服务器集群来分担请求数。应用服务器前面部署负载均衡服务器调度用户请求,根据分发策略将请求分发到多个应用服务器节点。
常用的负载均衡技术硬件的有F5,价格比较贵,软件的有LVS、Nginx、HAProxy。LVS是四层负载均衡,根据目标地址和端口选择内部服务器,Nginx是七层负载均衡和HAProxy支持四层、七层负载均衡,可以根据报文内容选择内部服务器,因此LVS分发路径优于Nginx和HAProxy,性能要高些,而Nginx和HAProxy则更具配置性,如可以用来做动静分离(根据请求报文特征,选择静态资源服务器还是应用服务器)。
五、数据库读写分离和分库分表
随着用户量的增加,数据库成为最大的瓶颈,改善数据库性能常用的手段是进行读写分离以及分表,读写分离顾名思义就是将数据库分为读库和写库,通过主备功能实现数据同步。分库分表则分为水平切分和垂直切分,水平切换则是对一个数据库特大的表进行拆分,例如用户表。垂直切分则是根据业务不同来切换,如用户业务、商品业务相关的表放在不同的数据库中。
六、使用CDN和反向代理提高网站性能
假如我们的服务器都部署在成都的机房,对于四川的用户来说访问是较快的,而对于北京的用户访问是较慢的,这是由于四川和北京分别属于电信和联通的不同发达地区,北京用户访问需要通过互联路由器经过较长的路径才能访问到成都的服务器,返回路径也一样,所以数据传输时间比较长。对于这种情况,常常使用CDN解决,CDN将数据内容缓存到运营商的机房,用户访问时先从最近的运营商获取数据,这样大大减少了网络访问的路径。比较专业的CDN运营商有蓝汛、网宿。
而反向代理,则是部署在网站的机房,当用户请求达到时首先访问反向代理服务器,反向代理服务器将缓存的数据返回给用户,如果没有没有缓存数据才会继续走应用服务器获取,也减少了获取数据的成本。反向代理有Squid,Nginx。
七、使用分布式文件系统
用户一天天增加,业务量越来越大,产生的文件越来越多,单台的文件服务器已经不能满足需求。需要分布式的文件系统支撑。常用的分布式文件系统有NFS。
八、使用NoSql和搜索引擎
对于海量数据的查询,我们使用nosql数据库加上搜索引擎可以达到更好的性能。并不是所有的数据都要放在关系型数据中。常用的NOSQL有mongodb和redis,搜索引擎有lucene。
九、将应用服务器进行业务拆分
随着业务进一步扩展,应用程序变得非常臃肿,这时我们需要将应用程序进行业务拆分,如百度分为新闻、网页、等业务。每个业务应用负责相对独立的业务运作。业务之间通过消息进行通信或者同享数据库来实现。
十、搭建分布式服务
这时我们发现各个业务应用都会使用到一些基本的业务服务,例如用户服务、订单服务、支付服务、安全服务,这些服务是支撑各业务应用的基本要素。我们将这些服务抽取出来利用分部式服务框架搭建分布式服务。淘宝的Dubbo是一个不错的选择。
大型网站的架构是根据业务需求不断完善的,根据不同的业务特征会做特定的设计和考虑,本文只是讲述一个常规大型网站会涉及的一些技术和手段。
如果你还有这些疑问,成熟的网站架构师需要学什么核心技能?Java程序员如何晋升为互联网架构师?Java语言在架构搭建中扮演什么角色?怎样成为年收入几十万的架构师?欢迎来电来访昌平北大青鸟java培训。
欢迎分享,转载请注明来源:内存溢出
微信扫一扫
支付宝扫一扫
评论列表(0条)