注册 登录  
 加关注
   显示下一条  |  关闭
温馨提示!由于新浪微博认证机制调整,您的新浪微博帐号绑定已过期,请重新绑定!立即重新绑定新浪微博》  |  关闭

随感而发,记录点点滴滴

All rivers run into sea

 
 
 

日志

 
 

RAID5和RAID10比较  

2014-02-21 12:34:11|  分类: 计算机硬件 |  标签: |举报 |字号 订阅

  下载LOFTER 我的照片书  |
   一直以来,看到关于raid5与raid10 的性能之争还是非常多的,甚至很多人那拿出了测试数据,但是,到底谁是谁非。这里,我就这两种raid的内部运行原理来分析一下,我们在什么情况下应当适合选哪一种raid 方式。
      为了方便对比,我这里拿同样多驱动器的磁盘来做对比,raid5 选择3D+1P 的raid方案,raid10 选择2D+2D 的Raid方案,分别如图:
                                                              RAID5和RAID10比较 - arrissy - 随感而发,记录点点滴滴
那么,我们分析如下三个过程:读,连续写,随机写,但是,在介绍这三个过程之前,我需要介绍一个特别重要的概念:cache 。
       cache技术最近几年,在磁盘存储技术上,发展的非常迅速,作为高端存储,cache已经是整个存储的核心所在,就是中低端存储,也有很大的cache存在,包括最简单的raid 卡,一般都包含有几十,甚至几百兆的raid cache。 

       cache的主要作用是什么呢?体现在读与写两个不同的方面,如果作为写,一般存储阵列只要求写到cache就算完成了写操作,所以,阵列的写是非常快速的,在写cache的数据积累到一定程度,阵列才把数据刷到磁盘,可以实现批量的写入,至于cache 数据的保护,一般都依赖于镜相与电池(或者是UPS)。 

       cache 的读一样不可忽视,因为如果读能在cache中命中的话,将减少磁盘的寻道,因为磁盘从寻道开始到找到数据,一般都在6ms 以上,而这个时间,对于那些密集型io的应用可能不是太理想。但是,如果cache 能命中,一般响应时间则可以在1ms 以内。(不要迷信存储厂商的iops(每秒的io 数)数据,他们可能全部在cache命中的基础上做到的,但是实际上,你的cache 命中率可能只有10%。)
       
       介绍完cache,我们就可以解释raid5 与raid10在不同的模式下,工作效率问题了,那么我们来分别分析以上三个问题。
       1、读操作
因为raid5 与raid10 的磁盘都可以提供服务,所以,在读上面他们基本是没有差别的,除非是读的数据能影响cache命中率,导致命中率不一样。  
                                             RAID5和RAID10比较 - arrissy - 随感而发,记录点点滴滴
2、连续写
连续写的过程,一般表示写入连续的大批量的数据,如媒体数据流,很大的文件等等,这个写操作过程,如果有写cache存在,并且算法没有问题的话,raid5比raid10 甚至会更好一些(这里要假定存储有一定大小足够的写cache,而且计算校验的cpu不会出现瓶颈).因为这个时候的校验是在cache 中完成,如4块盘的raid5,可以先在内存中计算好校验,同时写入3 个数据+1个校验。而raid10 只能同时写入2 个数据+2 个镜相。 
                                            RAID5和RAID10比较 - arrissy - 随感而发,记录点点滴滴
但是,我前面也说过了,写cache是可以缓存写操作的,等到一定时期再写到磁盘,但是,写操作不比读操作,这个写是迟早也要发生的,也就是说,最后落到磁盘上的写还是避免不了的,不过,如果不是连续性的强连续写,只要不达到磁盘的写极限,差别都不是太大。 
       3、离散写
这里可能是最难理解,但是,也是最重要的部分,数据库,如oracle数据库大部分操作就是离散写,如每次写一个数据块的数据,如8K;联机日志虽然看起来是连续写,但是因为每次写的量不多,不保证能添满raid5的一个条带(保证每张盘都能写入),所以很多时候也是离散写入。 
                                       RAID5和RAID10比较 - arrissy - 随感而发,记录点点滴滴
我们再接上图,假定要把一个数字2变成数字4,那么对于raid5,实际发生了4 次io,先读出2 与校验6,可能发生读命中然后在cache 中计算新的校验写入新的数字4与新的校验8,对于raid10,我们可以看到,同样的单个操作,最终raid10 只需要2 个io,而raid5 需要4个io。 

       但是,这里我忽略了raid5在那两个读操作的时候,还可能会发生读命中操作,也就是说,如果需要读取的数据已经在cache 中,可能是不需要4 个 io的,也证明了cache 对raid5的重要性,不仅仅是计算校验需要,而且对性能的提升由为重要。曾经测试过,在raid5 的阵列中,如果关闭写cache,raid5的性能将差很多倍。
       这里,并不是说cache 对raid10就不重要了,因为写缓冲,读命中等,都是提高速度的关键所在,不过的是,raid10 对cache 的依赖性没有raid5那么明显而已。
       到这里,大家应当也大致明白了raid5与raid10 的原理与差别了,一般来说,象小io的数据库类型操作,建议采用raid10,而大型文件存储,数据仓库,则从空间利用的角度,可以采用raid5。但是一切也不是绝对的,比如当磁盘数量非常多以及一些其他IT环境还需要特定环境特定分析。  


网络转载
  
 

 
  评论这张
 
阅读(35)| 评论(0)
推荐 转载

历史上的今天

评论

<#--最新日志,群博日志--> <#--推荐日志--> <#--引用记录--> <#--博主推荐--> <#--随机阅读--> <#--首页推荐--> <#--历史上的今天--> <#--被推荐日志--> <#--上一篇,下一篇--> <#-- 热度 --> <#-- 网易新闻广告 --> <#--右边模块结构--> <#--评论模块结构--> <#--引用模块结构--> <#--博主发起的投票-->
 
 
 
 
 
 
 
 
 
 
 
 
 
 

页脚

网易公司版权所有 ©1997-2018