Redian新闻
>
分布式存储技术:三副本 vs. 双重RAID

分布式存储技术:三副本 vs. 双重RAID

公众号新闻


( 三副本 VS   双重RAID
分布式技术路线对比

当下,分布式存储应用非常广泛,主要用于Openstack私有云、各种共有云平台、以及服务器虚拟化、超融合等;按接口划分:分布式存储包含块存储、对象存储、文件存储等。分布式存储正逐渐取代传统磁盘阵列,成为现代存储平台建设的首选。

分布式存储的主流厂商有IT大厂华为、新华三、浪潮,也有存储创新企业如道熵、XSKY、SmartX等。

主流布式存储厂家以开源Ceph为基础或参考模型,以三副本架构为主,如华为、新华三、浪潮、XSKY;而道熵则采用双重RAID架构,每个节点采用存储虚拟化与本地RAID管理,节点间则是分布式两副本技术,架构上更接近(分布式)磁盘阵列。

三副本技术路线

三副本分布式存储采用网络间三副本策略实现数据保护与故障修复。当某个硬盘(OSD)发生故障时,该硬盘OSD上的数据将自动按CRUSH规则在其他硬盘OSD上重建。

三副本网络数据重建有以下几个弊端:

1






消耗网络带宽,可能会影响到业务数据的正常工作;

2






TCP/IP网络具有数据包丢失与重发的特性,可能导致网络故障或网络抖动,影响OSD的状态,引起OSD重建的连锁反应;

3






严重时可导致业务中断、甚至丢失数据的风险。


三副本分布式存储的另一个弊端就是“慢盘”效应,以及相关的性能及稳定性问题。在三副本系统中,每个机械磁盘(HDD)单独作为一个OSD存储单元承接用户工作负载,而单个HDD随机IO读写非常低,仅为120 次读写/秒,极容易成为瓶颈。


由于分布式存储采用随机数据分布,而随机性必然导致个别磁盘上的负载远超平均值(著名的正太分布效应);此外,磁盘本身的制造缺陷或故障还会加剧 “慢盘”现象发生的频率。当系统出现一个或多个慢盘时,不仅会拖累总体性能与用户体验,甚至可能导致业务卡顿、中断、甚至系统崩溃的严重事故。


双重RAID技术路线

双重RAID采用节点内RAID与网络两副本策略相结合的方式,实现数据保护与故障修复。各节点采用log-structured 软件定义技术(而不是硬件RAID卡),实现节点存储资源池化、数据冗余保护(本地RAID)、ARC智能缓存、在线数据压缩、故障自动检测与报警等高级管理功能,通过虚拟卷为OSD提供存储服务(vOSD);在vOSD上层通过分布式两副本策略提供跨节点间数据保护与业务高可用功能。当某个硬盘发生故障时,由节点内RAID对数据实现本地数据修复,而上层vOSD状态正常,毫无感知,不会触发网络数据修复。


与网络数据修复相比,本地RAID数据修复具有以下特征:

1

硬件故障隔离,避免了网络修复可能导致的稳定性问题;

2

可自动避让业务,保证业务无感知;

3

本地修复时数据延迟小,不消耗网络带宽;

4

抵御故障能力强,每个节点都能抵御一个或多个硬盘故障;而三副本最多抵御两个连续的硬盘故障。


双重RAID的另一个技术优势在于,支持在线增加NVMe固态硬盘个数,或在线替换更大容量的NVMe固态硬盘,从而使得用户活动工作负载数据集 (Working Data Set),俗称热数据,可几乎全部落在两级缓存加速层中,从而使得系统总体性能可逼近全闪存存储系统。

双重RAID是迄今为止对付“慢盘”效应最有效的办法。在双重RAID架构中,每个节点不仅具备抵御磁盘故障、数据本地修复的能力,同时,通过存储资源池化技术将该节点上所有的vOSD 的工作负载平均分布到各个磁盘上。这种负载均衡技术可大幅度降低因工作负载不均匀,或个别磁盘性能下降导致的慢盘现象。此外,每个存储节点在整合的存储资源池基础上,利用节点的内存和大容量NVMe固态硬盘构成一个统一的两级缓存加速层,并采用自适应算法匹配vOSD工作负载的变化,大幅度提升各个vOSD承受极端工作负载的能力。

总结:双重RAID架构与三副本架构相比,在性能、稳定性和数据可靠性方面具有明显优势。特别需要指出的是,双重RAID具备非常优秀的硬件故障隔离特性,而三副本对硬件故障的检查和容错能力较弱,因此双重RAID可显著降低运维难度与运维人工成本。

原文链接:
https://mp.weixin.qq.com/s/WE_cnWmwPCVoQG0zjJ38CA

下载链接:
LeoStor分布式存储系统
超融合UIS场景化解决方案
ONEStor分布式软件定义存储
大规模业务系统的数据存储架构实战
大规模分布式存储系统原理解析与架构实战
《ONEStor专题系列(下)》
1、ONEStor专题系列--NTP模块详解 2、ONEStor模块之pg详解 3、ONEStor模块之tgt详解 4、ONEStor专题系列--IO流程解析
《ONEStor专题系列(上)》
1、ONEStor专题系列--MDS模块详解 2、ONEStor专题系列之Handy模块详解 3、ONEStor专题系列--Flashcache模块详解 4、ONEStor专题系列--MON模块详解
《RAID技术白皮书及应用合集》
1、RAID技术与应用 2、RAID技术白皮书 3、RAID级别简介
2023网络安全重要趋势
《桌面云及TCI技术合集》
1、锐捷云桌面TCI技术白皮书 2、基于英特尔TCI技术智能云解决方案推动金融行业桌面变革 3、让终端化身超级英雄,TCI架构到底有多神奇
《存储技术及未来趋势合集》
1、分布式存储趋势及对云存储规划影响 2、下一代数据存储技术研究报告
深信服企业云超融合灾备解决方案
《数据中心前沿网络技术合集(1)》
《数据中心前沿网络技术合集(2)》

温馨提示:请购买过架构师技术全店资料打包汇总(全)的读者,在“架构师技术联盟”微店留言,凭购买记录获取<服务器基础知识全解(终极版)>PDF阅读版本


现在购买架构师技术全店资料打包汇总(全)随打包发送<服务器基础知识全解(终极版),182页>PDF阅读版本可编辑PPT版本。现在下单最划算(活动优惠并享更新免费赠阅),后续价格会随资料增加上涨。



申明:感谢原创作者的辛勤付出。本号转载的文章均会在文中注明,若遇到版权问题请联系我们处理。


温馨提示:

扫描二维码关注公众号,点击阅读原文链接获取架构师技术全店资料打包汇总(全)电子书资料详情


微信扫码关注该文公众号作者

戳这里提交新闻线索和高质量文章给我们。
相关阅读
IEEE行业快报 | 新型存储技术-铁电存储分布式软件:X86/ARM CPU混合部署分布式中灰度方案就该这样设计!聚焦2023云边协同大会 | 构建云边端一体分布式云,助力行业数字化转型升级分布式存储架构发展及技术分析咏叶芹草打造分布式AI开发和部署平台,「潞晨科技」完成数亿元A轮融资|36氪首发使用注解实现redis分布式锁!未来储能研究:基于相变储热材料的热管理技术 | 热能存储技术国际线上研讨会报名中!保姆级教程:Spring Cloud 集成 Seata 分布式事务Service Mesh:探索分布式系统的幻觉与未来Spring Boot 整合分布式消息平台 Pulsar分布式存储的七方面问题Web3+AIoT=DePIN,分布式物理基础设施网络,一片不可不知的新蓝海分布式存储架构发展及技术分析(2023)八十五 给烈士安家如何设计一个高效的分布式日志服务平台大型分布式系统中,缓存就该这么玩大语言模型(LLM)分布式训练框架总结加拿大卫生部:新抗体药物获得批准 预防婴儿严重RSV让 GPT-4 帮我设计一个分布式缓存系统,从尝试到被我逼疯!你只会用 xxl-job?一款更强大、新一代分布式任务调度框架,很不错!【绿色金融】探索分布式光伏参与绿电及碳市场的新业态聊一聊分布式系统中的时空观构建( 老键曲库) Miley Cyrus - Flowers揭秘大语言模型实践:分布式推理的工程化落地才是关键!八十六 解放巴集瞭望·懂点科技丨ChatGPT也要背靠这一能力,看看下一代存储技术最前沿→兆易创新vs北京君正vs长江存储:谁能扛起国产存储大旗?第三届分布式转型高峰论坛:坚守合规底线 重构风控平台 助力行业高质量发展收藏:分布式存储分类、优势及应用领域基于双层Markov DRL架构的分布式星群激光组网算法中日花名脱钩:“夕化粧”与“白粉花”解读Go分布式链路追踪-Opentelemetry2025年中国分布式存储市场规模将达211.4亿元
logo
联系我们隐私协议©2024 redian.news
Redian新闻
Redian.news刊载任何文章,不代表同意其说法或描述,仅为提供更多信息,也不构成任何建议。文章信息的合法性及真实性由其作者负责,与Redian.news及其运营公司无关。欢迎投稿,如发现稿件侵权,或作者不愿在本网发表文章,请版权拥有者通知本网处理。