服务器数据恢复-RAID5常见故障&raid5数据恢复方案

本文涉及的产品
资源编排,不限时长
无影云电脑个人版,1个月黄金款+200核时
无影云电脑企业版,4核8GB 120小时 1个月
简介: raid5阵列常见故障:1、服务器硬件故障或者RAID阵列卡故障;2、服务器意外断电导致的磁盘阵列故障;3、服务器RAID阵列阵列磁盘出现物理故障,如:电路板坏、磁头损坏、盘面划伤、坏扇区、固件坏等;4、误操作导致磁盘盘序出现错误;5、raid在同步数据或者重建过程中,同组raid阵列中又有其他硬盘掉线导致同步失败。

raid5阵列常见故障:1、服务器硬件故障或者RAID阵列卡故障;
2、服务器意外断电导致的磁盘阵列故障;
3、服务器RAID阵列阵列磁盘出现物理故障,如:电路板坏、磁头损坏、盘面划伤、坏扇区、固件坏等;
4、误操作导致磁盘盘序出现错误;
5、raid在同步数据或者重建过程中,同组raid阵列中又有其他硬盘掉线导致同步失败。

RAID5磁盘阵列出现故障后需要注意的问题:
1、发现RAID5磁盘阵列发生故障或者数据丢失,建议不要盲目进行rebuild操作。
Rebuild:通过阵列的校验功能,根据阵列内其他正常硬盘中的数据,计算&生成损坏硬盘中的数据,然后同步到热备盘中。Rebuild操作适用于raid5阵列中有1块硬盘掉线的情况。针对raid5阵列中有2块磁盘掉线的情况:如果第一块硬盘掉线后服务器有写入操作,第一块掉线的硬盘数据在掉线后就不更新了。rebuild只能对先掉线的磁盘做Rebuild,如果对后掉线的磁盘做Rebuild操作,则部分阵列虽然能正常工作,但会出现数据错乱,某些文件无法打开的情况。
2、RAID5阵列中硬盘掉线,建议不要盲目进行强制上线操作。
从北亚企安数据恢复工程师做过的海量RAID5阵列数据恢复案例中来看,有部分raid5阵列数据丢失的原因是阵列中有一块硬盘离线后没有及时更换硬盘,此后服务器出现故障或者服务器重启,原来离线的硬盘重新上线,而原本在线的硬盘反而故障离线,数据不能正常使用。
用户对后离线的硬盘进行强制上线操作,磁盘阵列自动同步,导致数据新旧混乱,服务器数据丢失。市面上多数品牌和型号的阵列卡在原先离线磁盘自动上线时会检查校验信息,一旦发现校验信息不正确就会重新计算校验信息,无法在缺盘的情况下恢复数据。
3、千万不要进行初始化操作。
初始化类似于低级格式化,一旦对阵列进行初始化操作,这个阵列内所有硬盘的底层数据会被全部清零,导致阵列数据无法恢复。
4、重新配置阵列信息时要保持与原阵列配置信息一致。
一旦重新配置磁盘阵列的信息与原始磁盘阵列的信息不一致,阵列内多数文件将无法打开,导致数据丢失。多数服务器都具有重新配置阵列信息后自动初始化的功能,这将导致数据无法恢复。
5、在进行任何数据恢复操作前,务必将服务器内的所有硬盘以只读方式进行扇区级的镜像备份,避免破坏原始数据。

RAID5数据恢复方案:
1、将故障服务器中所有磁盘编号后取出,由硬件工程师对所有磁盘进行硬件故障检测。针对不存在硬件故障的磁盘,以只读方式做镜像;对于存在硬件故障的磁盘,由硬件工程师处理后使用专门的工具做镜像备份。
2、基于镜像文件分析底层数据,根据分析底层数据获取到的RAID5阵列结构相关信息重组raid5阵列,然后导出数据。
3、验证导出的数据,确认数据无误后重新搭建环境,将恢复出来的数据迁移到准备好的服务器环境中。

相关文章
|
5天前
|
存储 弹性计算 运维
端到端的ECS可观测性方案,助力云上业务安全稳定
本文介绍了云原生时代保障业务系统可靠性的方法和挑战,重点探讨了阿里云ECS在提升业务稳定性、性能监控及自动化恢复方面的能力。文章分为以下几个部分:首先,阐述了业务可靠性的三个阶段(事前预防、事中处理、事后跟进);其次,分析了云上业务系统面临的困难与挑战,并提出了通过更实时的监测和自动化工具有效规避风险;接着,详细描述了ECS实例稳定性和性能问题的解决方案;然后,介绍了即将发布的ECS Lens产品,它将全面提升云上业务的洞察能力和异常感知能力;最后,通过具体案例展示了如何利用OS自动重启和公网带宽自适应调节等功能确保业务连续性。总结部分强调了ECS致力于增强性能和稳定性的目标。
|
5天前
|
存储 数据挖掘 数据库
服务器数据恢复—OceanStor存储数据恢复案例
华为OceanStor T系列某型号存储中有一组由24块机械硬盘组建的一组RAID5阵列。 运行过程中该存储设备RAID5阵列上多块硬盘出现故障离线,阵列失效,存储中数据无法访问。
|
2天前
|
运维 数据挖掘 Windows
服务器数据恢复—服务器硬盘指示灯亮黄灯的数据恢复案例
服务器硬盘指示灯闪烁黄灯是一种警示,意味着服务器硬盘出现故障即将下线。发现这种情况建议及时更换硬盘。 一旦服务器上有大量数据频繁读写,硬盘指示灯会快速闪烁。服务器上某个硬盘的指示灯只有黄灯亮着,而其他颜色的灯没有亮的话,通常表示这块硬盘出现故障,这时候更换新硬盘同步数据即可。 如果没有及时发现硬盘损坏或者更换硬盘失败导致服务器崩溃,应该如何恢复数据呢?下面通过一个真实案例讲解一下服务器硬盘指示灯亮黄色的数据恢复案例。
|
3天前
|
存储 数据挖掘
服务器数据恢复—zfs文件系统服务器数据恢复案例
一台配有32块硬盘的服务器在运行过程中突然崩溃不可用。经过初步检测,基本上确定服务器硬件不存在物理故障。管理员重启服务器后问题依旧。需要恢复该服务器中的数据。
|
11天前
|
运维 数据挖掘 索引
服务器数据恢复—Lustre分布式文件系统服务器数据恢复案例
5台节点服务器,每台节点服务器上有一组RAID5阵列。每组RAID5阵列上有6块硬盘(其中1块硬盘设置为热备盘,其他5块硬盘为数据盘)。上层系统环境为Lustre分布式文件系统。 机房天花板漏水导致这5台节点服务器进水,每台服务器都有至少2块硬盘出现故障。每台服务器中的RAID5阵列短时间内同时掉线2块或以上数量的硬盘,导致RAID崩溃,服务器中数据无法正常读取。
|
16天前
|
存储 数据挖掘
服务器数据恢复—V7000存储上多块Mdisk成员盘出现故障的数据恢复案例
服务器存储数据恢复环境: 一台V7000存储上共12块SAS机械硬盘(其中1块是热备盘),组建了2组Mdisk,创建了一个pool。挂载在小型机上作为逻辑盘使用,小型机上安装的AIX+Sybase。 服务器存储故障: V7000存储中磁盘出现故障,管理员发现问题后立即更换磁盘。新更换的硬盘在上线同步数据的时候,存储上另一块磁盘也出现问题,导致逻辑盘无法挂接在小型机上,业务暂时中断。V7000存储的管理界面上显示两块硬盘故障脱机。 pool无法加载,其中三个通用卷均无法挂载。
|
6天前
|
机器学习/深度学习 人工智能 PyTorch
阿里云GPU云服务器怎么样?产品优势、应用场景介绍与最新活动价格参考
阿里云GPU云服务器怎么样?阿里云GPU结合了GPU计算力与CPU计算力,主要应用于于深度学习、科学计算、图形可视化、视频处理多种应用场景,本文为您详细介绍阿里云GPU云服务器产品优势、应用场景以及最新活动价格。
阿里云GPU云服务器怎么样?产品优势、应用场景介绍与最新活动价格参考
|
5天前
|
存储 运维 安全
阿里云弹性裸金属服务器是什么?产品规格及适用场景介绍
阿里云服务器ECS包括众多产品,其中弹性裸金属服务器(ECS Bare Metal Server)是一种可弹性伸缩的高性能计算服务,计算性能与传统物理机无差别,具有安全物理隔离的特点。分钟级的交付周期将提供给您实时的业务响应能力,助力您的核心业务飞速成长。本文为大家详细介绍弹性裸金属服务器的特点、优势以及与云服务器的对比等内容。
|
12天前
|
人工智能 JSON Linux
利用阿里云GPU加速服务器实现pdf转换为markdown格式
随着AI模型的发展,GPU需求日益增长,尤其是个人学习和研究。直接购置硬件成本高且更新快,建议选择阿里云等提供的GPU加速型服务器。
利用阿里云GPU加速服务器实现pdf转换为markdown格式
|
2天前
|
弹性计算 安全 搜索推荐
阿里云国际站注册教程:阿里云服务器安全设置
阿里云国际站注册教程:阿里云服务器安全设置 在云计算领域,阿里云是一个备受推崇的品牌,因其强大的技术支持和优质的服务而受到众多用户的青睐。本文将为您介绍阿里云国际站的注册过程,并重点讲解如何进行阿里云服务器的安全设置。

相关产品

  • 云服务器 ECS