服务器数据恢复—raid5阵列硬盘出现坏道导致上层应用崩溃的数据恢复案例

服务器数据恢复环境&故障:

一台服务器中有一组由16块SAS接口的硬盘组建的raid5阵列。

服务器磁盘阵列中有2块硬盘离线,服务器上跑的应用崩溃。

经过后续的分析发现丢失的数据为虚拟机文件,包含4个卷的数据。

服务器数据恢复过程:

1、将故障服务器中的所有硬盘编号后取出,并对服务器中的16块硬盘进行了物理故障检测。经过检测发现2块掉线硬盘存在大量物理坏道,SMART的错误冗余级别已经超过阈值。

2、硬件工程师在使用专业工具对这两块掉线硬盘进行物理修复。修复完成后将所有硬盘以只读方式进行全盘镜像。镜像完成后将所有磁盘按照编号还原到原服务器中,后续的数据分析和数据恢复操作都基于镜像文件进行,避免对原始磁盘数据造成二次破坏。

3、基于镜像文件分析所有硬盘底层数据。北亚企安数据恢复工程师通过收集&分析服务器存储日志搞清楚2块硬盘的掉线先后顺序,后续会使用后掉线的硬盘恢复数据。

4、利用分析出来的raid5相关信息虚拟重组磁盘阵列。虚拟重组完成后提取raid磁盘阵列中的4个lun。

5、分析底层结构并将文件系统进行跨lun组合,将raid5阵列的原有数据重组出来并导出。

6、验证导出的数据,经过验证确认导出的数据正常、完整、可用。

7、将所有恢复出来的数据迁移到用户方准备好的环境中。经过验证,用户方确认数据完整有效。

相关推荐
深圳市爱派派智能科技有限公司15 分钟前
“进迭时空 RISC-V 集群服务器 CSB1-N10SPK3:10 节点 K3,600 TOPS 绿色算力“
运维·服务器·risc-v·k3·进迭时空·集群服务器
☆凡尘清心☆15 分钟前
Linux运维故障排查速查命令清单
linux·运维·服务器
QWEDDRFTG18 分钟前
机房供电安全
服务器
qeen8733 分钟前
【Linux】make/Makefile 自动化工具的介绍
linux·运维·服务器·自动化
艾莉丝努力练剑1 小时前
【Linux:动静态库】Linux 动静态库与可执行文件
linux·运维·服务器·学习·面试·文件系统·动静态库
殷忆枫1 小时前
Linux 4G模块驱动适配实战:从手动绑定到自动识别
linux·运维·服务器
独隅1 小时前
CLion 在 Linux 上的完整安装与配置使用指南
linux·运维·服务器·c语言·c++·ide
大黄说说2 小时前
EF Core 避坑指南:查询慢、循环查询、并发更新问题如何解决
java·服务器·数据库
ocean'2 小时前
防火墙策略路由
linux·服务器·数据库
三言老师2 小时前
awk条件筛选日志内容实操
linux·运维·服务器·centos