服务器数据恢复—硬盘黄灯预警,RAID5阵列数据如何恢复?

服务器存储数据恢复环境:

某单位一台某品牌DS5300存储,1个机头+4个扩展柜,50块的硬盘组建了两组RAID5阵列。一组raid5阵列有27块硬盘,存放Oracle数据库文件。存储系统上层一共划分了11个卷。

服务器存储故障:

存储设备上两个硬盘指示灯亮黄色。其中一组RAID5阵列崩溃,存储不可用,设备已经过保。

服务器存储数据恢复过程:

1、硬件工程师对出现故障的raid5阵列中的27块硬盘做硬件故障检测,发现其中2块硬盘存在坏道、SMART的错误冗余级别已经超过阈值,其他25块硬盘正常。对25块正常硬盘以只读方式进行全盘镜像,对2块存在坏道的硬盘使用专业工具处理后生成镜像文件。后续的数据分析和数据恢复操作基于镜像文件进行,避免对原始磁盘数据造成二次破坏。

2、收集&分析故障存储的日志信息。分析两块硬盘的掉线时间,搞清楚数据较新的那块硬盘,使用数据较新的硬盘来恢复数据。

3、经过北亚企安数据恢复工程师的会诊,敲定了2个数据恢复方案:

方案一:通过存储设备的管理软件强制上线,强制上线之前把存储的所有硬盘进行备份。

方案二:分析硬盘底层数据,重组RAID。从底层提取数据,重新加载oracle数据库,调试上层应用。

4、首先、按照方案一实施:将故障存储上的所有硬盘都进行完整备份。先在模拟器上测试,之后再在存储上进行上线操作。

通过存储管理软件进行强制上线的操作,强制上线之后raid处于降级状态。设置好热备盘,让热备盘上线同步数据。同步完成后,上层的卷直接可以使用了,所有数据也都可见,上层应用也能正常使用。

第一种方案就成功恢复出数据,节省很多时间,上层应用也不需要调试,可以直接启动。

5、将卷里的文件都拷贝出来,移交给用户方。本次数据恢复工作完成。

相关推荐
九硕智慧建筑一体化厂家3 小时前
数字化管控落地,直流照明构筑安全照明体系
运维·人工智能·笔记·安全·智慧城市
波波0073 小时前
C# 15 重磅新特性: 带标签 break 与 continue:重新定义嵌套循环控制流
服务器·前端·c#
刘某的Cloud4 小时前
ceph osd 导入导出 rbd volume 卷
linux·运维·ceph·volume
隔窗听雨眠6 小时前
GBase 8s并发控制深度解析:封锁机制、隔离级别与死锁处理全攻略
服务器·数据库·oracle
神奇霸王龙6 小时前
Agent 准入门控屠夫:5 旗舰 4 维度评估
linux·运维·数据库·ai·ai作画·agent·ai编程
鲸采云SRM采购管理系统7 小时前
采购管理系统哪家好?2026最新测评对比
java·服务器·数据库
cfm_29147 小时前
基于Binlog实现不停机数据库平滑迁移技术
运维·数据库·架构
迪康Defender7 小时前
AI 重构终端安全运营:智能分析中枢 AI Insight 模块架构与落地场景深度解析
运维·网络·人工智能·其他·安全·重构·架构
那年窗外下的雪.7 小时前
AIDC 学习日志 第 04 天 BGP Underlay 基础与路由选择
服务器·学习·php
0x537 小时前
Java网络编程(二)
java·服务器·网络