分类: 服务器与存储
2008-06-11 20:37:21
RAID磁盘阵列设备,在使用过程中,经常会遇到一些常见故障,这也使得RAID在给我们带来海量存储空间的应用之外,也带来了很多难以估计的数据风险。本文将重点介绍RAID常见故障及相关处理方式。
RAID故障注意事项
1、数据丢失后,用户千万不要对硬盘进行任何操作,将硬盘按顺序卸下来,用镜像软件将每块硬盘做成镜像文件,也可以交给专业数据恢复中心进行。
2、不要对Raid卡进行Rebuild操作,否则会加大恢复数据的难度。
3、标记好硬盘在Raid卡上面的顺序。
4、一旦出现问题,可以拨打专业数据恢复中心的咨询电话找专业工程师进行咨询,切忌自己试图进行修复,除非你确信自己有足够的技术和经验来处理数据风险。
常见Raid 故障及可恢复性分析
1、软件故障:
a.突然断电造成RAID磁盘阵列卡信息的丢失的数据恢复。
b.重新配置RAID阵列信息,导致的数据丢失恢复。
c.如果磁盘顺序出错,将会导致系统不能识别数据。
d.误删除、误格式化、误分区、误克隆、文件解密、命毒损坏等数据恢复工作。
2、硬件损坏:
a.raid一般都会有几块硬盘,其中某一块硬盘出现损坏,数据将无法读取。
b.raid出现坏道,导致数据丢失,这种恢复成功率比较大。
c.如果硬盘同时出现两块以上的损坏,恢复工作非常复杂,成功率比较低。
案例一
2004-9-17,西城区某公司的赵先生拨打了专业数据恢复中心的咨询电话,该公司的一台服务器,不知为何突然无法启动,数据无法读取。该服务器是采用RAID 5的工作方式。数据恢复中心的工程师根据用户的陈述初步判断是硬盘的排列顺序问题。这是一个五块75G的阵列服务器,要做这块硬盘数据,至少要有400G空间。
恢复步骤如下:
* 分别对每块硬盘进行镜像,不要在原盘进行操作,以免造成二次破坏。
* 通过计算首先来判断,硬盘的排列顺序,只有顺序对数据才会出来,否则数据恢复跟本是不可能会出来的。
* 判断完毕这后,对这五个镜像文件来进行恢复。三天后,数据成功找回。
RAID基本知识
RAID 磁盘阵列(Redundant Array of Independent Disks)简单的解释,就是将N台硬盘透过RAID Controller(分Hardware,Software )结合成虚拟单台大容量的硬盘使用,其特色是N台硬盘同时读取速度加快及提供 容错性Fault Tolerant,所以RAID是当成平时主要访问Data的Storage不是Backup Solution。
在RAID有一基本概念称为EDAP ( Extended Data Availability and Protection ) ,其强调扩充性及容错机制,也是各家厂商如: Mylex,IBM,HP,Compaq,Adaptec,Infortrend等诉求的重点,包括在不须停机情况下可处理以下动作:
RAID 磁盘阵列支援自动检测故障硬盘。
RAID 磁盘阵列支援重建硬盘坏轨的资料。
RAID 磁盘阵列支援支持不须停机的硬盘备援 Hot Spare。
RAID 磁盘阵列支援支持不须停机的硬盘替换 Hot Swap。
RAID 磁盘阵列支援扩充硬盘容量等。
一旦RAID阵列出现故障,硬件服务商只能给客户重新初始化或者REBUILD,这样客户数据就会无法挽回。出现故障以后只要不对阵列作初始化操作,就有机会恢复出故障RAID磁盘阵列的数据。