返回顶部
首页 > 资讯 > 服务器 >服务器raid5先后两块盘掉线的恢复过程
  • 811
分享到

服务器raid5先后两块盘掉线的恢复过程

2023-06-04 20:06:58 811人浏览 泡泡鱼
摘要

第一部分:数据恢复方案【故障描述】    某公司的一台服务器组了一个raid5磁盘阵列有两块磁盘先后掉线,服务器崩溃。故障服务器的操作系统为linux redhat 5.3,应用系统为构架于oracle的一个o

第一部分:数据恢复方案

【故障描述】
    某公司的一台服务器组了一个raid5磁盘阵列有两块磁盘先后掉线,服务器崩溃。故障服务器的操作系统linux redhat 5.3,应用系统为构架于oracle的一个oa,数据重要,时间很急。因oracle已经不再对本oa系统提供后续支持,用户要求尽可能数据恢复+操作系统复原。
【初检结论】
    热备盘完全无启用,硬盘无明显物理故障,无明显同步表现。数据通常可恢复
【恢复方案】
    1、保护原环境,关闭服务器,确保在恢复过程中不再开启服务器。
    2、将故障硬盘标好序号,确保在拿出槽位后可以完全复原。
    3、将故障硬盘挂载至只读环境,对所有故障硬盘做完全镜像(参考<如何对磁盘做完整的全盘镜像备份>)。备份完成后交回原故障盘,之后的恢复操作直到数据确认无误前不再涉及原故障盘。
    4、对备份盘进行RAID结构分析,得到其原来的RAID级别,条带规则,条带大小,校验方向,META区域等。
    5、根据得到的RAID信息搭建一组虚拟的RAID5环境。
    6、进行虚拟磁盘及文件系统解释。
    7、检测虚拟结构是否正确,如不正确,重复4-7过程。
    8、确定数据无误后,按用户要求回迁数据。如果仍然使用原盘,需确定已经完全对原盘做过备份后,重建RAID,再做回迁。回迁操作系统时,可以使用linux livecd或win pe(通常不支持)等进行,也可以在故障服务器上用另外硬盘安装一个回迁用的操作系统,再进行扇区级别的回迁。
    9、数据移交后,由北亚数据恢复中心延长保管数据3天,以避免可能忽略的纰漏。
【恢复周期】
    备份时间,约2小时。解释及导出数据时间,约4小时。回迁操作系统,约4小时。

第二部分:数据恢复及系统复原过程

    1、对原硬盘进行完整镜像,镜像后发现2号盘有10-20个坏扇区,其余磁盘,均无坏道。
    2、分析结构:得到的最佳结构为0,1,2,3盘序,缺3号盘,块大小512扇区,backward parity(Adaptec),结构如下图:
服务器raid5先后两块盘掉线的恢复过程

    3、组好后数据验证,200M以上的最新压缩包解压无报错,确定结构正确。
    4、直接按此结构生成虚拟RAID到一块单硬盘上,打开文件系统无明显报错。
    5、确定备份包安全的情况下,经客户同意后,对原盘重建RAID,重建时已经用全新硬盘更换损坏的2号盘。将恢复好的单盘用USB方式接入故障服务器,再用linux SystemRescueCd启动故障服务器,之后通过dd命令进行全盘回写。
    6、回写后,启动操作系统。正常情况下,这时候所有工作应该完成了。不巧的是,因帮颇费周折才解决,特意另起一段叙述。

系统复原过程:

    dd所有数据后,启动操作系统,无法进入,报错信息为:/etc/rc.d/rc.sysinit:Line 1:/sbin/pidof:Permission denied
    怀疑此文件权限有问题,用SystemRescueCd重启后检查,此文件时间,权限,大小均有明显错误,显然节点损坏。
    重新分析重组数据中的根分区,定位出错的/sbin/pidof,发现问题因2号盘坏道引起。
    使用0,1,3这3块盘,针对2号盘的损坏区域进行xor补齐。补齐后重新校验文件系统,依然有错误,再次检查inode表,发现2号盘损坏区域有部分节点表现为(图中的55 55 55部分):
服务器raid5先后两块盘掉线的恢复过程
    很明显,虽然节点中描述的uid还正常存在,但属性,大小,以最初的分配块全部是错误的。按照所有可能进行分析,确定无任何办法找回此损坏节点。只能希望修复此节点,或复制一个相同的文件过来。
    对所有可能有错的文件,均通过日志确定原节点块的节点信息,再做修正。
    修正后重新dd根分区,执行fsck -fn /dev/sda5,进行检测,依然有报错,如下图:
服务器raid5先后两块盘掉线的恢复过程
    根据提示,在系统中发现有多个节点共用同样的数据块。按此提示进行底层分析,发现,因3号盘早掉线,帮存在节点信息的新旧交集。
    按节点所属的文件进行区别,清除错误节点后,再次执行fsck -fn /dev/sda5,依然有报错信息,但已经很少。根据提示,发现这些节点多位于doc目录下,不影响系统启动,于是直接fsck -fy /dev/sda5强行修复。
    修复后,重启系统,成功进入桌面。
    启动数据库服务,启动应用软件,一切正常,无报错。
    到此,数据恢复及系统回迁工作完成。

--结束END--

本文标题: 服务器raid5先后两块盘掉线的恢复过程

本文链接: https://www.lsjlt.com/news/239264.html(转载时请注明来源链接)

有问题或投稿请发送至: 邮箱/279061341@qq.com    QQ/279061341

猜你喜欢
  • 服务器raid5先后两块盘掉线的恢复过程
    第一部分:数据恢复方案【故障描述】    某公司的一台服务器组了一个raid5磁盘阵列有两块磁盘先后掉线,服务器崩溃。故障服务器的操作系统为linux redhat 5.3,应用系统为构架于oracle的一个o...
    99+
    2023-06-04
  • raid5阵列两块硬盘出现物理故障的数据恢复过程
    服务器数据恢复故障描述今天介绍的这次数据恢复的服务器故障情况为硬盘离线,故障服务器内是由多块硬盘组成的一组raid5磁盘阵列,由于服务器内的硬盘掉线导致服务器崩溃,管理员检查服务器发现这两块硬盘均有物理故障,想要恢复数据必须首先对掉线硬盘进...
    99+
    2023-06-04
  • raid5磁盘阵列2块硬盘离线数据的恢复过程是怎么样的
    raid5磁盘阵列2块硬盘离线数据的恢复过程是怎么样的,针对这个问题,这篇文章详细介绍了相对应的分析和解答,希望可以帮助更多想解决这个问题的小伙伴找到更简单易行的方法。服务器故障描述:客户使用Dell 2850服务器组建了raid5磁盘阵列...
    99+
    2023-06-06
  • 服务器硬盘掉了两块的解决过程
    一.服务器数据恢复故障描述需要进行数据恢复的服务器共10个磁盘柜,每个磁盘柜满配24块硬盘。其9个存储柜用作数据存储使用,另外1个存储柜用作元数据存储使用。元数据存储里一共24块146G硬盘,其中设置了9组RAID 1阵列,1组4盘位RAI...
    99+
    2023-06-04
  • Raid5两块硬盘离线导致服务器瘫痪的解决方法
    服务器数据恢复背景描述:需要进行数据恢复的磁盘阵列是两组分别由4块600G容量的SAS硬盘组成的raid5磁盘阵列,ext3文件系统、lvm结构。磁盘阵列中1号硬盘离线,热备盘启动同步,在同步过程中同raid中3号硬盘故障掉线,该组Raid...
    99+
    2023-06-04
  • 服务器硬盘掉线,重启后数据同步了怎么恢复
    【服务器数据恢复故障介绍】数据恢复中心近期接到客户服务器数据恢复案例并成功恢复,经客户许可后现将数据恢复过程分享给大家,下面简单介绍一下本次服务器数据恢复的故障情况。客户使用的是某品牌的服务器,搭配了多块硬盘组成一组raid5磁盘阵列,作为...
    99+
    2023-06-04
  • 服务器RAID数据恢复,磁盘阵列数据恢复过程
    数据恢复故障描述:raid磁盘阵列情况:服务器中共有5块 SAS 300GB 磁盘组成一组RAID5磁盘阵列服务器分区情况介绍:存储划分为一个LUN、3个分区,第一个分区存放的是系统,第二个分区用于存储生产库,第三个分区是备份分区。数据恢复...
    99+
    2023-06-04
  • 服务器瘫痪后的初检和数据恢复过程
    服务器数据恢复背景北京某国企的一台服务器在正常运行过程中突然崩溃,该服务器共有240块硬盘,其中元数据存储使用了24块硬盘,硬盘搭配情况为9组raid1磁盘阵列和1组raid10磁盘阵列。其余所有硬盘平均组成了36组raid5磁盘阵列。而到...
    99+
    2023-06-03
  • 成功案例分享-服务器3块硬盘离线恢复成功
    俗话说的好,正常的服务器都是正常运行的,不正常的服务器却各有各的故障。作为一名从业了十多年的服务器数据恢复工作者来说,近些年来遇到的服务器数据恢复案例中故障情况大多相似了,没见过的故障越来越少,我想一方面是自己从事服务器数据恢复工作的时间越...
    99+
    2023-06-04
  • 如何恢复阿里云服务器过期后的初始密码
    1. 登录阿里云控制台 首先,打开浏览器并访问阿里云官方网站。在页面右上角找到并点击"登录"按钮,然后输入您的阿里云账号和密码进行登录。 2. 进入云服务器ECS管理页面 登录成功后,您将进入阿里云控制台。在控制台页面中,找到并点击"云服...
    99+
    2023-10-27
    阿里 期后 服务器
  • 服务器故障导致SqlServer数据库损坏的恢复过程
    故障描述: 5块2T硬盘组建RAID5,划分LUN供windows服务器使用。在windows服务器内装有Sql Server2008数据库。存储空间内共有三个逻辑分区,大小分别为500G、800G、2.3...
    99+
    2024-04-02
软考高级职称资格查询
编程网,编程工程师的家园,是目前国内优秀的开源技术社区之一,形成了由开源软件库、代码分享、资讯、协作翻译、讨论区和博客等几大频道内容,为IT开发者提供了一个发现、使用、并交流开源技术的平台。
  • 官方手机版

  • 微信公众号

  • 商务合作