分布式数据恢复-hbase+hive分布式存储误删除如何恢复数据？-北亚数据恢复-ChinaUnix博客

北亚数据恢复的ChinaUnix博客

首页　| 　博文目录　| 　关于我

北亚数据恢复

博客访问： 410362
博文数量： 641
博客积分： 0
博客等级：民兵
技术积分： 6445
用户组：普通用户
注册时间： 2016-08-02 14:16

文章分类

全部博文（641）

数据恢复（599）
未分配的博文（42）

文章存档

2025年（26）

2024年（180）

2023年（218）

2022年（181）

2020年（12）

2019年（24）

我的朋友

相关博文

分布式数据恢复-hbase+hive分布式存储误删除如何恢复数据？

分类： HADOOP

2023-11-24 15:44:17

hbase+hive分布式存储数据恢复环境：
16台某品牌R730XD服务器节点，每台物理服务器节点上有数台虚拟机，虚拟机上配置的分布式，上层部署hbase数据库+hive数据仓库。

hbase+hive分布式存储故障&初检：
数据库文件被误删除，数据库无法使用。
通过现场对该分布式环境的初步检测，发现虚拟机还可以正常启动，虚拟机里面的数据库块文件丢失。好在块文件丢失之后没有对集群环境写入数据，底层数据损坏可能性比较小。

hbase+hive分布式存储数据恢复方案：
1、备份。
A、从物理服务器底层做备份，将设备断电、关机。将所有磁盘编号后从服务器/存储中取出。
B、从虚拟机层面备份，通过网络直接备份虚拟机底层磁盘文件。
C、北亚企安数据恢复中心准备一台服务器以只读方式挂载服务器硬盘，对所有磁盘进行扇区对扇区的全盘镜像备份。
D、备份完成后提供详细报告，内容涉及所有磁盘的健康状态和存在的坏道列表。
E、将服务器硬盘按照编号还原到原服务器/存储设备中，之后数据分析和数据恢复操作都基于镜像文件进行，避免对原始磁盘数据造成二次破坏。

2、基于镜像文件分析块文件结构。
A、分析每个虚拟机磁盘的块文件。
B、分析文件底层的聚合方式。
C、分析磁盘中数据分布情况。

3、分析Block文件key。
A、定位数据库文件中的key信息。
B、提取并解析数据库文件中key信息。
C、整合数据库文件key信息。

4、拼接Block文件。
A、根据Block文件的key信息提取文件片段。
B、拼接Block文件的片段。
C、校验拼接后的Block文件的正确性。

5、导入Block文件。
A、校验提取出来的Block文件完整性和正确性。
B、把提取出来的Block文件导入到hbase和hive数据仓库中。

6、验证数据。
由用户对数据进行详细验证。如果发现问题则重新检验上面的恢复流程。

阅读(170) | 评论(0) | 转发(0) |

上一篇：数据库数据恢复—SQLserver数据库中勒索病毒被加密的数据恢复案例

下一篇：Vsan数据恢复—Vsan分布式存储数据恢复案例

给主人留下些什么吧！~~

感谢所有关心和支持过ChinaUnix的朋友们

16024965号-6