百度360必应搜狗淘宝本站头条
当前位置:网站首页 > 技术教程 > 正文

「数据库数据恢复」SAP应用+Oracle数据库数据恢复案例

mhr18 2024-09-18 20:19 14 浏览 0 评论

服务器数据恢复环境:



6块SAS硬盘中的5块硬盘组成一个RAID5的阵列,1块作为热备盘使用。


服务器故障:

RAID5中1块硬盘故障,热备盘激活开始同步数据,在同步数据过程中又有一块硬盘故障离线,导致RAID5瘫痪,上层LUN无法正常使用。

服务器故障检测和备份:

1、检测磁盘。初步判断是RAID阵列中某些磁盘掉线导致存储不可用。因此在接收到磁盘以后先对所有磁盘做物理检测,检测发现只有一块硬盘有物理故障。

2、备份数据。将所有磁盘都镜像成文件,备份过程中也没有发现其他磁盘物理故障。


服务器故障分析:

1、分析故障原因

因为IBM存储控制器对于磁盘的检测策略很严格,磁盘性能不稳定也会被IBM存储控制器判定为坏盘并踢出RAID组。因此检测出的故障磁盘有可能是读写不稳定,也有可能是物理故障。而一旦RAID中掉线盘数超过这组RAID本身允许掉盘的最大数量,那么这个RAID组将不可用,基于RAID组的LUN也将不可用,因此导致数据丢失。

2、分析RAID组结构

IBM存储的LUN都是基于RAID组的,因此需要先分析底层RAID组的信息,然后利用分析获取到的信息重构原RAID组。分析每一块数据盘,如果那块盘的数据同其它数据盘不太一样,可以初步认定为HotSpare盘。分析其他数据盘,分析Oracle数据库页在每个磁盘中分布的情况,并根据数据分布的情况得出RAID组的条带大小,磁盘顺序及数据走向等RAID组的重要信息。

3、分析RAID组中的LUN信息

由于LUN是基于RAID组的,因此需要根据上述获取到的信息将RAID组虚拟重组出来,然后分析LUN在RAID组中的分配情况,以及LUN分配的数据块MAP。只需要将LUN的数据块分布MAP提取出来。然后针对这些信息编写相应的程序,对LUN的数据MAP做解析,然后根据数据MAP导出LUN的数据。


服务器数据恢复解决方案:

1、实施方案一

对恢复的包含Oracle数据库的LUN进行JFS2文件系统解析,并对文件系统不完整的部分进行人工修复。利用北亚自主开发的JFS2文件系统解析工具解析恢复的LUN,然后恢复文件系统中所有的Oracle数据库文件,并检测Oracle数据库的文件是否完整。对检测有坏块的数据库文件所在磁盘进行扫描Oracle碎片操作,将扫描到的数据页进行组合,然后将有坏块的数据库文件通过人工的方式填补修复完整。在完成所有Oracle数据库文件的恢复之后,应用SAP还是无法正常使用。SAP应用的一些重要数据存放在损坏的存储中,缺失这些数据会导致SAP即使在数据库完整的情况下也无法正常使用,因此还需采用方案二来恢复所有SAP的重要数据。

2、实施方案二

对恢复出来的所有LUN进行文件系统解析,将包含SAP的数据LUN进行文件系统的一致性检测。对文件系统不完整的部分进行人工修复,最后恢复所有SAP及SAP Test的数据。对SAP的数据进行检测,并对损坏的数据进行修复,确保恢复出来的SAP数据是完整的,这样才能保证SAP应用能够完整启动。利用恢复的SAP数据结合之前恢复出来的Oracle数据库,即可启动SAP及所有应用。

启动并修复Oracle数据及SAP应用:

1、启动Oracle数据库并修复

把恢复出来的数据库文件还原到已搭建好的环境中,并尝试启动数据库。在启动过程中由于数据库的一些临时文件校验不一致导致数据库启动失败。北亚数据恢复中心协调Oracle数据库工程师远程对数据库进行修复后,数据库正常启动,数据完整,然后尝试启动SAP。

2、启动SAP并修复

将恢复的SAP文件还原至已搭建好的环境中,并按照之前的启动脚本启动SAP,SAP启动正常,但SAP中用户权限及使用不正常,SAP表现为没有序列号。初步判断是SAP的注册文件没有恢复,重新检测恢复过程,排查可能出问题的部分。排查后发现是因为文件系统的损坏而导致某些文件没有恢复成功。重新修复文件系统,恢复这些数据。启动SAP正常,使用正常。


数据验证:

启动Oracle数据库,启动SAP,通过SAP客户端验证SAP中所有的数据,数据恢复完整,SAP能正常使用。

相关推荐

使用 Docker 部署 Java 项目(通俗易懂)

前言:搜索镜像的网站(推荐):DockerDocs1、下载与配置Docker1.1docker下载(这里使用的是Ubuntu,Centos命令可能有不同)以下命令,默认不是root用户操作,...

Spring Boot 3.3.5 + CRaC:从冷启动到秒级响应的架构实践与踩坑实录

去年,我们团队负责的电商订单系统因扩容需求需在10分钟内启动200个Pod实例。当运维组按下扩容按钮时,传统SpringBoot应用的冷启动耗时(平均8.7秒)直接导致流量洪峰期出现30%的请求超时...

《github精选系列》——SpringBoot 全家桶

1简单总结1SpringBoot全家桶简介2项目简介3子项目列表4环境5运行6后续计划7问题反馈gitee地址:https://gitee.com/yidao620/springbo...

Nacos简介—1.Nacos使用简介

大纲1.Nacos的在服务注册中心+配置中心中的应用2.Nacos2.x最新版本下载与目录结构3.Nacos2.x的数据库存储与日志存储4.Nacos2.x服务端的startup.sh启动脚...

spring-ai ollama小试牛刀

序本文主要展示下spring-aiollama的使用示例pom.xml<dependency><groupId>org.springframework.ai<...

SpringCloud系列——10Spring Cloud Gateway网关

学习目标Gateway是什么?它有什么作用?Gateway中的断言使用Gateway中的过滤器使用Gateway中的路由使用第1章网关1.1网关的概念简单来说,网关就是一个网络连接到另外一个网络的...

Spring Boot 自动装配原理剖析

前言在这瞬息万变的技术领域,比了解技术的使用方法更重要的是了解其原理及应用背景。以往我们使用SpringMVC来构建一个项目需要很多基础操作:添加很多jar,配置web.xml,配置Spr...

疯了!Spring 再官宣惊天大漏洞

Spring官宣高危漏洞大家好,我是栈长。前几天爆出来的Spring漏洞,刚修复完又来?今天愚人节来了,这是和大家开玩笑吗?不是的,我也是猝不及防!这个玩笑也开的太大了!!你之前看到的这个漏洞已...

「架构师必备」基于SpringCloud的SaaS型微服务脚手架

简介基于SpringCloud(Hoxton.SR1)+SpringBoot(2.2.4.RELEASE)的SaaS型微服务脚手架,具备用户管理、资源权限管理、网关统一鉴权、Xss防跨站攻击、...

SpringCloud分布式框架&amp;分布式事务&amp;分布式锁

总结本文承接上一篇SpringCloud分布式框架实践之后,进一步实践分布式事务与分布式锁,其中分布式事务主要是基于Seata的AT模式进行强一致性,基于RocketMQ事务消息进行最终一致性,分布式...

SpringBoot全家桶:23篇博客加23个可运行项目让你对它了如指掌

SpringBoot现在已经成为Java开发领域的一颗璀璨明珠,它本身是包容万象的,可以跟各种技术集成。本项目对目前Web开发中常用的各个技术,通过和SpringBoot的集成,并且对各种技术通...

开发好物推荐12之分布式锁redisson-sb

前言springboot开发现在基本都是分布式环境,分布式环境下分布式锁的使用必不可少,主流分布式锁主要包括数据库锁,redis锁,还有zookepper实现的分布式锁,其中最实用的还是Redis分...

拥抱Kubernetes,再见了Spring Cloud

相信很多开发者在熟悉微服务工作后,才发现:以为用SpringCloud已经成功打造了微服务架构帝国,殊不知引入了k8s后,却和CloudNative的生态发展脱轨。从2013年的...

Zabbix/J监控框架和Spring框架的整合方法

Zabbix/J是一个Java版本的系统监控框架,它可以完美地兼容于Zabbix监控系统,使得开发、运维等技术人员能够对整个业务系统的基础设施、应用软件/中间件和业务逻辑进行全方位的分层监控。Spri...

SpringBoot+JWT+Shiro+Mybatis实现Restful快速开发后端脚手架

作者:lywJee来源:cnblogs.com/lywJ/p/11252064.html一、背景前后端分离已经成为互联网项目开发标准,它会为以后的大型分布式架构打下基础。SpringBoot使编码配置...

取消回复欢迎 发表评论: