HPE 서버에서 RAID 볼륨을 인식하지 못하는 경우
HPE 서버에서 RAID 장애가 발생하면 서버 자체는 정상적으로 켜지더라도 특정 볼륨이나 파일에 접근할 수 없거나, RAID 구성이 정상적으로 인식되지 않는 문제가 발생할 수 있습니다.
특히 RAID Controller의 장애, HDD 또는 SSD의 인식불량, RAID 구성정보 손상, RAID Degraded 및 Rebuild 과정의 오류가 발생하면 단순히 디스크를 교체하거나 RAID를 다시 구성하는 것만으로는 기존 데이터에 접근하기 어려울 수 있습니다.
이번 사례에서는 HPE 서버의 RAID 장애로 데이터에 접근할 수 없는 상황을 기준으로 구성 디스크의 상태와 RAID 구조를 분석하고 데이터복구 가능성을 확인하는 과정을 살펴봅니다.
장애 증상
HPE 서버에서 RAID 볼륨이 정상적으로 인식되지 않거나 데이터에 접근할 수 없는 경우 다음과 같은 증상이 나타날 수 있습니다.
- 서버에서 RAID 볼륨 인식불가
- 특정 HDD 인식불량
- RAID Degraded 상태
- RAID Controller에서 구성정보 확인불가
- 서버 부팅 후 데이터 볼륨 접근불가
- 폴더 및 파일 접근불가
RAID 장애가 발생한 경우에는 현재 RAID 구성 상태를 확인하는 것이 중요합니다.
01. 구성 디스크 상태 확인
먼저 RAID에 연결되어 있던 각 HDD 또는 SSD를 개별적으로 확인합니다.
각 저장장치의 인식 여부와 읽기 상태를 확인하고 배드섹터, 읽기 불량, 물리적 손상 등의 장애가 있는지 분석합니다.
RAID를 구성하고 있던 여러 디스크 중 일부에 문제가 있는 경우에는 각 디스크의 상태가 전체 RAID 데이터 구조에 어떤 영향을 미치는지 함께 확인해야 합니다.
02. RAID 구성정보 분석
구성 디스크의 상태를 확인한 후 기존 RAID 구조를 분석합니다.
확인하는 주요 항목은 다음과 같습니다.
- RAID Level
- 디스크 개수
- 디스크 순서
- Stripe Size
- 데이터 시작 위치
- 패리티 구조
- RAID Metadata
RAID Controller에서 기존 구성을 정상적으로 확인할 수 없는 경우에도 각 구성 디스크에 남아 있는 정보를 분석하여 기존 RAID 구조를 추정할 수 있습니다.
03. 가상 RAID 구성
분석된 정보를 바탕으로 원본 디스크에 직접 데이터를 기록하지 않는 방식으로 가상 RAID 환경을 구성합니다.
가상 RAID에서 데이터 영역이 정상적으로 연결되는지 확인하고 파일시스템 구조를 분석합니다.
이 과정에서 파일과 폴더 구조가 정상적으로 표시되는지 확인하는 것이 중요합니다.
04. 파일시스템 분석
RAID 구성이 정상적으로 확인되면 서버에서 사용하던 파일시스템을 분석합니다.
파일시스템의 구조와 메타데이터를 확인하고 파티션, 볼륨, 폴더 및 파일 정보를 확인합니다.
파일 목록이 정상적으로 확인되더라도 실제 데이터 영역에 문제가 있을 수 있기 때문에 중요 파일을 직접 확인하여 데이터 상태를 검증하는 과정이 필요합니다.
05. 데이터 추출
복구 가능한 데이터가 확인되면 별도의 저장장치로 데이터를 추출합니다.
원본 RAID 디스크에 데이터를 기록하지 않고 분석된 데이터를 별도의 저장장치에 저장하면서 파일 및 폴더 구조를 확인합니다.
특히 업무용 서버의 경우 데이터베이스, 문서, 이미지, 백업파일 등 중요한 파일의 정상 여부를 함께 확인하는 것이 중요합니다.
복구 과정에서 중요한 점
HPE 서버 RAID 장애가 발생했을 때 다음 작업은 임의로 진행하지 않는 것이 좋습니다.
- RAID Rebuild
- RAID 초기화
- 새로운 Array 생성
- HDD 순서 변경
- 디스크 포맷
- 반복적인 서버 부팅
이러한 작업은 RAID 구성정보나 기존 데이터 영역에 영향을 줄 수 있습니다.
데이터가 중요한 경우 현재 서버와 디스크 상태를 유지한 상태에서 먼저 RAID 구성을 분석하는 것이 좋습니다.
HPE 서버 RAID 데이터복구 결과
HPE 서버 RAID 장애의 복구 가능성과 작업 방법은 RAID Level, 장애가 발생한 디스크의 수와 상태, RAID 구성정보 및 파일시스템 손상 여부에 따라 달라집니다.
따라서 서버 RAID 장애가 발생했다면 단순히 RAID를 다시 구성하기보다 구성 디스크를 개별적으로 진단하고 기존 RAID 구조를 분석하는 것이 중요합니다.
인젠은 서버 RAID 장애 발생 시 저장장치 상태 분석 → RAID 구성정보 분석 → 가상 RAID 구성 → 파일시스템 분석 → 데이터 추출 및 검증의 과정을 통해 복구 가능성을 확인합니다.
서버 RAID 장애 상담 시 필요한 정보
가능하다면 다음 정보를 함께 알려주시면 장애 상태를 파악하는 데 도움이 됩니다.
- HPE 서버 모델
- RAID Controller 모델
- HDD / SSD 개수와 용량
- RAID Level
- 현재 RAID 상태
- 서버 부팅 여부
- 장애 발생 전후에 진행한 작업
서버 RAID 장애는 장애 발생 이후 어떤 작업을 했는지에 따라서도 복구 가능성이 달라질 수 있습니다. 따라서 중요한 데이터가 있다면 추가 작업 전에 전문적인 진단을 받는 것을 권장합니다.

