GUNET BLOG

NAS 리빌드 중 두 번째 디스크 오류가 더 위험한 이유

NAS 리빌드 중 다른 디스크에도 오류가 생기면, 실제 RAID 구성과 오류 시점을 기록하고 추가 읽기 부하를 줄일 방향을 판단합니다.

01

왜 구분해서 봐야 하나요?

리빌드는 정상 멤버에서도 많은 데이터를 읽습니다. 그 과정에서 잠재된 읽기 오류나 연결 문제가 드러날 수 있습니다. 추가 오류의 영향은 RAID 유형, 이미 빠진 멤버 수, 읽히지 않는 영역과 발생 순서에 따라 달라지므로 두 번째 오류라는 이유만으로 최종 결과를 단정하지 않습니다.

02

먼저 확인할 순서

  1. RAID 유형, 멤버 수와 리빌드 대상 슬롯을 확인합니다.
  2. 리빌드 시작 시각, 진행률, 새 오류가 발생한 멤버와 시각을 기록합니다.
  3. 풀, 볼륨 접근 상태와 중요 데이터 백업 유무를 확인합니다.
  4. 컨트롤러 로그와 각 디스크의 읽기 오류, 연결 이탈을 구분합니다.
03

반복 시도보다 판단이 필요한 상황

  • 추가 멤버가 이탈하거나 읽기 오류가 빠르게 늘면 새 검사와 다른 교체 작업을 보류합니다.
  • 진행 중인 리빌드를 중단할지 판단할 근거가 부족하면 임의 전원 차단 대신 상태를 보존하고 지원 절차를 확인합니다.
04

피해야 할 조치

  • 리빌드 중 남은 디스크를 번갈아 빼 보는 것
  • 오류 원인을 확인하지 않고 전체 스캔, Scrub을 추가하는 것
05

판단의 기준과 한계

추가 읽기 오류가 생긴 시점의 구성을 보존합니다. 데이터 보존과 리빌드 지속 여부는 남은 멤버의 읽기 가능 범위를 기준으로 판단합니다.

RAID 5, RAID 6, 미러와 SHR 계열의 장애 허용 범위는 서로 다릅니다. 오류 개수만으로 복구 가능률을 제시하지 않습니다.

TECHNICAL RESOURCES CONTACT

확인하려는 기술 내용과 사용 환경을 알려주세요

장비와 운영 환경, 확인한 오류나 자료 내용을 알려주시면 필요한 안내와 상담 범위를 확인합니다.