교체 디스크가 보이지만 유효한 재구성 멤버가 되지 않은 경우 RAID 배열은 저하 상태로 유지됩니다. 일반적인 원인은 크기 불일치, 외부 메타데이터, 지원되지 않는 상태, 수동 할당 누락, 또는 다른 고장난 소스 디스크입니다.
교체 디스크를 무작위로 초기화하거나 외부 구성을 가져오지 마세요. 먼저 정확한 배열, 누락된 역할, 교체 시리얼 번호, 컨트롤러 상태, 재구성 가능 여부를 확인하세요. 목표는 신뢰된 소스 구성을 변경하지 않고 빈 적격 대상만 연결하는 것입니다.
교체 디스크가 올바른 컨트롤러에 인식되는지 확인하세요
디스크는 운영 체제에서는 보이지만 RAID 컨트롤러에는 접근 불가능할 수 있으며, 컨트롤러에는 예상과 다른 인클로저 슬롯에 나타날 수도 있습니다. 물리적 시리얼 번호, 베이, 컨트롤러 포트, 보고된 섹터 수를 비교하세요.
새 드라이브가 RAID 계층에서 보이지 않는 경우, 배열 메타데이터를 변경하기 전에 전원, 백플레인, 케이블, HBA 모드, 인클로저 매핑을 점검하세요. 시리얼 번호를 확인하지 않고 반복 삽입하면 잘못된 멤버를 서비스할 수 있습니다.
Ready, Unconfigured, Spare 상태는 재구성 중이 아닙니다
많은 하드웨어 컨트롤러는 새 디스크를 Ready 또는 Unconfigured Good과 같은 중립 상태로 둡니다. 디스크가 교체용, 전용 예비용, 또는 해당 컨트롤러의 워크플로우에 따른 글로벌 핫 스페어로 할당될 때까지 배열은 저하 상태로 남아 있습니다.
Ready 상태의 새 드라이브는 좋은 예입니다: 단순히 존재하는 것만으로는 누락된 RAID 역할을 채우지 못합니다. 핫 인서트, 수동 교체 또는 예비 디스크 할당이 필요한지 확인하세요.
소프트웨어 RAID는 보통 명시적인 추가가 필요합니다
Linux md 배열은 블록 장치가 동일한 경로에 다시 나타났다고 해서 사라진 디스크를 반드시 다시 추가하지 않습니다. 이전 멤버는 여전히 제거된 상태로 표시될 수 있으며, 교체 디스크는 사용되지 않는 장치로만 존재할 수 있습니다.
수동 mdadm 재추가 동작은 안전 경계를 반영합니다: 이전에 사라졌던 장치를 자동으로 신뢰하는 것보다 관리자가 확인하고 의도적으로 추가하도록 요구하는 것이 더 안전할 수 있습니다.
외부 메타데이터가 교체를 차단할 수 있음
재사용된 디스크에는 다른 배열의 RAID 서명이 포함될 수 있습니다. 컨트롤러는 이를 외부로 표시하는데, 가져오면 활성 구성이 변경될 수 있기 때문입니다. 새 디스크도 자동 자격을 방해하는 공장, 테스트 또는 이전 사용 메타데이터를 포함할 수 있습니다.
빈 교체용 디스크에서 외부 구성을 가져오지 마세요. 외부 교체 디스크 상태의 경우 새 멤버를 미구성 양호 상태로 변경하는 것이 관련 경로였으며, 이전 배열 정의를 가져오는 것이 아닙니다.
용량 및 섹터 기하학은 배열 최소 요구 사항을 충족해야 함
교체 디스크는 실패한 멤버만큼 사용 가능한 섹터를 제공해야 합니다. 명목상 동일한 드라이브라도 약간 작을 수 있습니다. 일부 컨트롤러는 논리적 또는 물리적 섹터 형식, 인터페이스 유형, 펌웨어 자격 또는 암호화 기능 변경도 거부합니다.
박스에 적힌 라벨뿐 아니라 정확한 크기와 섹터 형식을 비교하세요. 컨트롤러가 새 디스크를 지원하지 않거나 너무 작다고 보고하면 강제로 온라인으로 만들지 말고 호환 가능한 더 큰 대상을 선택하세요.
다른 소스 디스크가 재구성을 방해할 수 있음
재구성에는 살아남은 멤버로부터 읽을 수 있는 데이터가 필요합니다. 다른 디스크에 복구 불가능한 섹터, 반복된 타임아웃 또는 배열에서의 탈락이 있으면 컨트롤러가 중단하거나 교체품을 예비로 유지하거나 재구성 실패 후 열화 상태로 남을 수 있습니다.
원본 디스크가 실패한 순간부터 교체 시도까지 이벤트 로그를 검토하세요. 최신 경고는 대상에 관한 것일 수 있지만 실제 차단 원인은 다른 소스 멤버의 읽기 오류일 수 있습니다.
상태 기반 문제 해결 순서 사용
| 교체 상태 | 가능한 의미 | 다음 점검 |
|---|---|---|
| 감지되지 않음 | 연결 또는 컨트롤러 경로 문제 | 전원, 케이블, 베이, HBA, 시리얼 맵 |
| 준비됨 / 미구성 양호 | 보이지만 할당되지 않음 | 교체 또는 예비 할당 |
| 외부 | 기존 RAID 메타데이터 존재 | 신원 확인; 새 대상 메타데이터만 지우기 |
| 너무 작음 / 지원되지 않음 | 적격성 실패 | 정확한 섹터, 포맷, 컨트롤러 지원 |
| 예비, 재구성 중 아님 | 트리거 또는 소스 오류 없음 | 누락된 역할, 정책, 살아남은 멤버 로그 |
| 재구성 중단됨 | 소스 또는 경로를 완료할 수 없음 | 읽기 오류, 시간 초과, 두 번째 실패 |
컨트롤러별 수동 재구성 할당은 핫 스페어 작업을 사용해 복구를 트리거할 수 있습니다. 다른 RAID 스택에서 복사한 일반 명령 대신 플랫폼에 문서화된 상태 전환을 사용하세요.
시스템을 떠나기 전에 재구성 트리거를 확인하세요
교체가 할당되면 처리된 블록이 증가하고 의도한 일련 번호가 대상임을 확인할 때까지 충분히 관찰하세요. 시작하자마자 중단되는 상태 전환은 대시보드에 잠시 재구성이 표시되더라도 여전히 저하된 어레이입니다.
중단 후 첫 번째 오류를 저장하세요. 특히 살아남은 소스 디스크가 시간 초과되거나 컨트롤러가 대상 기하학을 거부할 때 최종 요약보다 실제 차단 원인을 더 명확히 식별하는 경우가 많습니다.
자주 묻는 질문
교체 디스크를 먼저 초기화해야 하나요?
보통은 아닙니다. 초기화는 메타데이터를 쓸 수 있으며 잘못된 디스크를 선택하면 파괴적일 수 있습니다. 컨트롤러의 교체 워크플로우를 사용해 확인된 빈 대상만 준비하세요.
왜 콜드 스와핑 후 새 디스크가 사용되지 않았나요?
일부 컨트롤러는 핫 인서트 시 교체 디스크를 다르게 감지하고 연결합니다. 콜드 스와핑은 누락된 역할과 별도의 준비된 디스크를 남길 수 있으며, 수동으로 할당해야 합니다.
드라이브를 강제로 온라인 상태로 만들 수 있나요?
강제 온라인 작업은 특정 복구 상황을 위해 설계되었으며 오래된 데이터를 승격시킬 수 있습니다. 새 빈 교체 디스크의 경우 현재 어레이 데이터를 포함하는 척하지 말고 재구성 대상 또는 예비 디스크로 할당하세요.
구성원 변경 후에만 어레이가 정상 상태가 됩니다
가시적인 교체는 저하 상태를 제거하지 않습니다. 교체 대상은 적격해야 하며, 누락된 역할에 할당되고, 읽을 수 있는 소스에서 재구성되어 활성 동기화 멤버로 승격되어야 합니다.
지원 및 팁
더 읽어보기

전원 손실 후 RAID 어레이가 비활성화되는 이유는 무엇인가요?
비활성 배열은 종종 메타데이터가 발견되었지만 시스템이 비정상 종료 후 안전하게 시작할 만큼 충분한 신뢰도나 구성원이 없음을 의미합니다.

누락된 RAID 멤버를 강제로 온라인 상태로 전환할 때의 위험은 무엇인가요?
강제 옵션은 오래된 메타데이터, 손상된 패리티, 누락된 쓰기 또는 활성 풀에 대한 안전 검사 우회를 허용하므로 사용하기 전에 증거를 확인하고 보존하세요.

불량 SATA 케이블과 고장 나는 NAS 드라이브를 구별하는 방법
오류가 디스크에 따라 발생하는지 아니면 SATA 경로에 남아 있는지 추적하고, 하드웨어를 교체하기 전에 전송 카운터와 미디어 상태 증거를 구분하세요.
