중복 제거된 백업은 왜 복원 공간보다 작아 보이나요?

에바 왕기술 작가 그리고 이자 ZimaSpace의 상주 장인입니다. 평생을 기술에 열정을 가진 사람으로서 홈랩과 오픈소스 소프트웨어에 열정을 가지고 있으며,복잡한 기술 개념을 쉽게 이해할 수 있는 실습 가이드로 번역하는 데 전문성을 가지고 있습니다.에바는 셀프 호스팅이 어렵지 않고 재미있어야 한다고 믿습니다. 그녀의 튜토리얼을 통해 커뮤니티가 하드웨어 설정의 신비를 풀도록돕고 있습니다. 첫 NAS 구축부터 Docker 컨테이너 마스터링까지.

중복 제거된 백업은 반복되는 청크를 한 번만 저장하기 때문에 더 작아 보이지만, 복원 과정에서는 각 논리 파일과 독립적인 사본이 재구성됩니다.

가상 머신 이미지 10개는 백업 저장소에서 동일한 운영 체제 블록을 수 기가바이트씩 공유할 수 있습니다. 이를 일반 파일 시스템으로 복원하면 대상이 호환되는 공유, 희소성 또는 압축을 지원하지 않는 한 10개의 주소 공간이 다시 생성됩니다. 따라서 저장소 크기와 복원 용량은 선택한 대상 파일 시스템에서 서로 다른 할당 규칙과 오버헤드를 사용하는 서로 다른 표현을 나타냅니다.

중복 제거는 데이터를 한 번 저장하고 여러 번 참조합니다

백업 소프트웨어는 데이터를 청크로 나누고 지문을 생성한 다음, 아직 존재하지 않는 청크만 저장합니다. 매니페스트는 각 파일과 복원 지점에 어떤 청크가 속하는지 보존합니다. 저장소는 하나의 물리적 페이로드와 여러 참조를 통해 여러 논리적 사본을 표현할 수 있습니다.

백업 중복 제거에 관한 개요에서는 백업 저장소에서 중복 사본이 제거되는 방식을 설명합니다. 절약되는 용량은 단순히 파일 수가 아니라 반복되는 콘텐츠에 따라 달라집니다.

복원은 이 매핑을 되돌리는 과정입니다. 각 파일은 요청된 대상에 순서대로 바이트를 기록합니다. 대상이 블록 공유를 지원하지 않으면 반복되는 청크가 다시 별도의 익스텐트를 차지합니다. 데이터 절감은 저장소의 특성이며, 모든 복원 대상이 동일하게 압축된 상태로 유지된다는 보장은 아닙니다.

압축, 희소성 및 메타데이터가 차이를 키웁니다

압축은 콘텐츠의 엔트로피에 따라 저장되는 바이트 수를 줄입니다. 희소 파일은 긴 0 영역을 생략하지만, 복원 옵션에 따라 이러한 빈 영역이 실제로 할당될 수 있습니다. 할당 단위, 체크섬, 확장 속성 및 파일 시스템 메타데이터는 저장소 요약에서 제외될 수 있는 대상 측 오버헤드를 추가합니다.

저장소에 관한 설명에서는 희소 파일과 할당된 크기를 구분합니다. 파일은 논리적 길이가 크면서도 물리적 블록은 더 적게 사용할 수 있습니다. 이러한 절약을 유지하려면 복원 도구가 빈 영역을 명시적으로 보존해야 합니다.

반대의 경우도 발생할 수 있습니다. 압축을 지원하는 대상이나 기록 중 복사 클론은 논리적 크기보다 작은 상태로 복원된 데이터를 유지할 수 있습니다. 표현 방식, 보존 집합 및 대상 파일 시스템이 모두 영향을 미치므로 저장소 바이트를 복원 바이트로 변환하는 보편적인 배수는 없습니다.

중복 제거가 주된 원인이 아닌 경우

중복되지 않은 단일 파일이 예상보다 크게 증가한다면 이 설명은 적용되지 않습니다. 암호화, 이미 압축된 미디어, 데이터베이스 내보내기 형식 또는 씬 프로비저닝 변경이 대신 주요 원인일 수 있습니다. 백업 카탈로그가 한 범위에 대해서는 고유 데이터만 표시하는 반면, 복원에는 선택한 여러 스냅샷이 포함될 수도 있습니다.

중복 제거 비율에 관한 기술 논의에서는 중복 제거 비율을 보고할 때 논리적 크기와 물리적 크기를 구분해야 한다고 강조합니다. 범위가 명시되지 않은 비율은 용량 계획을 오도할 수 있습니다.

복원된 파일의 해시나 개수가 선택한 백업과 다르면 이 메커니즘은 더 이상 적용되지 않습니다. 이 경우 문제는 예상된 확장이 아니라 선택 또는 무결성에 있습니다. 백업 바이트가 더 작다는 이유만으로 검증 전에 임시 공간을 부족하게 책정해서는 안 됩니다.

비율을 믿기보다 복원을 측정하세요

대표적인 복원 집합을 선택하고 논리적 원본 바이트, 고유 저장소 바이트, 압축된 바이트, 희소 익스텐트, 파일 수 및 대상 할당 단위를 기록합니다. 격리된 대상에 희소성 보존 옵션과 기본 옵션을 각각 사용해 복원한 다음 해시와 할당된 공간을 확인합니다.

활성 서비스가 테스트 대상을 압박하지 않도록 공유 모델 스토리지 스토리지 플랜을 사용하세요. 실행 결과를 비교하는 동안 저장소 보존 정책과 대상 압축 설정은 동일하게 유지하세요.

복구 용량은 중복 제거된 저장소 수치가 아니라, 측정된 할당 출력 크기와 논리적 데이터 세트 크기에 작업 여유 공간을 더한 값 중 더 큰 쪽을 기준으로 책정하세요. 희소성 보존에 따라 결과가 달라진다면 해당 의존성을 문서화하세요. 파일의 정체성이나 개수가 달라진다면 용량을 조정하기 전에 중단하고 복원 정확성 문제를 해결하세요.

기술 및 AI 허브

더 읽어보기

Get More Builds Like This

Stay in the Loop

Get updates from Zima - new products, exclusive deals, and real builds from the community.

Stay in the Loop preferences

We respect your inbox. Unsubscribe anytime.