매일 밤 같은 백분율에서 멈추는 VM 백업은 대개 동일한 원본 영역이나 백업 단계에 도달한 것이므로, 해당 백분율은 반복적으로 확인할 수 있는 진단 지표가 됩니다.
멈춘 시점의 정확한 VM 디스크, 단계, 로그 메시지, 처리량, 대상 상태를 기록하세요. 그런 다음 다른 데이터스토어와 비교하고, 해당 영역 주변의 원본 스토리지를 점검하며, 게스트 정지 훅과 대량 전송을 구분하고, 야간 리소스 경합을 확인하세요. 일정한 백분율에서 멈춘다는 사실만으로 네트워크 장애라고 단정하지 마세요.
백분율을 반복 가능한 위치 지표로 활용하기
여러 날에 걸쳐 정확한 백분율, 경과 시간, 현재 VM 디스크, 백업 단계, 전송 속도, 마지막 로그 줄을 기록하세요. 백분율은 작업이 어디까지 진행되었는지를 보여 주는 증거일 뿐, 그 자체로 진단 결과는 아닙니다.
PBS 튜닝 사례에 따르면 PBS 성능 병목은 원본 읽기, 해시 계산, 압축, 네트워크 전송, 데이터스토어 작업 사이에서 이동할 수 있습니다. 따라서 무작위로 설정을 변경하기 전에 멈춤이 어느 단계에서 발생하는지 파악하세요.
매번 동일한 VM과 단계에서 거의 같은 지점에 멈춘다면, 일반적인 네트워크 혼잡보다 결정적인 원본 데이터 문제나 반복 가능한 작업 단계를 우선적으로 의심하세요.
다른 대상과 백업 대상 비교하기
용량과 복구 정책이 허용한다면 동일한 VM을 다른 데이터스토어나 임시 로컬 대상으로 백업해 보세요. 스냅샷 모드와 VM 작업 부하는 비슷하게 유지해야 합니다.
일반적인 Proxmox 백업 스토리지 경로에는 NFS 또는 NAS 스토리지가 포함되며, 대상의 지연 시간이나 잠금 문제로 인해 VM 자체는 정상이어도 특정 대상에서 작업이 멈출 수 있습니다.
대체 대상에서 이전에 멈췄던 지점을 통과한다면 원래 데이터스토어, 파일 시스템, 네트워크 경로, 여유 공간을 조사하세요. 두 대상에서 동일하게 멈춘다면 원본 또는 백업 단계로 다시 범위를 좁히세요.
반복적으로 멈추는 영역 주변의 원본 디스크 확인하기
백업이 문제 지점에 접근하는 동안 호스트 스토리지 로그, SMART 데이터, ZFS 또는 파일 시스템 오류, 읽기 지연 시간을 점검하세요. 백업이 모든 콜드 블록을 읽는 첫 번째 작업일 수 있습니다.
장시간 PBS 백업 병목에 관한 실제 사례는 VM의 전체 크기보다 하나의 병목이 긴 백업 시간을 좌우할 수 있음을 보여 줍니다.
같은 지점에서 읽기 오류, 시간 초과 또는 지연 시간 급증이 반복된다면 장애 대응을 데이터 보존 모드로 전환해야 합니다. 원본 디스크가 손상되고 있다면 전체 읽기를 반복하지 마세요.
게스트 정지와 데이터 전송 구분하기
백업이 게스트 에이전트 정지, 스냅샷 생성, 메타데이터 준비 중에 멈추는지, 아니면 대량 데이터 전송이 이미 시작된 후에 멈추는지 확인하세요. 게스트 작업 부하를 최소화한 유지 관리 시간대에 백업을 테스트하세요.
일반적인 Proxmox 백업 워크플로는 백업 오케스트레이션과 스토리지 전송을 구분합니다. 따라서 디스크와 네트워크 처리량이 정상이어도 애플리케이션 일관성을 위한 정지 훅이 멈추는 상황을 파악하는 데 도움이 됩니다.
필수가 아닌 게스트 정지 훅을 비활성화했을 때 작업이 진행된다면, 일관성 옵션을 복원하기 전에 해당 훅이나 게스트 에이전트를 수정하세요. 대체 복구 계획 없이 중요한 데이터베이스를 정지하지 않은 상태로 두지 마세요.
야간 리소스 경합 작업과 백업 시간 분리하기
멈춘 시각을 스크럽, 복제, 미디어 검사, 스냅샷, 중복 제거 또는 클라우드 동기화 작업과 비교하세요. 경합이 의심되는 작업은 한 번에 하나만 일시적으로 시간을 변경해 테스트하세요.
여러 리소스가 동일한 야간 시간대를 공유하고 백업 백분율이 단지 경합이 드러나는 지점일 때는 PBS의 아키텍처와 튜닝을 더 깊이 살펴보는 것이 도움이 됩니다.
백업이 이전의 멈춤 지점을 반복적으로 통과하고 사용할 수 있는 복원 지점으로 완료되면 문제가 해결된 것입니다. VM 백업 준비 상태에 관한 관련 ZimaSpace 가이드는 복구 기준을 보완합니다. 진행률이 100%라고 해서 신뢰하지 말고, 검증 계획에 테스트 복원 1회를 포함하세요.
지원 및 팁
더 읽어보기

Plex가 다른 Docker 컨테이너와 GPU를 공유할 수 있나요?
Plex와 다른 컨테이너가 동일한 GPU에 함께 액세스할 수 있는 경우가 많지만, 드라이버 지원, 디바이스 매핑, 비디오 엔진 부하, 메모리, 복구 동작을 테스트해야 합니다.

Plex 오류가 클라이언트에서 발생한 것인지 서버에서 발생한 것인지 확인하는 방법
다른 클라이언트에서 동일한 항목을 재현하고, 세션 경로를 비교한 다음, 범위 분석을 통해 장애가 실제로 발생한 위치를 확인한 후에만 서버 증거를 수집하세요.

Plex 캐시 및 트랜스코딩 임시 저장소 구성 방법
영구 Plex 상태는 보호하면서 트랜스코딩 임시 파일은 적합한 로컬 저장소에 배치한 다음, 정리 상태와 여유 공간 및 재시작 동작을 확인하세요.

