Kopia zapasowa maszyny wirtualnej, która co noc zatrzymuje się przy tym samym procencie, zwykle dociera do tego samego obszaru źródłowego lub etapu tworzenia kopii, dzięki czemu procent staje się powtarzalnym wskaźnikiem diagnostycznym.
Zapisz dokładny dysk maszyny wirtualnej, etap, komunikat w dzienniku, przepustowość oraz stan miejsca docelowego w momencie zatrzymania. Następnie porównaj inne repozytorium danych, sprawdź pamięć masową źródła w pobliżu tego obszaru, oddziel proces wstrzymywania operacji w systemie gościa od transferu danych i przeanalizuj nocne konflikty zasobów. Nie traktuj stałego procentu jako dowodu awarii sieci.
Użyj procentu jako powtarzalnego wskaźnika lokalizacji
Zapisuj przez kilka nocy dokładny procent, czas trwania, aktualny dysk maszyny wirtualnej, etap tworzenia kopii, szybkość transferu oraz ostatni wiersz dziennika. Procent wskazuje, na jakim etapie znajduje się zadanie, ale sam w sobie nie stanowi diagnozy.
Prace nad dostrajaniem PBS pokazują, że wąskie gardła wydajności PBS mogą występować podczas odczytu ze źródła, haszowania, kompresji, transferu sieciowego oraz operacji na repozytorium danych, dlatego przed zmianą przypadkowych ustawień określ etap, na którym występuje zatrzymanie.
Jeśli ta sama maszyna wirtualna i ten sam etap zatrzymują się niemal w tym samym miejscu przy każdym uruchomieniu, w pierwszej kolejności sprawdź deterministyczne dane źródłowe lub powtarzalny etap procesu, zamiast zakładać ogólne przeciążenie sieci.
Porównaj miejsce docelowe kopii z innym miejscem
Wykonaj kopię zapasową tej samej maszyny wirtualnej do innego repozytorium danych lub tymczasowej lokalizacji lokalnej, jeśli pozwalają na to pojemność i zasady odzyskiwania. Zachowaj porównywalny tryb tworzenia migawek i obciążenie maszyny wirtualnej.
Typowa ścieżka pamięci masowej kopii zapasowych Proxmox obejmuje pamięć NFS lub NAS, a opóźnienia albo blokady w miejscu docelowym mogą powodować zatrzymanie jednego miejsca, podczas gdy sama maszyna wirtualna pozostaje sprawna.
Jeśli alternatywne miejsce docelowe przekroczy punkt wcześniejszego zatrzymania, sprawdź pierwotne repozytorium danych, system plików, ścieżkę sieciową oraz wolne miejsce. Jeśli oba miejsca zatrzymują się identycznie, wróć do analizy źródła lub etapu tworzenia kopii.
Sprawdź dysk źródłowy w pobliżu powtarzalnego obszaru
Podczas zbliżania się kopii do punktu awarii sprawdź dzienniki pamięci masowej hosta, dane SMART, błędy ZFS lub systemu plików oraz opóźnienia odczytu. Kopia zapasowa może być pierwszym zadaniem odczytującym każdy nieużywany blok.
Rzeczywiste opisy długotrwałych wąskich gardeł kopii PBS pokazują, dlaczego długa kopia może być zdominowana przez jedno wąskie gardło, a nie przez deklarowany rozmiar maszyny wirtualnej.
Powtarzalny błąd odczytu, przekroczenie limitu czasu lub skok opóźnienia w tym samym miejscu powinny przełączyć obsługę incydentu w tryb ochrony danych. Jeśli dysk źródłowy ulega awarii, unikaj wielokrotnych pełnych odczytów.
Oddziel wstrzymywanie operacji w systemie gościa od transferu danych
Ustal, czy kopia zatrzymuje się podczas zamrażania systemu gościa przez agenta, tworzenia migawki, przygotowywania metadanych, czy dopiero po rozpoczęciu przesyłania dużej ilości danych. Przetestuj kopię w oknie konserwacyjnym przy minimalnym obciążeniu systemu gościa.
Ogólny proces tworzenia kopii Proxmox oddziela orkiestrację kopii od transferu pamięci masowej, co jest przydatne, gdy zawiesza się mechanizm wstrzymywania aplikacji zapewniający spójność, mimo że przepustowość dysku i sieci pozostaje prawidłowa.
Jeśli wyłączenie nieistotnego mechanizmu wstrzymywania operacji w systemie gościa pozwoli na kontynuowanie zadania, napraw ten mechanizm lub agenta systemu gościa przed przywróceniem opcji zapewniającej spójność. Nie pozostawiaj ważnych baz danych bez wstrzymywania operacji bez alternatywnego planu odzyskiwania.
Przenieś zadanie poza godziny nocnych konfliktów zasobów
Porównaj czas zatrzymania z operacjami czyszczenia, replikacją, skanowaniem multimediów, migawkami, deduplikacją lub synchronizacją z chmurą. Tymczasowo przełóż tylko jedno konkurencyjne zadanie, aby przetestować wpływ konfliktu zasobów.
Szersze spojrzenie na architekturę i dostrajanie PBS jest przydatne, gdy kilka zasobów korzysta z tego samego nocnego okna, a procent kopii wskazuje jedynie miejsce, w którym konflikt staje się widoczny.
Problem można uznać za rozwiązany, gdy kopia wielokrotnie przekracza wcześniejszy punkt zatrzymania i kończy się użytecznym punktem przywracania. Powiązany przewodnik ZimaSpace dotyczący gotowości kopii zapasowych maszyn wirtualnych uzupełnia ten zakres o odzyskiwanie; uwzględnij jedno testowe przywracanie w planie walidacji, zamiast ufać wskaźnikowi postępu pokazującemu 100 procent.
Wsparcie i wskazówki
Więcej do przeczytania

Czy Plex może współdzielić kartę graficzną z innym kontenerem Dockera?
Plex i inny kontener często mogą korzystać z tego samego układu GPU, ale należy przetestować obsługę sterowników, mapowanie urządzeń, obciążenie silnika wideo, pamięć oraz...

Jak ustalić, czy błąd Plex pochodzi od klienta, czy od serwera
Odtwórz ten sam przypadek na innym kliencie, porównaj ścieżkę sesji, a następnie zbierz dowody z serwera dopiero wtedy, gdy zakres analizy wskaże, gdzie faktycznie...

Jak skonfigurować pamięć podręczną Plex i tymczasową pamięć na transkodowane pliki
Chroń trwały stan Plex, umieszczając tymczasowe pliki transkodowania na odpowiedniej pamięci lokalnej, a następnie zweryfikuj czyszczenie, ilość wolnego miejsca i zachowanie podczas ponownego uruchamiania.

