Dlaczego kopia zapasowa maszyny wirtualnej każdej nocy zatrzymuje się na tym samym procencie?

Eva Wong jest Technicznym pisarzem i stałym majsterkowiczem w ZimaSpace. Całe życie geek z pasją do homelabów i oprogramowania open-source, specjalizuje się w tłumaczeniu skomplikowanych koncepcji technicznych na przystępne, praktyczne przewodniki. Eva wierzy, że samodzielne hostowanie powinno być zabawą, a nie czymś onieśmielającym. Poprzez swoje samouczki umożliwia społeczności rozwiewanie tajemnic konfiguracji sprzętu, od budowy pierwszego NAS po opanowanie kontenerów Docker.

Kopia zapasowa maszyny wirtualnej, która co noc zatrzymuje się przy tym samym procencie, zwykle dociera do tego samego obszaru źródłowego lub etapu tworzenia kopii, dzięki czemu procent staje się powtarzalnym wskaźnikiem diagnostycznym.

Zapisz dokładny dysk maszyny wirtualnej, etap, komunikat w dzienniku, przepustowość oraz stan miejsca docelowego w momencie zatrzymania. Następnie porównaj inne repozytorium danych, sprawdź pamięć masową źródła w pobliżu tego obszaru, oddziel proces wstrzymywania operacji w systemie gościa od transferu danych i przeanalizuj nocne konflikty zasobów. Nie traktuj stałego procentu jako dowodu awarii sieci.

Użyj procentu jako powtarzalnego wskaźnika lokalizacji

Zapisuj przez kilka nocy dokładny procent, czas trwania, aktualny dysk maszyny wirtualnej, etap tworzenia kopii, szybkość transferu oraz ostatni wiersz dziennika. Procent wskazuje, na jakim etapie znajduje się zadanie, ale sam w sobie nie stanowi diagnozy.

Prace nad dostrajaniem PBS pokazują, że wąskie gardła wydajności PBS mogą występować podczas odczytu ze źródła, haszowania, kompresji, transferu sieciowego oraz operacji na repozytorium danych, dlatego przed zmianą przypadkowych ustawień określ etap, na którym występuje zatrzymanie.

Jeśli ta sama maszyna wirtualna i ten sam etap zatrzymują się niemal w tym samym miejscu przy każdym uruchomieniu, w pierwszej kolejności sprawdź deterministyczne dane źródłowe lub powtarzalny etap procesu, zamiast zakładać ogólne przeciążenie sieci.

Porównaj miejsce docelowe kopii z innym miejscem

Wykonaj kopię zapasową tej samej maszyny wirtualnej do innego repozytorium danych lub tymczasowej lokalizacji lokalnej, jeśli pozwalają na to pojemność i zasady odzyskiwania. Zachowaj porównywalny tryb tworzenia migawek i obciążenie maszyny wirtualnej.

Typowa ścieżka pamięci masowej kopii zapasowych Proxmox obejmuje pamięć NFS lub NAS, a opóźnienia albo blokady w miejscu docelowym mogą powodować zatrzymanie jednego miejsca, podczas gdy sama maszyna wirtualna pozostaje sprawna.

Jeśli alternatywne miejsce docelowe przekroczy punkt wcześniejszego zatrzymania, sprawdź pierwotne repozytorium danych, system plików, ścieżkę sieciową oraz wolne miejsce. Jeśli oba miejsca zatrzymują się identycznie, wróć do analizy źródła lub etapu tworzenia kopii.

Sprawdź dysk źródłowy w pobliżu powtarzalnego obszaru

Podczas zbliżania się kopii do punktu awarii sprawdź dzienniki pamięci masowej hosta, dane SMART, błędy ZFS lub systemu plików oraz opóźnienia odczytu. Kopia zapasowa może być pierwszym zadaniem odczytującym każdy nieużywany blok.

Rzeczywiste opisy długotrwałych wąskich gardeł kopii PBS pokazują, dlaczego długa kopia może być zdominowana przez jedno wąskie gardło, a nie przez deklarowany rozmiar maszyny wirtualnej.

Powtarzalny błąd odczytu, przekroczenie limitu czasu lub skok opóźnienia w tym samym miejscu powinny przełączyć obsługę incydentu w tryb ochrony danych. Jeśli dysk źródłowy ulega awarii, unikaj wielokrotnych pełnych odczytów.

Oddziel wstrzymywanie operacji w systemie gościa od transferu danych

Ustal, czy kopia zatrzymuje się podczas zamrażania systemu gościa przez agenta, tworzenia migawki, przygotowywania metadanych, czy dopiero po rozpoczęciu przesyłania dużej ilości danych. Przetestuj kopię w oknie konserwacyjnym przy minimalnym obciążeniu systemu gościa.

Ogólny proces tworzenia kopii Proxmox oddziela orkiestrację kopii od transferu pamięci masowej, co jest przydatne, gdy zawiesza się mechanizm wstrzymywania aplikacji zapewniający spójność, mimo że przepustowość dysku i sieci pozostaje prawidłowa.

Jeśli wyłączenie nieistotnego mechanizmu wstrzymywania operacji w systemie gościa pozwoli na kontynuowanie zadania, napraw ten mechanizm lub agenta systemu gościa przed przywróceniem opcji zapewniającej spójność. Nie pozostawiaj ważnych baz danych bez wstrzymywania operacji bez alternatywnego planu odzyskiwania.

Przenieś zadanie poza godziny nocnych konfliktów zasobów

Porównaj czas zatrzymania z operacjami czyszczenia, replikacją, skanowaniem multimediów, migawkami, deduplikacją lub synchronizacją z chmurą. Tymczasowo przełóż tylko jedno konkurencyjne zadanie, aby przetestować wpływ konfliktu zasobów.

Szersze spojrzenie na architekturę i dostrajanie PBS jest przydatne, gdy kilka zasobów korzysta z tego samego nocnego okna, a procent kopii wskazuje jedynie miejsce, w którym konflikt staje się widoczny.

Problem można uznać za rozwiązany, gdy kopia wielokrotnie przekracza wcześniejszy punkt zatrzymania i kończy się użytecznym punktem przywracania. Powiązany przewodnik ZimaSpace dotyczący gotowości kopii zapasowych maszyn wirtualnych uzupełnia ten zakres o odzyskiwanie; uwzględnij jedno testowe przywracanie w planie walidacji, zamiast ufać wskaźnikowi postępu pokazującemu 100 procent.

Wsparcie i wskazówki

Więcej do przeczytania

Get More Builds Like This

Stay in the Loop

Get updates from Zima - new products, exclusive deals, and real builds from the community.

Stay in the Loop preferences

We respect your inbox. Unsubscribe anytime.