Was tun, wenn ein VM-Backup nur im Snapshot-Modus bei demselben Prozentsatz einfriert

Eva Wong ist die Technische Redakteurin und und leidenschaftliche Tüftlerin bei ZimaSpace. Eine lebenslange Geek mit einer Leidenschaft für Homelabs und Open-Source-Software, sie spezialisiert sich darauf, komplexe technische Konzepte in zugängliche, praktische Anleitungenzu übersetzen. Eva ist der Meinung, dass Self-Hosting Spaß machen und nicht einschüchternd sein sollte. Durch ihre Tutorials befähigt sie die Community, Hardware-Setups zu entmystifizieren, vom Bau ihres ersten NAS bis hin zur Beherrschung von Docker-Containern.

Ein VM-Backup, das nur im Snapshot-Modus bei derselben Prozentzahl einfriert, deutet zunächst auf den Live-Snapshot- oder Guest-Freeze-Pfad hin und nicht auf einen bestimmten fehlerhaften Festplattenbereich.

Der entscheidende Vergleich ist der Snapshot-Modus mit dem Stop-Modus bei derselben VM, demselben Ziel und einer ungefähr gleich großen Datenmenge. Wenn der Stop-Modus wiederholt über die bisherige Prozentzahl hinauskommt, wird die allgemeine Diagnose eines festen fehlerhaften Bereichs unwahrscheinlicher. Die Untersuchung sollte sich dann auf das Einfrieren und Auftauen durch den QEMU Guest Agent, die Anwendungsruhe, snapshotfähigen Speicher und das Verhalten während laufender Schreibvorgänge konzentrieren. Sichern Sie während der Tests weiterhin im Stop-Modus, damit die Fehlersuche nie die letzte wiederherstellbare Kopie beseitigt.

Nachweisen, dass der Stop-Modus den Fehlerpunkt des Snapshots überwindet

Führen Sie während eines Wartungsfensters ein Backup im Stop-Modus auf dasselbe Ziel aus, das auch der fehlerhafte Snapshot-Job verwendet. Notieren Sie die Prozentzahl, den Datenträger, den Durchsatz und die Dauer an der Stelle, an der der Snapshot-Modus normalerweise anhält.

Ein Vergleich der Backup-Modi in Proxmox erklärt, dass der Snapshot-Modus VMs im laufenden Betrieb hält, während der Stop-Modus viele Variablen zur Laufzeit des Gasts entfernt.

Wenn der Stop-Modus an derselben Stelle einfriert, kehren Sie zum allgemeinen Artikel über das Einfrieren bei derselben Prozentzahl sowie zu Tests des Quell- oder Zielspeichers zurück. Wenn der Stop-Modus erfolgreich abgeschlossen wird, sollten die nächsten Tests im Snapshot-spezifischen Pfad bleiben.

Prüfen, ob das Einfrieren durch den QEMU Guest Agent ausgelöst wird

Prüfen Sie das Backup-Protokoll auf guest-fsfreeze-freeze, guest-fsfreeze-thaw, Zeitüberschreitungen oder Kommunikationsfehler mit dem Guest Agent. Vergleichen Sie den Zeitstempel mit dem Journal des Gasts oder den Windows-Ereignisprotokollen.

Eine Anleitung für Windows-Backups in Proxmox weist darauf hin, dass der Guest Agent fsfreeze ausführt, wenn der Agent aktiviert ist.

Deaktivieren Sie Funktionen zur Gastkonsistenz nicht als erste dauerhafte Maßnahme. Verwenden Sie einen kontrollierten Test, um festzustellen, ob der Freeze-Aufruf selbst die Grenze darstellt, und beheben Sie anschließend die Wechselwirkung zwischen Guest Agent und Dateisystem.

Nach Dateisystemen suchen, die sich nicht sauber einfrieren lassen

Erfassen Sie alle im Gast eingebundenen Dateisysteme, einschließlich Loop-Geräten, Netzwerkdateisystemen, anwendungsähnlichen Bind-Mounts, Datenbankspeichern und ungewöhnlichen Control-Panel-Strukturen. Notieren Sie, welches Dateisystem beim Start des Snapshots ausgelastet ist.

CloudLinux dokumentiert einen Fall, in dem fsfreeze komplexe Gastsysteme zum Hängen bringen kann, anstatt dass das Backup-Ziel selbst die Ursache ist.

Wenn das Entfernen oder Korrigieren eines problematischen Mounts im Gast dazu führt, dass der Snapshot-Modus die Prozentzahl überschreitet, stellen Sie den Konsistenzschutz anschließend wieder her und dokumentieren Sie die Abhängigkeit. Vermeiden Sie wiederholte erzwungene Neustarts, da aus einem Backup-Problem dadurch ein Schaden am Dateisystem des Gasts werden kann.

-15% OFF

Eine Zeitüberschreitung beim Einfrieren von einem Übertragungsstillstand unterscheiden

Prüfen Sie, ob das Backup anhält, bevor eine nennenswerte Datenübertragung beginnt, unmittelbar nach einer Freeze-Anforderung oder erst später beim Kopieren der Blöcke. Eine feste Prozentzahl nahe null kann auf eine völlig andere Fehlerphase hinweisen als ein Stillstand auf halber Strecke einer virtuellen Festplatte.

Ein Fall aus einer Hosting-Wissensdatenbank zeigt, dass das Einfrieren das Backup nach dem Start der Snapshot-Sequenz dauerhaft blockieren kann.

Wenn die Übertragung nie beginnt, konzentrieren Sie sich auf die Ruhephase des Gasts. Wenn die Übertragung lange Zeit normal läuft und erst später ins Stocken gerät, vergleichen Sie stattdessen die Schreiblast im laufenden Betrieb, das Verhalten der Snapshot-Schicht und die Speicherlatenz.

Das Einfrieren des Gasts außerhalb des vollständigen Backups reproduzieren

Testen Sie, sofern Plattform und Wartungsrichtlinien dies zulassen, das Einfrier- und Auftauverhalten des Guest Agent unabhängig oder beobachten Sie den Gast während eines manuellen Snapshot-Vorgangs genau. Halten Sie eine Konsole geöffnet und vergewissern Sie sich, dass der Gast nach dem Auftauen wieder Schreibvorgänge ausführt.

Ein QEMU-Problem dokumentiert, dass QEMU-fsfreeze VMs bei bestimmten Dateisystemkonfigurationen des Gasts sperren kann.

Wenn sich der Stillstand bereits durch das alleinige Einfrieren reproduzieren lässt, beheben Sie zunächst diesen Pfad im Gast, bevor Sie den PBS-Durchsatz optimieren. Wenn Einfrieren und Auftauen sauber funktionieren, untersuchen Sie als Nächstes die Wechselwirkung zwischen Snapshot-Speicher und laufenden Schreibvorgängen.

Den Stop-Modus als Wiederherstellungspfad beibehalten, bis der Snapshot-Modus funktioniert

Geben Sie zuverlässige Backups nicht zugunsten einer Komfortfunktion auf. Planen Sie Backups im Stop-Modus während eines akzeptablen Wartungsfensters, bis der Snapshot-Modus mehrmals erfolgreich abgeschlossen wurde und ein Wiederherstellungstest das Ergebnis bestätigt.

Ein Beispiel auf Server Fault zeigt eine reale Umgebung, in der der Stop-Modus als Ausweichlösung dient, wenn das Verhalten von Live-Snapshots eine separate Behandlung erfordert.

Die Fehlerbehebung ist abgeschlossen, wenn der Snapshot-Modus die bisherige Prozentzahl wiederholt überschreitet und der Gast vor, während und nach dem Backup reagiert. Der zugehörige ZimaSpace-Artikel über das Einfrieren von VM-Backups bei derselben Prozentzahl bleibt der richtige übergeordnete Pfad, wenn auch der Stop-Modus einfriert.

Häufig gestellte Fragen

Ist der Stop-Modus ein dauerhafter Ersatz für den Snapshot-Modus?

Er kann eine zuverlässige Ausweichlösung sein, wenn Ausfallzeiten akzeptabel sind. Der Snapshot-Modus ist jedoch in der Regel vorzuziehen, wenn der Gast sicher in einen konsistenten Zustand versetzt werden kann und Live-Backups zuverlässig abgeschlossen werden.

Sollte ich den QEMU Guest Agent deaktivieren, damit Backups funktionieren?

Nur als kontrollierten Diagnosetest und sofern dies angemessen ist. Der Agent stellt auch nützliche Funktionen zum Herunterfahren und zur Konsistenzsicherung bereit. Daher sollte das zugrunde liegende Problem beim Einfrieren identifiziert und nicht verborgen werden.

Warum stoppt das Backup bei derselben Prozentzahl, wenn das Problem bei fsfreeze liegt?

Prozentuale Fortschrittsanzeigen können wiederholbare Backup-Phasen und nicht nur Positionen auf dem Datenträger abbilden. Ein Freeze oder ein Übergang innerhalb des Snapshots, der immer dieselbe Phase erreicht, kann daher dieselbe sichtbare Prozentzahl erzeugen.

Support & Tipps

Mehr zum Lesen

Get More Builds Like This

Stay in the Loop

Get updates from Zima - new products, exclusive deals, and real builds from the community.

Stay in the Loop preferences

We respect your inbox. Unsubscribe anytime.