Wat te doen wanneer een VM-back-up alleen in snapshotmodus bij hetzelfde percentage vastloopt

Eva Wong is de Technisch Schrijver en en vaste knutselaar bij ZimaSpace. Een levenslange geek met een passie voor homelabs en open-source software, zij is gespecialiseerd in het vertalen van complexe technische concepten naar toegankelijke, praktische handleidingen. Eva gelooft dat zelf-hosting leuk moet zijn, niet intimiderend. Met haar tutorials stelt ze de community in staat om hardware-setup te ontrafelen, van het bouwen van hun eerste NAS tot het beheersen van Docker-containers.

Een VM-back-up die alleen in snapshotmodus bij hetzelfde percentage vastloopt, wijst eerder op het pad voor live snapshots of het bevriezen van de gast dan op een vaste slechte schijfregio.

De doorslaggevende vergelijking is snapshotmodus versus stopmodus met dezelfde VM, bestemming en ongeveer dezelfde hoeveelheid data. Als de stopmodus het oude percentage herhaaldelijk passeert, wordt de algemene diagnose van een vaste probleemregio minder waarschijnlijk en moet het onderzoek zich richten op het bevriezen en hervatten via de QEMU Guest Agent, het tijdelijk stilleggen van applicaties, opslag die snapshots ondersteunt en gedrag bij live schrijfbewerkingen. Bewaar tijdens het testen een werkende back-up in stopmodus, zodat het oplossen van problemen nooit de laatste herstelbare kopie verwijdert.

Bewijs dat de stopmodus het foutpunt van de snapshot passeert

Voer tijdens een onderhoudsvenster één back-up in stopmodus uit naar hetzelfde doel dat door de mislukte snapshottaak wordt gebruikt. Noteer het percentage, de schijf, de doorvoersnelheid en de duur waarop de snapshotmodus normaal stopt.

Een vergelijking van back-upmodi in Proxmox legt uit dat snapshotmodus VM's actief houdt, terwijl de stopmodus veel variabelen tijdens het uitvoeren van de gast uitsluit.

Als de stopmodus op hetzelfde punt vastloopt, ga dan terug naar het algemene artikel over vastlopen op hetzelfde percentage en voer tests uit op de bron- of doelopslag. Als de stopmodus voltooit, houd je de volgende experimenten binnen het snapshotspecifieke pad.

Controleer of het bevriezen via de QEMU Guest Agent de trigger is

Controleer het back-uplog op guest-fsfreeze-freeze, guest-fsfreeze-thaw, time-outs of communicatiefouten met de guest agent. Vergelijk de tijdstempel met het gastjournal of de Windows-gebeurtenislogboeken.

Een handleiding voor Windows-back-ups in Proxmox vermeldt dat de guest agent fsfreeze uitvoert wanneer de agent is ingeschakeld.

Schakel functies voor gastconsistentie niet als eerste oplossing permanent uit. Gebruik een gecontroleerde test om vast te stellen of de freeze-aanroep zelf de grens vormt en herstel vervolgens de interactie tussen de guest agent en het bestandssysteem.

Zoek naar bestandssystemen die niet netjes kunnen worden bevroren

Breng alle gekoppelde bestandssystemen binnen de gast in kaart, inclusief loopapparaten, netwerkbestandssystemen, bind-achtige applicatiekoppelingen, databaseopslag en ongebruikelijke indelingen van configuratiepanelen. Noteer welk bestandssysteem bezet is wanneer de snapshot begint.

CloudLinux beschrijft een geval waarin fsfreeze complexe gasten kan laten vastlopen, in plaats van dat de back-upbestemming zelf de oorzaak is.

Als het verwijderen of corrigeren van één problematische koppeling in de gast ervoor zorgt dat de snapshotmodus het percentage passeert, herstel dan daarna de consistentiebescherming en documenteer de afhankelijkheid. Vermijd herhaaldelijk geforceerd resetten, omdat een back-upprobleem daardoor kan veranderen in schade aan het gastbestandssysteem.

-15% OFF
Single board computer zimaboard2

Maak onderscheid tussen een time-out bij het bevriezen en een overdrachtsblokkade

Controleer of de back-up stopt voordat er betekenisvolle gegevensoverdracht begint, direct na een freeze-verzoek of pas later tijdens het kopiëren van blokken. Een vast percentage vlak bij nul kan wijzen op een volledig andere foutfase dan een blokkade halverwege een virtuele schijf.

Een geval uit een kennisbank voor hosting laat zien dat het bevriezen de back-up onbeperkt kan blokkeren nadat de snapshotreeks is gestart.

Als de overdracht nooit begint, richt je dan op het tijdelijk stilleggen van de gast. Als de overdracht lange tijd normaal verloopt voordat deze vastloopt, vergelijk dan de belasting door live schrijfbewerkingen, het gedrag van de snapshotlaag en de opslaglatentie.

Reproduceer het bevriezen van de gast buiten de volledige back-up

Test, voor zover het platform en het onderhoudsbeleid dit toestaan, het bevriezen en hervatten via de guest agent afzonderlijk of observeer de gast nauwlettend tijdens een handmatige snapshotgebeurtenis. Houd een console open en controleer of de gast na het hervatten weer schrijfbewerkingen uitvoert.

Een QEMU-issue documenteert dat QEMU fsfreeze VM's kan vergrendelen bij bepaalde indelingen van bestandssystemen in de gast.

Als alleen het bevriezen de blokkade reproduceert, herstel dan eerst dat gastpad voordat je PBS-doorvoer afstemt. Als het bevriezen en hervatten probleemloos verlopen, ga dan verder met de interactie tussen snapshotopslag en live schrijfbewerkingen.

Houd de stopmodus als herstelpad aan totdat de snapshotmodus werkt

Breng betrouwbare back-ups niet in gevaar terwijl je een gemaksfunctie onderzoekt. Plan back-ups in stopmodus tijdens een acceptabel onderhoudsvenster totdat de snapshotmodus meerdere keren is voltooid en een hersteltest het resultaat bevestigt.

Een voorbeeld op Server Fault laat zien dat de stopmodus een terugvaloptie biedt wanneer live-snapshotgedrag afzonderlijk moet worden afgehandeld.

De oplossing is voltooid wanneer de snapshotmodus het oude percentage herhaaldelijk passeert en de gast vóór, tijdens en na de back-up responsief blijft. Het gerelateerde ZimaSpace-artikel over algemene back-ups die op hetzelfde percentage vastlopen blijft de juiste bovenliggende route als ook de stopmodus vastloopt.

Veelgestelde vragen

Is de stopmodus een permanente vervanging voor de snapshotmodus?

Dat kan een betrouwbare terugvaloptie zijn wanneer downtime acceptabel is, maar de snapshotmodus heeft meestal de voorkeur als de gast veilig tijdelijk kan worden stilgelegd en live back-ups consistent worden voltooid.

Moet ik de QEMU Guest Agent uitschakelen om back-ups te laten werken?

Alleen als gecontroleerde diagnostische test, waar dat gepast is. De agent biedt ook nuttige functies voor afsluiten en consistentie. Het onderliggende bevriezingsprobleem moet daarom worden vastgesteld in plaats van verborgen.

Waarom stopt de back-up op hetzelfde percentage als het probleem fsfreeze is?

Voortgangspercentages kunnen overeenkomen met herhaalbare back-upfasen en niet alleen met schijflocaties. Een freeze of overgang naar een snapshot die in dezelfde fase wordt bereikt, kan daardoor hetzelfde zichtbare percentage opleveren.

Ondersteuning & Tips

Meer om te lezen

Get More Builds Like This

Stay in the Loop

Get updates from Zima - new products, exclusive deals, and real builds from the community.

Stay in the Loop preferences

We respect your inbox. Unsubscribe anytime.