Een VM-back-up die alleen in snapshotmodus bij hetzelfde percentage vastloopt, wijst eerder op het pad voor live snapshots of het bevriezen van de gast dan op een vaste slechte schijfregio.
De doorslaggevende vergelijking is snapshotmodus versus stopmodus met dezelfde VM, bestemming en ongeveer dezelfde hoeveelheid data. Als de stopmodus het oude percentage herhaaldelijk passeert, wordt de algemene diagnose van een vaste probleemregio minder waarschijnlijk en moet het onderzoek zich richten op het bevriezen en hervatten via de QEMU Guest Agent, het tijdelijk stilleggen van applicaties, opslag die snapshots ondersteunt en gedrag bij live schrijfbewerkingen. Bewaar tijdens het testen een werkende back-up in stopmodus, zodat het oplossen van problemen nooit de laatste herstelbare kopie verwijdert.
Bewijs dat de stopmodus het foutpunt van de snapshot passeert
Voer tijdens een onderhoudsvenster één back-up in stopmodus uit naar hetzelfde doel dat door de mislukte snapshottaak wordt gebruikt. Noteer het percentage, de schijf, de doorvoersnelheid en de duur waarop de snapshotmodus normaal stopt.
Een vergelijking van back-upmodi in Proxmox legt uit dat snapshotmodus VM's actief houdt, terwijl de stopmodus veel variabelen tijdens het uitvoeren van de gast uitsluit.
Als de stopmodus op hetzelfde punt vastloopt, ga dan terug naar het algemene artikel over vastlopen op hetzelfde percentage en voer tests uit op de bron- of doelopslag. Als de stopmodus voltooit, houd je de volgende experimenten binnen het snapshotspecifieke pad.
Controleer of het bevriezen via de QEMU Guest Agent de trigger is
Controleer het back-uplog op guest-fsfreeze-freeze, guest-fsfreeze-thaw, time-outs of communicatiefouten met de guest agent. Vergelijk de tijdstempel met het gastjournal of de Windows-gebeurtenislogboeken.
Een handleiding voor Windows-back-ups in Proxmox vermeldt dat de guest agent fsfreeze uitvoert wanneer de agent is ingeschakeld.
Schakel functies voor gastconsistentie niet als eerste oplossing permanent uit. Gebruik een gecontroleerde test om vast te stellen of de freeze-aanroep zelf de grens vormt en herstel vervolgens de interactie tussen de guest agent en het bestandssysteem.
Zoek naar bestandssystemen die niet netjes kunnen worden bevroren
Breng alle gekoppelde bestandssystemen binnen de gast in kaart, inclusief loopapparaten, netwerkbestandssystemen, bind-achtige applicatiekoppelingen, databaseopslag en ongebruikelijke indelingen van configuratiepanelen. Noteer welk bestandssysteem bezet is wanneer de snapshot begint.
CloudLinux beschrijft een geval waarin fsfreeze complexe gasten kan laten vastlopen, in plaats van dat de back-upbestemming zelf de oorzaak is.
Als het verwijderen of corrigeren van één problematische koppeling in de gast ervoor zorgt dat de snapshotmodus het percentage passeert, herstel dan daarna de consistentiebescherming en documenteer de afhankelijkheid. Vermijd herhaaldelijk geforceerd resetten, omdat een back-upprobleem daardoor kan veranderen in schade aan het gastbestandssysteem.
Maak onderscheid tussen een time-out bij het bevriezen en een overdrachtsblokkade
Controleer of de back-up stopt voordat er betekenisvolle gegevensoverdracht begint, direct na een freeze-verzoek of pas later tijdens het kopiëren van blokken. Een vast percentage vlak bij nul kan wijzen op een volledig andere foutfase dan een blokkade halverwege een virtuele schijf.
Een geval uit een kennisbank voor hosting laat zien dat het bevriezen de back-up onbeperkt kan blokkeren nadat de snapshotreeks is gestart.
Als de overdracht nooit begint, richt je dan op het tijdelijk stilleggen van de gast. Als de overdracht lange tijd normaal verloopt voordat deze vastloopt, vergelijk dan de belasting door live schrijfbewerkingen, het gedrag van de snapshotlaag en de opslaglatentie.
Reproduceer het bevriezen van de gast buiten de volledige back-up
Test, voor zover het platform en het onderhoudsbeleid dit toestaan, het bevriezen en hervatten via de guest agent afzonderlijk of observeer de gast nauwlettend tijdens een handmatige snapshotgebeurtenis. Houd een console open en controleer of de gast na het hervatten weer schrijfbewerkingen uitvoert.
Een QEMU-issue documenteert dat QEMU fsfreeze VM's kan vergrendelen bij bepaalde indelingen van bestandssystemen in de gast.
Als alleen het bevriezen de blokkade reproduceert, herstel dan eerst dat gastpad voordat je PBS-doorvoer afstemt. Als het bevriezen en hervatten probleemloos verlopen, ga dan verder met de interactie tussen snapshotopslag en live schrijfbewerkingen.
Houd de stopmodus als herstelpad aan totdat de snapshotmodus werkt
Breng betrouwbare back-ups niet in gevaar terwijl je een gemaksfunctie onderzoekt. Plan back-ups in stopmodus tijdens een acceptabel onderhoudsvenster totdat de snapshotmodus meerdere keren is voltooid en een hersteltest het resultaat bevestigt.
Een voorbeeld op Server Fault laat zien dat de stopmodus een terugvaloptie biedt wanneer live-snapshotgedrag afzonderlijk moet worden afgehandeld.
De oplossing is voltooid wanneer de snapshotmodus het oude percentage herhaaldelijk passeert en de gast vóór, tijdens en na de back-up responsief blijft. Het gerelateerde ZimaSpace-artikel over algemene back-ups die op hetzelfde percentage vastlopen blijft de juiste bovenliggende route als ook de stopmodus vastloopt.
Veelgestelde vragen
Is de stopmodus een permanente vervanging voor de snapshotmodus?
Dat kan een betrouwbare terugvaloptie zijn wanneer downtime acceptabel is, maar de snapshotmodus heeft meestal de voorkeur als de gast veilig tijdelijk kan worden stilgelegd en live back-ups consistent worden voltooid.
Moet ik de QEMU Guest Agent uitschakelen om back-ups te laten werken?
Alleen als gecontroleerde diagnostische test, waar dat gepast is. De agent biedt ook nuttige functies voor afsluiten en consistentie. Het onderliggende bevriezingsprobleem moet daarom worden vastgesteld in plaats van verborgen.
Waarom stopt de back-up op hetzelfde percentage als het probleem fsfreeze is?
Voortgangspercentages kunnen overeenkomen met herhaalbare back-upfasen en niet alleen met schijflocaties. Een freeze of overgang naar een snapshot die in dezelfde fase wordt bereikt, kan daardoor hetzelfde zichtbare percentage opleveren.
Ondersteuning & Tips
Meer om te lezen

Kan Plex een GPU delen met een andere Docker-container?
Plex en een andere container kunnen vaak dezelfde GPU gebruiken, maar je moet de driverondersteuning, apparaattoewijzing, belasting van de video-engine, het geheugengebruik en het...

Hoe je kunt bepalen of een Plex-fout door de client of de server wordt veroorzaakt
Reproduceer hetzelfde item op een andere client, vergelijk het sessiepad en verzamel pas serverbewijs nadat de scope heeft uitgewezen waar de fout daadwerkelijk zit.

Plex-cache en tijdelijke opslag voor transcodering configureren
Bescherm de permanente Plex-status door tijdelijke transcodebestanden op geschikte lokale opslag te plaatsen en controleer vervolgens het opruimen, de beschikbare ruimte en het gedrag...

