Een SATA-SSD kan na een warme herstart verdwijnen wanneer de controller of verbinding in een slechte toestand blijft die alleen door volledige stroomonderbreking wordt opgeheven.
Bij een normale herstart wordt de software opnieuw ingesteld, maar wordt de stand-byvoeding van de SSD, controller, backplane of moederbordpoort mogelijk niet onderbroken. Als de verbinding niet gereed komt, kan de schijf verdwijnen voordat partities, bestandssystemen, pools of toepassingen erbij betrokken zijn. Een volledige uitschakeling verandert de diagnose, omdat hierdoor de controller en verbinding grondiger worden geïnitialiseerd. Begin met het vaststellen van de laagste laag waarop het apparaat verloren gaat, in plaats van meteen de opslag opnieuw op te bouwen of het bestandssysteem te vervangen.
Bepaal of BIOS, de SATA-controller of alleen het besturingssysteem de SSD kwijtraakt
Noteer of de SSD vóór en na een warme herstart zichtbaar is in BIOS of UEFI, in de controllerview van het besturingssysteem, in de lijst met blokapparaten, in de partitietabel en in het gekoppelde bestandssysteem.
De Linux libATA-handleiding beschrijft hoe het stuurprogramma wacht tot een SATA-verbinding gereed komt en een apparaat als afwezig kan beschouwen wanneer dit niet lukt. Het herstelmodel voor SATA-verbindingen legt uit waarom een schijf kan verdwijnen voordat de laag van het bestandssysteem wordt bereikt.
Als BIOS de SSD ook kwijtraakt, richt je dan op firmware, poortvoeding, verbindingsinitialisatie, kabel en de controller van de schijf. Als BIOS de SSD wel ziet maar het besturingssysteem niet, bewaar dan de logboeken van het besturingssysteem en controleer de enumeratie van het stuurprogramma en de controllermodus.
Vergelijk een warme herstart, volledige uitschakeling en stroomonderbreking
Test een normale herstart, een uitschakeling van het besturingssysteem gevolgd door onmiddellijk inschakelen en een uitschakeling waarbij de stroom lang genoeg wordt onderbroken om de stand-byvoedingslijnen te laten ontladen. Herhaal elke toestand minstens twee keer.
De PCI-apparaatweergave vormt een duidelijke scheidslijn tussen de aanwezigheid van de controller en de detectie van opslag. Het hulpprogramma lspci kan bevestigen of de AHCI- of SATA-controller tussen herstarts is veranderd, zelfs wanneer het SSD-blokapparaat ontbreekt.
Als alleen volledige stroomonderbreking de schijf herstelt, zijn vastgehouden controllerstatus, een onvolledige reset van de SATA-PHY, de firmwarestatus van de SSD of een interactie met energiebeheer de waarschijnlijkste oorzaken. Dit patroon past minder goed bij een gewoon koppelings- of partitieprobleem.
Controleer de eerste SATA-verbinding en de resetfout
Sla het kernel- of systeemgebeurtenissenlogboek van de mislukte warme herstart op voordat je koud opstart. Zoek naar meldingen over een verbroken verbinding, mislukte COMRESET-opdrachten, time-outs bij het gereedkomen van het apparaat, mislukte IDENTIFY-opdrachten of herhaalde poortresets.
Active Link Power Management voor SATA kan de verbinding in energiebesparende toestanden brengen die sommige combinaties van controllers en SSD's slecht verwerken. ArchWiki waarschuwt dat agressief energiebeheer van verbindingen ernstige problemen kan veroorzaken bij incompatibele apparaten.
De eerste fout is waardevoller dan latere meldingen dat het bestandssysteem of de pool niet beschikbaar is. Bewaar het poortnummer en het schijfmodel, zodat elke latere kabel-, slot- en firmwaretest aan hetzelfde pad kan worden gekoppeld.
Controleer de SATA-kabel, voedingsconnector en tellers voor interfacefouten
Sluit de SATA-datakabel en voedingsconnector opnieuw aan terwijl de server volledig is uitgeschakeld. Controleer vergrendelingslipjes, scherpe bochten, splitters, backplane-connectoren en adapters op schade of slechte verbindingen.
De probleemoplossingsrichtlijnen voor opslag van Unraid stellen dat oplopende UDMA-CRC-fouten aanleiding moeten zijn om datakabels, voedingskabels, controllerverbindingen en poorten te controleren, in plaats van meteen het bestandssysteem te repareren.
Een historische CRC-teller bewijst niet dat de huidige kabel nog steeds defect is. Noteer de onbewerkte waarde, voer één gecontroleerde herstartcyclus uit en controleer of de teller toeneemt.
Controleer SMART, foutlogboeken en de firmwarestatus van de SSD
Leg het model, serienummer, de firmwareversie, het aantal inschakelcycli, het aantal onveilige uitschakelingen, interfacefouten en beschikbare apparaatfoutlogboeken van de SSD vast wanneer de schijf zichtbaar is.
De smartctl-referentie beschrijft SMART-kenmerken en foutlogboeken die helpen onderscheid te maken tussen problemen met de flashgezondheid en fouten in het transport of de controller.
Voer een firmware-update voor de SSD alleen uit nadat je back-ups, modelcompatibiliteit en de herstelinstructies van de leverancier hebt gecontroleerd. Wijzig per keer slechts één firmwarelaag, zodat een geslaagde oplossing kan worden geïdentificeerd.
Gebruik opnieuw scannen alleen als diagnose
Wanneer de controller aanwezig blijft maar de schijf ontbreekt, voer je één ondersteunde opslagrescan uit nadat alle actieve I/O is gestopt. Noteer of de SSD terugkomt zonder een stroomcyclus.
Microsoft documenteert dat de DiskPart-opdracht rescan nieuw gedetecteerde schijven lokaliseert, waardoor deze opdracht helpt onderscheid te maken tussen vertraagde enumeratie door het besturingssysteem en een schijf die op controllerniveau ontbreekt.
Een geslaagde rescan is geen permanente oplossing. Het laat zien dat de controller en SSD na een nieuwe detectiepoging kunnen communiceren; het resterende werk ligt dus bij firmware, stuurprogramma, controllermodus of verbindingsinitialisatie.
Isoleer de schijf, poort en controller voordat je iets vervangt
Verplaats de SSD na het maken van een back-up naar een bekende goede SATA-poort met een bekende goede kabel, of test een bekende goede schijf op het oorspronkelijke pad. Wijzig per cyclus slechts één onderdeel.
De ZimaSpace-handleiding voor het onderscheiden van fouten in SATA-kabel en schijf biedt de aanvullende isolatieworkflow voor opslagpaden die onderbroken uitvallen.
Het probleem is opgelost wanneer de SSD zichtbaar blijft tijdens herhaalde warme herstarts, koude starts, perioden van inactiviteit en langdurige leesbewerkingen, zonder nieuwe verbindingsfouten. Gebruik de schijf niet langer voor primaire gegevens als deze blijft verdwijnen via bekende goede poorten en kabels of steeds ernstigere apparaatfouten rapporteert.
Ondersteuning & Tips
Meer om te lezen

Kan Plex een GPU delen met een andere Docker-container?
Plex en een andere container kunnen vaak dezelfde GPU gebruiken, maar je moet de driverondersteuning, apparaattoewijzing, belasting van de video-engine, het geheugengebruik en het...

Hoe je kunt bepalen of een Plex-fout door de client of de server wordt veroorzaakt
Reproduceer hetzelfde item op een andere client, vergelijk het sessiepad en verzamel pas serverbewijs nadat de scope heeft uitgewezen waar de fout daadwerkelijk zit.

Plex-cache en tijdelijke opslag voor transcodering configureren
Bescherm de permanente Plex-status door tijdelijke transcodebestanden op geschikte lokale opslag te plaatsen en controleer vervolgens het opruimen, de beschikbare ruimte en het gedrag...

