Una porta dello switch diventa sospetta quando gli errori fisici recenti o le continue perdite del collegamento rimangono associati a essa dopo aver verificato il cavo e l'endpoint.
Le sole copie lente sul NAS non sono sufficienti: latenza dello storage, comportamento SMB, congestione, un cavo patch danneggiato o una scheda di rete guasta possono produrre la stessa segnalazione. Stabilire se il problema riguarda un solo client o tutti i client, azzerare i contatori e spostare un solo componente per test, così la decisione finale sulla sostituzione ricadrà sul livello corretto.
Cercare un'indicazione di affidabilità specifica della porta
Registrare gli eventi di attivazione/disattivazione del collegamento, la velocità e il duplex negoziati, la perdita di pacchetti e gli errori di trasferimento per il percorso interessato. Confrontare un trasferimento con checksum di un file di grandi dimensioni e un ping sulla rete locale con quelli di un client funzionante collegato allo stesso switch.
Gli errori fisici in ricezione e i contatori CRC o dei frame sono indizi più affidabili dei soli scarti in uscita. Una diagnosi di Server Fault osserva che gli errori dei frame possono indicare un guasto del cavo o dell'interfaccia, motivo per cui è necessario escludere il cavo prima di attribuire la colpa alla porta.
Salvare i valori dei contatori, azzerarli e ripetere un trasferimento con durata definita. I vecchi conteggi cumulativi non dimostrano l'esistenza di un problema attivo; i contatori che aumentano durante il guasto forniscono una base di confronto utilizzabile.
Verificare il cavo e lo stato della negoziazione
Sostituire entrambi i cavi patch con cavi sicuramente funzionanti e, quando possibile, bypassare i giunti a parete dubbi. Mantenere lo stesso endpoint e la stessa porta dello switch, quindi ripetere esattamente il trasferimento e registrare se gli errori continuano ad aumentare.
Verificare che entrambe le estremità concordino su velocità e duplex e utilizzino normalmente l'autonegoziazione. Un disallineamento può causare perdite e scarse prestazioni senza che la porta sia danneggiata, quindi correggere lo stato della negoziazione prima di proseguire con la sostituzione dell'hardware.
Se la sostituzione del cavo elimina gli errori, contrassegnare e ritirare il cavo difettoso. Se gli stessi errori ricompaiono sulla stessa porta, conservare il risultato e procedere con lo scambio della porta invece di cambiare contemporaneamente la scheda di rete.
Spostare lo stesso percorso controllato su un'altra porta
Copiare i requisiti di VLAN, accesso, LAG e PoE su una porta sicuramente funzionante, quindi spostare lo stesso endpoint e il cavo verificato. Se la perdita e i contatori smettono di aumentare, la causa principale è probabilmente la porta originale o la sua configurazione.
Collegare un secondo endpoint sicuramente funzionante e il relativo cavo alla porta sospetta. Se il guasto rimane associato alla porta con endpoint diversi, le prove ora supportano un guasto della porta o del PHY dello switch; se segue l'endpoint originale, esaminare la sua scheda di rete e il driver.
Il confronto tra SMB e NFS aiuta a tenere separato il comportamento del protocollo da un test a un livello inferiore: la scelta della condivisione file non può correggere nuovi errori CRC o continue perdite del collegamento.
Verificare la soluzione alternativa e scegliere la sostituzione
Lasciare il dispositivo interessato sulla porta sicuramente funzionante e ripetere il trasferimento file originale, il confronto dei checksum e un ping prolungato. Il ripristino si manifesta con uno stato del collegamento stabile, velocità negoziata corretta, contatori degli errori fisici invariati e assenza di nuovi tentativi o corruzione a livello applicativo.
Disabilitare e contrassegnare la porta sospetta se il problema la segue attraverso due combinazioni di cavi ed endpoint sicuramente funzionanti. Sostituire lo switch quando non è possibile isolare in sicurezza la porta guasta, quando più porte sviluppano lo stesso problema o quando compaiono guasti condivisi dello switch.
Procedere all'escalation quando non funzionano soltanto i carichi trunk o PoE, perché moduli ottici, budget di alimentazione, configurazione VLAN e uplink aggiungono rami non dimostrati da un test su una porta di accesso. Conservare le istantanee dei contatori e la matrice degli scambi per questa revisione.
Supporto e consigli
Altro da leggere

Quale luminosità dello schermo aiuta a ridurre l’affaticamento degli occhi durante lunghe revisioni di file sul NAS?
Non esiste una percentuale di luminosità universale; adatta una schermata bianca all’ambiente, controlla i riflessi, mantieni il testo leggibile e verifica durante una revisione...

Come ridurre l'affaticamento del collo quando la console di un home server è montata troppo in basso
Sposta le attività di routine dalla console bassa oppure alza in sicurezza il target visivo, mantenendo la tastiera più in basso e ripetendo il...

Perché i miei occhi si sentono stanchi dopo aver monitorato di notte una dashboard luminosa del server?
L’affaticamento durante l’uso notturno della dashboard spesso combina una luminosità non adeguata, riflessi, concentrazione prolungata e una riduzione dell’ammiccamento; regola un fattore alla volta...

