安全なアプローチは、失敗の兆候を記録し、一度に1つの変数だけを変更し、単一のコマンドではなく、観測可能なゲートを順に確認しながら、適合する修正だけを適用することです。
USB直接接続ストレージエンクロージャを使用するLinuxホームサーバーでは、実際のリスクは、負荷がかかったときにUSB DASのディスクが切断、リセット、または消失することです。現在の識別情報と復旧ポイントを記録し、最も影響の少ない切り分けから始め、別の変数を変更する前に成功・失敗の結果を解釈し、ストレージが不安定になった場合や、復旧可能なコピーが1つしかなく、それが危険にさらされる場合は停止します。以下の手順は、元のワークロードが成功するか、証拠がエスカレーションの境界に達した時点でのみ終了します。
切断の正確な兆候を記録する
書き込み負荷の高いアプリケーションを停止し、同じ転送を再現しながらjournalctl -k -fまたはdmesg -wを収集します。タイムスタンプ、USBトポロジー、ブリッジのベンダーIDと製品ID、ネゴシエートされた速度、デバイスのシリアル番号、マウント状態、および後続のリセットメッセージによって開始イベントが隠れる前に現れた最初のエラーを記録します。
解決済みのAsk Ubuntu事例では、UASの中断と切断の事例として、UASの中断メッセージとデバイスの消失を併せて読む必要がある典型例が示されています。この兆候は限定的な観測として扱い、すべての切断がUASのバグだと断定しないでください。
書き込み中にリセットが繰り返される、ファイルシステムが読み取り専用になる、ドライブからクリック音がする、またはSMARTやデバイスのエラーカウンターが増加する場合は、テストを中止してデータを保護してください。不安定なUSB経路でファイルシステム修復を実行しないでください。
まず電源と信号の問題を切り分ける
元のエンクロージャでワークロードを再現し、その後はケーブル、ホストポート、電源アダプター、または適切な場合は給電付きハブのうち、1項目だけを変更します。ドライブ、ファイルシステム、ワークロード、実行時間は一定に保ちます。複数ドライブをバスパワーで動かすエンクロージャが、スピンアップ時または同時書き込み時だけ失敗する場合、アイドル状態の読み取りが正常でも、電源の問題が疑われます。
リンク速度が低下していないか、コネクターを動かすとリセットされないか、フロントパネルのポートや延長ケーブル経由の場合だけ失敗しないかを確認します。疑わしいケーブルは短い認証済みケーブルに交換し、対照テスト中はアダプターを避けます。特定のポートまたはホストでエラーが発生する場合は、コントローラーと電源管理をテストするまでエンクロージャを切り分けの対象外にします。
この分岐は、ハードウェア経路を1箇所だけ変更した後、コールドスタートを2回行い、継続的な転送を実行しても元の負荷で接続が維持されれば合格です。すべてのケーブルとポートで同じトランザクションパターンに失敗する場合は、ブリッジプロトコルとエンクロージャ対ドライブのテストに進みます。
UASはデフォルトの原因ではなく、互換性の分岐としてテストする
デバイスが現在uasを使用していることを確認し、正確なUSB IDを記録します。UAS固有の中断を再現した後にのみ、一時的かつ適切な範囲に限定したusb-storageのquirkを使うか、バルクオンリー方式を使用することが分かっているホストで同じデバイスをテストします。この切り分けでは、キュー深度や性能が低下することを想定してください。
Linux Mintのトラブルシューティングスレッドでは、デバイスの接続中にカーネルログでUASエラーを監視することで、UAS関連のエラーを明らかにする方法が推奨されています。同じ負荷でリセットが消えるかどうかを比較します。ログにuasという単語が表示されただけでは、因果関係の証明にはなりません。
バルクオンリー転送が2回とも安定し、UASだけが繰り返し失敗する場合は、そのベンダーIDと製品IDに限って回避策を維持し、エンクロージャのファームウェアや交換の選択肢を確認します。両方の転送方式で失敗する場合は、quirkを削除し、電源、ブリッジ、熱、またはドライブの切り分けを続けます。
エラーがドライブに付いてくるのか、エンクロージャに残るのかを確認する
疑わしいドライブを正常なエンクロージャまたは直接接続したSATA経路に取り付け、正常な予備ドライブを疑わしいDASに取り付けます。書き込み負荷をかける前に、同じ非破壊読み取りテストを実行します。エラーがドライブに付いてくる場合は、そのメディアまたはコントローラーが原因です。エラーがDAS側に残る場合は、ブリッジ、バックプレーン、冷却、ケーブル、または電源が原因です。
関連するZimaSpaceのドライブとエンクロージャの切り分けガイドでは、ペア交換による判断方法を詳しく説明しています。ブリッジの故障をメディア不良と取り違えたり、故障しかけたドライブをエンクロージャのリセットの繰り返しで見逃したりしないよう、転送テストの後に使用してください。
再接続、再起動、継続的なI/Oを行っても元のワークロードが安定し、新たなカーネルリセットやデバイスエラーが発生しなければ、復旧は成功です。障害が一貫して特定のコンポーネントに付いてくる場合は、そのコンポーネントをエスカレーションまたは交換します。結果が混在する場合は、書き込みを停止し、最も安定した経路を通じて重要なデータのイメージを作成し、ハードウェアサポート用にログを保管します。
サポートとヒント
もっと読む

新しいストレージへリポジトリを移行するためのBorg Backup移行ガイド
Borgリポジトリを一貫性のある1つのオブジェクトとして移行します。書き込みを停止し、鍵とIDを保持し、リストアを検証してから、移行元を維持したままクライアントを更新します。

Resticリポジトリのメンテナンスワークフロー:チェック、プルーニング、コンパクト化、復元テスト
Resticには個別のcompactコマンドはありません。pruneが再パッキングを実行します。ロックと空き容量を確保し、完了後に再確認して、最後に分離環境で復元テストを行ってください。

壊れた、または放置されたバックアップ履歴からのTime Machine NAS復元ガイド
古いバンドルはそのままにしてください。修復するか新しいチェーンを作るかを決める前に、NASアクセス、宛先ID、イメージの損傷、放棄された履歴を切り分けてください。

