ホストストレージのメンテナンス中に仮想マシンのバックアップを保護するには、まず新しい書き込みを停止し、既存の復元ポイントを検証してから、メンテナンス対象のストレージ外に少なくとも1つの使用可能なコピーを保管します。
ホームサーバーや小規模NASでは、メンテナンス対象のディスク、プール、HBA、エンクロージャ、データストアに、VMバックアップも保存されていることがよくあります。そのため重要なのはツールの名前ではなく、安全な手順です。バックアップ処理を停止し、復元ポイントが読み取れることを確認し、メンテナンスを元に戻せる状態にしてから、ホストのストレージ層に触れます。
メンテナンス対象のストレージに依存するバックアップを把握する
まず、メンテナンス対象のストレージから読み書きするすべてのVM、コンテナ、バックアップジョブ、リポジトリ、スナップショットの保存場所、レプリケーション先を一覧にします。重要なのはVMがどこで稼働しているかではなく、これからオフラインにするコンポーネントにバックアップチェーンや復元カタログが依存しているかどうかです。
ホームラボでよくある落とし穴は、VMディスクとバックアップリポジトリを別々のデータセットに保存していても、同じプール、USBエンクロージャ、コントローラー、または1台のマシンを共有していることです。整理性は向上しますが、リスクがプール全体、コントローラー全体、またはホスト全体に及ぶ場合、バックアップは保護されません。
復元経路が同じストレージに依存している場合、そのバックアップはメンテナンス期間中は利用できないものとして扱います。メンテナンス対象のデバイスを必要としない2つ目のコピー、リモートコピー、または検証済みのエクスポートを用意してから次に進みます。
バックアップ先を新規書き込みなしの状態にする
最も安全なメンテナンス期間は、ストレージ層の変更中に新しいバックアップの書き込み、プルーニング、コンパクション、レプリケーション、ガベージコレクションが開始されないようにすることから始まります。バックグラウンドでインデックスやチャンクを書き換えているリポジトリより、停止しているリポジトリの方が状況を把握しやすくなります。
Proxmox Backup Serverは、データストアの読み取り専用およびオフラインのメンテナンスモードに対応しており、競合する処理はモードが有効になる前に完了できます。この違いは重要です。読み取り専用では復元が許可される場合がありますが、オフラインでは読み取りと書き込みの両方がブロックされます。
作業を保護できる範囲で、影響の最も少ないモードを使用します。ファームウェア、ケーブル接続、プールのインポート、ディスク交換、ファイルシステム修復では、通常オフラインの方が安全です。新規書き込みを停止するだけでよいリポジトリ側のチェックでは、読み取り専用で十分な場合があります。記憶に頼らず、使用したモードと無効にしたジョブを記録してください。
ストレージを移動または修復する前に復元ポイントを検証する
検証されていないバックアップは、復元候補にすぎません。メンテナンス前に、使用しているツールの検証機能を実行するか、少なくとも保持する予定の復元ポイントのうち、最新と最古のものから小規模な隔離復元を実行します。
Proxmox Backup Serverには、バックアップデータを復元時だけ信頼するのではなく、定期的にチェックできる検証ジョブが用意されています。メンテナンスでは、数週間前のバックアップ成功通知よりも、最近の検証結果の方が有用です。
検証に失敗した場合は、メンテナンス計画を中止し、まずバックアップセットを修復します。検証できる復元ポイントが1つだけの場合は、それを隔離して保持し、2つ目の正常な復元経路が確保されるまでプルーニングやコンパクションを行わないでください。
メンテナンスの影響範囲外に復元用コピーを1つ保管する
ディスク、プール、コントローラー、マウントオプション、リポジトリ構成を変更する前に、少なくとも1つの復元用コピーを影響範囲の外へ移します。リムーバブルディスク、別のNAS、リモートのProxmox Backup Server、クラウドオブジェクトストレージ、または重要なVMの一時エクスポートなどが考えられます。
Veeamのスケールアウトリポジトリに関するドキュメントでは、リポジトリのメンテナンスを状態を伴う操作として扱い、エクステントをメンテナンスモードに切り替えて、エクステントのパッチ適用やアップグレードなどの作業を行う方法を説明しています。ここから得られる一般的な教訓は、メンテナンスを無計画なストレージイベントとして実行するのではなく、リポジトリの状態と連携して行うべきだということです。
ホームサーバーでは、実際に必要な復旧方法に合ったコピーを選びます。重要なVMが1台だけなら起動可能なエクスポートが適している場合があります。一方、多数のVMでは重複排除されたバックアップのレプリケーションが適していることがあります。コピーが有効なのは、その保存場所、ロック解除方法、そしてメンテナンス対象のホストストレージを使わずに復元する方法が分かっている場合だけです。
復元経路を確認してからジョブを再開する
メンテナンス後、すべてのスケジュール済みジョブをすぐに再有効化しないでください。まずストレージを正常に再マウントまたはインポートし、リポジトリの所有権と空き容量を確認してから、既存のバックアップに対する読み取りテストを実行します。その後で新しい書き込みを許可します。
バックアップのメンテナンスタスクはI/O負荷が高くなることがあります。Veeamのベストプラクティスでは、完全バックアップファイルのメンテナンスについて、新しい完全バックアップファイルを合成し、その後で元のファイルを削除する処理として説明しています。このような処理は、ストレージ修復や不安定なディスクとの同時実行を避けるべきです。
サービスは、ストレージの健全性、リポジトリへの読み取りアクセス、復元ポイントの一覧表示、小規模な復元テスト、スケジュール済みの書き込みの順に復旧します。いずれかの段階で処理が遅い、項目が見つからない、または結果に一貫性がない場合は、ジョブを無効にしたまま調査してください。新しいバックアップチェーンによって問題が隠れてしまう前に対処する必要があります。
よくある質問
ホストのディスクを交換している間もVMバックアップを実行できますか?
バックアップリポジトリと復元経路が、メンテナンス対象のストレージから明確に分離されている場合に限ります。バックアップ先がプール、コントローラー、エンクロージャ、またはホストの依存関係を共有している場合は、まず新しい書き込みを停止してください。
ストレージメンテナンス前の保護として、VMスナップショットだけで十分ですか?
いいえ。同じストレージ上のスナップショットは短期間のロールバックには役立ちますが、プール、コントローラー、エンクロージャ、またはホストの障害からは保護できません。独立したバックアップコピーを保持してください。
メンテナンスにZFSレプリケーションも含まれる場合は、メンテナンス期間の前に保持期間と空き容量の動作を確認してください。宛先プールが満杯になると、単純なメンテナンス作業が、ZimaSpaceの宛先プールがスナップショットレプリケーションで満杯になるのを防ぐガイドで扱われているのと同じ障害パターンにつながる可能性があります。
サポートとヒント
もっと読む

ライブTV録画の容量・保存期間・クリーンアップガイド
実際の録音を測定し、ヘッドルームを確保し、経過時間と容量の制限を組み合わせ、ストレージが満杯になる前に最も古い対象プログラムが削除されることを確認する。

データベース復元後のホームメディアメタデータ復旧ワークフロー
復元した状態を保護し、メディアの識別情報とパスを確認してから、メタデータを広範囲に変更する前に、パイロットライブラリで不足しているアートワークや一致項目を修復します。

オーディオ、ビデオ、字幕のJellyfinクライアント互換性チェックリスト
代表的なファイルを一度に1つの変数だけテストし、すべてのクライアントについて、ダイレクトプレイ、リマックス、音声変換、動画トランスコード、または失敗を記録します。

