アプライアンス管理コンソールでバックアップ プランの違反を特定する

ポリシー テンプレートとリソース プロファイルは、アプライアンス管理コンソールのバックアップ プラン セクションで定義されます。これらは、App Manager のアプリケーションと VM に適用されます。バックアップ プランの違反は、ジョブ(またはアクション)がポリシー テンプレートのポリシーで定義された要件を満たしていない場合に発生します。

このセクションでは、バックアップ プラン違反の潜在的な原因、アプライアンス管理コンソールがバックアップ プラン違反の発生を特定する方法、バックアップ プラン違反の発生をモニタリングするために使用できる方法について詳しく説明します。以下が含まれています。

バックアップ プランのポリシー違反の原因

アプライアンス管理コンソールは、バックアップ プランをアプリケーションとデータセットに適用します。ここで、App Manager サービスでのアプリケーション コピー データの管理は、バックアップ テンプレートとその関連ポリシーで定義したルールに基づいて行われます。バックアップ テンプレートには、各データソースのデータのソース(スナップショットまたはレプリケーション)とスケジュール(頻度、保持、開始時間、終了時間)を定義する 1 つ以上のポリシーが含まれています。バックアップ プラン ポリシーで定義されたジョブ(またはアクション)がポリシーのスケジュールに従って開始されない場合、バックアップ プラン違反が発生します。

各バックアップ/リカバリ アプライアンスは、バックアップ プランの分析を 1 時間ごとに自動的に実行し、スケジュールされたジョブで 1 日を通して発生するバックアップ プラン違反を特定します。このバックグラウンド オペレーションは、バックアップ プラン ポリシー ウィンドウの終了にできるだけ近いタイミングで、バックアップ プランの違反の可能性を警告します。バックアップ/リカバリ アプライアンスがバックアップ プランの違反をモニタリングする方法をご覧ください。

アプライアンス管理コンソールを使用すると、管理者はポリシー テンプレートのライブラリを作成できます。各バックアップ プラン ポリシーの主な特徴の 1 つは、このポリシーがいつ実行されるかを決定するスケジュールです。

バックアップ プランの違反は、ジョブスロット数の設定に関する問題が原因であることがよくあります。スロット数は、同時に実行できるジョブの数を決定します。ただし、ジョブスロット数を増やしても、バックアップ プランの違反が停止するとは限りません。実際には、バックアップ プランの違反は、次のセクションで説明する条件のいずれかに関連している可能性があります。

失敗したジョブ

ジョブの失敗は、バックアップ プランの違反の一般的な原因です。たとえば、Oracle ホストにアクセスできない場合、バックアップ/復元アプライアンスは Oracle RMAN からデータをキャプチャできないため、スナップショット ジョブが失敗します。ジョブが失敗した場合は、環境を確認して、すべてのアプリケーションとホストにアクセスできることを確認します。

ホストごとの複数のアプリケーション

ホストに複数のアプリケーションがあり、各アプリケーションが個別のポリシー テンプレートで管理されている場合(整合性グループとしてグループ化されていない場合)、空きスロットがあっても、一度にスナップショット ジョブを実行できるアプリケーションは 1 つだけです。

VM が VM として管理され、Backup and DR エージェントを介して管理されるアプリケーションもある場合、一度にデータ キャプチャ ジョブを実行できるのは、アプリケーションのいずれか 1 つだけです。

ホストに D:\、E:\、F:\ ドライブがあり、個々のドライブが別々のバックアップ テンプレートで管理されている場合、各ドライブは順番に管理されます。たとえば、ポリシーの実行可能時間帯が午前 1 時(UTC)から午前 3 時(UTC)で、最初のドライブのスナップショット ジョブの完了に 3 時間かかる場合、他の 2 つのドライブではその日のスナップショット ジョブが実行されません。

考えられる解決策の 1 つは、合計実行時間を延長する手段として、バックアップ プランのポリシー ウィンドウを延長することです。別の解決策は、複数のアプリケーションを整合性グループに含めることです。

バックアップ プランの違反が誤検出である可能性がある

バックアップ プランの違反が実際には誤検出(特定の条件が存在することを誤って示す結果)である場合があります。すべてのバックアップ プラン違反が実際に違反であるとは限りません。次の 2 つの例に示すように、誤検出が発生する可能性があります。

  • クラスタ化されたボリュームがある VM のコピーデータを管理しています。バックアップ プラン ポリシーが実行されているにもかかわらず、VM がボリュームを制御していない場合、この障害はバックアップ プランの違反と見なされます。
  • ジョブ(VM、アプリケーションなど)のバックアップ プラン駆動型スケジューラがオフになっている場合、バックアップ プラン ポリシーが適用されるたびにバックアップ プラン違反が発生する可能性があります。

バックアップ/リカバリ アプライアンスのリソースの制約

バックアップ/復元アプライアンスのリソースの制約は、ネットワーク ポートのスループット、iSCSI イニシエータの最大数、バックエンド ストレージまたはフロントエンド ストレージのスループット機能などの問題に関連している可能性があります。この場合、スロット数を増やしても効果はありません。

ポリシー ウィンドウのサイズまたはジョブの実行時間

長時間実行されるジョブは、他のアプリケーションで使用できるジョブスロットを保持します。各アプリケーションが平均 1 分でジョブを完了し、5 つのスロットがある場合、1 時間あたり 300 個のジョブが可能です。各アプリケーションが平均 1 時間かかり、5 つのスロットがある場合、1 時間あたり 5 個のジョブが可能です。ただし、ポリシーの合計ウィンドウが 3 時間の場合、このバックアップ プラン ポリシーを使用しようとするアプリケーションの数は、24 時間の期間で可能なアプリケーション コピー データ管理の合計に大きな影響を与えます。

たとえば、アプリケーションが 100 個ある場合、最初の例(1 時間あたり 300 個のジョブ)では、アプライアンスはすべてのアプリケーションを約 20 分で完了します。ただし、2 番目の例(1 時間あたり 5 つのジョブ)で 100 個のアプリケーションがある場合、アプライアンスは 1 日あたり 15 個のアプリケーションのみを管理します。これにより、バックアップ プランの違反が 85 件発生します。

ジョブの実行時間を制御することはできませんが、実行中のアプリケーションがスケジュールされている時間を確認できます。新しいアプリケーションの最初のスナップショット ジョブで、ジョブ時間が長くなることもあります。オンランプ設定を使用すると、取り込みジョブがスロットをロックして、すでに取り込まれたアプリケーションをロックアウトするのを防ぐことができます。

バックアップ/リカバリ アプライアンスがバックアップ プランの違反をモニタリングする方法

各バックアップ/リカバリ アプライアンスは、バックアップ プランの分析を 1 時間ごとに自動的に実行し、スケジュールされたジョブで 1 日を通して発生するバックアップ プラン違反を特定します。このバックグラウンド オペレーションは、バックアップ プラン ポリシー ウィンドウの終了にできるだけ近いタイミングで、バックアップ プランの違反の可能性を警告します。

分析中、アプライアンスは、過去 1 時間以内に業務時間外になったすべてのバックアップ プラン ポリシーを確認します。各ポリシーでバックアップ プランの違反が確認されます。バックアップ プラン ポリシーのポリシー ウィンドウの終了から 60 分以内にバックアップ プランの違反があった場合、これらの違反に関するエントリがイベント データベースに作成されます。ポリシーにバックアップ プラン違反がない場合、アラートやイベントは生成されません。

バックアップ プラン ポリシーの完了期間である 60 分以内にバックアップ プラン違反が発生すると、アラートが開始され、アクティビティ通知が生成されます。バックアップ プラン違反のアラートは、システム モニター イベント(モニターを参照)またはメール イベント通知の形式で受け取ることができます。各アラートには、特定アプリケーションの違反している各バックアップ プラン ポリシーに関する詳細情報が含まれます。たとえば、イベント メッセージ、ポリシー名とタイプ、違反時間とタイプ、ジョブ情報(想定されるジョブ、許容範囲、成功、失敗)などです。バックアップ プラン違反アラートには、レポート マネージャーのバックアップ プラン コンプライアンス レポートの一部として含まれるバックアップ プラン違反レポートに表示されるのと同じレベルの詳細が含まれています。

プラットフォーム サーバーログ(udppm ログファイル)も作成され、分析が実行された日時、分析されたポリシー、分析の結果が記録されます。

バックアップ プランの分析では、実行中のジョブの結果として生じる可能性のある不一致が考慮されます。特定の状況では、ジョブは割り当てられたポリシーの開始時間内に開始されますが、想定よりも長く実行され、指定されたポリシーの時間枠内に完了しないことがあります(たとえば、ジョブが午後 10 時に開始され、午後 11 時 30 分に終了するなど)。最初は、ジョブは成功と見なされ、バックアップ プラン違反アラートは生成されません。ただし、ジョブの完了時に、次のバックアップ プラン分析サイクルの一部として再評価され、バックアップ プラン違反としてフラグが設定される可能性があります。バックアップ プラン ポリシーの成否は、ジョブが実際に完了したタイミングによって異なります。

分析中に、アプライアンスがバックアップ プラン ポリシーで 1 つ以上のジョブが実行されなかったと判断した場合、バックアップ プラン違反が発生し、生成されたアラートまたはイベントには、失敗したジョブに関する次の追加情報が含まれます。

  • ジョブの予想実行時間
  • ジョブの実行が失敗した理由

アプライアンスは、タイムラインを調べて、そのサービスの種類で使用可能なスロットがないためにジョブが実行されなかったかどうかを判断します。この理由でアラートやイベントが発生した場合は、アラートやイベントにこの情報が含まれます。

アプリケーションに、ポリシー ウィンドウが重複する複数のバックアップ プラン ポリシーがあり、この重複期間中に両方のポリシーでジョブが失敗した場合、アプライアンスは 1 つのアラートのみを生成します。重複するポリシーに対して重複するアラートが開始されることはありません。ジョブ アラートの欠落は、アプリケーション、ポリシータイプ、時間枠ごとに集計されます。

バックアップ プランの違反をモニタリングする

バックアップ プランの違反は、[モニタリング] タブ、またはメール通知や レポート マネージャーを使用して、マネージド アプライアンスからモニタリングして表示できます。

モニタリング

バックアップ プランの違反の詳細は、[Monitor] タブ([Monitor] > [Events])のイベントとして表示できます。[モニタリング] タブの使用方法の詳細については、モニタリングをご覧ください。

レポート マネージャー

アプライアンス管理コンソールのレポート マネージャーには、バックアップ プラン違反レポートの完全なライブラリがあります。これらのレポートは、現在の成功率を確認する手順を簡素化し、同じ名前の複数のアプリケーションを簡単に区別するのに役立ちます。

次のステップ