バックアップ/リカバリ アプライアンスでの低スプラッシュ バックアップの原因

低スプラッシュ バックアップとは

通常、Backup and DR のバックアップ/リカバリ アプライアンスでは、Backup and DR はデータベースの初回完全取り込みバックアップに時間がかかりますが、それ以降のバックアップはすべて高速な増分バックアップになります。増分バックアップでは、現在のスナップショットと前のスナップショットのビットマップを比較し、増分変更のみを適用します。

低スプラッシュ バックアップは、前のバックアップ ジョブでシステムエラーが発生し、ビットマップ画像が信頼できないか、ビットマップを読み取ることができない場合に発生する特別なタイプのバックアップ ジョブです。ビットマップを読み取るサービスは、Linux 環境では cbt_server、Windows 環境では AAMService です。

低スプラッシュ バックアップは、信頼性の高いビットマップを再作成するために完全な取り込みを再度実行する必要があるため、通常の条件で作成されたバックアップよりも時間がかかります。これにより、完全バックアップを置き換えることなく、増分変更を適用できます。

低スプラッシュ バックアップの原因にならないもの

  • コネクタのアップグレード
  • グレースフル システム再起動
  • バックアップ時にサービスがまだ実行されていることを前提とした、cbt_server または AAMService の正常な再起動
  • 信頼性の低いビットマップの原因となるエラーが発生しなかったフェイルオーバー。

信頼できないビットマップの原因

信頼性の低いビットマップは、バックアップ ジョブが中断された場合に発生します。たとえば、次のような場合です。

  • ホストのクリーンでないシャットダウン:
    • 正常でないシャットダウンは、ビットマップの信頼性の低さにより、ロー スプラッシュを引き起こします。これには、物理マシンの電源を切る、正常なシャットダウンを行わずに Windows をオフにする、ブルースクリーン エラーが発生するなどの方法が含まれます。クラスタ内の 1 台のマシンでブルースクリーン エラーが発生してフェイルオーバーがトリガーされた場合でも、失敗したマシンのビットマップは信頼できないため、このことは当てはまります。
    • 前回のバックアップ以降にデータベースをホストしているクラスタ内のすべての Windows サーバーが使用できず、Backup and DR エージェントが実行されている場合。前回のバックアップ以降にデータベースをホストした各クラスタホストからビットマップを取得して変更を検出し、すべてのビットマップがない場合は、データの完全性を維持するために低スプラッシュを実行する必要があります。データベースをホストしていたクラスタホストで BSOD が発生した場合、ビットマップはバックアップで利用できる可能性がありますが、信頼性は低いため、低スプラッシュ復元が必要です。
  • カーネル モジュールの更新の失敗
  • ユーザーモード デーモンのクラッシュまたは再起動
  • バックアップの実行中に指紋認証エラーが発生する。(Backup and DR は、各バックアップ ジョブで「フィンガープリント チェック」を実行してエラーを確認します)。
  • OS のシャットダウン中にストレージ ディスクがいっぱいで、システムがすべてのデータを Vault に書き込むことができない場合、Vault 処理中にエラーが発生します。
  • SAP HANA ノードのフェイルオーバーにより、バックアップが別のノードにリダイレクトされる。
  • カーネル モジュールを読み込めないため、バックアップが劣化モードで実行されています。これは通常、OS がサポートされていないバージョンである場合に発生します。
  • バックアップ中に cbt_server または AAMService が停止すると、ビットマップを取得できず、バックアップ ジョブが低スプラッシュ モードで実行されます。AAMService のダウン時間が短い場合は、AAMService を起動すると、通常のバックアップでビットマップが利用可能になります。
    • cbt_server または AAMService が停止し、ドライバによって数ギガバイトのイベントがキューに登録されると、ビットマップを再作成できなくなり、バックアップは低スプラッシュ モードになります。これにかかる時間は、データベースで発生するディスク I/O の量によって異なります。通常、AAMService のダウンタイムが数日必要になります。
  • cbt_server または AAMService の正常でないシャットダウンにより、現在読み込まれているビットマップの信頼性が低下する可能性があります。ビットマップは、追跡対象のファイルが過去 15 分以内に書き込まれた場合に読み込まれるため、一般的に、ビジー状態のデータベースでは低スプラッシュが発生します。
  • 追跡対象のファイル(SQL Server の .mdf ファイルなど)を含むボリュームがホストでマウント解除されてから再マウントされると、マウント解除中にファイルに書き込まれた内容を把握できないため、ビットマップは信頼できなくなります。