在设备管理控制台中为 IBM Db2 HADR 配置 Pacemaker 感知型快照

Backup and DR Service 为 IBM Db2 高可用性灾难恢复 (HADR) 数据库提供了一个可识别 Pacemaker 的快照功能。 您可以使用此功能安全地获取由 Pacemaker 集群管理的备用数据库的 Persistent Disk 快照。

此过程可防止 Pacemaker 在快照期间将临时数据库停用误解为失败。避免误解可防止不必要的数据库重启。

准备工作

向 Db2 实例操作系统用户授予必要的权限,以便在所有 Db2 HADR 备用节点上使用 sudo 权限运行 Pacemaker 命令。

  1. root 用户身份打开 /etc/sudoers.d/db2_pacemaker_access 文件进行修改:

    visudo -f /etc/sudoers.d/db2_pacemaker_access
    
  2. 将以下代码行添加到文件中:

    DB2_INSTANCE_OS_USER  ALL=(root)    NOPASSWD: /usr/sbin/pcs status, /usr/sbin/pcs resource * DB2_HADR_PACEMAKER_RESOURCE_REGEX
    
  3. 替换以下占位符:

    • DB2_INSTANCE_OS_USER:您的 Db2 实例操作系统用户名。
    • DB2_HADR_PACEMAKER_RESOURCE_REGEX:与您的 Db2 HADR Pacemaker 资源名称匹配的正则表达式。 例如,*_db2

启用可识别 Pacemaker 的备份

如需启用此功能,请在 Db2 应用的备份设置中指定 Pacemaker 资源名称。

  1. 在 Backup and DR 设备管理控制台中,前往 Db2 应用备份设置。
  2. 找到 Db2 HADR CLUSTER PACEMAKER RESOURCE 选项。
  3. 输入管理 HADR 集群的 Db2 实例的 Pacemaker 资源名称。

可识别 Pacemaker 的快照的工作原理

可识别 Pacemaker 的备份过程通过一系列特定操作协调 Pacemaker 和 Db2。

  1. 脚本运行预检,以验证脚本是否位于备用节点上,以及 HADR 对是否处于健康状态。
  2. 脚本将 Db2 实例资源置于 Pacemaker 的维护模式。此操作会指示 Pacemaker 停止监控资源。
  3. 脚本使用 db2 deactivate 命令停用数据库,以冻结数据库 I/O。
  4. 脚本获取 Persistent Disk 存储空间的快照。
  5. 脚本使用 db2 activate 命令激活数据库,以解冻 I/O。
  6. 脚本将 Db2 实例资源从维护模式中移除,以便 Pacemaker 恢复监控。
  7. 脚本记录所有操作并运行清理例程。

问题排查

如果备份作业失败,请检查数据库备用节点上的以下日志以了解更多详细信息:

  • /var/act/log/customapp-db2instance.log:包含有关备用数据库停用和激活的信息,以及 Pacemaker 资源维护模式的进入和退出信息。
  • /act/tmpdata/BACKUP_JOB_NAME/pcs_background_cleanup.log:指示 Pacemaker 资源是否因快照超出两分钟的超时时间而 自动退出维护模式。
  • /var/log/pacemaker/pacemaker.log:提供来自 Pacemaker 的其他上下文。

快照超时

如果 Persistent Disk 快照作业超过两分钟,Backup and DR 会自动退出 Pacemaker 资源维护模式。备份作业状态会更改为 Retrying,并且调度器会在十分钟后启动新的备份。

中止或阻止的备份作业

如果备份作业中止或被阻止,系统会在两分钟后退出 Pacemaker 资源维护模式,并且备份作业会失败。

配置提醒

您可以从 Backup and DR 设备管理控制台配置提醒,以便在备份作业失败时发送电子邮件。此外,建议您根据 pcs status 配置 Pacemaker 提醒。

后续步骤