Backup and DR Service 为 IBM Db2 高可用性灾难恢复 (HADR) 数据库提供了一个可识别 Pacemaker 的快照功能。 您可以使用此功能安全地获取由 Pacemaker 集群管理的备用数据库的 Persistent Disk 快照。
此过程可防止 Pacemaker 在快照期间将临时数据库停用误解为失败。避免误解可防止不必要的数据库重启。
准备工作
向 Db2 实例操作系统用户授予必要的权限,以便在所有 Db2 HADR 备用节点上使用 sudo 权限运行 Pacemaker 命令。
以
root用户身份打开/etc/sudoers.d/db2_pacemaker_access文件进行修改:visudo -f /etc/sudoers.d/db2_pacemaker_access将以下代码行添加到文件中:
DB2_INSTANCE_OS_USER ALL=(root) NOPASSWD: /usr/sbin/pcs status, /usr/sbin/pcs resource * DB2_HADR_PACEMAKER_RESOURCE_REGEX替换以下占位符:
DB2_INSTANCE_OS_USER:您的 Db2 实例操作系统用户名。DB2_HADR_PACEMAKER_RESOURCE_REGEX:与您的 Db2 HADR Pacemaker 资源名称匹配的正则表达式。 例如,*_db2。
启用可识别 Pacemaker 的备份
如需启用此功能,请在 Db2 应用的备份设置中指定 Pacemaker 资源名称。
- 在 Backup and DR 设备管理控制台中,前往 Db2 应用备份设置。
- 找到 Db2 HADR CLUSTER PACEMAKER RESOURCE 选项。
- 输入管理 HADR 集群的 Db2 实例的 Pacemaker 资源名称。
可识别 Pacemaker 的快照的工作原理
可识别 Pacemaker 的备份过程通过一系列特定操作协调 Pacemaker 和 Db2。
- 脚本运行预检,以验证脚本是否位于备用节点上,以及 HADR 对是否处于健康状态。
- 脚本将 Db2 实例资源置于 Pacemaker 的维护模式。此操作会指示 Pacemaker 停止监控资源。
- 脚本使用
db2 deactivate命令停用数据库,以冻结数据库 I/O。 - 脚本获取 Persistent Disk 存储空间的快照。
- 脚本使用
db2 activate命令激活数据库,以解冻 I/O。 - 脚本将 Db2 实例资源从维护模式中移除,以便 Pacemaker 恢复监控。
- 脚本记录所有操作并运行清理例程。
问题排查
如果备份作业失败,请检查数据库备用节点上的以下日志以了解更多详细信息:
/var/act/log/customapp-db2instance.log:包含有关备用数据库停用和激活的信息,以及 Pacemaker 资源维护模式的进入和退出信息。/act/tmpdata/BACKUP_JOB_NAME/pcs_background_cleanup.log:指示 Pacemaker 资源是否因快照超出两分钟的超时时间而 自动退出维护模式。/var/log/pacemaker/pacemaker.log:提供来自 Pacemaker 的其他上下文。
快照超时
如果 Persistent Disk 快照作业超过两分钟,Backup and DR 会自动退出 Pacemaker 资源维护模式。备份作业状态会更改为 Retrying,并且调度器会在十分钟后启动新的备份。
中止或阻止的备份作业
如果备份作业中止或被阻止,系统会在两分钟后退出 Pacemaker 资源维护模式,并且备份作业会失败。
配置提醒
您可以从 Backup and DR 设备管理控制台配置提醒,以便在备份作业失败时发送电子邮件。此外,建议您根据 pcs status 配置 Pacemaker 提醒。
后续步骤
- 详细了解 Backup and DR 概念。
- 详细了解适用于 IBM Db2 数据库的 Backup and DR。