维护 Filestore 实例

本页面简要介绍了 Filestore 实例的维护。本文档涵盖了维护类别、层级影响、网络持久性和最佳实践。

概览

Filestore 会定期更新实例,以确保文件共享服务可靠、安全且最新。维护更新通常每 1 到 2 周进行一次。

Filestore 维护完全由 Google 管理。 您无法配置自定义维护期,也无法手动延迟或重新安排维护。

维护更新分为以下几类:

  • Filestore 软件更新:系统优化、性能改进和新功能。
  • 操作系统补丁:持续监控和修补底层虚拟机 (VM) 操作系统,以防范安全漏洞。
  • 基础架构升级:底层虚拟机迁移、硬件维护和网络更新。

维护影响(按服务层级)

维护更新的影响取决于实例的服务层级。

由于基本层级实例在维护期间会短暂停机,因此我们建议主要将基本层级用于开发、测试和非关键型工作负载。对于需要高可用性和不间断文件访问的生产工作负载,请使用区域、Enterprise 或可用区级层。

可用区、区域和 Enterprise 层级

Zonal、区域和 Enterprise 服务层级使用不中断升级 (NDU)。

在维护期间,这些层级中的实例会保持完全可用状态,并继续处理文件请求,停机时间接近于零。维护更新在后台应用,使升级过程对已连接的网络文件系统 (NFS) 客户端透明。

基本层级

基本层级实例由单节点存储提供支持,不支持自动故障切换。当发生底层主机迁移、系统补丁或软件更新时,文件操作会暂时暂停,直到更新完成。

在维护事件期间,基本 HDD 和基本 SSD 层级实例会短暂无法使用,通常持续 2 到 5 分钟。

在此维护窗口期间:

  • 文件操作(例如读取、写入和目录列表)暂时暂停或冻结。
  • 使用默认重试机制的已连接客户端会等待实例恢复响应。

网络和实例持久性

分配给 Filestore 实例的内部 IP 地址在整个维护过程中保持不变。连接的 NFS 客户端在更新后无需更新装载配置或重新装载文件共享。

服务等级协议 (SLA)

根据 Filestore 服务等级协议 (SLA),因计划内维护而导致的服务中断时间不计入服务中断时间。

维护处理方面的最佳实践

由于您无法安排或延迟 Filestore 维护,因此请配置 NFS 客户端和基础架构,以便妥善处理暂时性不可用情况:

  • 使用硬装载:在客户端上装载 Filestore 文件共享时,请指定 hard 装载选项,而不是 soft。如果使用硬挂载,当文件服务器暂时不可用时,NFS 客户端会无限期地重试请求,直到服务器响应为止。这样可保持数据完整性并防止应用 I/O 错误。
  • 配置 NFS 客户端超时和重试:在 NFS 客户端上配置超时和重新传输装载选项,以便维护期间的暂时性延迟不会导致客户端超时。
  • 实现应用重试:在客户端应用中构建具有指数退避算法的重试逻辑,以顺利处理临时存储延迟。
  • 监控实例运行状况和维护情况:在 Google Cloud 控制台中或使用 Cloud Monitoring 监控实例性能和状态。在基本级实例上,您可能会在更新窗口期间发现短暂的延迟高峰或文件操作暂时暂停。

后续步骤