Eventos y políticas de mantenimiento

Para mantener actualizadas tus instancias de Google Cloud Managed Lustre, Google Cloud se realiza un mantenimiento periódico en ellas. Los eventos de mantenimiento pueden incluir actualizaciones del software o la infraestructura subyacentes. Estos eventos pueden causar un tiempo de inactividad temporal, durante el cual las operaciones de E/S en la instancia pueden dejar de responder. Las operaciones de E/S afectadas se reanudan una vez que se completa el mantenimiento. Por lo general, el tiempo de inactividad es de 2 a 25 minutos.

Mientras se realiza el mantenimiento, el estado de una instancia es UPGRADING. Una vez que se completa el mantenimiento, la instancia vuelve al estado ACTIVE.

Las políticas de mantenimiento te permiten controlar cuándo ocurren estos eventos de mantenimiento. Puedes configurar una política de mantenimiento para cada instancia para especificar períodos de mantenimiento y períodos en los que se debe excluir el mantenimiento. Si no se configura una política de mantenimiento en una instancia, el mantenimiento puede ocurrir en cualquier momento.

También puedes reprogramar un evento de mantenimiento para que comience de inmediato, durante el siguiente período disponible o en un momento específico hasta 28 días después.

Instancias de escala extrema

Es posible que ciertas configuraciones de Managed Lustre que proporcionan un rendimiento y una escala extremos requieran un tiempo de inactividad planificado de hasta 4 horas para el mantenimiento periódico del host. Google coordina estos eventos de mantenimiento contigo con anticipación.

Acerca de las políticas de mantenimiento

Puedes configurar una política de mantenimiento en cada instancia de Managed Lustre. Una política de mantenimiento incluye lo siguiente:

  • Período de mantenimiento semanal: Es un período recurrente de una hora durante la semana en el que es aceptable que Managed Lustre inicie un evento de mantenimiento.
  • Período de exclusión de mantenimiento: Es un período durante el cual Managed Lustre no puede iniciar un evento de mantenimiento. Puedes definir un período de exclusión por instancia, con una duración máxima de dos semanas. Si no se especifica ningún año en las fechas de inicio y finalización, el período de exclusión se repite anualmente.

Un período de exclusión tiene prioridad sobre un período de mantenimiento normal. Si un evento programado se encuentra dentro de este período, Managed Lustre lo difiere al siguiente período disponible o lo omite por completo. La actualización se aplica durante el siguiente ciclo de mantenimiento.

Notificaciones de mantenimiento

Puedes suscribirte a las notificaciones por correo electrónico para los próximos eventos de mantenimiento y planificar cualquier posible interrupción. Las suscripciones a las notificaciones de mantenimiento se administran a través de la página Comunicación de la consola de Google Cloud Google Cloud :

Ir a la página Comunicación

Una vez que te suscribas, se enviarán las siguientes notificaciones:

  • Notificación anticipada: Se envía entre 7 y 14 días antes de un evento de mantenimiento programado o después de que el cliente reprograma un evento de mantenimiento.
  • Cancelado: Se envía si Google cancela un evento de mantenimiento programado o si el cliente lo reprograma.
  • En curso: Se envía cuando comienza un evento de mantenimiento.
  • Completado: Se envía cuando se completa un evento de mantenimiento.

También puedes ver los próximos programas de mantenimiento en la página de detalles de la instancia en la Google Cloud consola de Google Cloud o puedes usar Cloud Logging para ver los registros de mantenimiento.

Configura un período de mantenimiento

Un período de mantenimiento requiere un día de la semana y una hora de inicio UTC para el período de una hora.

Google Cloud Consola de Google Cloud

Para configurar un período de mantenimiento cuando creas una instancia, consulta Crea una instancia.

gcloud

Para crear una instancia con un período de mantenimiento, especifica la marca --maintenance-policy-weekly-windows:

gcloud lustre instances create INSTANCE_ID \
  --per-unit-storage-throughput=PER_UNIT_STORAGE_THROUGHPUT \
  --capacity-gib=CAPACITY_GIB \
  --filesystem=FS_NAME \
  --location=LOCATION \
  --network=NETWORK_PATH \
  --maintenance-policy-weekly-windows='dayOfWeek=DAY,startTime={START_TIME}'

Reemplaza lo siguiente:

  • INSTANCE_ID: Es el ID de tu instancia de Managed Lustre.
  • PER_UNIT_STORAGE_THROUGHPUT es el nivel de rendimiento en MBps por TiB. Los valores válidos son 0, 125, 250, 500 y 1000. Para especificar el [nivel dinámico][dynamic-tier], configúralo en 0 y agrega la marca --dynamic-tier-options-mode=DEFAULT_CACHE.
  • CAPACITY: Es la capacidad de tu instancia en GiB.
  • FS_NAME: Es el nombre de tu sistema de archivos.
  • LOCATION: Es la ubicación de tu instancia de Managed Lustre.
  • NETWORK_PATH: Es la ruta de acceso completa de la red de VPC a la que pertenece la instancia, en el formato projects/PROJECT_ID/global/networks/NETWORK. Consulta Configura una red de VPC.
  • DAY: Es el día de la semana para el período de mantenimiento (p.ej., TUESDAY).
  • START_TIME: Es la hora de inicio UTC del período de mantenimiento en formato de diccionario (p.ej., {hours=1,minutes=0}).

Para obtener más información sobre cómo crear una instancia, consulta Crea una instancia de Managed Lustre.

API de REST

Para especificar un período de mantenimiento para una instancia, incluye el objeto maintenancePolicy cuando crees una instancia.

A continuación, se muestra un ejemplo de un objeto maintenancePolicy:

"maintenancePolicy": {
  "weeklyMaintenanceWindows": [
    {
      "dayOfWeek": "DAY",
      "startTime": {
        "hours": HOURS,
        "minutes": MINUTES
      }
    }
  ]
}

Reemplaza lo siguiente:

  • DAY: Es el día de la semana para el período de mantenimiento (p.ej., TUESDAY).
  • HOURS: Es la hora del día para la hora de inicio del período de mantenimiento (p.ej., 1).
  • MINUTES: Es el minuto de la hora para la hora de inicio del período de mantenimiento (p.ej., 0).

Configura un período de exclusión

Para evitar que se realice el mantenimiento durante ciertos períodos, como días festivos o eventos empresariales, puedes definir un período de exclusión de mantenimiento en tu política de mantenimiento. Los períodos de exclusión pueden durar hasta dos semanas. Para crear un período de exclusión recurrente anual, no especifiques un año en las fechas de inicio y finalización.

Puedes combinar un período de mantenimiento semanal y un período de exclusión en la misma política.

Google Cloud Consola de Google Cloud

Para configurar un período de exclusión cuando creas una instancia, consulta Crea una instancia.

gcloud

Para crear una instancia con un período de exclusión, especifica la marca --maintenance-policy-exclusion-window:

gcloud lustre instances create INSTANCE_ID \
  --per-unit-storage-throughput=PER_UNIT_STORAGE_THROUGHPUT \
  --capacity-gib=CAPACITY_GIB \
  --filesystem=FILESYSTEM \
  --location=LOCATION \
  --network=NETWORK_PATH \
  --maintenance-policy-exclusion-window='startDate={START_DATE},endDate={END_DATE},time={TIME}'

Reemplaza lo siguiente:

  • INSTANCE_ID: Es el ID de tu instancia de Managed Lustre.
  • PER_UNIT_STORAGE_THROUGHPUT es el nivel de rendimiento en MBps por TiB. Los valores válidos son 0, 125, 250, 500 y 1000. Para especificar el [nivel dinámico][dynamic-tier], configúralo en 0 y agrega la marca --dynamic-tier-options-mode=DEFAULT_CACHE.
  • CAPACITY: Es la capacidad de tu instancia en GiB.
  • FS_NAME: Es el nombre de tu sistema de archivos.
  • LOCATION: Es la ubicación de tu instancia de Managed Lustre.
  • NETWORK_PATH: Es la ruta de acceso completa de la red de VPC a la que pertenece la instancia, en el formato projects/PROJECT_ID/global/networks/NETWORK. Consulta Configura una red de VPC.
  • START_DATE: Es la fecha de inicio del período de exclusión de mantenimiento en formato de diccionario (p.ej., {day=08,month=06,year=2026}). Para que se repita anualmente, omite la clave year.
  • END_DATE: Es la fecha de finalización del período de exclusión de mantenimiento en formato de diccionario (p.ej., {day=08,month=06,year=2026}). Para que se repita anualmente, omite la clave year.
  • TIME: Es la hora de inicio y finalización UTC del período de exclusión en formato de diccionario (p.ej., {hours=1,minutes=0}).

API de REST

A continuación, se muestra un ejemplo de un objeto maintenancePolicy con un período de exclusión:

"maintenancePolicy": {
  "maintenanceExclusionWindow": [
    {
      "startDate": {
        "day": START_DAY,
        "month": START_MONTH,
        "year": START_YEAR
      },
      "endDate": {
        "day": END_DAY,
        "month": END_MONTH,
        "year": END_YEAR
      },
      "time": {
        "hours": HOURS,
        "minutes": MINUTES
      }
    }
  ]
}

Reemplaza lo siguiente:

  • START_YEAR: Es el año de la fecha de inicio del período de exclusión (p.ej., 2026). Omite este campo y END_YEAR para crear un período recurrente anual.
  • START_MONTH: Es el mes de la fecha de inicio del período de exclusión (p.ej., 12).
  • START_DAY: Es el día de la fecha de inicio del período de exclusión (p.ej., 24).
  • END_YEAR: Es el año de la fecha de finalización del período de exclusión (p.ej., 2027). Omite este campo y START_YEAR para crear un período recurrente anual.
  • END_MONTH: Es el mes de la fecha de finalización del período de exclusión (p.ej., 1).
  • END_DAY: Es el día de la fecha de finalización del período de exclusión (p.ej., 7).
  • HOURS: Es la hora del día para el período de exclusión (p.ej., 0).
  • MINUTES: Es el minuto de la hora para el período de exclusión (p.ej., 0).

Actualiza una política de mantenimiento

Para agregar o modificar la política de mantenimiento de una instancia existente, haz lo siguiente:

Google Cloud Consola de Google Cloud

Para actualizar la política de mantenimiento de una instancia, consulta Administra instancias.

gcloud

En el siguiente ejemplo de gcloud, se actualiza la política de mantenimiento de una instancia:

gcloud lustre instances update INSTANCE_ID \
--location=LOCATION \
--maintenance-policy-weekly-windows='dayOfWeek=DAY,startTime={START_TIME}'

Reemplaza lo siguiente:

  • INSTANCE_ID: Es el ID de tu instancia de Managed Lustre.
  • LOCATION: Es la ubicación de tu instancia de Managed Lustre.
  • DAY: Es el día de la semana para el período de mantenimiento (p.ej., TUESDAY).
  • START_TIME: Es la hora de inicio UTC del período de mantenimiento en formato de diccionario (p.ej., {hours=1,minutes=0}).

API de REST

Para especificar un período de mantenimiento para una instancia, incluye el objeto maintenancePolicy cuando actualices una instancia. También debes especificar maintenancePolicy en el parámetro de consulta updateMask.

En el siguiente ejemplo de curl, se actualiza la política de mantenimiento de una instancia:

curl -X PATCH -H "Authorization: Bearer $(gcloud auth print-access-token)" -H "Content-Type: application/json" -d '{
  "maintenancePolicy": {
    "weeklyMaintenanceWindows": [
      {
        "dayOfWeek": "DAY",
        "startTime": {
          "hours": HOURS,
          "minutes": MINUTES
        }
      }
    ]
  }
}' "https://lustre.googleapis.com/v1/projects/PROJECT_ID/locations/LOCATION/instances/INSTANCE_ID?updateMask=maintenancePolicy"

Reemplaza lo siguiente:

  • PROJECT_ID: Es el ID de tu Google Cloud proyecto.
  • LOCATION Es la ubicación de la instancia de Managed Lustre.
  • INSTANCE_ID Es el ID de la instancia de Managed Lustre.
  • DAY: Es el día de la semana para el período de mantenimiento (p.ej., TUESDAY).
  • HOURS Es la hora del día para la hora de inicio del período de mantenimiento (p.ej., 3).
  • MINUTES MINUTOS: Es el minuto de la hora para la hora de inicio del período de mantenimiento (p.ej., 45).

Quita una política de mantenimiento

Para quitar una política de mantenimiento de una instancia, borra todos los períodos de mantenimiento semanales y los períodos de exclusión de la política.

Google Cloud Consola de Google Cloud

Para quitar una política de mantenimiento de una instancia, edita la instancia y borra los campos de la política de mantenimiento. Consulta Administra instancias.

gcloud

Usa el comando gcloud lustre instances update con las marcas --clear-maintenance-policy-weekly-windows y --clear-maintenance-policy-exclusion-window:

gcloud lustre instances update INSTANCE_ID \
--location=LOCATION \
--clear-maintenance-policy-weekly-windows \
--clear-maintenance-policy-exclusion-window

Reemplaza lo siguiente:

  • INSTANCE_ID: Es el ID de tu instancia de Managed Lustre.
  • LOCATION: Es la ubicación de tu instancia de Managed Lustre.

API de REST

Para quitar una política de mantenimiento con la API de REST, usa el instances.patch método con un objeto maintenancePolicy vacío y el parámetro de consulta updateMask configurado como maintenancePolicy:

curl -X PATCH -H "Authorization: Bearer $(gcloud auth print-access-token)" -H "Content-Type: application/json" -d '{
  "maintenancePolicy": {}
}' "https://lustre.googleapis.com/v1/projects/PROJECT_ID/locations/LOCATION/instances/INSTANCE_ID?updateMask=maintenancePolicy"

Reemplaza lo siguiente:

  • PROJECT_ID: Es el ID de tu Google Cloud proyecto.
  • LOCATION: Es la ubicación de la instancia de Managed Lustre.
  • INSTANCE_ID: Es el ID de la instancia de Managed Lustre.

Consulta los registros de mantenimiento

Managed Lustre usa Cloud Logging para registrar eventos de mantenimiento, incluidos los siguientes tipos de actividad:

  • LustreAdvancedNotification: Se programó el mantenimiento de la instancia.
  • LustreOngoingNotification: Se inició el mantenimiento en la instancia. Una vez que se completa, se registra otro evento LustreOngoingNotification, esta vez con is_completed=true.
  • LustreCancelledNotification: Se canceló el mantenimiento.

Puedes ver los registros de mantenimiento con el Explorador de registros o con Google Cloud CLI.

Explorador de registros

Para ver los registros de mantenimiento de Managed Lustre con el Explorador de registros, haz lo siguiente:

  1. En la Google Cloud consola de Google Cloud, ve a la página Cloud Logging > Explorador de registros:

    Ir al Explorador de registros

  2. Ingresa el siguiente filtro en el editor de consultas y haz clic en Ejecutar consulta:

    resource.type="lustre.googleapis.com/Instance"
    resource.labels.instance_id="INSTANCE_ID"
    resource.labels.location="LOCATION"
    logName="projects/PROJECT_ID/logs/lustre.googleapis.com%2Fmaintenance"
    

    Reemplaza lo siguiente:

    • INSTANCE_ID: Es el ID de tu instancia de Managed Lustre.
    • LOCATION: Es la ubicación de la instancia de Managed Lustre.
    • PROJECT_ID: Es el ID de tu Google Cloud proyecto.

Gcloud CLI

Para ver los registros de mantenimiento con Google Cloud CLI, ejecuta el gcloud logging read comando:

gcloud logging read 'resource.type="lustre.googleapis.com/Instance" resource.labels.instance_id="INSTANCE_ID" resource.labels.location="LOCATION" logName="projects/PROJECT_ID/logs/lustre.googleapis.com%2Fmaintenance"' --project=PROJECT_ID

Reemplaza lo siguiente:

  • INSTANCE_ID: Es el ID de la instancia de Managed Lustre.
  • LOCATION: Es la zona en la que se encuentra la instancia.
  • PROJECT_ID: Es el ID del proyecto en el que se encuentra la instancia.

Reprogramar mantenimiento

Si un evento de mantenimiento programado entra en conflicto con tus necesidades, puedes reprogramarlo. Cuando reprogramas, tienes las siguientes opciones:

  • De inmediato: Reprograma el evento de mantenimiento para que comience lo antes posible. Esta opción ignora los períodos de mantenimiento y los períodos de exclusión que están configurados en la instancia.
  • Próximo período disponible: Reprograma el evento de mantenimiento al siguiente período de mantenimiento disponible. Por lo general, esto desplaza la actualización una semana.
  • Por fecha: Reprograma el evento de mantenimiento para una fecha y hora específicas. Puedes retrasar el mantenimiento un máximo de 28 días a partir de la hora programada originalmente. Esta opción ignora los períodos de mantenimiento y los períodos de exclusión que están configurados en la instancia.

Para reprogramar el mantenimiento, haz lo siguiente:

gcloud

Para iniciar el evento de mantenimiento lo antes posible, haz lo siguiente:

gcloud lustre instances reschedule-maintenance INSTANCE_ID \
--location=LOCATION \
--reschedule-type=immediately

Para reprogramar el mantenimiento al siguiente período disponible, haz lo siguiente:

gcloud lustre instances reschedule-maintenance INSTANCE_ID \
--location=LOCATION \
--reschedule-type=next-available-window

Para reprogramar el mantenimiento a un momento específico, haz lo siguiente:

gcloud lustre instances reschedule-maintenance INSTANCE_ID \
--location=LOCATION \
--reschedule-type=by-time \
--reschedule-schedule-time=TIMESTAMP

Reemplaza lo siguiente:

  • INSTANCE_ID: Es el ID de tu instancia de Managed Lustre.
  • LOCATION: Es la ubicación de tu instancia de Managed Lustre.
  • TIMESTAMP: Es la hora de inicio en formato RFC 3339 (por ejemplo, 2026-04-30T10:00:00Z). No debe ser posterior a 28 días a partir de la hora programada originalmente.

API de REST

Usa el instances.rescheduleMaintenance método.

En el siguiente ejemplo de curl, se inicia el evento de mantenimiento lo antes posible:

curl -X POST -H "Authorization: Bearer $(gcloud auth print-access-token)" -H "Content-Type: application/json" -d '{
  "reschedule": {
    "rescheduleType": "IMMEDIATELY"
  }
}' "https://lustre.googleapis.com/v1/projects/PROJECT_ID/locations/LOCATION/instances/INSTANCE_ID:rescheduleMaintenance"

En el siguiente ejemplo de curl, se reprograma el mantenimiento al siguiente período disponible:

curl -X POST -H "Authorization: Bearer $(gcloud auth print-access-token)" -H "Content-Type: application/json" -d '{
  "reschedule": {
    "rescheduleType": "NEXT_AVAILABLE_WINDOW"
  }
}' "https://lustre.googleapis.com/v1/projects/PROJECT_ID/locations/LOCATION/instances/INSTANCE_ID:rescheduleMaintenance"

En el siguiente ejemplo de curl, se reprograma el mantenimiento a un momento específico:

curl -X POST -H "Authorization: Bearer $(gcloud auth print-access-token)" -H "Content-Type: application/json" -d '{
  "reschedule": {
    "rescheduleType": "BY_TIME",
    "scheduleTime": "TIMESTAMP"
  }
}' "https://lustre.googleapis.com/v1/projects/PROJECT_ID/locations/LOCATION/instances/INSTANCE_ID:rescheduleMaintenance"

Reemplaza lo siguiente:

  • PROJECT_ID: Es el ID de tu Google Cloud proyecto.
  • INSTANCE_ID: Es el ID de tu instancia de Managed Lustre.
  • LOCATION: Es la ubicación de tu instancia de Managed Lustre.
  • TIMESTAMP: Es la hora de inicio en formato RFC 3339 (por ejemplo, 2026-04-30T10:00:00Z). No debe ser posterior a 28 días a partir de la hora programada originalmente.