Descripción general de la política de posición compacta y la política de cargas de trabajo

En este documento, se proporciona una descripción general y una comparación de las políticas de posición compacta y las políticas de cargas de trabajo. Ambas políticas te permiten configurar la posición de las instancias de Compute Engine para minimizar la latencia de red.

De forma predeterminada, administras la ubicación de tus instancias de procesamiento especificando solo sus zonas. Para crear instancias de procesamiento que estén más cerca unas de otras, puedes usar las siguientes opciones. Para obtener más información, consulta también la colocación de recursos de infraestructura de IA.

  • Los siguientes recursos ya están colocados de forma densa entre sí:

    • Recursos que consumen la misma reserva futura para bloques de capacidad
    • Recursos que consumen la misma reserva futura en modo calendario
    • Recursos que creas juntos a través de una solicitud de cambio de tamaño del grupo de instancias administrado (MIG)
  • Los recursos que creas juntos cuando especificas la opción de consumo de inicio flexible pueden colocarse de forma densa según la disponibilidad de mejor esfuerzo. Si, en cambio, necesitas recursos colocados de forma densa, aplica una política de posición compacta que especifique una distancia máxima o una política de cargas de trabajo que especifique una distancia máxima.

  • De lo contrario, para colocar los recursos cerca, aplica una política de posición compacta o una política de cargas de trabajo.

    • Cuando necesites recursos colocados de forma densa, especifica una distancia máxima en la política.
    • Cuando desees recursos colocados de forma densa según la disponibilidad de mejor esfuerzo, no especifiques una distancia máxima en la política.

Para obtener más información sobre cuándo usar una política de posición compacta en comparación con una política de cargas de trabajo, consulta la comparación de la política de posición compacta y la política de cargas de trabajo en este documento.

Comparación de la política de posición compacta y la política de cargas de trabajo

En la siguiente tabla, se resumen las diferencias entre las políticas de posición compacta y las políticas de cargas de trabajo:

Política de posición compacta Política de cargas de trabajo
Uso de la política
  • Instancias independientes
  • Instancias implementadas con la API masiva
  • MIG con GPU generales
MIG con GPU en clúster
Tipos de máquinas compatibles A4X Max, A4X, A4, A3 Ultra, A3 Mega, A3 High, A3 Edge, A2, G4 y G2
  • Para inicio flexible: A4 y A3 Ultra
  • Para instancias de VM interrumpibles o reservas: A4X, A4, A3 Ultra, A3 Mega y A3 High (8 GPU)
Semántica de agrupación

Compute Engine coloca las instancias que usan la misma política de posición compacta más cerca.

Te recomendamos que uses una política de posición diferente para cada carga de trabajo. Si vuelves a usar una política de posición en instancias que ejecutan diferentes cargas de trabajo, todas esas instancias se colocarán juntas. Esta colocación puede dificultar la creación de instancias que estén cerca juntas cuando escalas horizontalmente una carga de trabajo específica.

Compute Engine coloca las instancias en un MIG que usa una política de cargas de trabajo más cerca.

Si vuelves a usar una política de cargas de trabajo en varios MIG que ejecutan diferentes cargas de trabajo, las instancias se colocan juntas en MIG individuales. La reutilización es ideal para modelos de entrenamiento grandes en los que cada grupo de instancias debe estar aislado entre sí.

Configuración de colocación de instancias de procesamiento

Para la colocación de instancias de procesamiento de mejor esfuerzo, establece el groupPlacementPolicy.collocation campo en COLLOCATED.

Para la colocación de instancias de procesamiento de mejor esfuerzo, establece el workloadPolicy.type campo en HIGH_THROUGHPUT.

Configuraciones adicionales
  • Para la colocación estricta de instancias de procesamiento, especifica el maxDistance campo.
  • Para las series de máquinas que admiten la partición, como A4X Max y A4X, especifica el gpuTopology campo.
  • Para la colocación estricta de instancias de procesamiento, especifica el maxTopologyDistance campo.
  • Para las series de máquinas que admiten la partición, como A4X Max y A4X, especifica el campo acceleratorTopology.

Si deseas obtener más información, consulta las siguientes secciones:

Políticas de posición compacta

Cuando aplicas políticas de posición compacta a instancias de procesamiento independientes o a instancias de procesamiento creadas de forma masiva, Compute Engine hace todo lo posible para crear instancias de procesamiento lo más cerca posible unas de otras. Si tu aplicación requiere una latencia de red mínima, especifica el maxDistance campo (vista previa) cuando crees una política de posición compacta.

Para obtener más información, consulta Acerca de las políticas de posición compacta en la documentación de Compute Engine.

Comparación de los valores de distancia máxima para las políticas de posición compacta

Un valor de distancia máxima más bajo garantiza una colocación más cercana de la instancia de procesamiento, pero también aumenta la probabilidad de que no se creen algunas instancias de procesamiento.

En la siguiente tabla, se muestran las series de máquinas y la cantidad de instancias de procesamiento que admite cada valor de distancia máxima:

maxDistance en una política de posición compacta maxTopologyDistance en una política de cargas de trabajo Descripción Serie de máquinas compatible Cantidad máxima de instancias de procesamiento
Sin especificar (no recomendado) Sin especificar (no recomendado) Compute Engine hace todo lo posible para colocar las instancias de procesamiento lo más cerca posible unas de otras, pero sin una distancia máxima entre ellas. A4X Max, A4X, A4, A3 Ultra, A3 Mega1, A3 High1, A3 Edge1, A2, G4 y G2 1500
3 CLUSTER Compute Engine crea instancias de procesamiento en bloques adyacentes. A4, A3 Mega1, A3 High1, A3 Edge1, A2, G4 y G2 1,500
2 BLOCK Compute Engine crea instancias de procesamiento en el mismo bloque. A4, A3 Ultra, A3 Mega1, A3 High1, A3 Edge1, A2, G4 y G2
  • Para A3 Ultra, A3 Mega1, A3 High1 y A3 Edge1: 256
  • Para todas las demás series de máquinas compatibles: 150
1 SUBBLOCK Compute Engine crea instancias de procesamiento en el mismo subbloque. A3 Edge1, A2, G4 y G2 22

1 Si deseas aplicar una política de posición compacta a una instancia de A3 Mega, A3 High o A3 Edge que se creó antes del 1 de octubre de 2025, comunícate con tu equipo de cuentas o el equipo de ventas.

Políticas de cargas de trabajo

Las políticas de cargas de trabajo te permiten especificar la posición y la infraestructura subyacente para las instancias de procesamiento en un MIG. El uso de políticas de cargas de trabajo con A4X Max, A4X, A4, A3 Ultra, A3 Mega y A3 High (8 GPU) te ayuda a minimizar la latencia de red entre las instancias de procesamiento y optimizar el rendimiento.

Según los tipos de máquinas que usan las instancias de procesamiento en tu MIG, las políticas de cargas de trabajo son obligatorias o opcionales en las siguientes situaciones:

  • Para implementar subbloques de instancias de A4X Max o A4X, se requieren políticas de cargas de trabajo.

  • Para usar instancias de A4, A3 Ultra, A3 Mega o A3 High (8 GPU), las políticas de cargas de trabajo son opcionales.

  • La política de cargas de trabajo no es compatible con las series de máquinas A3 Edge, A2, G4, G2 y N1. Para los MIG que usan estas series de máquinas, puedes usar la política de posición compacta para la colocación de VM.

Para obtener más información, consulta Acerca de las políticas de cargas de trabajo en MIG en la documentación de Compute Engine.

¿Qué sigue?