En esta página, se describe cómo optimizar el acceso de clientes NFS de Linux para cargas de trabajo de automatización de diseño electrónico (EDA). Este documento está dirigido a administradores de almacenamiento , arquitectos de la nube y ingenieros de sistemas responsables de configurar nodos de procesamiento de Linux y administrar entornos de EDA de alto rendimiento en Google Cloud.
Prácticas recomendadas para clientes
Los nodos de Linux y las VMs interactivas activan NetApp Volumes a través de NFS. El ajuste del cliente no aumenta los límites de capacidad de procesamiento del volumen, pero ayuda a evitar tormentas de metadatos, sobrecarga de ranuras en un solo extremo de almacenamiento y un comportamiento de lectura secuencial deficiente en bibliotecas grandes.
Configura los clientes en el siguiente orden:
Simultaneidad del kernel (antes de la activación): Simultaneidad de NFS de Linux
Para las imágenes de procesamiento de Cluster Toolkit y Slurm, incluye la configuración de la tabla de ranuras en la imagen de procesamiento o en las secuencias de comandos de inicio antes de la primera activación.
Opciones de activación (en la activación): Opciones de activación de NFS de Linux
Lectura anticipada (después de la activación, opcional): Lectura anticipada de NFS de Linux
Para obtener más información sobre la optimización del cliente NFS, consulta Optimiza los clientes NFS de Linux para NetApp Volumes.
Para obtener información sobre los comandos de activación y las políticas de exportación, consulta Conecta clientes NFS. Para distribuir clientes en volúmenes grandes, consulta Conecta volúmenes de gran capacidad con varios extremos de almacenamiento y patrones arquitectónicos de EDA.
Optimiza las granjas de EDA con muchos clientes
Usa la siguiente configuración para implementaciones a gran escala con cientos o miles de nodos de procesamiento que comparten las mismas exportaciones. Estas configuraciones no coinciden con las configuraciones de pruebas comparativas de una sola VM, que suelen usar la opción de activación nconnect=16 en un solo host.
| Área | Punto de partida recomendado |
|---|---|
| Protocolo | NFSv3 (vers=3), a menos que necesites funciones de NFSv4.1 |
| Simultaneidad (NFSv3) | Tabla de ranuras de RPC baja por cliente; por ejemplo, 8 entradas en /etc/modprobe.d/sunrpc.conf |
| Conexiones | Una conexión TCP por cliente por extremo de almacenamiento; no uses nconnect |
| Volúmenes de gran capacidad | Activa por DNS o grupos estáticos para distribuir nodos en varios extremos de almacenamiento |
| Tamaño de transferencia | Establece rsize=262144 y wsize=262144 |
| Confiabilidad | Usa hard, tcp, timeo=600 o Google Cloud los valores predeterminados de la consola |
| Carga de metadatos | Usa noatime en bibliotecas y desde cero si la aplicación lo permite |
| Bloqueos (NFSv3) | Usa nolock si no usas bloqueos de asesoramiento y Network Status Monitor (NSM) no está configurado |
| Lectura anticipada | Aumenta para las bibliotecas de lectura después de la activación si las lecturas secuenciales son lentas |
Para validar tu configuración, usa el comando nfsiostat y las métricas que se describen
en Supervisa el rendimiento
mientras ejecutas una prueba de regresión que representa tu carga de trabajo de producción
típica.
Optimiza los clientes por nivel de datos
En la siguiente tabla, se enumeran las áreas de enfoque del cliente y las opciones de activación típicas por nivel de datos:
| Nivel | Enfoque del cliente | Opciones típicas relacionadas con la activación |
|---|---|---|
| Bibliotecas | Reduce los viajes de ida y vuelta de GETATTR y metadatos; lectura secuencial de archivos grandes |
vers=3, hard, tcp, noatime, rsize y wsize; considera actimeo=600 y nocto solo si los datos son de lectura y las reglas de coherencia lo permiten |
| Desde cero | Muchos escritores; la coherencia es importante | vers=3, hard, tcp y noatime; no uses el almacenamiento en caché de atributos agresivo; mantén bajo el recuento de ranuras por nodo |
| Herramientas | Principalmente de lectura, similar a las bibliotecas | vers=3, hard, tcp, noatime, rsize=262144 y wsize=262144; considera actimeo=600 y nocto solo si los datos son de lectura y las reglas de coherencia lo permiten; mantén opciones de activación estables en la imagen del clúster |
| Página principal | E/S pequeñas combinadas | Google Cloud Por lo general, los valores predeterminados de la consola son suficientes; usa ranuras bajas si la página principal comparte un extremo con desde cero |
Usa Kerberos (sec=krb5, krb5i o krb5p) solo cuando lo requiera la política.
No combines Kerberos con nconnect. Para obtener más información, consulta
Opciones de activación de NFS de Linux.
¿Qué sigue?
- Para obtener resultados de pruebas comparativas, consulta Pruebas comparativas de cargas de trabajo de automatización de diseño electrónico.