Otimizar o acesso do cliente NFS do Linux para cargas de trabalho de automação de design eletrônico

Esta página descreve como otimizar o acesso do cliente NFS do Linux para cargas de trabalho de automação de projetos eletrônicos (EDA). Este documento é destinado a administradores de armazenamento , arquitetos de nuvem e engenheiros de sistemas responsáveis por configurar nós de computação do Linux e gerenciar ambientes de EDA de alta performance no Google Cloud.

Práticas recomendadas para clientes

Os nós do Linux e as VMs interativas ativam NetApp Volumes no NFS. O ajuste do cliente não aumenta os limites de capacidade de processamento do volume, mas ajuda a evitar tempestades de metadados, sobrecarga de slots em um único endpoint de armazenamento e comportamento de leitura sequencial ruim em bibliotecas grandes.

Configure os clientes na seguinte ordem:

  1. Simultaneidade do kernel (antes da montagem): simultaneidade do NFS do Linux

    Para imagens de computação do Cluster Toolkit e do Slurm, inclua as configurações de tabela de slots na imagem de computação ou nos scripts de inicialização antes da primeira ativação.

  2. Opções de ativação (na ativação): opções de ativação do NFS do Linux

  3. Leitura antecipada (após a ativação, opcional): leitura antecipada do NFS do Linux

Para mais informações sobre a otimização do cliente NFS, consulte Otimizar clientes NFS do Linux para NetApp Volumes.

Para comandos de ativação e políticas de exportação, consulte Conectar clientes NFS. Para distribuir clientes em volumes grandes, consulte Conectar volumes de grande capacidade com vários endpoints de armazenamento e padrões arquitetônicos de EDA.

Otimizar farms de EDA com muitos clientes

Use as configurações a seguir para implantações em grande escala com centenas ou milhares de nós de computação que compartilham as mesmas exportações. Essas configurações não correspondem a configurações de comparativo de mercado de VM única, que normalmente usam a opção de ativação nconnect=16 em um único host.

Área Ponto de partida recomendado
Protocolo NFSv3 (vers=3), a menos que você precise de recursos do NFSv4.1
Simultaneidade (NFSv3) Tabela de slots RPC baixa por cliente; por exemplo, 8 entradas em /etc/modprobe.d/sunrpc.conf
Conexões Uma conexão TCP por cliente por endpoint de armazenamento; não use nconnect
Volumes de grande capacidade Ative por DNS ou grupos estáticos para distribuir nós em vários endpoints de armazenamento
Tamanho da transferência Defina rsize=262144 e wsize=262144
Confiabilidade Use hard, tcp, timeo=600, ou Google Cloud padrões de console
Carga de metadados Use noatime em bibliotecas e rascunhos se o aplicativo permitir
Bloqueios (NFSv3) Use nolock se você não usar bloqueios consultivos e o Network Status Monitor (NSM) não estiver configurado
Leitura antecipada Aumente para bibliotecas de leitura após a ativação se as leituras sequenciais forem lentas

Valide a configuração usando o comando nfsiostat e as métricas descritas em Monitorar a performance ao executar um teste de regressão que representa sua carga de trabalho de produção típica.

Otimizar clientes por camada de dados

A tabela a seguir lista as áreas de foco do cliente e as opções de ativação típicas por camada de dados:

Nível Foco do cliente Opções típicas relacionadas à ativação
Bibliotecas Reduzir viagens de ida e volta de GETATTR e metadados; leitura sequencial de arquivos grandes vers=3, hard, tcp, noatime, rsize e wsize; considere actimeo=600 e nocto somente se os dados forem lidos principalmente e as regras de coerência permitirem
Rascunho Muitos escritores; a coerência é importante vers=3, hard, tcp e noatime; não use o armazenamento em cache de atributos agressivo; mantenha a contagem de slots baixa por nó
Ferramentas Leitura principalmente, semelhante às bibliotecas vers=3, hard, tcp, noatime, rsize=262144 e wsize=262144; considere actimeo=600 e nocto somente se os dados forem lidos principalmente e as regras de coerência permitirem; mantenha opções de ativação estáveis na imagem do cluster
Página inicial E/S pequenas misturadas Google Cloud Os padrões de console geralmente são suficientes; use slots baixos se a página inicial compartilhar um endpoint com o rascunho

Use o Kerberos (sec=krb5, krb5i ou krb5p) somente quando exigido pela política. Não combine o Kerberos com nconnect. Para mais informações, consulte Opções de ativação do NFS do Linux.

A seguir