Operador de Rede NVIDIA
Ao ativar o complemento de cluster do Operador de Rede NVIDIA, você pode passar os seguintes pares de chave/valor como argumentos.
| Chave (API e CLI) | Nome para Exibição da Chave (Console) | Descrição | Obrigatório/Opcional | Valor Padrão | Valor de Exemplo |
|---|---|---|---|---|---|
affinity |
afinidade |
Um grupo de regras de programação de afinidade. Formato JSON em texto simples ou codificado em Base64. Não utilizado por:
Possíveis equivalentes:
|
Opcional | null | null |
nodeSelectors |
seletores de nó |
Você pode usar seletores de nó e labels de nó para controlar os nós de trabalho nos quais os pods complementares são executados. Para que um pod seja executado em um nó, o seletor de nós do pod deve ter a mesma chave/valor do label do nó. Defina Formato JSON em texto simples ou codificado em Base64. Não utilizado por:
Possíveis equivalentes:
|
Opcional | null | {"foo":"bar", "foo2": "bar2"}O pod só será executado em nós que tenham o label |
numOfReplicas |
numOfReplications | O número de réplicas da implantação do complemento. Não utilizado por:
Possíveis equivalentes:
|
Obrigatório | 1Cria uma réplica da implantação do complemento por cluster. |
2Cria duas réplicas da implantação do complemento por cluster. |
rollingUpdate |
Atualização incremental |
Controla o comportamento desejado de atualização incremental por maxSurge e maxUnavailable. Formato JSON em texto simples ou codificado em Base64. Não utilizado por:
Possíveis equivalentes:
|
Opcional | null | null |
tolerations |
tolerâncias |
Você pode usar taints e tolerations para controlar os nós de trabalho nos quais os pods complementares são executados. Para que um pod seja executado em um nó que tenha uma taint, o pod deve ter uma tolerância correspondente. Defina Formato JSON em texto simples ou codificado em Base64. Possíveis equivalentes:
|
Opcional | null | [{"key":"tolerationKeyFoo", "value":"tolerationValBar", "effect":"noSchedule", "operator":"exists"}]Somente pods que têm essa tolerância podem ser executados em nós de trabalho que têm a mancha |
topologySpreadConstraints |
topologiaSpreadConstraints |
Como distribuir pods correspondentes entre a topologia fornecida. Formato JSON em texto simples ou codificado em Base64. Não utilizado por:
|
Opcional | null | null |
| Chave (API e CLI) | Nome para Exibição da Chave (Console) | Descrição | Obrigatório/Opcional | Valor Padrão | Valor de Exemplo |
|---|---|---|---|---|---|
operator.nodeSelectors |
nvidia-rede-operador nodeSelectors | Seletores de nó nos pods Operador de Rede NVIDIA. | Opcional | null |
|
operator.tolerations |
nvidia-network-operator tolerâncias | Tolerâncias nos pods NVIDIA Network Operator. | Opcional | null |
|
nicClusterPolicy.tolerations |
tolerâncias nicClusterPolicy | Tolerâncias para DaemonSets gerenciados por NicClusterPolicy. | Opcional | null |
|
nicClusterPolicy.deploymentTolerations |
nicClusterPolicy deploymentTolerâncias | Tolerâncias para Implantações gerenciadas por NicClusterPolicy. | Opcional | null |
|
operator.affinity |
afinidade nvidia-rede-operador | Regras de programação de afinidade para o Operador de Rede NVIDIA. Formato JSON em texto sem formatação. | Opcional | null |
|
operator.resources |
recursos de contêiner nvidia-network-operator | Os recursos do Operador de Rede NVIDIA controlam os limites de recursos e as solicitações do contêiner nvidia-network-operator. Formato JSON em texto sem formatação. |
Opcional |
|
|
operator.cniBinDirectory |
cniBinDiretório | Diretório binário CNI para Operador de Rede NVIDIA. | Opcional | /opt/cni/bin |
|
operator.cniNetworkDirectory |
cniNetworkDirectory | Diretório de rede CNI para Operador de Rede NVIDIA. | Opcional | /etc/cni/net.d |
|
operator.admissionControllers.enabled |
operator.admissionControllers.ativado | Ative controladores de admissão para o Operador de Rede NVIDIA. | Opcional | false |
|
sriovNetworkOperator.enabled |
sriovNetworkOperator.ativado | Ative o Operador de Rede NVIDIA SR-IOV. | Opcional | false |
|
sriov-network-operator.operator.resourcePrefix |
sriov-network-operator.operator.resourcePrefix | Prefixo de recurso para recursos criados pelo Operador de Rede SR-IOV. | Opcional | nvidia.com |
|
sriov-network-operator.operator.admissionControllers.enabled |
sriov-network-operator.operator.admissionControllers.ativado | Ative controladores de admissão para o Operador de Rede SR-IOV. | Opcional | false |
|
sriov-network-operator.operator.sriovOperatorConfig.configDaemonNodeSelectors |
sriov-network-operator.operator.sriovOperatorConfig.configDaemonNodeSelectors | Configure configDaemonNodeSelector para sriovOperatorConfig. |
Opcional |
|
|
vfCreationMode |
vfModeCriação | Modo para criação de VF. Os valores válidos são sriovNetworkOperator e custom. |
Opcional | custom |
|
customizeVfCreationConfigMap |
customVfCreationConfigMap | Especifique se deseja ignorar a criação do ConfigMap vf-shape-config. |
Opcional | false |
|
skipNodeFeatureDiscoveryDependencyCheck |
skipNFDDependencyCheck | Ignore a verificação de dependência de Descoberta de Recurso de Nó. | Opcional | false |
A tabela a seguir descreve considerações para configurar este complemento de cluster em clusters grandes.
| Nome do Argumento | Número wrt de Atribuições dos Nós | Descrição | À medida que o tamanho do cluster aumenta | Riscos | Recomendação |
|---|---|---|---|---|---|
operator.nodeSelectors
|
S |
Controla onde os pods do Operador de Rede NVIDIA estão programados. |
|
Se este argumento estiver configurado incorretamente:
|
|
operator.tolerations
|
S |
Controla tolerâncias para os pods de Operador de Rede NVIDIA e DaemonSets relacionados. |
|
Se este argumento estiver configurado incorretamente:
|
|
operator.affinity
|
S |
Controla as regras de afinidade do nó para os pods do Operador de Rede NVIDIA. |
|
Se este argumento estiver configurado incorretamente:
|
|
operator.resources
|
S |
Define solicitações e limites de CPU e memória para o contêiner do Operador de Rede NVIDIA. |
O operador coordena recursos de rede no cluster. À medida que o número de nós aumenta, ele deve processar mais objetos, alterações de estado de nó e operações de reconciliação. O operador também conta com labels de Descoberta de Recurso de Nó para determinar quais nós exigem componentes de rede. |
Se os recursos forem subdimensionados:
|
|
operator.cniBinDirectory
|
N |
Controla o diretório nos nós onde os binários CNI são implantados. |
Os binários CNI devem ser implantados no diretório usado pelo runtime do contêiner. Um caminho incorreto pode afetar muitos nós ao mesmo tempo. |
Se este argumento estiver configurado incorretamente:
|
|
operator.cniNetworkDirectory
|
N |
Controla o diretório de host onde os arquivos de configuração CNI são implantados. |
Os arquivos de configuração CNI devem ser colocados no diretório lido pelo runtime do kubelet ou contêiner. Um diretório incorreto pode afetar todos os nós que usam a configuração. |
Se este argumento estiver configurado incorretamente:
|
|
operator.admissionControllers.enabled
|
N |
Controla se o Operador de Rede NVIDIA implanta seu controlador de admissão. |
O controlador de admissão ajuda a impedir a entrada de configuração inválida no cluster. Isso se torna mais importante quando muitos usuários ou sistemas de automação criam recursos personalizados de rede. |
Se o controlador de admissão estiver desativado:
|
|
sriovNetworkOperator.enabled
|
N |
Controla se o Operador de Rede SR-IOV está implantado. |
O Operador de Rede SR-IOV fornece os componentes SR-IOV necessários para a rede de alto desempenho baseada em função virtual, incluindo algumas configurações RDMA e GPUDirect RDMA. |
Se o Operador de Rede SR-IOV estiver desativado quando necessário:
|
|
sriov-network-operator.operator.resourcePrefix
|
N |
Define o prefixo usado para recursos criados pelo Operador de Rede SR-IOV. |
O prefixo determina os nomes de recursos estendidos que o Kubernetes e as cargas de trabalho usam. A alteração do prefixo requer que todos os manifestos da carga de trabalho usem os novos nomes de recursos. |
Se este argumento estiver configurado incorretamente:
|
|
sriov-network-operator.operator.admissionControllers.enabled
|
S |
Controla os controladores de admissão do Operador de Rede SR-IOV. |
Os controladores de admissão detectam a configuração SR-IOV inválida antes de atingir os nós e ajudam a manter as configurações de função virtual e NIC consistentes à medida que o número de grupos de nós e políticas aumenta. |
Se os controladores de admissão estiverem desativados:
|
|
sriov-network-operator.operator.sriovOperatorConfig.configDaemonNodeSelectors
|
S |
Seleciona os nós que o daemon de configuração SR-IOV configura. |
O seletor determina quais nós recebem a configuração SR-IOV. Em um cluster grande, um seletor incorreto pode afetar centenas ou milhares de nós. |
Se este argumento estiver configurado incorretamente:
|
|
vfCreationMode
|
N |
Determina se a criação da função virtual é gerenciada automaticamente pelo operador ou pela lógica personalizada. |
Um processo de criação de função virtual automatizado e consistente reduz as diferenças de configuração entre os nós. A lógica de criação personalizada fornece mais flexibilidade, mas aumenta a probabilidade de configuração de nó inconsistente. |
Se este argumento estiver configurado incorretamente:
|
|
skipNodeFeatureDiscoveryDependencyCheck
|
S |
Determina se o operador ignora a verificação de dependência de Descoberta de Recurso de Nó. |
Ignorar a verificação evita a validação de dependência redundante quando a Descoberta de Recursos de Nó é gerenciada separadamente. No entanto, o administrador do cluster se torna responsável por garantir que os labels de nó necessários estejam disponíveis e permaneçam corretos. |
Se este argumento estiver configurado incorretamente:
|
|