

As traduções são geradas por tradução automática. Em caso de conflito entre o conteúdo da tradução e da versão original em inglês, a versão em inglês prevalecerá.

# Monitoramento de confiabilidade e desempenho para AWS CloudHSM
<a name="reliability-monitoring"></a>

Você pode usar o [Amazon CloudWatch Logs](https://docs.aws.amazon.com/AmazonCloudWatch/latest/logs/WhatIsCloudWatchLogs.html) para monitorar seu AWS CloudHSM cluster quase em tempo real. Usando CloudWatch métricas, você pode configurar CloudWatch alarmes para alertá-lo se alguma dessas métricas exceder os limites definidos. Para obter mais informações, consulte Como [trabalhar com Amazon CloudWatch Logs e AWS CloudHSM Audit Logs](https://docs.aws.amazon.com/cloudhsm/latest/userguide/get-hsm-audit-logs-using-cloudwatch.html) e [Obter CloudWatch métricas AWS CloudHSM](https://docs.aws.amazon.com/cloudhsm/latest/userguide/hsm-metrics-cw.html) na AWS CloudHSM documentação.

A seção descreve como configurar alarmes para as seguintes métricas, que podem ajudá-lo a monitorar o status de confiabilidade dos AWS CloudHSM clusters e dos módulos de segurança de hardware (HSMs):
+ [Instância de HSM não íntegra (recomendada)](#reliability-monitoring-unhealthy)
+ [Temperatura HSM](#reliability-monitoring-temperature)

## Instância de HSM não íntegra (recomendada)
<a name="reliability-monitoring-unhealthy"></a>

A `HsmUnhealthy` métrica indica que a instância do HSM não está funcionando adequadamente. O valor da linha de base para essa métrica é zero. Se a métrica for maior que zero, significa que um ou mais HSMs no cluster não estão funcionando conforme o esperado. AWS CloudHSM substitui automaticamente as instâncias não íntegras para você. No entanto, todas as solicitações enviadas ao HSM depois que ele começou a se comportar inesperadamente e antes de ser marcado como não íntegro falharão.

Criar um alarme nessa métrica ajuda a validar se a instância do HSM não íntegra foi substituída com sucesso. Ele também fornece informações sobre os erros relatados pelo aplicativo que podem ser o resultado de um HSM não íntegro.

Se você receber um alarme para essa métrica, monitore o aplicativo para garantir que ele possa lidar com falhas por um curto período e valide se ele ainda está funcionando conforme o esperado após a substituição do HSM.

A tabela a seguir mostra os valores de configuração para esse alarme. Para obter instruções sobre como configurar esse alarme, consulte [Criar um CloudWatch alarme com base em um limite estático](https://docs.aws.amazon.com/AmazonCloudWatch/latest/monitoring/ConsoleAlarms.html) na documentação de CloudWatch registros.


****  

| Propriedade | Valor | 
| --- | --- | 
| Métrica | `HsmUnhealthy` | 
| Namespace | `AWS/CloudHSM` | 
| Dimensão | `HSM ID` e `cluster ID` | 
| Estatística | `Maximum` | 
| Tipo de limite | `Static` | 
| Sempre que a duração for | `Greater/Equal` | 
| Than | `1` | 

**nota**  
Você não pode tornar um HSM insalubre para testar o alarme ou o desempenho do aplicativo. No entanto, você pode simular uma falha do HSM bloqueando e desbloqueando o tráfego entre o aplicativo e o HSM por um curto período de tempo. Para bloquear esse tráfego, você pode modificar seus [grupos de segurança](https://docs.aws.amazon.com/vpc/latest/userguide/vpc-security-groups.html) ou [listas de controles de acesso à rede (Rede ACLs)](https://docs.aws.amazon.com/vpc/latest/userguide/vpc-network-acls.html).

## Temperatura HSM
<a name="reliability-monitoring-temperature"></a>

A `HsmTemperature` métrica indica a temperatura da junção do processador de hardware. O HSM fica insalubre se a temperatura atingir 110 graus centígrados. Um alarme para essa métrica pode ajudar você a prever se um HSM ficará insalubre.

A tabela a seguir mostra os valores de configuração para esse alarme. Para obter instruções sobre como configurar esse alarme, consulte [Criar um CloudWatch alarme com base em um limite estático](https://docs.aws.amazon.com/AmazonCloudWatch/latest/monitoring/ConsoleAlarms.html) na documentação de CloudWatch registros.


| Propriedade | Valor | 
| --- | --- | 
| Métrica | `HsmTemperature` | 
| Namespace | `AWS/CloudHSM` | 
| Dimensão | `HSM ID` e `cluster ID` | 
| Estatística | `Maximum` | 
| Tipo de limite | `Static` | 
| Sempre que a duração for | `Greater/Equal` | 
| Than | `90` | 