View a markdown version of this page

Surveillance de la fiabilité et des performances pour AWS CloudHSM - AWS Conseils prescriptifs

Les traductions sont fournies par des outils de traduction automatique. En cas de conflit entre le contenu d'une traduction et celui de la version originale en anglais, la version anglaise prévaudra.

Surveillance de la fiabilité et des performances pour AWS CloudHSM

Vous pouvez utiliser Amazon CloudWatch Logs pour surveiller votre AWS CloudHSM cluster en temps quasi réel. À l'aide de CloudWatch métriques, vous pouvez configurer des CloudWatch alarmes pour vous avertir si l'une de ces métriques dépasse les seuils définis. Pour plus d'informations, consultez les sections Travailler avec Amazon CloudWatch Logs et AWS CloudHSM Audit Logs et Obtenir CloudWatch des métriques AWS CloudHSM dans la AWS CloudHSM documentation.

La section décrit comment configurer les alarmes pour les mesures suivantes, qui peuvent vous aider à surveiller l'état de fiabilité des AWS CloudHSM clusters et des modules de sécurité matériels (HSMs) :

Instance HSM défectueuse (recommandé)

La HsmUnhealthy métrique indique que l'instance HSM ne fonctionne pas correctement. La valeur de référence pour cette métrique est zéro. Si la métrique est supérieure à zéro, cela signifie qu'un ou plusieurs HSMs éléments du cluster ne fonctionnent pas comme prévu. AWS CloudHSM remplace automatiquement les instances défectueuses pour vous. Cependant, toutes les demandes envoyées au HSM après qu'il a commencé à se comporter de manière inattendue et avant qu'il ne soit marqué comme non fonctionnel échoueront.

La création d'une alarme sur cette métrique vous permet de vérifier que l'instance HSM défectueuse a été remplacée avec succès. Il fournit également des informations sur les erreurs signalées par les applications qui pourraient être le résultat d'un HSM défectueux.

Si vous recevez une alarme pour cette métrique, surveillez l'application pour vous assurer qu'elle peut gérer les défaillances de courte durée et vérifiez qu'elle fonctionne toujours comme prévu après le remplacement du HSM.

Le tableau suivant indique les valeurs de configuration de cette alarme. Pour obtenir des instructions sur la configuration de cette alarme, consultez la section Créer une CloudWatch alarme basée sur un seuil statique dans la documentation CloudWatch des journaux.

Propriété Value
Métrique

HsmUnhealthy

Namespace

AWS/CloudHSM

Dimension

HSM ID et cluster ID

Statistique

Maximum

Type de seuil

Static

Chaque fois que la durée est

Greater/Equal

Than

1

Note

Vous ne pouvez pas rendre un HSM défectueux afin de tester l'alarme ou les performances de l'application. Cependant, vous pouvez simuler une panne du HSM en bloquant et en débloquant le trafic entre l'application et le HSM pendant une courte période. Pour bloquer ce trafic, vous pouvez modifier vos groupes de sécurité ou vos listes de contrôle d'accès réseau (Réseau ACLs).

Température HSM

La HsmTemperature métrique indique la température de jonction du processeur matériel. Le HSM devient malsain si la température atteint 110 degrés Celsius. Une alarme correspondant à cette métrique peut vous aider à prévoir si un HSM ne fonctionnera pas correctement.

Le tableau suivant indique les valeurs de configuration de cette alarme. Pour obtenir des instructions sur la configuration de cette alarme, consultez la section Créer une CloudWatch alarme basée sur un seuil statique dans la documentation CloudWatch des journaux.

Propriété Value
Métrique

HsmTemperature

Namespace

AWS/CloudHSM

Dimension

HSM ID et cluster ID

Statistique

Maximum

Type de seuil

Static

Chaque fois que la durée est

Greater/Equal

Than

90