

本文為英文版的機器翻譯版本，如內容有任何歧義或不一致之處，概以英文版為準。

# 的可靠性和效能監控 AWS CloudHSM
<a name="reliability-monitoring"></a>

您可以使用 [Amazon CloudWatch Logs](https://docs.aws.amazon.com/AmazonCloudWatch/latest/logs/WhatIsCloudWatchLogs.html) 近乎即時地監控 AWS CloudHSM 叢集。使用 CloudWatch 指標，您可以設定 CloudWatch 警示，在其中任何指標超過其定義的閾值時提醒您。如需詳細資訊，請參閱 AWS CloudHSM 文件中的[使用 Amazon CloudWatch Logs 和 AWS CloudHSM Audit Logs](https://docs.aws.amazon.com/cloudhsm/latest/userguide/get-hsm-audit-logs-using-cloudwatch.html) 和[取得 的 CloudWatch 指標 AWS CloudHSM](https://docs.aws.amazon.com/cloudhsm/latest/userguide/hsm-metrics-cw.html)。

本節說明如何為下列指標設定警示，這可協助您監控 AWS CloudHSM 叢集和硬體安全模組 (HSMs的可靠性狀態：
+ [運作狀態不佳的 HSM 執行個體 （建議）](#reliability-monitoring-unhealthy)
+ [HSM 溫度](#reliability-monitoring-temperature)

## 運作狀態不佳的 HSM 執行個體 （建議）
<a name="reliability-monitoring-unhealthy"></a>

`HsmUnhealthy` 指標表示 HSM 執行個體未正確執行。此指標的基準值為零。如果指標大於零，表示叢集中的一或多個 HSMs 未如預期運作。 AWS CloudHSM 會自動為您取代運作狀態不佳的執行個體。不過，在 HSM 開始意外行為後，在標示為運作狀態不佳之前傳送到 HSM 的所有請求都會失敗。

在此指標上建立警示可協助您驗證運作狀態不佳的 HSM 執行個體是否已成功取代。它還提供了有關應用程式報告錯誤的洞見，這些錯誤可能是運作狀態不佳 HSM 的結果。

如果您收到此指標的警示，請監控應用程式，以確保它可以在短時間內處理失敗，並在取代 HSM 後驗證它仍然如預期般運作。

下表顯示此警示的組態值。如需如何設定此警示的指示，請參閱 [ CloudWatch Logs 文件中的根據靜態閾值建立 CloudWatch 警示](https://docs.aws.amazon.com/AmazonCloudWatch/latest/monitoring/ConsoleAlarms.html)。 CloudWatch 



| 屬性 | Value | 
| --- | --- | 
| 指標 | `HsmUnhealthy` | 
| 命名空間 | `AWS/CloudHSM` | 
| 維度 | `HSM ID` 和 `cluster ID` | 
| 統計數字 | `Maximum` | 
| 閾值類型 | `Static` | 
| 每當持續時間為 | `Greater/Equal` | 
| 大於 | `1` | 

**注意**  
您無法讓 HSM 運作狀態不佳，以測試警示或應用程式效能。不過，您可以透過在短時間內封鎖和解除封鎖應用程式與 HSM 之間的流量，來模擬 HSM 失敗。若要封鎖此流量，您可以修改[安全群組](https://docs.aws.amazon.com/vpc/latest/userguide/vpc-security-groups.html)或[網路存取控制清單 （網路 ACLs)](https://docs.aws.amazon.com/vpc/latest/userguide/vpc-network-acls.html)。

## HSM 溫度
<a name="reliability-monitoring-temperature"></a>

`HsmTemperature` 指標表示硬體處理器的連接溫度。如果溫度達到攝氏 110 度，HSM 就會變得運作不良。此指標的警示可協助您預測 HSM 是否運作狀態不佳。

下表顯示此警示的組態值。如需如何設定此警示的指示，請參閱 [ CloudWatch Logs 文件中的根據靜態閾值建立 CloudWatch 警示](https://docs.aws.amazon.com/AmazonCloudWatch/latest/monitoring/ConsoleAlarms.html)。 CloudWatch 


| 屬性 | Value | 
| --- | --- | 
| 指標 | `HsmTemperature` | 
| 命名空間 | `AWS/CloudHSM` | 
| 維度 | `HSM ID` 和 `cluster ID` | 
| 統計數字 | `Maximum` | 
| 閾值類型 | `Static` | 
| 每當持續時間為 | `Greater/Equal` | 
| 大於 | `90` | 