本文為英文版的機器翻譯版本,如內容有任何歧義或不一致之處,概以英文版為準。
的可靠性和效能監控 AWS CloudHSM
您可以使用 Amazon CloudWatch Logs 近乎即時地監控 AWS CloudHSM 叢集。使用 CloudWatch 指標,您可以設定 CloudWatch 警示,在其中任何指標超過其定義的閾值時提醒您。如需詳細資訊,請參閱 AWS CloudHSM 文件中的使用 Amazon CloudWatch Logs 和 AWS CloudHSM Audit Logs 和取得 的 CloudWatch 指標 AWS CloudHSM。
本節說明如何為下列指標設定警示,這可協助您監控 AWS CloudHSM 叢集和硬體安全模組 (HSMs的可靠性狀態:
運作狀態不佳的 HSM 執行個體 (建議)
HsmUnhealthy 指標表示 HSM 執行個體未正確執行。此指標的基準值為零。如果指標大於零,表示叢集中的一或多個 HSMs 未如預期運作。 AWS CloudHSM 會自動為您取代運作狀態不佳的執行個體。不過,在 HSM 開始意外行為後,在標示為運作狀態不佳之前傳送到 HSM 的所有請求都會失敗。
在此指標上建立警示可協助您驗證運作狀態不佳的 HSM 執行個體是否已成功取代。它還提供了有關應用程式報告錯誤的洞見,這些錯誤可能是運作狀態不佳 HSM 的結果。
如果您收到此指標的警示,請監控應用程式,以確保它可以在短時間內處理失敗,並在取代 HSM 後驗證它仍然如預期般運作。
下表顯示此警示的組態值。如需如何設定此警示的指示,請參閱 CloudWatch Logs 文件中的根據靜態閾值建立 CloudWatch 警示。 CloudWatch
| 屬性 | Value |
|---|---|
| 指標 |
|
| 命名空間 |
|
| 維度 |
|
| 統計數字 |
|
| 閾值類型 |
|
| 每當持續時間為 |
|
| 大於 |
|
注意
您無法讓 HSM 運作狀態不佳,以測試警示或應用程式效能。不過,您可以透過在短時間內封鎖和解除封鎖應用程式與 HSM 之間的流量,來模擬 HSM 失敗。若要封鎖此流量,您可以修改安全群組或網路存取控制清單 (網路 ACLs)。
HSM 溫度
HsmTemperature 指標表示硬體處理器的連接溫度。如果溫度達到攝氏 110 度,HSM 就會變得運作不良。此指標的警示可協助您預測 HSM 是否運作狀態不佳。
下表顯示此警示的組態值。如需如何設定此警示的指示,請參閱 CloudWatch Logs 文件中的根據靜態閾值建立 CloudWatch 警示。 CloudWatch
| 屬性 | Value |
|---|---|
| 指標 |
|
| 命名空間 |
|
| 維度 |
|
| 統計數字 |
|
| 閾值類型 |
|
| 每當持續時間為 |
|
| 大於 |
|