View a markdown version of this page

에 대한 신뢰성 및 성능 모니터링 AWS CloudHSM - AWS 권장 가이드

기계 번역으로 제공되는 번역입니다. 제공된 번역과 원본 영어의 내용이 상충하는 경우에는 영어 버전이 우선합니다.

에 대한 신뢰성 및 성능 모니터링 AWS CloudHSM

Amazon CloudWatch Logs를 사용하여 AWS CloudHSM 클러스터를 거의 실시간으로 모니터링할 수 있습니다. CloudWatch 지표를 사용하면 이러한 지표 중 하나라도 정의된 임계값을 초과하는 경우 알림을 받도록 CloudWatch 경보를 구성할 수 있습니다. 자세한 내용은 AWS CloudHSM 설명서의 Amazon CloudWatch Logs 및 AWS CloudHSM 감사 로그 작업 및에 대한 CloudWatch 지표 가져오기 AWS CloudHSM를 참조하세요.

이 섹션에서는 AWS CloudHSM 클러스터 및 하드웨어 보안 모듈(HSMs)의 신뢰성 상태를 모니터링하는 데 도움이 되는 다음 지표에 대한 경보를 구성하는 방법을 설명합니다.

비정상 HSM 인스턴스(권장)

HsmUnhealthy 지표는 HSM 인스턴스가 제대로 작동하지 않음을 나타냅니다. 이 지표의 기준 값은 0입니다. 지표가 0보다 크면 클러스터의 하나 이상의 HSMs이 예상대로 작동하지 않는 것입니다. AWS CloudHSM 는 비정상 인스턴스를 자동으로 대체합니다. 그러나 예기치 않게 작동하기 시작한 후 비정상으로 표시되기 전에 HSM으로 전송된 모든 요청은 실패합니다.

이 지표에 대한 경보를 생성하면 비정상 HSM 인스턴스가 성공적으로 교체되었는지 검증하는 데 도움이 됩니다. 또한 비정상 HSM의 결과일 수 있는 애플리케이션 보고 오류에 대한 인사이트를 제공합니다.

이 지표에 대한 경보가 수신되면 애플리케이션을 모니터링하여 잠시 동안 장애를 처리할 수 있는지 확인하고 HSM을 교체한 후에도 예상대로 작동하는지 확인합니다.

다음 표에는이 경보의 구성 값이 나와 있습니다. 이 경보를 설정하는 방법에 대한 지침은 CloudWatch Logs 설명서의 정적 임계값을 기반으로 CloudWatch 경보 생성을 참조하세요. CloudWatch

속성
지표

HsmUnhealthy

네임스페이스

AWS/CloudHSM

측정 기준

HSM IDcluster ID

통계

Maximum

임계값 유형

Static

지속 시간이 인 경우

Greater/Equal

보다

1

참고

경보 또는 애플리케이션 성능을 테스트하기 위해 HSM을 비정상으로 만들 수 없습니다. 그러나 애플리케이션과 HSM 간의 트래픽을 잠시 차단하고 차단 해제하여 HSM 장애를 시뮬레이션할 수 있습니다. 이 트래픽을 차단하기 위해 보안 그룹 또는 네트워크 액세스 제어 목록(네트워크 ACLs 수정할 수 있습니다.

HSM 온도

HsmTemperature 지표는 하드웨어 프로세서의 정션 온도를 나타냅니다. 온도가 섭씨 110 도에 도달하면 HSM이 비정상 상태가 됩니다. 이 지표에 대한 경보는 HSM이 비정상이 될지 예측하는 데 도움이 될 수 있습니다.

다음 표에는이 경보의 구성 값이 나와 있습니다. 이 경보를 설정하는 방법에 대한 지침은 CloudWatch Logs 설명서의 정적 임계값을 기반으로 CloudWatch 경보 생성을 참조하세요. CloudWatch

속성
지표

HsmTemperature

네임스페이스

AWS/CloudHSM

측정 기준

HSM IDcluster ID

통계

Maximum

임계값 유형

Static

지속 시간이 인 경우

Greater/Equal

보다

90