RDS Proxy 모니터링 대시보드
프록시의 모니터링 탭에서 RDS Proxy 모니터링 대시보드에 액세스할 수 있습니다.
이 대시보드는 위젯으로 정렬된 사전 구성된 지표 세트를 제공하며, 일반적인 관찰성 및 문제 해결 작업을 수행하는 데 도움이 되도록 설계되었습니다. 이 대시보드에 지표가 표시되지 않는 경우 대시보드의 링크를 사용하여 CloudWatch의 모든 지표를 볼 수 있습니다.
기본 대시보드에서는 지표를 추가하거나 제거할 수 없습니다. 프록시에 대한 사용자 지정 모니터링 보기를 생성하려면 CloudWatch에서 직접 생성할 수 있습니다. 자세한 내용은 CloudWatch 대시보드 사용을 참조하세요.
모니터링 대시보드는 여러 섹션으로 나뉘며, 지표는 사전 정의된 집계를 사용하여 위젯으로 그룹화됩니다. 기본 RDS Proxy 지표에 대한 자세한 내용은 CloudWatch를 사용하여 RDS Proxy 지표 모니터링을 참조하세요.
개요
역할별 가용성 %
AvailabilityPercentage 지표 집계를 기반으로 READWRITE 및 READ_ONLY 역할에서 대상을 사용할 수 있었던 시간의 백분율입니다.
가용성 지표는 프록시에서 수행하는 데이터베이스 상태 확인의 성공률을 설명하며, 이는 대상 데이터베이스 인스턴스의 상태를 반영합니다. 이 위젯은 각 역할에 대한 Average 통계를 사용하며, 계산은 지정된 역할의 데이터베이스 인스턴스 수(READWRITE 역할의 경우 1개, READ_ONLY 역할의 경우 잠재적으로 여러 개)와 프록시의 노드 수(RDS Proxy 인프라에 의해 결정됨)의 영향을 받습니다.
참고
RDS Proxy는 등록된 DB 인스턴스의 구성에 따라 자동으로 용량을 조정합니다. 프록시의 노드 수를 직접 제어할 수는 없지만 가용성 지표의 sample count 통계를 사용하여 현재 노드 수를 확인할 수 있습니다. RDS Proxy가 용량을 조정하는 방법에 대한 자세한 내용은 IP 주소 용량 계획을 참조하세요.
READWRITE 대상 역할에는 데이터베이스 인스턴스가 하나만 포함될 수 있으며, 가용성 백분율은 모든 프록시 노드의 평균 상태 확인 성공률로 계산됩니다. 예를 들어 프록시에 4개의 노드가 포함되어 있고 그 중 하나가 지정된 기간 동안 성공적인 상태 확인 응답을 받지 못한 경우 읽기/쓰기 가용성은 해당 기간 동안 75%로 보고됩니다. 마찬가지로 프록시에 4개의 노드가 포함되어 있고 1분 기간 중 30초 동안 상태 확인을 실행할 수 없는 경우 프록시는 해당 1분 동안 50% 가용성을 보고합니다.
READ_ONLY 대상 역할에는 Aurora 클러스터의 여러 복제본과 같은 여러 데이터베이스 인스턴스가 포함될 수 있습니다. 각 RDS Proxy 노드의 관점에서 대상 인스턴스 중 하나라도 상태 확인을 통과하면 읽기 전용 역할은 사용 가능으로 간주됩니다. 그런 다음 모든 프록시 노드에서 가용성의 평균을 구하고 최종 수치가 위젯에 표시됩니다. 다음과 같이 4개의 노드가 포함된 프록시의 예를 살펴보겠습니다.
-
각 프록시 노드는 여러 읽기 전용 대상(데이터베이스 인스턴스)에 대해 상태 확인을 수행하는데 일부는 성공하고 일부는 실패합니다. 프록시 노드는 하나 이상의 대상 인스턴스로부터 성공적인 상태 확인 응답을 수신하는 한 읽기 전용 역할을 사용 가능으로 보고합니다.
-
4개의 프록시 노드는 여러 읽기 전용 대상에 대해 상태 확인을 수행합니다. 3개의 프록시 노드가 하나 이상의 대상에 연결할 수 있지만 1개는 대상에 연결할 수 없습니다. 읽기 전용 역할 가용성은 프록시 노드에서 보고하는 역할 가용성의
Average로 계산됩니다.(100% + 100% + 100% + 0% )/ 4 = 75%
참고
RDS Proxy READ_ONLY 대상 역할은 읽기 가능한 대기가 2개 있는 Aurora 클러스터 또는 Amazon RDS Multi-AZ DB 클러스터 배포에서는 지원되지만 읽기 복제본이 있는 Amazon RDS DB 인스턴스 배포에서는 지원되지 않습니다. 프록시에 읽기 전용 대상이 없는 경우 READ_ONLY 역할의 가용성에 '0'이 표시될 수 있습니다.
역할 가용성 위젯은 다음과 같은 시나리오에서 가장 유용합니다.
-
프록시 노드 또는 대상 데이터베이스 인스턴스의 상태로 인해 가용성이 영향을 받았는지 여부를 빠르게 평가하려는 경우, 연결 오류를 진단합니다.
-
데이터베이스가 확실한 가용성 손실을 경험하지 않았지만 프록시의 상태 확인 지표가 데이터베이스 과부하 가설을 지지할 수 있는 경우, 트래픽 급증 이벤트를 진단합니다. RDS Proxy는 모니터링 및 상태 확인 작업에 예약된 여러 영구 연결을 사용하므로 데이터베이스 지표가 가동 중지를 나타내지 않지만 프록시의 상태 확인이 간헐적으로 실패하는 경우 과도한 데이터베이스 부하의 지표일 수 있습니다.
-
프록시가 대상 인스턴스에 연결할 수 없는 구성 문제를 식별합니다. 예를 들어 프록시 가용성 지표가 하락했지만 대상 인스턴스가 다른 신호에 따라 정상으로 표시되는 경우 이는 프록시의 서브넷과 연결된 네트워크 ACL 문제 또는 대상 데이터베이스 인스턴스에 연결된 보안 그룹의 잘못된 구성을 나타낼 수 있습니다.
RDS Proxy 가용성 지표와 관련된 문제를 진단할 때는 데이터베이스 자체의 상태 및 사용률 지표도 검토해야 합니다. 프록시의 가용성 계산은 데이터베이스의 상태 확인 응답 능력에 영향을 받기 때문에 결론을 내리기 전에 양쪽에서 정보를 수집해야 합니다.
역할별 데이터베이스 연결 사용률 %
각 역할에 대한 프록시 연결 풀의 사용률 백분율로, DatabaseConnections를 MaxDatabaseConnectionsAllowed로 나눈 값으로 계산됩니다.
허용되는 최대 데이터베이스 연결 수는 MaxConnectionsPercent 설정에서 제어되는 프록시의 최대 풀 크기를 나타내며, 이는 max_connections 파라미터와 같은 데이터베이스 연결 한도에 따라 달라집니다. 이 설정에 대한 자세한 내용은 RDS Proxy 연결 고려 사항을 참조하세요.
참고
RDS Proxy는 내부 모니터링 연결을 위해 MaxConnectionsPercent 할당량의 일부를 예약합니다. 총 예약 연결 수는 상수가 아니라 내부 프록시 노드 수 및 대상 데이터베이스 인스턴스 수에 따라 달라집니다.
허용되는 연결 수와 피크 부하 시 예상되는 최대 데이터베이스 연결 수 사이에 최소 30%의 헤드룸을 두는 것이 좋습니다. 이 헤드룸은 예기치 않은 워크로드 급증 시 클라이언트 경험을 개선하고 RDS Proxy가 내부 인프라에서 열 관리 및 기타 목적으로 연결을 재배포하는 데 도움이 됩니다. 이 권장 사항을 따르는 데 도움이 되도록 연결 사용률 위젯에는 최대 70%의 고정 가이드라인이 포함되어 있습니다.
예를 들어 각 인스턴스에 대해 라이터 1개 및 리더 2개가 있고 max_connections 설정이 500인 Aurora PostgreSQL 클러스터와 MaxConnectionsPercent가 50으로 구성된 프록시가 있다고 가정합니다.
-
RDS Proxy는 모니터링을 위해 여러 개의 연결을 예약합니다. 즉,
MaxDatabaseConnectionsAllowed가 인스턴스당 250개 미만입니다.(max_connections=500 * MaxConnectionsPercent=50%) - reserved connections -
라이터 1개가 포함된
READWRITE역할의 경우 프록시 연결 풀의 최대 크기는 250보다 약간 작고(50% * 500 - reserved_connections) 70% 가이드라인은 175개 미만의 연결(70% * 250 - reserved connections)에 해당합니다. -
리더 2개가 포함된
READ_ONLY역할의 경우 프록시 연결 풀의 최대 크기는 500보다 약간 작고(2 * 50% * 500 - reserved_connections) 70% 가이드라인은 350개 미만의 연결(70% * 500 - reserved connections)에 해당합니다.
이 위젯은 연결 사용률의 일반적인 지표 역할을 하며 특정 문제 해결 시나리오에서 유용한 출발점입니다. 예제:
-
연결 사용률이 빈번하고 급격하게 변동한다면
MaxIdleConnectionsPercent설정이 너무 낮다는 신호일 수 있으며, 유휴 연결을 더 오랫동안 열린 상태로 유지하여 연결 이탈을 줄일 수 있습니다. -
워크로드 패턴 및 클라이언트 활동을 기반으로 특정 시점에 사용되는 연결 수를 대략적으로 예상할 수 있습니다. 위젯은 이러한 예상을 검증하고 잠재적 클라이언트 문제를 탐지하는 데 도움이 될 수 있습니다.
MaxIdleConnectionsPercent설정이 매우 낮지만 연결 사용률이 지속적으로 매우 높은 상황을 생각해 보세요. 이는 클라이언트가 유휴 상태인 경우가 거의 없음을 나타낼 수도 있지만(반드시 문제가 아닐 수도 있음) 연결이 고정되어 유휴 상태 확인의 대상이 아님을 의미할 수도 있습니다. -
고정 또는 프록시 구성에 문제가 없는 상황에서 데이터베이스 연결 사용률이 높다면 데이터베이스의
max_connections설정을 상향해야 하거나 읽기 전용 역할의 경우 클러스터에 읽기 복제본을 추가해야 함을 의미할 수 있습니다.
지연 시간 분석
연결 대여 및 쿼리 응답의 지연 시간입니다.
| Label | 설명 | 소스 |
|---|---|---|
DatabaseConnectionsBorrowLatency |
풀의 기존 데이터베이스 연결이든 데이터베이스에 대해 열어야 하는 새 데이터베이스 연결이든 관계없이 프록시가 데이터베이스 연결을 확보하는 데 걸리는 시간입니다. | RDS Proxy, DatabaseConnectionsBorrowLatency 지표 |
QueryResponseLatency |
쿼리 요청을 받는 시간과 프록시가 응답하는 시간의 차이입니다. | RDS Proxy, QueryResponseLatency 지표 |
QueryDatabaseResponseLatency |
프록시와 데이터베이스 간의 네트워크 지연 시간을 포함하여 데이터베이스가 쿼리에 응답하는 데 걸린 시간입니다. | RDS Proxy, QueryDatabaseResponseLatency 지표 |
이 위젯은 쿼리의 평균 응답 시간 그리고 프록시 계층이 총 지연 시간에 미치는 영향을 파악하는 데 도움이 됩니다. 대여 지연 시간 지표는 풀에서 즉시 사용할 수 있는 연결이 부족하여 클라이언트 요청이 대기하는 상황인 풀 정체를 탐지하는 데 특히 유용할 수 있습니다.
이러한 지표의 데이터 포인트는 값이 0보다 큰 경우에만 게시됩니다. 즉, 쿼리 트래픽이 없는 기간 동안 위젯에 공백이 생길 수 있습니다.
클라이언트 연결
클라이언트와 프록시 간의 연결 수로, 연결 상태별로 세분화됩니다.
| Label | 설명 | 소스 |
|---|---|---|
ClientConnectionsReceived |
수신된 클라이언트 연결 요청 수입니다. | RDS Proxy, ClientConnectionsReceived 지표 |
ClientConnectionsSetupSucceeded |
성공적으로 설정된 클라이언트 연결 수입니다. | RDS Proxy, ClientConnectionsSetupSucceeded 지표 |
ClientConnectionsSetupFailedAuth |
잘못 구성된 인증 또는 TLS로 인해 실패한 클라이언트 연결 시도 횟수입니다. | RDS Proxy, ClientConnectionsSetupFailedAuth 지표 |
ClientConnectionsClosed |
닫은 클라이언트 연결 수입니다. | RDS Proxy, ClientConnectionsClosed 지표 |
이 위젯은 단일 차트에 여러 클라이언트 연결 지표를 표시하여 클라이언트 연결의 처리량 및 상태를 평가하는 데 도움이 될 수 있습니다. 클라이언트 연결의 전체 성공률을 모니터링하고 연결이 열리고 닫히는 속도를 관찰하는 데 유용할 수 있습니다. 이는 연결 스톰과 시간 경과에 따른 클라이언트 활동의 변화를 감지하는 데 도움이 될 수 있습니다.
프록시 워크로드
QueryRequests 프록시 지표를 기반으로 한 프록시 엔드포인트당 쿼리 요청 수입니다.
데이터 시리즈 레이블은 엔드포인트에 따라 다릅니다.
-
기본 읽기/쓰기 프록시 엔드포인트는
default레이블을 사용합니다. -
AWS Management Console을 통해 프록시를 생성하는 동안 선택적 읽기 전용 엔드포인트를 활성화한 경우 이 엔드포인트는 프록시 이름 접두사가 붙은
read-only레이블을 사용합니다. 프록시 이름이my-proxy인 경우 레이블은my-proxy-read-only입니다. -
추가 프록시 엔드포인트는 추가 접두사 없이 엔드포인트 이름을 레이블로 사용합니다.
이 위젯은 각 프록시 엔드포인트를 통해 처리되는 워크로드 볼륨을 모니터링하는 데 유용합니다.
중요
QueryRequests 지표는 현재 확장 쿼리 프로토콜을 사용하는 PostgreSQL 연결에서 쿼리 활동에 대해서는 내보내지 않습니다.
Latency
대상별 데이터베이스 응답 지연 시간
QueryDatabaseResponseLatency 프록시 지표를 기반으로 한 대상(데이터베이스 인스턴스)별 데이터베이스 응답 지연 시간입니다.
이 위젯은 프록시에 속한 각 데이터베이스 인스턴스에 대한 데이터베이스 응답 지연 시간을 모니터링하는 유용합니다. 특히 워크로드마다 다른 데이터베이스 인스턴스를 사용하거나 인스턴스 크기가 동일하지 않은 경우에 더욱 그렇습니다. 다음 예제를 살펴보세요.
-
데이터베이스 클러스터에 여러 개의 읽기 복제본이 포함되어 있으며, 모두 프록시를 통해 트래픽을 수신합니다. 또한 일부 복제본은 프록시를 우회하는 클라이언트로부터 직접 트래픽을 수신합니다. 이 위젯을 통해 추가 트래픽이 프록시를 통해 처리되는 워크로드의 쿼리 지연 시간에 영향을 미치는지 확인할 수 있습니다.
-
데이터베이스 클러스터에는 크기가 다른 복제본이 포함되어 있고, 전체 워크로드는 프록시를 통해 처리되며, 데이터베이스 인스턴스는 연결 한도가 인스턴스 크기에 비례하는 기본 연결 구성을 사용합니다. 프록시는 연결 한도를 준수하고 작은 인스턴스에 비례적으로 적은 수의 연결을 전송하지만 캐시 및 버퍼도 작아지기 때문에 지연 시간이 길어질 수 있습니다. 이 위젯은 실제로 그런 상황인지 그리고 쿼리 지연 시간 측면에서 작은 인스턴스가 더 큰 인스턴스와 보조를 맞추고 있는지 확인하는 데 도움이 될 수 있습니다.
연결 풀
역할별 데이터베이스 연결 고정 %
각 역할에 고정된 데이터베이스 연결의 백분율로, DatabaseConnectionsCurrentlySessionPinned를 DatabaseConnections로 나눈 값으로 계산됩니다.
이 위젯은 워크로드에서 연결 고정을 모니터링하는 데 유용합니다. 다른 위젯과 마찬가지로 여기서 고정된 연결 절대 수보다 더 적합한 상태 지표로 상대 값이 사용됩니다. 이상적인 값은 0이지만 모든 워크로드에서 연결 고정을 완전히 피할 수 있는 것은 아닙니다. 나머지 워크로드에 눈에 띄는 영향을 주지 않는 한 소수의 연결에 고정이 발생할 수 있습니다. 그러나 전체 워크로드의 대다수에서 고정이 발생하는 경우 RDS Proxy가 연결을 멀티플렉싱(트랜잭션 간에 재사용)하지 못하게 하는 클라이언트 동작 문제를 나타낼 수 있습니다.
연결 고정에 대한 자세한 내용은 RDS Proxy 고정 방지를 참조하세요.
역할별 데이터베이스 연결 설정 지표
프록시와 데이터베이스 간의 연결 설정 수로, 설정 결과 및 대상 역할별로 세분화됩니다. 이 위젯에는 각 역할에 대한 여러 데이터 시리즈가 표시됩니다.
| Label | 설명 | 소스 |
|---|---|---|
DatabaseConnectionRequests |
데이터베이스 연결을 생성하기 위한 요청 수입니다. | RDS Proxy, DatabaseConnectionRequests 지표 |
DatabaseConnectionsSetupSucceeded |
성공적으로 설정된 데이터베이스 연결 수입니다. | RDS Proxy, DatabaseConnectionsSetupSucceeded 지표 |
DatabaseConnectionsSetupFailed |
실패한 데이터베이스 연결 요청 수입니다. | RDS Proxy, DatabaseConnectionsSetupFailed 지표 |
이러한 지표의 데이터 포인트는 값이 0보다 큰 경우에만 게시됩니다. 즉, 관련 이벤트가 없는 기간 동안 위젯에 공백이 생길 수 있습니다. 예를 들어 클라이언트가 지정된 기간 동안 프록시를 통해 쿼리를 실행하고 프록시가 기존 백엔드 데이터베이스 연결을 재사용하여(새 연결을 열지 않음) 전체 트래픽을 처리할 수 있는 경우 해당 기간의 데이터 포인트가 표시되지 않습니다.
이 위젯은 프록시와 데이터베이스 간의 활동 및 연결 이탈을 관찰하는 데 유용합니다. 클라이언트 연결 위젯에 표시된 정보와 페어링하면 이를 사용하여 프록시 내에서 연결 풀링 및 멀티플렉싱의 효율성을 평가할 수 있습니다.
RDS Proxy는 전체 연결 풀을 최대 용량으로 사전 할당하지 않으며 일정 기간 동안 사용하지 않으면 유휴 데이터베이스 연결을 종료합니다. DatabaseConnectionRequests가 0보다 크고 부하 상태에서 변동하는 것은 정상이지만, DatabaseConnectionRequests 대비 ClientConnectionsReceived의 비율을 주의 깊게 살펴볼 필요가 있습니다. 예제:
-
클라이언트가 프록시에 특정 수의 연결을 설정하고 프록시가 각 기간에 데이터베이스에 대한 거의 동일한 수의 연결을 설정하는 경우 고정 또는 기타 이유로 인해 프록시가 연결을 재사용할 수 없다고 추론할 수 있습니다. 이런 상황에서는 프록시가 연결을 재사용하지 못하게 하는 클라이언트 동작에 중점을 두고 추가 조사가 필요할 수 있습니다.
-
클라이언트가 프록시에 특정 수의 연결을 설정하지만 새 데이터베이스 연결은 그 일부에 불과하면 프록시가 기존 연결을 재사용하여 대다수의 트래픽을 처리함을 나타냅니다. 이는 연결 풀의 정상적이고 바람직한 상태입니다.
대상별 데이터베이스 연결 설정 지표
역할별 데이터베이스 연결 설정 지표와 동일한 내용으로, 데이터가 대상(데이터베이스 인스턴스)별로 세분화된 지표입니다.
데이터베이스 연결 사용률
대상별 데이터베이스 연결 사용률 %
각 대상(데이터베이스 인스턴스)에 대한 프록시 연결 풀의 사용률 백분율로, DatabaseConnections를 MaxDatabaseConnectionsAllowed로 나눈 값으로 계산됩니다.
이 위젯은 역할별 데이터베이스 연결 사용률 %와 유사하지만 각 데이터베이스 인스턴스의 연결 사용률을 세부적으로 보여줍니다. 여러 인스턴스가 있는 데이터베이스 클러스터의 READ_ONLY 역할에서 공평한 연결 분포를 확인하는 데 유용할 수 있습니다.
예를 들어 리더 2개가 있고 MaxDatabaseConnectionsAllowed가 리더당 500인 Aurora 클러스터가 있다고 가정합니다. 프록시 연결 수가 첫 번째 리더에서 100개, 두 번째 리더에서 125개인 경우 위젯은 첫 번째 리더에서 20%, 두 번째 리더에서 25%의 연결 사용률을 표시합니다.
참고
RDS Proxy는 데이터베이스의 연결 한도를 기준으로 각 복제본의 클라이언트 연결 수를 균등화하려고 시도합니다. CPU 사용률과 같은 데이터베이스 지표를 기반으로 트래픽을 로드 밸런싱하지 않으며, 각 클라이언트 세션이 설정된 후 얼마나 오래 지속될지 알 수 없습니다. 따라서 인스턴스 간 연결 사용률의 사소한 불균형은 정상적인 현상입니다.
READWRITE/READ_ONLY 역할별 데이터베이스 연결 사용량
프록시 및 데이터베이스에서 사용 및 허용하는 데이터베이스 연결 수입니다. 이 유형의 위젯은 두 가지가 있습니다. 하나는 READWRITE 역할용 위젯이고 다른 하나는 READ_ONLY 역할용 위젯입니다.
이 위젯은 프록시의 데이터베이스 대상이 Aurora DB 클러스터 및 Amazon RDS Multi-AZ DB 클러스터 배포를 포함하는 READ_ONLY 역할을 지원하는 경우에만 표시됩니다. Amazon RDS DB 인스턴스 배포에는 이 위젯이 표시되지 않습니다.
각 위젯에는 여러 데이터 시리즈가 포함되어 있습니다.
| Label | 설명 | 소스 |
|---|---|---|
Database Connections |
프록시 또는 다른 클라이언트가 설정했는지 여부에 관계없이 데이터베이스에 존재하는 연결 수입니다. | 데이터베이스, DatabaseConnections 지표 |
Database Connections: proxy |
RDS Proxy가 데이터베이스 모니터링에 사용하는 내부 연결을 제외하고 프록시와 데이터베이스 사이에 존재하는 데이터베이스 연결 수입니다. | RDS Proxy, DatabaseConnections 지표 |
MaxDatabaseConnectionsAllowed: Proxy |
프록시에서 허용하고 MaxConnectionsPercent 설정으로 제어되는 최대 데이터베이스 연결 수입니다. |
RDS Proxy, MaxDatabaseConnectionsAllowed 지표 |
표시된 그림은 프록시 및 기본 데이터베이스 클러스터의 합계입니다. 예를 들어 데이터베이스 클러스터에 각각 1,000개의 연결을 허용하는 인스턴스가 2개 포함되어 있고 프록시의 MaxConnectionsPercent가 20으로 구성되어 있다고 가정합니다. 이 시나리오에서 MaxDatabaseConnectionsAllowed: Proxy는 2 * 1000 * 20% = 400에서 RDS Proxy가 모니터링 목적으로 내부적으로 예약한 연결 수를 뺀 값을 표시합니다. 실제 값은 400보다 작으며 프록시의 노드 수에 따라 달라집니다.
이 위젯은 다음과 같은 상황에서 가장 유용합니다.
-
프록시 및 데이터베이스의 절대 연결 사용률 모니터링.
-
프록시를 통해 데이터베이스에 도달하는 연결 수와 프록시를 우회하는 연결 수를 파악.
-
현재 연결 사용률과 최대 허용 사용률 간의 차이 계산.
참고
모든 클라이언트 연결이 프록시를 통해 처리되더라도 DatabaseConnections의 값은 Database Connections: Proxy보다 높습니다. RDS 플랫폼 및 RDS Proxy 인프라에서 유지 관리하는 다수의 내부 연결이 항상 존재합니다. 이러한 연결은 데이터베이스에 의해 계산되지만 프록시 지표에는 반영되지 않습니다.