Les traductions sont fournies par des outils de traduction automatique. En cas de conflit entre le contenu d'une traduction et celui de la version originale en anglais, la version anglaise prévaudra.
Surveillance d'Amazon DocumentDB avec CloudWatch
Amazon DocumentDB (avec compatibilité avec MongoDB) s'intègre à Amazon CloudWatch afin que vous puissiez collecter et analyser les mesures opérationnelles de vos clusters. Vous pouvez surveiller ces métriques à l'aide de la CloudWatch console, de la console Amazon DocumentDB, du AWS Command Line Interface (AWS CLI) ou de l' CloudWatchAPI.
CloudWatch vous permet également de définir des alarmes afin d'être averti si une valeur de métrique dépasse un seuil que vous avez spécifié. Vous pouvez même configurer Amazon CloudWatch Events pour qu'il prenne des mesures correctives en cas de violation. Pour plus d'informations sur l'utilisation CloudWatch et les alarmes, consultez la CloudWatch documentation Amazon.
Rubriques
Métriques Amazon DocumentDB
Pour surveiller l'état et les performances de votre cluster et de vos instances Amazon DocumentDB, vous pouvez consulter les mesures suivantes dans la console Amazon DocumentDB.
Note
Les mesures des tableaux suivants s'appliquent à la fois aux clusters basés sur des instances et aux clusters élastiques.
Rubriques
Métriques d'utilisation des ressources
| Métrique | Description |
|---|---|
BackupRetentionPeriodStorageUsed |
Quantité totale de stockage de sauvegarde en octets utilisée pour prendre en charge la fonctionnalité de restauration instantanée dans la fenêtre de rétention d'Amazon DocumentDB. Incluse dans le total indiqué par la métrique TotalBackupStorageBilled. Calculée séparément pour chaque cluster Amazon DocumentDB. |
ChangeStreamLogSize |
Quantité de stockage (en Mo) utilisée par votre cluster pour stocker le journal du flux de modifications. Cette valeur est un sous-ensemble du stockage total du cluster (VolumeBytesUsed) et affecte le coût du cluster. Pour plus d'informations sur les tarifs du stockage, consultez la page produit |
CPUUtilization |
Pourcentage de l'UC utilisé par une instance. |
DatabaseConnections |
Le nombre de connexions (actives et inactives) ouvertes sur une instance prise à une fréquence d'une minute. |
DatabaseConnectionsMax |
Nombre maximum de connexions de base de données ouvertes (actives et inactives) sur une instance sur une période d'une minute. |
DatabaseConnectionsLimit |
Le nombre maximum de connexions simultanées à la base de données (actives et inactives) autorisées sur une instance à un moment donné. |
DatabaseConnectionsActiveMax |
Le nombre maximum de connexions de base de données actives sur une instance sur une période d'une minute. Les connexions actives sont celles qui exécutent actuellement une opération, par opposition aux connexions inactives. Pour les quotas de connexion actifs par type d'instance, consultezQuotas d'instances. |
DatabaseCursors |
Le nombre de curseurs ouverts sur une instance prise à une fréquence d'une minute. |
DatabaseCursorsMax |
Le nombre maximum de curseurs ouverts sur une instance sur une période d'une minute. |
DatabaseCursorsLimit |
Le nombre maximum de curseurs autorisés sur une instance à un moment donné. |
DatabaseCursorsTimedOut |
Le nombre de curseurs dont le délai a expiré au cours d'une période d'une minute. |
FreeableMemory |
Quantité de mémoire vive disponible, en octets. |
FreeLocalStorage |
Cette métrique indique la quantité de stockage accessible à chaque instance pour les journaux et les tables temporaires. Cette valeur dépend de la classe d'instance. Vous pouvez augmenter la quantité d'espace de stockage libre pour une instance en choisissant une classe d'instance plus grande pour votre instance. (Cela ne s'applique pas à DocumentDB Serverless.) |
LowMemThrottleQueueDepth |
La profondeur de la file d'attente pour les demandes qui sont limitées en raison d'une faible quantité de mémoire disponible prise à une fréquence d'une minute. |
LowMemThrottleMaxQueueDepth |
Profondeur de file d'attente maximale pour les demandes qui sont limitées en raison d'une faible quantité de mémoire disponible sur une période d'une minute. |
LowMemNumOperationsThrottled |
Le nombre de demandes qui sont limitées en raison d'une faible quantité de mémoire disponible sur une période d'une minute. |
SnapshotStorageUsed |
Quantité totale de stockage de sauvegarde en octets consommée par tous les instantanés d'un cluster Amazon DocumentDB donné en dehors de sa fenêtre de rétention des sauvegardes. Incluse dans le total indiqué par la métrique TotalBackupStorageBilled. Calculée séparément pour chaque cluster Amazon DocumentDB. |
SwapUsage |
Quantité d'espace d'échange utilisé sur l'instance. |
TotalBackupStorageBilled |
La quantité totale de stockage de sauvegarde en octets pour laquelle vous êtes facturé pour un cluster Amazon DocumentDB donné. Inclut le stockage de sauvegarde mesuré par les métriques BackupRetentionPeriodStorageUsed et SnapshotStorageUsed. Calculée séparément pour chaque cluster Amazon DocumentDB. |
TransactionsOpen |
Le nombre de transactions ouvertes sur une instance prise à une fréquence d'une minute. |
TransactionsOpenMax |
Le nombre maximum de transactions ouvertes sur une instance sur une période d'une minute. |
TransactionsOpenLimit |
Le nombre maximum de transactions simultanées autorisées sur une instance à un moment donné. |
VolumeBytesUsed |
Volume de stockage, en octets, utilisé par votre cluster. Cette valeur a une incidence sur le coût du cluster. Pour plus d'informations sur les tarifs, consultez la page produit |
Métriques de latence
| Métrique | Description |
|---|---|
DBClusterReplicaLagMaximum |
Délai maximal, en millisecondes, entre l'instance principale et chaque instance Amazon DocumentDB du cluster. |
DBClusterReplicaLagMinimum |
Durée minimale du retard, millisecondes, entre l'instance principale et chaque instance de réplica dans le cluster. |
DBInstanceReplicaLag |
La durée du retard, en millisecondes, lors de la réplication des mises à jour à partir de l'instance principale vers une instance de réplica. |
ReadLatency |
Temps moyen nécessaire par I/O opération sur un disque. |
WriteLatency |
Durée moyenne, en millisecondes, nécessaire pour effectuer une opération sur un disque I/O . |
NVMe-backed métriques d'instance
| Métrique | Description |
|---|---|
NVMeStorageCacheHitRatio |
Pourcentage de demandes traitées par le cache hiérarchisé. |
FreeNVMeStorage |
Espace de stockage disponible pour les volumes NVMe éphémères. |
ReadIOPSNVMeStorage |
Nombre moyen d' I/O opérations de lecture de disque effectuées sur un stockage NVMe éphémère. |
ReadLatencyNVMeStorage |
Temps moyen nécessaire par I/O opération de lecture de disque pour le stockage NVMe éphémère. |
ReadThroughputNVMeStorage |
Nombre moyen d’octets lus sur le disque par seconde sur le stockage de volumes NVMe éphémères. |
WriteIOPSNVMeStorage |
Nombre moyen d' I/O opérations d'écriture sur disque sur un stockage NVMe éphémère. |
WriteLatencyNVMeStorage |
Temps moyen nécessaire par I/O opération d'écriture sur disque pour le stockage NVMe éphémère. |
WriteThroughputNVMeStorage |
Nombre moyen d’octets écrits sur disque par seconde sur le stockage de volumes NVMe éphémères. |
Métriques des opérations
| Métrique | Description |
|---|---|
DocumentsDeleted |
Le nombre de documents supprimés sur une période d'une minute. |
DocumentsInserted |
Le nombre de documents insérés sur une période d'une minute. |
DocumentsReturned |
Le nombre de documents retournés sur une période d'une minute. |
DocumentsUpdated |
Le nombre de documents mis à jour sur une période d'une minute. |
OpcountersCommand |
Le nombre de commandes émises sur une période d'une minute. |
OpcountersDelete |
Le nombre d'opérations de suppression effectuées sur une période d'une minute. |
OpcountersGetmore |
Le nombre de getmores émis sur une période d'une minute. |
OpcountersInsert |
Le nombre d'opérations d'insertion effectuées sur une période d'une minute. |
OpcountersQuery |
Le nombre de requêtes émises sur une période d'une minute. |
OpcountersUpdate |
Nombre d'opérations de mise à jour effectuées sur une période d'une minute. |
TransactionsStarted |
Le nombre de transactions démarrées sur une instance sur une période d'une minute. |
TransactionsCommitted |
Le nombre de transactions validées sur une instance sur une période d'une minute. |
TransactionsAborted |
Le nombre de transactions abandonnées sur une instance sur une période d'une minute. |
TTLDeletedDocuments |
Le nombre de documents supprimés par un TTLMonitor sur une période d'une minute. |
Command-level métriques
Amazon DocumentDB publie des mesures de latence et de simultanéité par commande pour. CloudWatch Ces indicateurs vous aident à identifier les opérations qui contribuent le plus à votre charge de travail et à détecter les problèmes de latence ou la pression de concurrence.
Chaque commande du tableau suivant émet trois mesures sur une période d'une minute :
AvgDuration— Temps d'exécution moyen de la commande, en microsecondes.P100Duration— Durée d'exécution maximale de la commande (100e centile), en microsecondes.MaxConcurrent— Le nombre maximum d'exécutions simultanées de la commande.
Les noms des métriques suivent le modèleCommand.. Par exemple, commandName.metricNameCommand.find.AvgDuration ou Command.aggregate.MaxConcurrent.
| Métrique | Description |
|---|---|
Command.find |
Lisez les requêtes à l'aide de Find. |
Command.insert |
Opérations d'insertion de documents. |
Command.findAndModify |
Opérations de recherche et de modification atomiques. |
Command.update |
Opérations de mise à jour des documents. |
Command.delete |
Opérations de suppression de documents. |
Command.aggregate |
Exécutions du pipeline d'agrégation. |
Command.count |
Opérations de comptage. |
Command.distinct |
Requêtes portant sur des valeurs distinctes. |
Command.getMore |
Opérations de récupération par lots de curseurs. |
Command.abortTransaction |
Opérations d'interruption de transaction. |
Command.commitTransaction |
Opérations de validation de transactions. |
Métriques de débit
| Métrique | Description |
|---|---|
NetworkReceiveThroughput |
Quantité de débit réseau reçue des clients par chaque instance du cluster de base de données, en octets par seconde. Ce débit n'inclut pas le trafic réseau entre les instances du cluster et le volume de cluster. |
NetworkThroughput |
La quantité de débit réseau, en octets par seconde, reçue et transmise aux clients par chaque instance du cluster Amazon DocumentDB. Ce débit n'inclut pas le trafic réseau entre les instances du cluster et le volume de cluster. |
NetworkTransmitThroughput |
Quantité de débit réseau envoyée aux clients par chaque instance du cluster, en octets par seconde. Ce débit n'inclut pas le trafic réseau entre les instances du cluster et le volume de cluster. |
ReadIOPS |
Nombre moyen d' I/O opérations de lecture de disque par seconde. Amazon DocumentDB indique les IOPS en lecture et en écriture séparément et à intervalles d'une minute. |
ReadThroughput |
Nombre moyen d’octets lus sur le disque par seconde. |
StorageNetworkReceiveThroughput |
Quantité de débit réseau, en octets par seconde, reçue du volume de stockage du cluster Amazon DocumentDB par chaque instance du cluster. |
StorageNetworkTransmitThroughput |
La quantité de débit réseau, en octets par seconde, envoyée au volume de stockage du cluster Amazon DocumentDB par chaque instance du cluster. |
StorageNetworkThroughput |
La quantité de débit réseau, en octets par seconde, reçue et envoyée au volume de stockage du cluster Amazon DocumentDB par chaque instance du cluster Amazon DocumentDB. |
VolumeReadIOPs |
Nombre moyen d' I/O opérations de lecture facturées à partir d'un volume de cluster, rapporté à intervalles de 5 minutes. Les opérations lues facturées sont calculées au niveau du volume de cluster, regroupées à partir de toutes les instances du cluster, puis rapportées par intervalles de 5 minutes. La valeur est calculée en prenant la valeur de la métrique des opérations de lecture sur une période de 5 minutes. Vous pouvez déterminer la quantité d'opérations lues facturées par seconde en prenant la valeur de la métrique des opérations de lecture facturées et en la divisant par 300 secondes. Par exemple, si le Vous cumulez les opérations de lecture facturées pour les requêtes qui demandent des pages de base de données non présentes dans le cache des tampons et qui doivent, par conséquent, être chargées depuis le stockage. Il se peut que vous constatiez des pics dans les opérations de lecture facturées, car les résultats des requêtes sont lus à partir du stockage, puis chargés dans le cache des tampons. |
VolumeWriteIOPs |
Nombre moyen d' I/O opérations d'écriture facturées à partir d'un volume de cluster, rapporté à intervalles de 5 minutes. Les opérations lues facturées sont calculées au niveau du volume de cluster, regroupées à partir de toutes les instances du cluster, puis rapportées par intervalles de 5 minutes. La valeur est calculée en prenant la valeur de la métrique des opérations en écriture sur une période de 5 minutes. Vous pouvez déterminer la quantité d'opérations lues facturées par seconde en prenant la valeur de la métrique des opérations en écriture facturées et en la divisant par 300 secondes. Par exemple, si la Notez que |
WriteIOPS |
Nombre moyen d' I/O opérations d'écriture sur disque par seconde. Lorsqu'ils sont utilisés au niveau d'un cluster, WriteIOPs ils sont évalués sur toutes les instances du cluster. Les IOPS de lecture et d'écriture sont signalées séparément et à des intervalles d'une minute. |
WriteThroughput |
Nombre moyen d’octets écrits sur le disque par seconde. |
Métriques du système
| Métrique | Description |
|---|---|
AvailableMVCCIds |
Un compteur qui indique le nombre d'opérations d'écriture restantes disponibles avant d'atteindre zéro. Lorsque ce compteur atteint zéro, votre cluster passe en mode lecture seule jusqu'à ce que les identifiants soient récupérés et recyclés. Le compteur diminue à chaque opération d'écriture et augmente à mesure que le ramasse-miettes recycle les anciens identifiants MVCC. |
BufferCacheHitRatio |
Pourcentage de demandes traitées par le cache de tampon. |
DiskQueueDepth |
Nombre d' I/O opérations en attente d'écriture ou de lecture sur le disque. |
EngineUptime |
Temps d'exécution de l'instance, en secondes. |
IndexBufferCacheHitRatio |
Pourcentage de demandes d'index traitées par le cache tampon. Vous pouvez constater un pic supérieur à 100 % pour la métrique juste après la suppression d'un index, d'une collection ou d'une base de données. Ce problème sera automatiquement corrigé au bout de 60 secondes. Cette limitation sera corrigée dans une prochaine mise à jour. |
LongestActiveGCRuntime |
Durée en secondes du plus long processus de collecte des déchets actif. Met à jour toutes les minutes et suit uniquement les opérations actives, à l'exception des processus qui se terminent dans la fenêtre d'une minute. |
Métriques de l'instance T3
| Métrique | Description |
|---|---|
CPUCreditUsage |
Le nombre de crédits CPU dépensés pendant la période de mesure. |
CPUCreditBalance |
Le nombre de crédits CPU accumulés par une instance. Ce solde diminue lorsque les crédits UC sont dépensés plus rapidement qu’ils ne sont gagnés. |
CPUSurplusCreditBalance |
Le nombre de crédits CPU excédentaires dépensés pour maintenir les performances du processeur lorsque la CPUCreditBalance valeur est nulle. |
CPUSurplusCreditsCharged |
Le nombre de crédits CPU excédentaires dépassant le nombre maximum de crédits CPU pouvant être gagnés sur une période de 24 heures, et entraînant ainsi des frais supplémentaires. Pour plus d'informations, consultez la section Surveillance de vos crédits CPU. |
Affichage des CloudWatch données
Vous pouvez consulter les CloudWatch données Amazon à l'aide de la CloudWatch console, de la console Amazon DocumentDB AWS Command Line Interface (AWS CLI) ou de l' CloudWatch API.
Dimensions d'Amazon DocumentDB
Les métriques d'Amazon DocumentDB sont qualifiées par les valeurs du compte ou de l'opération. Vous pouvez utiliser la CloudWatch console pour récupérer les données Amazon DocumentDB filtrées selon l'une des dimensions du tableau suivant.
| Dimension | Description |
|---|---|
DBClusterIdentifier |
Filtre les données que vous demandez pour un cluster Amazon DocumentDB spécifique. |
DBClusterIdentifier, Role |
Filtre les données que vous demandez pour un cluster Amazon DocumentDB spécifique, en agrégeant la métrique par rôle d'instance ()WRITER/READER. Par exemple, vous pouvez regrouper des métriques pour toutes les instances READER qui appartiennent à un cluster. |
DBInstanceIdentifier |
Filtre les données que vous demandez pour une instance de base de données spécifique. |
Surveillance des métriques Opcounter
Les métriques Opcounter ont une valeur différente de zéro (généralement ~50) pour les clusters inactifs. Cela est dû au fait qu'Amazon DocumentDB effectue des contrôles de santé périodiques, des opérations internes et des tâches de collecte de métriques.
Surveillance des connexions à la base de données
Lorsque vous visualisez le nombre de connexions à l'aide de commandes du moteur de base de données telles quedb.runCommand( { serverStatus: 1 }), vous pouvez voir jusqu'à 10 connexions de plus que ce que vous voyez dans DatabaseConnections through CloudWatch. Cela se produit parce qu'Amazon DocumentDB effectue des contrôles de santé périodiques et effectue des tâches de collecte de métriques qui ne sont pas prises en DatabaseConnections compte. DatabaseConnectionsreprésente uniquement les connexions initiées par le client.