Les traductions sont fournies par des outils de traduction automatique. En cas de conflit entre le contenu d'une traduction et celui de la version originale en anglais, la version anglaise prévaudra.
Caractéristiques de l'application HBase pour les versions AMI antérieures d'Amazon EMR
Versions prises en charge de HBase
| Version de HBase | Version d'AMI | AWS CLI paramètres de configuration | Détails de la version de HBase |
|---|---|---|---|
| 0.94.18 |
3.1.0 et ultérieures |
|
|
| 0.94.7 |
3.0-3.0.4 |
|
|
| 0.92 |
2.2 et ultérieures |
|
Prérequis des clusters HBase
Un cluster créé à l'aide des versions AMI 2.x et 3.x d'Amazon EMR doit respecter les conditions requises suivantes pour HBase.
-
Le AWS CLI (facultatif) : pour interagir avec HBase à l'aide de la ligne de commande, téléchargez et installez la dernière version du. AWS CLI Pour plus d’informations, consultez Installation d’ AWS Command Line Interface dans le Guide de l’utilisateur AWS Command Line Interface .
-
Au moins deux instances (facultatif) : le nœud principal du cluster exécute le serveur maître HBase et Zookeeper, et les nœuds de tâche exécutent les serveurs de région HBase. Pour de meilleures performances, les clusters HBase doivent s'exécuter sur au moins deux instances EC2, mais vous pouvez exécuter HBase sur un seul nœud à des fins d'évaluation.
-
Long-running Cluster : HBase ne s'exécute que sur des clusters de longue durée. Par défaut, l'interface de ligne de commande et la console Amazon EMR créent des clusters de longue durée.
-
Un jeu de paires de clés Amazon EC2 (recommandée) : pour utiliser le protocole Secure Shell (SSH) pour vous connecter avec le nœud principal et exécuter les commandes de shell HBase, vous devez utiliser une paire de clés Amazon EC2 lorsque vous créez le cluster.
-
Versions correctes d'AMI et de Hadoop – Les clusters HBase sont actuellement pris en charge uniquement sur Hadoop 20.205 ou version ultérieure.
-
Ganglia (facultatif) – Pour surveiller les métriques de performance HBase, installez Ganglia lorsque vous créez le cluster.
-
Un compartiment Amazon S3 pour les journaux (facultatif) – Les journaux de HBase sont disponibles sur le nœud principal. Si vous voulez que ces journaux soient copiés dans Amazon S3, spécifiez un compartiment S3 qui contiendra les fichiers journaux lorsque vous créez le cluster.
Création d'un cluster avec HBase
Le tableau suivant répertorie les options qui sont disponibles lorsque vous utilisez la console pour créer un cluster avec HBase à l'aide d'une version AMI d'Amazon EMR.
| Champ | Action |
|---|---|
| Restore from backup (Rétablir à partir d'une sauvegarde) | Spécifiez s'il convient de précharger le cluster HBase avec les données stockées dans Amazon S3. |
| Backup location (Emplacement de sauvegarde) | Spécifiez l'URI où la sauvegarde à restaurer réside dans Amazon S3. |
| Backup version (Version de sauvegarde) | Éventuellement, spécifiez le nom de version de la sauvegarde dans Backup Location (Emplacement de sauvegarde) à utiliser. Si vous laissez ce champ vide, Amazon EMR utilise la dernière sauvegarde dans Emplacement de sauvegarde pour renseigner le nouveau cluster HBase. |
| Schedule Regular Backups (Planifier des sauvegardes régulières) | Spécifiez s'il convient de planifier des sauvegardes incrémentielles automatiques. La première sauvegarde est une sauvegarde complète pour créer une référence pour les futures sauvegardes incrémentielles. |
| Consistent backup (Sauvegarde uniforme) | Spécifiez si les sauvegardes doivent être cohérentes. Une sauvegarde cohérente est une sauvegarde qui interrompt les opérations d'écriture au cours de la phase initiale de sauvegarde, pour la synchronisation entre les nœuds. Les éventuelles opérations d'écriture ainsi interrompues sont placées dans une file d'attente et reprises lorsque la synchronisation est terminée. |
| Backup frequency (Fréquence de sauvegarde) | Nombre de days/hours /minutes entre les sauvegardes planifiées. |
| Backup location (Emplacement de sauvegarde) | L'URI Amazon S3 où les sauvegardes sont stockées. L'emplacement de sauvegarde pour chaque cluster HBase doit être différent pour garantir que les sauvegardes différentielles restent correctes. |
| Backup start time (Heure de début de sauvegarde) | Spécifiez quand la première sauvegarde doit avoir lieu. Vous pouvez spécifier now, ce qui entraîne le commencement de la première sauvegarde lorsque le cluster est en cours d'exécution, ou saisir une date et une heure dans ISO format |
L'exemple de AWS CLI commande suivant lance un cluster avec HBase et d'autres applications :
Note
Les caractères de continuation de ligne Linux (\) sont inclus pour des raisons de lisibilité. Ils peuvent être supprimés ou utilisés dans les commandes Linux. Pour Windows, supprimez-les ou remplacez-les par un caret (^).
aws emr create-cluster --name "Test cluster" --ami-version3.3\ --applications Name=HueName=HiveName=PigName=HBase\ --use-default-roles --ec2-attributes KeyName=myKey\ --instance-typec1.xlarge--instance-count3--termination-protected
Une fois la connexion entre les clusters Hive et HBase établie (comme indiqué dans la procédure précédente), vous pouvez accéder aux données stockées sur le cluster HBase en créant une table externe dans Hive.
L'exemple de code suivant, lorsqu'il est exécuté à partir de l'invite de Hive, crée une table externe qui référence les données stockées dans une table HBase appelée inputTable. Vous pouvez ensuite référencer inputTable dans les instructions Hive pour interroger et modifier les données stockées dans le cluster HBase.
Note
L'exemple suivant utilise protobuf-java-2.4.0a.jar dans AMI 2.3.3, mais vous devez modifier l'exemple pour qu'il corresponde à votre version. Pour vérifier quelle version du fichier JAR de tampons de protocole vous avez, exécutez la commande à l'invite de commande Hive : ! ls /home/hadoop/lib;.
add jar lib/emr-metrics-1.0.jar ; add jar lib/protobuf-java-2.4.0a.jar ; set hbase.zookeeper.quorum=ec2-107-21-163-157.compute-1.amazonaws.com ; create external table inputTable (key string, value string) stored by 'org.apache.hadoop.hive.hbase.HBaseStorageHandler' with serdeproperties ("hbase.columns.mapping" = ":key,f1:col1") tblproperties ("hbase.table.name" = "t1"); select count(*) from inputTable ;
Personnalisation de la configuration de HBase
Les paramètres par défaut devraient fonctionner pour la plupart des applications, mais vous avez la possibilité de modifier vos paramètres de configuration HBase. Pour ce faire, exécutez l'un des deux scripts d'action d'amorçage :
-
configure-hbase-daemons – Configure les propriétés des démons principal, regionserver et zookeeper. Ces propriétés incluent la taille des tas et des options pour passer à la machine virtuelle Java (JVM) lorsque le démon HBase démarre. Vous définissez ces propriétés en tant qu'arguments dans l'action d'amorçage. Cette action d'amorçage modifie le fichier de configurationhome/hadoop//conf/hbase-user-env.sh sur le cluster HBase.
-
configure-hbase – Configure des paramètres spécifiques au site HBase, tels que le port auquel le maître HBase doit se lier et le nombre maximal de fois où le client d'interface de ligne de commande client doit recommencer une action. Vous pouvez définir ces paramètres un par un, en tant qu'arguments dans l'action d'amorçage, ou vous pouvez spécifier l'emplacement d'un fichier de configuration XML dans Amazon S3. Cette action d'amorçage modifie le fichier de configurationhome/hadoop//conf/hbase-site.xml sur le cluster HBase.
Note
Ces scripts, tels que d'autres actions d'amorçage, peuvent uniquement être exécutés lorsque le cluster est créé. Vous ne pouvez pas les utiliser pour modifier la configuration d'un cluster HBase en cours d'exécution.
Lorsque vous exécutez les actions d'amorçage configure-hbase ou configure-hbase-daemons, les valeurs que vous spécifiez remplacent les valeurs par défaut. Toutes les valeurs que vous ne définissez pas explicitement reçoivent les valeurs par défaut.
La configuration de HBase avec ces actions d'amorçage est analogue à l'utilisation d'actions d'amorçage dans Amazon EMR pour configurer les paramètres Hadoop et les propriétés de démon Hadoop. La différence est que HBase n'a pas d'options de mémoire par processus. Au lieu de cela, les options de mémoire sont définies à l'aide de l'--argument, où daemon-optsdaemon est remplacé par le nom du démon à configurer.
Configuration des démons HBase
Amazon EMR propose une action d'amorçage que vous pouvez utiliser pour modifier la configuration des démons HBase, où se region trouve la région dans laquelle vous lancez votre cluster HBase. s3:// region.elasticmapreduce/bootstrap-actions/configure-hbase-daemons
Pour configurer les démons HBase à l'aide de AWS CLI, ajoutez l'action configure-hbase-daemons bootstrap lorsque vous lancez le cluster afin de configurer un ou plusieurs démons HBase. Vous pouvez définir les propriétés suivantes :
| Propriété | Description |
|---|---|
hbase-master-opts |
Options qui contrôlent la façon dont la machine virtuelle Java exécute le démon maître. Si elles sont définies, elles remplacent les variables HBASE_MASTER_OPTS par défaut. |
regionserver-opts |
Options qui contrôlent la façon dont la machine virtuelle Java exécute le démon de serveur de région. Si elles sont définies, elles remplacent les variables HBASE_REGIONSERVER_OPTS par défaut. |
zookeeper-opts |
Options qui contrôlent la façon dont la machine virtuelle Java exécute le démon zookeeper. Si elles sont définies, elles remplacent les variables HBASE_ZOOKEEPER_OPTS par défaut. |
Pour plus d'informations sur ces options, consultez hbase-env.sh
Une action d'amorçage permettant de configurer les valeurs de zookeeper-opts et hbase-master-opts est illustrée dans l'exemple suivant.
Note
Les caractères de continuation de ligne Linux (\) sont inclus pour des raisons de lisibilité. Ils peuvent être supprimés ou utilisés dans les commandes Linux. Pour Windows, supprimez-les ou remplacez-les par un caret (^).
aws emr create-cluster --name "Test cluster" --ami-version3.3\ --applications Name=HueName=HiveName=PigName=HBase\ --use-default-roles --ec2-attributes KeyName=myKey\ --instance-typec1.xlarge--instance-count3--termination-protected \ --bootstrap-actions Path=s3://elasticmapreduce/bootstrap-actions/configure-hbase-daemons,\ Args=["--hbase-zookeeper-opts=-Xmx1024m -XX:GCTimeRatio=19","--hbase-master-opts=-Xmx2048m","--hbase-regionserver-opts=-Xmx4096m"]
Configuration des paramètres de site HBase
Amazon EMR fournit une action d'amorçage, s3://elasticmapreduce/bootstrap-actions/configure-hbase, que vous pouvez utiliser pour modifier la configuration de HBase. Vous pouvez définir les valeurs de configuration une par une, en tant qu'arguments dans l'action d'amorçage, ou vous pouvez spécifier l'emplacement d'un fichier de configuration XML dans Amazon S3. La définition des valeurs de configuration une par une est utile si vous avez besoin de définir uniquement quelques paramètres de configuration. Leur définition à l'aide d'un fichier XML est utile si vous avez beaucoup de modifications à apporter, ou si vous souhaitez enregistrer vos paramètres de configuration en vue de les réutiliser.
Note
Vous pouvez préfixer le nom du compartiment Amazon S3 avec un préfixe de région, par exemples3://, où se region.elasticmapreduce/bootstrap-actions/configure-hbaseregion trouve la région dans laquelle vous lancez votre cluster HBase.
Cette action d'amorçage modifie le fichier de configuration /home/hadoop/conf/hbase-site.xml sur le cluster HBase. L'action d'amorçage ne peut être exécutée que lorsque le cluster HBase est lancé.
Pour plus d'informations sur les paramètres de site HBase que vous pouvez configurer, consultez Configuration par défaut
Définissez l'action d'amorçage configure-hbase lorsque vous lancez le cluster HBase, et spécifiez les valeurs dans hbase-site.xml à changer.
Pour spécifier les paramètres de chaque site HBase à l'aide du AWS CLI
-
Pour modifier le
hbase.hregion.max.filesizeparamètre, tapez la commande suivante et remplacez-lamyKeypar le nom de votre paire de clés Amazon EC2.Note
Les caractères de continuation de ligne Linux (\) sont inclus pour des raisons de lisibilité. Ils peuvent être supprimés ou utilisés dans les commandes Linux. Pour Windows, supprimez-les ou remplacez-les par un caret (^).
aws emr create-cluster --name "Test cluster" --ami-version3.3\ --applications Name=HueName=HiveName=PigName=HBase\ --use-default-roles --ec2-attributes KeyName=myKey\ --instance-typec1.xlarge--instance-count3--termination-protected \ --bootstrap-actions Path=s3://elasticmapreduce/bootstrap-actions/configure-hbase,Args=["-s","hbase.hregion.max.filesize=52428800"]
Pour spécifier les paramètres du site HBase à l'aide d'un fichier XML à l'aide du AWS CLI
-
Créez une version personnalisée de
hbase-site.xml. Votre fichier personnalisé doit être un fichier XML valide. Pour réduire le risque d'introduire des erreurs, commencez par la copie par défaut dehbase-site.xml, située sur le nœud principal HBase Amazon EMR à l'adresse/home/hadoop/conf/hbase-site.xml, puis modifiez une copie de ce fichier au lieu de créer un fichier complètement neuf. Vous pouvez donner un nouveau nom à votre nouveau fichier ou conserver le nomhbase-site.xml. -
Chargez votre fichier
hbase-site.xmlpersonnalisé sur un compartiment Amazon S3. Les autorisations doivent être définies pour que le AWS compte qui lance le cluster puisse accéder au fichier. Si le AWS compte qui lance le cluster possède également le compartiment Amazon S3, il y a accès. -
Définissez l'action d'amorçage configure-hbase lorsque vous lancez le cluster HBase et incluez l'emplacement de votre fichier
hbase-site.xmlpersonnalisé. L'exemple suivant définit les valeurs de configuration de site HBase sur celles spécifiées dans le fichiers3://amzn-s3-demo-bucket/my-hbase-site.xml. Tapez la commande suivante,myKeyremplacez-la par le nom de votre paire de clés EC2 etamzn-s3-demo-bucketremplacez-la par le nom de votre compartiment Amazon S3.Note
Les caractères de continuation de ligne Linux (\) sont inclus pour des raisons de lisibilité. Ils peuvent être supprimés ou utilisés dans les commandes Linux. Pour Windows, supprimez-les ou remplacez-les par un caret (^).
aws emr create-cluster --name "Test cluster" --ami-version3.3\ --applications Name=HueName=HiveName=PigName=HBase\ --use-default-roles --ec2-attributes KeyName=myKey\ --instance-typec1.xlarge--instance-count3--termination-protected \ --bootstrap-actions Path=s3://elasticmapreduce/bootstrap-actions/configure-hbase,Args=["--site-config-file","s3://amzn-s3-demo-bucket/config.xml"]Si vous spécifiez plusieurs options pour personnaliser le fonctionnement de HBase, vous devez préfixer chaque paire clé-valeur avec un commutateur d'option
-s, comme illustré dans l'exemple suivant :--bootstrap-actionss3://elasticmapreduce/bootstrap-actions/configure-hbase,Args=["-s","zookeeper.session.timeout=60000"]
Une fois le proxy configuré et la connexion SSH ouverte, vous pouvez consulter l'interface utilisateur HBase en ouvrant une fenêtre de navigateur avec http ://master-public-dns-name: 60010/master -status, où se master-public-dns-name trouve l'adresse DNS publique du nœud maître du cluster HBase.
Vous pouvez afficher les journaux HBase actuels en utilisant SSH pour vous connecter au nœud principal et en accédant au répertoire mnt/var/log/hbase. Ces journaux ne sont pas disponibles une fois que le cluster a été arrêté sauf si vous activez la journalisation dans Amazon S3 lorsque le cluster est lancé.
Sauvegarde et restauration HBase
Amazon EMR offre la possibilité de sauvegarder vos données HBase sur Amazon S3, manuellement ou selon une planification automatique. Vous pouvez effectuer des sauvegardes complètes et incrémentielles. Une fois que vous avez une version de sauvegarde des données HBase, vous pouvez restaurer cette version dans un cluster HBase. Vous pouvez restaurer les données dans un cluster HBase en cours d'exécution ou lancer un nouveau cluster, prérempli avec les données de sauvegarde.
Au cours du processus de sauvegarde, HBase continue d'exécuter les commandes d'écriture. Cela garantit la disponibilité du cluster tout au long de la sauvegarde, mais cela entraîne un risque d'incohérence entre les données en cours de sauvegarde et les éventuelles opérations d'écriture en cours d'exécution en parallèle. Pour comprendre les incohérences qui peuvent survenir, vous devez prendre en compte le fait que HBase distribue les opérations d'écriture sur les nœuds de son cluster. Si une opération d'écriture se produit après qu'un nœud particulier a été interrogé, ces données ne sont pas incluses dans l'archive de sauvegarde. Il peut même arriver que des écritures antérieures dans le cluster HBase (envoyées à un nœud qui a déjà été interrogé) soient absentes de l'archive de sauvegarde, tandis que des écritures postérieures (envoyées à un nœud avant qu'il soit interrogé) sont incluses.
Si une sauvegarde cohérente est nécessaire, vous devez suspendre les écritures dans HBase au cours de la première partie du processus de sauvegarde, la synchronisation entre les nœuds. Pour cela, vous pouvez spécifier le paramètre --consistent lorsque vous demandez une sauvegarde. Avec ce paramètre, les écritures intervenant au cours de cette période sont mises en file d'attente et exécutées dès que la synchronisation se termine. Vous pouvez également planifier des sauvegardes récurrentes, ce qui résout les incohérences au fil du temps, car les données qui manquent dans un cycle de sauvegarde sont sauvegardées lors du cycle suivant.
Lorsque vous sauvegardez les données HBase, vous devez spécifier un répertoire de sauvegarde différent pour chaque cluster. Un moyen simple pour cela consiste à utiliser l'identifiant du cluster dans le chemin d'accès spécifié pour le répertoire de sauvegarde. Par exemple, s3://amzn-s3-demo-bucket/backups/j-3AEXXXXXX16F2. Cela garantit que toutes les sauvegardes incrémentielles futures référenceront le cluster HBase approprié.
Lorsque vous êtes prêt à supprimer les anciens fichiers de sauvegarde devenus inutiles, nous vous recommandons de commencer par effectuer une sauvegarde complète de vos données HBase. Ceci garantit la conservation de toutes les données et fournit un point de départ pour les futures sauvegardes incrémentielles. Une fois la sauvegarde complète terminée, vous pouvez accédez à l'emplacement de sauvegarde et supprimer manuellement les anciens fichiers de sauvegarde.
Le processus de sauvegarde HBase utilise l'opération S3DistCp de copie, qui présente certaines limites en ce qui concerne l'espace de stockage temporaire des fichiers.
Sauvegarde et restauration HBase à l'aide de la console
La console offre la possibilité de lancer un nouveau cluster et de le remplir avec les données issues d'une sauvegarde HBase précédente. Elle vous permet également de planifier des sauvegardes incrémentielles périodiques des données HBase. Des fonctionnalités de sauvegarde et de restauration supplémentaires sont disponibles via l'interface de ligne de commande, telles que la possibilité de restaurer les données dans un cluster déjà en cours d'exécution, d'effectuer des sauvegardes manuelles et de planifier des sauvegardes complètes automatisées.
Pour remplir un nouveau cluster avec des données HBase archivées à l'aide de la console
Accédez à la nouvelle console Amazon EMR et sélectionnez Changer pour l'ancienne console depuis le menu latéral. Pour plus d'informations sur ce qu'implique le passage à l'ancienne console, consultez la rubrique Utilisation de l'ancienne console.
-
Choisissez Créer un cluster.
-
Dans la section Configuration des logiciels, pour Additional Applications (Applications supplémentaires), choisissez HBase et Configurer et ajouter.
-
Dans la boîte de dialogue Add Application (Ajouter une application), cochez Restore From Backup (Restituer à partir d'une sauvegarde).
-
Pour Backup Location (Emplacement de sauvegarde), spécifiez l'emplacement de la sauvegarde à charger dans le nouveau cluster HBase. Il doit s'agir d'une URL Amazon S3 de la forme
s3://amzn-s3-demo-bucket/backups/. -
Pour Backup Version (Version de sauvegarde), vous avez la possibilité de spécifier le nom d'une version de sauvegarde à charger en définissant une valeur. Si vous ne définissez pas de valeur pour Version de sauvegarde, Amazon EMR charge la dernière sauvegarde à l'emplacement spécifié.
-
Choisissez Ajouter, puis créez le cluster avec d'autres options, si vous le souhaitez.
Pour planifier des sauvegardes automatisées des données HBase à l'aide de la console
-
Dans la section Configuration des logiciels, pour Additional Applications (Applications supplémentaires), choisissez HBase et Configurer et ajouter.
-
Choisissez Schedule Regular Backups (Planifier des sauvegardes régulières).
-
Spécifiez si les sauvegardes doivent être cohérentes. Une sauvegarde cohérente est une sauvegarde qui interrompt les opérations d'écriture au cours de la phase initiale de sauvegarde, pour la synchronisation entre les nœuds. Les éventuelles opérations d'écriture ainsi interrompues sont placées dans une file d'attente et reprises lorsque la synchronisation est terminée.
-
Définissez la fréquence à laquelle les sauvegardes doivent intervenir en entrant un nombre pour Backup Frequency (Fréquence de sauvegarde) et en choisissant Jours, Heures ou Minutes. La première sauvegarde automatisée qui s'exécute est une sauvegarde complète. Après cela, Amazon EMR enregistre des sauvegardes incrémentielles basées sur la planification que vous spécifiez.
-
Spécifiez l'emplacement dans Amazon S3 où les sauvegardes doivent être stockées. Chaque cluster HBase doit être sauvegardé dans un emplacement distinct dans Amazon S3, afin de garantir que les sauvegardes incrémentielles sont calculées correctement.
-
Spécifiez quand la première sauvegarde doit intervenir en définissant une valeur pour Backup Start Time (Heure de début de sauvegarde). Vous pouvez spécifier
now, ce qui entraîne le commencement de la première sauvegarde lorsque le cluster est en cours d'exécution, ou saisir une date et une heure dans ISO format. Par exemple, le 26/09/2013 T20:00Z définit l'heure de début au 26 septembre 2013 à 20 h UTC. -
Choisissez Ajouter.
-
Procédez à la création du cluster avec d'autres options, si vous le souhaitez.
Surveillez HBase avec CloudWatch
Amazon EMR fournit trois indicateurs CloudWatch que vous pouvez utiliser pour surveiller vos sauvegardes HBase. Ces mesures sont transmises CloudWatch à intervalles de cinq minutes et sont fournies gratuitement.
| Métrique | Description |
|---|---|
HBaseBackupFailed |
Si la dernière sauvegarde a échoué. La valeur est définie sur 0 par défaut et mise à jour sur 1 en cas d'échec de la tentative de sauvegarde précédente. Cette métrique est présentée uniquement pour les clusters HBase. Cas d'utilisation : surveiller les sauvegardes HBase Unités : nombre |
HBaseMostRecentBackupDuration |
Délai nécessaire à l'exécution de la précédente sauvegarde. Cette métrique est définie même si la dernière sauvegarde a réussi ou a échoué. Lorsque la sauvegarde est en cours, cette métrique retourne le nombre de minutes qui se sont écoulées depuis le démarrage de la sauvegarde. Cette métrique est présentée uniquement pour les clusters HBase. Cas d'utilisation : surveiller les sauvegardes HBase Unités : minutes |
HBaseTimeSinceLastSuccessfulBackup |
Nombre de minutes écoulées depuis la dernière sauvegarde de HBase réussie démarrée sur votre cluster. Cette métrique est présentée uniquement pour les clusters HBase. Cas d'utilisation : surveiller les sauvegardes HBase Unités : minutes |
Configuration de Ganglia pour HBase
Vous configurez Ganglia pour HBase à l'aide de l'action d'amorçage configure-hbase-for-ganglia. Cette action d'amorçage configure HBase pour publier des métriques dans Ganglia.
Vous devez configurer HBase et Ganglia lorsque vous lancez le cluster. La création de rapports Ganglia ne peut pas être ajoutée à un cluster en cours d'exécution.
Ganglia stocke également les fichiers journaux sur le serveur à l'adresse /mnt/var/log/ganglia/rrds. Si vous avez configuré votre cluster pour conserver les fichiers journaux dans un compartiment Amazon S3, les fichiers journaux Ganglia y sont conservés également.
Pour lancer un cluster avec Ganglia pour HBase, utilisez l'action d'amorçage configure-hbase-for-ganglia, comme illustré dans l'exemple suivant.
Note
Les caractères de continuation de ligne Linux (\) sont inclus pour des raisons de lisibilité. Ils peuvent être supprimés ou utilisés dans les commandes Linux. Pour Windows, supprimez-les ou remplacez-les par un caret (^).
aws emr create-cluster --name "Test cluster" --ami-version3.3\ --applications Name=HueName=HiveName=PigName=HBaseName=Ganglia\ --use-default-roles --ec2-attributes KeyName=myKey\ --instance-typec1.xlarge--instance-count3--termination-protected \ --bootstrap-actions Path=s3://elasticmapreduce/bootstrap-actions/configure-hbase-for-ganglia
Une fois que le cluster a été lancé et Ganglia configuré, vous pouvez accéder aux graphiques et rapports Ganglia à l'aide de l'interface graphique en cours d'exécution sur le nœud maître.