View a markdown version of this page

Gérer les interruptions d'instances Spot - Présentation des instances Spot Amazon EC2

Gérer les interruptions d'instances Spot

La meilleure façon de gérer convenablement les interruptions d'instances Spot et de limiter l'impact sur vos performances ou votre disponibilité consiste à concevoir votre application de manière à ce qu'elle soit tolérante aux pannes. Pour ce faire, vous pouvez tirer parti des recommandations de rééquilibrage d'instance EC2 et des avis d'interruption des instances Spot.

La recommandation de rééquilibrage d'instance EC2 est une nouvelle fonction qui vous avertit lorsqu'une instance Spot présente un risque élevé d'interruption. Le signal vous donne la possibilité de gérer de manière proactive l'instance Spot avant l'avis d'interruption de deux minutes. Vous pouvez décider de rééquilibrer votre charge de travail en instance Spot nouvelle ou existante qui ne présente pas de risque élevé d'interruption. Nous avons facilité l'utilisation de ce signal en utilisant la fonction Rééquilibrage de capacité dans les groupes EC2 Auto Scaling. Pour plus d'informations, consultez Rééquilibrage de capacité Amazon EC2 Auto Scaling.

Un avis d'interruption d'instance Spot est un avertissement émis deux minutes avant qu'Amazon EC2 n'interrompe une instance Spot. Si votre charge de travail est « flexible dans le temps », vous pouvez configurer vos instances Spot pour qu'elles soient arrêtées ou mises en veille prolongée, au lieu d'être arrêtées, lorsqu'elles sont interrompues. Amazon EC2 arrête ou met automatiquement en veille prolongée vos instances Spot en cas d'interruption, et les reprend automatiquement lorsque la capacité est disponible.

Vous pouvez utiliser la recommandation de rééquilibrage de l'instance EC2 et/ou l'avis d'interruption d'instance Spot pour structurer votre charge de travail en tenant compte de la tolérance aux pannes, afin de pouvoir capturer des notifications et d'enregistrer l'état d'un travail sur le stockage (par exemple, Amazon S3, Amazon EFS ou Amazon FSx), conserver les fichiers journaux de l'instance (ou les diffuser en continu pour une approche plus tolérante aux pannes), drainer les connexions à partir d'un équilibreur de charge, etc.

Certains services AWS et tiers gèrent déjà les interruptions d'instances Spot afin de réduire l'impact sur votre application. Par exemple, Amazon EKS exécutant des groupes de nœuds gérés avec des instances Spot lance automatiquement des nœuds Kubernetes de remplacement lorsqu'une recommandation de rééquilibrage ou des avis d'interruption sont envoyés pour un nœud existant.