View a markdown version of this page

Résolution des problèmes liés à l'expiration du délai de mise à jour du cluster lorsque cfn-hup n'est pas en cours d'exécution - AWS ParallelCluster

Les traductions sont fournies par des outils de traduction automatique. En cas de conflit entre le contenu d'une traduction et celui de la version originale en anglais, la version anglaise prévaudra.

Résolution des problèmes liés à l'expiration du délai de mise à jour du cluster lorsque cfn-hup n'est pas en cours d'exécution

Le script d’assistance cfn-hup est un démon qui détecte les modifications des métadonnées de ressources et exécute les actions définies par l’utilisateur lorsqu’un changement est détecté. C'est ainsi que vous effectuez des mises à jour de configuration sur vos instances Amazon EC2 en cours d'exécution via l'action de l'UpdateStackAPI.

Actuellement, le cfn-hup démon est lancé par lesupervisord. Mais après le lancement, le cfn-hup processus est détaché du supervisord contrôle. Si le cfn-hup démon est tué par un acteur externe, il ne redémarre pas automatiquement. Si elle cfn-hup n'est pas en cours d'exécution, lors d'une mise à jour du cluster, la CloudFormation pile lance le processus de mise à jour comme prévu, mais la procédure de mise à jour n'est pas activée sur le nœud principal et la pile finit par entrer en temporisation. Dans les journaux du cluster/var/log/chef-client, vous pouvez voir que la recette de mise à jour n'est jamais invoquée.

Vérifiez et redémarrez cfn-hup en cas de panne

  1. Sur le nœud principal, vérifiez s'il cfn-hup est en cours d'exécution :

    $ ps aux | grep cfn-hup
  2. Vérifiez le cfn-hup journal /var/log/cfn-hup.log et /var/log/supervisord.log le nœud principal.

  3. S'il cfn-hup ne fonctionne pas, essayez de le redémarrer en exécutant :

    $ sudo /opt/parallelcluster/pyenv/versions/cookbook_virtualenv/bin/supervisorctl start cfn-hup