Docker Swarm · Lección 10
¿Cómo repara Swarm un servicio cuando una tarea deja de funcionar?
La auto-reparación requiere un sistema externo de monitoreo que avise a Swarm por su API cada vez que detecta una caída
Si el contenedor termina o su HEALTHCHECK falla repetidamente, marca la tarea como no saludable y crea una tarea nueva para volver al número de réplicas deseado
El HEALTHCHECK reinicia el proceso dentro del mismo contenedor, sin crear una tarea nueva ni cambiar de nodo
Solo reacciona cuando el nodo entero deja de responder, de modo que un contenedor bloqueado pero todavía vivo no se reemplaza nunca
Docker Swarm · Lección 10
Completa el código
El HEALTHCHECK se define en el Dockerfile o en el archivo
Revisa: puede ir en el Dockerfile o en el archivo Compose del stack.
Docker Swarm · Lección 10
¿Por qué un contenedor puede estar en ejecución y aun así no estar atendiendo peticiones correctamente?
Pista: el proceso puede seguir vivo pero bloqueado (por un deadlock o falta de recursos) sin atender conexiones; estar en ejecución solo indica que no ha terminado, mientras que el health check comprueba si la aplicación realmente responde.
✓
¡Lección completada!
Health checks y auto-reparación
0
XP ganado
3
Vidas restantes