♥ 3
⚡ 0
Nomad en Producción · Lección 28

¿Qué tipo de métricas es especialmente relevante monitorear con Prometheus en una instalación de Nomad en producción, más allá de solo confirmar que el servicio está técnicamente en línea?

Métricas sobre el estado de los jobs (cuántos están corriendo correctamente vs fallando), la utilización de recursos de los nodos client, el estado del consenso entre los servers, y la latencia de las decisiones de scheduling, dando visibilidad real del comportamiento operativo del cluster completo
Solo es relevante monitorear si el binario de Nomad está técnicamente instalado en el servidor, sin ninguna necesidad real de monitorear métricas adicionales de comportamiento operativo
Nomad no expone absolutamente ninguna métrica real compatible con Prometheus, haciendo imposible monitorear su comportamiento mediante esa herramienta específica
Solo es relevante monitorear estas métricas si el cluster tiene exactamente un único job en total ejecutándose, sin ninguna necesidad real de visibilidad sobre más jobs
Nomad en Producción · Lección 28

Completa el código

Las métricas dan visibilidad real del comportamiento operativo del cluster
Nomad en Producción · Lección 28

¿Por qué monitorear específicamente cuántos jobs están fallando (no solo si el servicio de Nomad está técnicamente en línea) revela problemas reales que una simple verificación de disponibilidad del servicio no detectaría?

✓

¡Lección completada!

Monitoreo de Nomad con Prometheus

0
XP ganado
3
Vidas restantes