Saltar al contenido principal

Monitorización

La sección Monitoring tiene una página por cada herramienta: Prometheus (las métricas), Grafana (dashboards y alertas) y Nagios (si las máquinas y sus servicios están en marcha). Todos pueden leerlas; los operadores modifican lo que Horizon guarda.

Ninguna página escribe en el servidor hasta que se pulsa Apply configuration. Mientras tanto, el menú lateral muestra en rojo el número de cambios pendientes de cada una.

Las tres son independientes y cada una se activa al registrar su servidor en Admin. Hasta entonces, la página indica que está desactivada y por qué.

Prometheus​

  • Scrape jobs propios: máquinas que Horizon no ha desplegado pero que publican métricas, cada una con sus etiquetas. Se añaden con un asistente.
  • Targets de los stacks: llegan solos. Una plantilla marca qué salidas son URLs de métricas y, al desplegar el stack, aparecen aquí con sus etiquetas (entorno incluido). Son de solo lectura: se cambian cambiando el stack.
  • Not configured yet: salidas que deberían ser targets pero no pueden (por ejemplo, un valor que no es una URL).
  • Configuration: lo que contiene el servidor, leído directamente de la máquina.

Apply configuration escribe los ficheros de Horizon en la carpeta que vigila Prometheus, comprueba que se pueden leer y restaura lo anterior si algo falla. No se reinicia nada: Prometheus los recoge solo en menos de un minuto.

Grafana​

  • Dashboards y Alert rules: documentos JSON que los operadores añaden, editan, desactivan y borran. Solo se listan los de Horizon, guardados en la carpeta Horizon de Grafana; nunca lo que alguien haya creado a mano.
  • Configuration: los ficheros que Horizon gestiona en el host y cuáles han cambiado o faltan.

Los ajustes del propio Grafana (contraseña de administrador, inicio de sesión con Keycloak, notificaciones y puntos de contacto) se configuran en su ficha de Admin.

Nagios​

La página muestra el enlace a la web de Nagios y:

  • Checks manuales: un PING de cualquier dirección con nombre, bajo uno de los host groups del servidor. Útil para vigilar equipos que no son de ningún stack.
  • Stack hosts: cada máquina que publica un stack desplegado, agrupada por stack, con sus checks. Debajo de cada stack se lista lo que no se ha podido publicar y por qué (una máquina sin nombre DNS, un host group que no existe, ...).
  • Configuration: cada fichero que el servidor no tiene tal como Horizon lo escribiría ahora, y por qué.

Apply configuration escribe los checks manuales y los de todos los stacks en los ficheros de Horizon (horizon-checks.cfg y un horizon-vm-<host>.cfg por VM), los valida con nagios -v y reinicia Nagios. Si la validación o el reinicio fallan, se restauran todos los ficheros anteriores.

información

Los stacks publican sus máquinas solos al desplegarse y las quitan al eliminarse; el Apply manual solo hace falta para los checks manuales o para resincronizar tras un fallo.