Skip to main content

Monitorització

La secció Monitoring té una pàgina per a cada eina: Prometheus (les mètriques), Grafana (dashboards i alertes) i Nagios (si les màquines i els seus serveis estan en marxa). Tothom les pot llegir; els operadors modifiquen el que Horizon guarda.

Cap pàgina no escriu al servidor fins que es prem Apply configuration. Mentrestant, el menú lateral mostra en vermell el nombre de canvis pendents de cadascuna.

Les tres són independents i cadascuna s'activa en registrar el seu servidor a Admin. Fins aleshores, la pàgina indica que està desactivada i per què.

Prometheus​

  • Scrape jobs propis: màquines que Horizon no ha desplegat però que publiquen mètriques, cadascuna amb les seves etiquetes. S'afegeixen amb un assistent.
  • Targets dels stacks: arriben sols. Una plantilla marca quines sortides són URLs de mètriques i, en desplegar l'stack, apareixen aquí amb les seves etiquetes (entorn inclòs). Són de només lectura: es canvien canviant l'stack.
  • Not configured yet: sortides que haurien de ser targets però no poden (per exemple, un valor que no és una URL).
  • Configuration: el que conté el servidor, llegit directament de la màquina.

Apply configuration escriu els fitxers d'Horizon a la carpeta que vigila Prometheus, comprova que es poden llegir i restaura l'anterior si alguna cosa falla. No es reinicia res: Prometheus els recull sol en menys d'un minut.

Grafana​

  • Dashboards i Alert rules: documents JSON que els operadors afegeixen, editen, desactiven i esborren. Només es llisten els d'Horizon, desats a la carpeta Horizon de Grafana; mai el que algú hagi creat a mà.
  • Configuration: els fitxers que Horizon gestiona al host i quins han canviat o falten.

Els ajustos del mateix Grafana (contrasenya d'administrador, inici de sessió amb Keycloak, notificacions i punts de contacte) es configuren a la seva fitxa d'Admin.

Nagios​

La pàgina mostra l'enllaç a la web de Nagios i:

  • Checks manuals: un PING de qualsevol adreça amb nom, sota un dels host groups del servidor. Útil per vigilar equips que no són de cap stack.
  • Stack hosts: cada màquina que publica un stack desplegat, agrupada per stack, amb els seus checks. Sota cada stack es llista el que no s'ha pogut publicar i per què (una màquina sense nom DNS, un host group que no existeix, ...).
  • Configuration: cada fitxer que el servidor no té tal com Horizon l'escriuria ara, i per què.

Apply configuration escriu els checks manuals i els de tots els stacks als fitxers d'Horizon (horizon-checks.cfg i un horizon-vm-<host>.cfg per VM), els valida amb nagios -v i reinicia Nagios. Si la validació o el reinici fallen, es restauren tots els fitxers anteriors.

info

Els stacks publiquen les seves màquines sols en desplegar-se i les treuen en eliminar-se; l'Apply manual només cal per als checks manuals o per tornar a sincronitzar després d'una fallada.