Saltar a contenido

Monitoreo

Tenemos dos herramientas de monitoreo complementarias, ambas corriendo en LXC dentro de Proxmox:

Herramienta Para qué Acceso
SigNoz Observabilidad: métricas, logs y trazas de cada servidor (mira desde adentro) signoz.histrix.com.ar
Uptime Kuma Disponibilidad: chequea por HTTP que los sitios de clientes estén levantados (mira desde afuera) kuma.histrix.com.ar → ver Uptime Kuma

El resto de esta página describe SigNoz.


Usamos SigNoz como plataforma de observabilidad open-source para monitorear todos los servidores de clientes. Centraliza métricas, logs y trazas en una sola UI.

Acceso rápido

UI: https://signoz.histrix.com.ar · Scripts del agente: repositorio signoz-agent (ver Agentes).

Arquitectura general

graph LR
    subgraph ZeroTier ["ZeroTier — red Infra-mesh (privada)"]
        direction LR
        subgraph Remoto1 ["Servidor remoto 1"]
            NE1[node_exporter]
            OA1[otelcol-contrib]
        end
        subgraph Remoto2 ["Servidor remoto 2..N"]
            NE2[node_exporter]
            OA2[otelcol-contrib]
        end
        subgraph Central ["Central — LXC Proxmox (systemd)"]
            OC[signoz-otel-collector :4317]
            CH[ClickHouse]
            SZ[signoz :8080]
            ZK[Zookeeper]
        end
    end

    NE1 -->|:9100| OA1
    NE2 -->|:9100| OA2
    OA1 -->|OTLP gRPC :4317| OC
    OA2 -->|OTLP gRPC :4317| OC
    OC --> CH
    ZK --> CH
    CH --> SZ

Todo el tráfico entre agentes y central viaja dentro de la red ZeroTier Infra-mesh (con flow rules propias) — nunca por internet público.

Componentes

Componente Dónde corre Para qué
Zookeeper Central (LXC Proxmox) Coordinación del cluster ClickHouse
ClickHouse Central (LXC Proxmox) Almacenamiento de métricas, logs y trazas
signoz-otel-collector Central (LXC Proxmox) Recibe OTLP de los agentes, escribe en ClickHouse
signoz Central (LXC Proxmox) Backend API + UI web en :8080
otelcol-contrib Cada servidor remoto, systemd Recolecta y envía métricas + logs
node_exporter Cada servidor remoto, systemd Expone métricas del host vía Prometheus

Todo corre como servicios systemd nativos — sin Docker. El central es un LXC de Debian en Proxmox (montado con el helper-script de community-scripts); los agentes son binarios en cada servidor remoto.

Qué se recolecta

Métricas del host (automático en todos los agentes):

  • CPU por core, load average
  • RAM y swap
  • Disco: uso, I/O, latencia
  • Red: bytes, paquetes, errores
  • Procesos: cantidad y estados

Logs (según lo que exista en el servidor):

  • /var/log/syslog, /var/log/messages
  • /var/log/auth.log, /var/log/secure
  • journald (ssh, cron, docker, nginx, mysql, etc.)
  • Logs de todos los containers Docker del host

Servicios adicionales (con scripts add-on):

  • MySQL, PostgreSQL, Redis, Nginx, PHP-FPM, Docker, Traefik

Datos retenidos

ClickHouse guarda 74 días de métricas y logs.

Secciones de esta documentación

  • Servidor Central — cómo instalar y mantener el stack SigNoz
  • Agentes — cómo instalar el agente en un servidor remoto
  • Addons — agregar MySQL, PostgreSQL, Redis, Nginx, etc.
  • Dashboards y Alertas — qué ver en la UI y cómo crear alertas
  • Mantenimiento — actualizaciones, disco, troubleshooting
  • Seguridad — ZeroTier, firewall, bindings
  • Uptime Kuma — monitoreo de disponibilidad de sitios cliente por HTTP