Monitoreo
Tenemos dos herramientas de monitoreo complementarias, ambas corriendo en LXC dentro de Proxmox:
| Herramienta | Para qué | Acceso |
|---|---|---|
| SigNoz | Observabilidad: métricas, logs y trazas de cada servidor (mira desde adentro) | signoz.histrix.com.ar |
| Uptime Kuma | Disponibilidad: chequea por HTTP que los sitios de clientes estén levantados (mira desde afuera) | kuma.histrix.com.ar → ver Uptime Kuma |
El resto de esta página describe SigNoz.
Usamos SigNoz como plataforma de observabilidad open-source para monitorear todos los servidores de clientes. Centraliza métricas, logs y trazas en una sola UI.
Acceso rápido
UI: https://signoz.histrix.com.ar · Scripts del agente: repositorio signoz-agent (ver Agentes).
Arquitectura general
graph LR
subgraph ZeroTier ["ZeroTier — red Infra-mesh (privada)"]
direction LR
subgraph Remoto1 ["Servidor remoto 1"]
NE1[node_exporter]
OA1[otelcol-contrib]
end
subgraph Remoto2 ["Servidor remoto 2..N"]
NE2[node_exporter]
OA2[otelcol-contrib]
end
subgraph Central ["Central — LXC Proxmox (systemd)"]
OC[signoz-otel-collector :4317]
CH[ClickHouse]
SZ[signoz :8080]
ZK[Zookeeper]
end
end
NE1 -->|:9100| OA1
NE2 -->|:9100| OA2
OA1 -->|OTLP gRPC :4317| OC
OA2 -->|OTLP gRPC :4317| OC
OC --> CH
ZK --> CH
CH --> SZ
Todo el tráfico entre agentes y central viaja dentro de la red ZeroTier Infra-mesh (con flow rules propias) — nunca por internet público.
Componentes
| Componente | Dónde corre | Para qué |
|---|---|---|
| Zookeeper | Central (LXC Proxmox) | Coordinación del cluster ClickHouse |
| ClickHouse | Central (LXC Proxmox) | Almacenamiento de métricas, logs y trazas |
| signoz-otel-collector | Central (LXC Proxmox) | Recibe OTLP de los agentes, escribe en ClickHouse |
| signoz | Central (LXC Proxmox) | Backend API + UI web en :8080 |
| otelcol-contrib | Cada servidor remoto, systemd | Recolecta y envía métricas + logs |
| node_exporter | Cada servidor remoto, systemd | Expone métricas del host vía Prometheus |
Todo corre como servicios systemd nativos — sin Docker. El central es un LXC de Debian en Proxmox (montado con el helper-script de community-scripts); los agentes son binarios en cada servidor remoto.
Qué se recolecta
Métricas del host (automático en todos los agentes):
- CPU por core, load average
- RAM y swap
- Disco: uso, I/O, latencia
- Red: bytes, paquetes, errores
- Procesos: cantidad y estados
Logs (según lo que exista en el servidor):
/var/log/syslog,/var/log/messages/var/log/auth.log,/var/log/secure- journald (ssh, cron, docker, nginx, mysql, etc.)
- Logs de todos los containers Docker del host
Servicios adicionales (con scripts add-on):
- MySQL, PostgreSQL, Redis, Nginx, PHP-FPM, Docker, Traefik
Datos retenidos
ClickHouse guarda 74 días de métricas y logs.
Secciones de esta documentación
- Servidor Central — cómo instalar y mantener el stack SigNoz
- Agentes — cómo instalar el agente en un servidor remoto
- Addons — agregar MySQL, PostgreSQL, Redis, Nginx, etc.
- Dashboards y Alertas — qué ver en la UI y cómo crear alertas
- Mantenimiento — actualizaciones, disco, troubleshooting
- Seguridad — ZeroTier, firewall, bindings
- Uptime Kuma — monitoreo de disponibilidad de sitios cliente por HTTP