Sobre el proyecto

DumbMonit es una plataforma de monitoreo en desarrollo activo y en progreso, posicionada como una alternativa más simple a herramientas pesadas como Zabbix, Checkmk o configuraciones combinadas de Prometheus/Grafana/Alertmanager, dirigida a usuarios que gestionan alrededor de 10 máquinas, switches de red y servicios autoalojados. Sus prioridades de diseño principales son la lectura rápida del estado, la incorporación simplificada de dispositivos y el ruido mínimo de alertas. Las capacidades clave incluyen: - Amplio soporte de fuentes de datos listo para usar: SNMP v1/v2c/v3 para switches, routers, NAS, UPS e impresoras con perfiles MIB aplicados automáticamente detectados mediante el sysObjectID del dispositivo; integraciones nativas para Proxmox VE, Proxmox Backup Server, Proxmox Datacenter Manager, Proxmox Mail Gateway, firewalls OPNsense, hardware de servidor compatible con Redfish (Supermicro, iDRAC, iLO, etc.), servidores de correo MDaemon y aplicaciones autoalojadas comunes (Nextcloud, Immich, Paperless-ngx, Jellyfin, Plex, TrueNAS, Synology DSM). Agentes multiplataforma para Linux, macOS, FreeBSD y Windows recopilan métricas de CPU, memoria, disco, servicios, temperatura, salud SMART y pools ZFS, con scripts de instalación de una línea que registran el agente con el gestor de servicios del host. El monitoreo de contenedores Docker está disponible a través del agente, junto con monitores de servicios para HTTP, TCP, DNS, ping y verificación de certificados TLS, monitores de sesión a nivel de aplicación para SMTP, PostgreSQL, MySQL/MariaDB, MQTT y WebSocket, monitores de latido compatibles con push (dead man's switch) y descubrimiento de red CIDR para incorporación masiva de dispositivos. - Alertas de bajo ruido: Las reglas predeterminadas preconstruidas cubren problemas comunes, incluidos dispositivos inalcanzables, CPU saturada, discos casi llenos, UPS funcionando con batería, copias de seguridad obsoletas y certificados por vencer. Las características incluyen supresión de alertas basada en dependencias (las caídas de dispositivos principales suprimen las alertas de descendientes), agrupación y deduplicación de alertas basadas en host, períodos de silencio configurables para reconocimiento de alertas, ventanas de mantenimiento programadas, políticas de notificación con histéresis, tiempos de espera por canal y horas de silencio, detección de anomalías de línea base estacional que aprende patrones de red sin ajuste manual de umbrales, pronósticos predictivos de llenado de disco y almacén de datos, y soporte para 22 canales de notificación, incluidos Discord, Slack, Microsoft Teams, Telegram, correo electrónico, webhooks personalizados, PagerDuty y Home Assistant. - Características de interfaz y operativas: Temas claro y oscuro, modo pared de pantalla completa para pantallas de sala, navegación por paleta de comandos, vistas optimizadas para móviles para verificación de estado y silenciamiento de alertas, páginas de estado públicas con marca e historial de disponibilidad de 90 días, seguimiento de incidentes y suscripciones por correo electrónico/RSS. Los controles de acceso incluyen roles de administrador/visor, autenticación de dos factores TOTP opcional, soporte OIDC/SSO con mapeo de grupo a rol y registro de auditoría. La plataforma expone tokens de API REST con alcance, un servidor MCP integrado para integración con asistentes de IA, endpoints de métricas compatibles con Prometheus para pilas de monitoreo existentes y funcionalidad de copia de seguridad y restauración de configuración cifrada. El despliegue se ejecuta como un solo contenedor, con VictoriaMetrics integrado para almacenamiento de series temporales y SQLite para configuración y estado, sin requerir servicios de base de datos separados. Se pueden desplegar agentes de retransmisión opcionales en sitios remotos para ejecutar sondas a través de redes sin requerir acceso VPN entrante. Como versión alfa, la plataforma se usa a diario en el homelab del autor, pero se esperan asperezas, cambios importantes y ninguna ruta de actualización garantizada entre cambios de esquema de base de datos; algunas integraciones solo se han probado con dispositivos simulados en lugar de hardware real.