El Problema: “El disco está lleno… otra vez”
En la administración de sistemas, pocas cosas son tan molestas como una caída de servicio porque un disco se llenó silenciosamente con logs o backups. La necesidad en nuestra empresa era clara: necesitábamos un sistema que nos notificara antes de llegar al 100%.
Aunque evalué scripts simples o herramientas legacy, opté por el estándar de la industria: Prometheus + Grafana.
La Arquitectura: Prometheus y Windows Exporter
Para capturar los datos, utilizamos Prometheus como base de datos de series temporales. Dado que monitoreamos servidores Windows (como se ve en mi dashboard), implementamos el windows_exporter. Este agente (servicio de windows) expone métricas del sistema operativo que Prometheus “va tanteando” periódicamente.
El Dashboard en Grafana
Grafana se conecta a Prometheus para visualizar esos datos.

Como se observa en la captura, lo que empezó como un control de disco (panel inferior “Remaining Disk Space”) nos abrió la puerta a métricas mucho más profundas:
- Disk I/O: El panel de “Maximum Disk Read/Write” nos permite ver si la lentitud del servidor es por procesamiento o por saturación de disco.
- Correlación de Recursos: Podemos ver si un aumento en el uso de RAM (Memory Usage by Host) coincide con un pico de CPU, facilitando el diagnóstico de problemas de rendimiento en las aplicaciones.
Alertas Inteligentes
La parte crítica del proyecto fue el Alert Manager. Configuré reglas específicas:
- Warning: Cuando el disco supera el 80%.
- Critical: Cuando supera el 90%.
A diferencia de revisar logs manualmente, Grafana envía estas alertas directamente a nuestros canales de comunicación (Email/Slack/Telegram), permitiéndonos actuar de inmediato.
Conclusión
Implementar Grafana y Prometheus para solucionar un problema de espacio en disco fue como ir a comprar una linterna y volver con un sistema de iluminación completo. No solo solucionamos las notificaciones, sino que ganamos una visión histórica y detallada de la salud de nuestra infraestructura.
