Home
Descripción de la página
Esta página actúa como resumen operativo del entorno monitorizado y concentra en una sola vista el estado básico de Windows, el estado principal de SQL Server y las alertas activas. Sirve para detectar con rapidez servidores que requieren atención antes de entrar en dashboards de detalle.
La vista combina indicadores sencillos pero muy útiles para una primera revisión: uso medio de CPU, porcentaje mínimo de espacio libre en disco, bloqueos activos, trabajos fallidos, estado de actualización de SQL Server, permanencia de páginas en memoria, uso del log de transacciones y volumen medio de entrada y salida contra almacenamiento.
También funciona como punto de navegación. Cuando un valor requiere análisis, el propio dashboard dirige al panel específico correspondiente para profundizar en contadores de Windows, proceso bloqueador, trabajos fallidos, versión de SQL Server o contadores internos de la instancia.
Variables
| Variable | Descripción |
|---|---|
$Instance | Permite seleccionar la instancia de SQL Server que se muestra en la sección de estado SQL. Sus valores corresponden a las instancias configuradas en el dashboard. |
$hostname | Permite seleccionar el servidor Windows que se muestra en la sección de estado de Windows. Sus valores corresponden a los hosts monitorizados disponibles en el dashboard. |
Rango de tiempo | Define el intervalo temporal aplicado a las métricas históricas y a los cálculos recientes del dashboard. Afecta especialmente a CPU media, trabajos fallidos, PLE y actividad de E/S. |
Alerts
Esta sección reúne las alertas activas visibles en Grafana para dar prioridad inmediata a incidencias ya evaluadas por las reglas de monitorización. Es el punto más rápido para saber si existe un problema que ya ha superado un umbral operativo.
Active Alerts
- Descripción: Lista las alertas en estados de error, disparada o pendiente para facilitar una revisión rápida al inicio del turno o ante una incidencia en curso.
- Tipo de panel: alertlist
Recomendación práctica: Revisa primero las alertas en estado firing o error, porque ya representan condiciones detectadas por las reglas de monitorización y pueden ahorrar tiempo antes de analizar el resto del dashboard.
Windows Status
Esta sección resume el estado del sistema operativo por host y destaca los dos síntomas más habituales de presión de infraestructura: saturación sostenida de CPU y falta de espacio libre en disco. Su objetivo es señalar qué servidor necesita una revisión inmediata del lado Windows.
Estado de host ($hostname)
- Descripción: Muestra, para cada host seleccionado, el uso medio de CPU de los últimos cinco minutos y el porcentaje libre del disco con menos espacio disponible. El panel se repite por servidor para ofrecer una comprobación rápida de salud del sistema operativo.
- Tipo de panel: stat
- Unidades: Porcentaje
Colores por valor:
| Valor | Color | Descripción |
|---|---|---|
Avg CPU entre 0 % y 80 % | Uso medio de CPU dentro del rango esperado | |
Avg CPU > 80 % | Carga de CPU elevada en los últimos cinco minutos | |
Min Disk % entre 20 % y 100 % | El disco más comprometido mantiene espacio libre suficiente | |
Min Disk % < 20 % | Alguna unidad tiene poco margen operativo |
Recomendación práctica: Si la CPU se mantiene alta o el espacio libre baja del 20 %, entra en Windows Counters para confirmar si el problema viene de un proceso puntual, paginación, crecimiento de archivos o falta real de capacidad en disco.
SQL Server Status
Esta sección concentra un chequeo funcional de cada instancia SQL Server y mezcla estado de concurrencia, automatización, versión, memoria, log e I/O. Está pensada para priorizar si el problema principal está en bloqueos, mantenimiento fallido, presión de memoria, crecimiento del log o cuello de botella de almacenamiento.
Estado de instancia ($Instance)
- Descripción: Muestra por instancia el número de bloqueos activos, los trabajos fallidos detectados en el periodo, el estado de actualización de SQL Server, el valor de Page Life Expectancy, el espacio usado por el log y la actividad media de entrada y salida. El panel se repite por instancia para facilitar una lectura comparativa rápida.
- Tipo de panel: stat
- Unidades: Mixtas: recuento, estado, segundos, capacidad de log y bytes por segundo
Colores por valor:
| Valor | Color | Descripción |
|---|---|---|
Blocks = 0 | No hay sesiones bloqueadas activas | |
Blocks > 0 | Existen bloqueos que pueden degradar la concurrencia | |
Failed Jobs = 0 | Los trabajos revisados terminaron sin error en el rango analizado | |
Failed Jobs > 0 | Hay trabajos fallidos que requieren revisar historial y pasos | |
SQL Version: Updated | La versión se considera actualizada según la referencia del dashboard | |
SQL Version: To Check | Conviene revisar si faltan parches o actualización de rama | |
PLE > 3000 s | La caché de datos muestra una permanencia saludable | |
PLE <= 3000 s | Puede existir presión de memoria o más lecturas desde disco | |
Log Used hasta 15 GB | Uso del log dentro de un margen razonable | |
Log Used > 15 GB | El log está creciendo y puede necesitar truncado o más espacio | |
AVG IO bytes/s hasta 2 MB/s | La actividad media de almacenamiento encaja con la línea base esperada | |
AVG IO bytes/s > 2 MB/s | La instancia muestra una carga de E/S elevada o un posible cuello de botella |
Recomendación práctica: Si ves bloqueos, busca primero la sesión cabecera y reduce la duración de las transacciones; si fallan jobs, valida que SQL Server Agent siga operativo; si sube el uso del log, revisa truncado y crecimiento; y si el I/O o el PLE salen de rango, confirma si el problema es memoria, consultas costosas o almacenamiento lento.
