Skip to content

Home

Resumen del dashboardSQL Server + Windows

Descripción de la página

Esta página actúa como resumen operativo del entorno monitorizado y concentra en una sola vista el estado básico de Windows, el estado principal de SQL Server y las alertas activas. Sirve para detectar con rapidez servidores que requieren atención antes de entrar en dashboards de detalle.

La vista combina indicadores sencillos pero muy útiles para una primera revisión: uso medio de CPU, porcentaje mínimo de espacio libre en disco, bloqueos activos, trabajos fallidos, estado de actualización de SQL Server, permanencia de páginas en memoria, uso del log de transacciones y volumen medio de entrada y salida contra almacenamiento.

También funciona como punto de navegación. Cuando un valor requiere análisis, el propio dashboard dirige al panel específico correspondiente para profundizar en contadores de Windows, proceso bloqueador, trabajos fallidos, versión de SQL Server o contadores internos de la instancia.

Variables

VariableDescripción
$InstancePermite seleccionar la instancia de SQL Server que se muestra en la sección de estado SQL. Sus valores corresponden a las instancias configuradas en el dashboard.
$hostnamePermite seleccionar el servidor Windows que se muestra en la sección de estado de Windows. Sus valores corresponden a los hosts monitorizados disponibles en el dashboard.
Rango de tiempoDefine el intervalo temporal aplicado a las métricas históricas y a los cálculos recientes del dashboard. Afecta especialmente a CPU media, trabajos fallidos, PLE y actividad de E/S.

Alerts

Esta sección reúne las alertas activas visibles en Grafana para dar prioridad inmediata a incidencias ya evaluadas por las reglas de monitorización. Es el punto más rápido para saber si existe un problema que ya ha superado un umbral operativo.

Active Alerts

  • Descripción: Lista las alertas en estados de error, disparada o pendiente para facilitar una revisión rápida al inicio del turno o ante una incidencia en curso.
  • Tipo de panel: alertlist

Recomendación práctica: Revisa primero las alertas en estado firing o error, porque ya representan condiciones detectadas por las reglas de monitorización y pueden ahorrar tiempo antes de analizar el resto del dashboard.

Windows Status

Esta sección resume el estado del sistema operativo por host y destaca los dos síntomas más habituales de presión de infraestructura: saturación sostenida de CPU y falta de espacio libre en disco. Su objetivo es señalar qué servidor necesita una revisión inmediata del lado Windows.

Estado de host ($hostname)

  • Descripción: Muestra, para cada host seleccionado, el uso medio de CPU de los últimos cinco minutos y el porcentaje libre del disco con menos espacio disponible. El panel se repite por servidor para ofrecer una comprobación rápida de salud del sistema operativo.
  • Tipo de panel: stat
  • Unidades: Porcentaje

Colores por valor:

ValorColorDescripción
Avg CPU entre 0 % y 80 %Uso medio de CPU dentro del rango esperado
Avg CPU > 80 %Carga de CPU elevada en los últimos cinco minutos
Min Disk % entre 20 % y 100 %El disco más comprometido mantiene espacio libre suficiente
Min Disk % < 20 %Alguna unidad tiene poco margen operativo

Recomendación práctica: Si la CPU se mantiene alta o el espacio libre baja del 20 %, entra en Windows Counters para confirmar si el problema viene de un proceso puntual, paginación, crecimiento de archivos o falta real de capacidad en disco.

SQL Server Status

Esta sección concentra un chequeo funcional de cada instancia SQL Server y mezcla estado de concurrencia, automatización, versión, memoria, log e I/O. Está pensada para priorizar si el problema principal está en bloqueos, mantenimiento fallido, presión de memoria, crecimiento del log o cuello de botella de almacenamiento.

Estado de instancia ($Instance)

  • Descripción: Muestra por instancia el número de bloqueos activos, los trabajos fallidos detectados en el periodo, el estado de actualización de SQL Server, el valor de Page Life Expectancy, el espacio usado por el log y la actividad media de entrada y salida. El panel se repite por instancia para facilitar una lectura comparativa rápida.
  • Tipo de panel: stat
  • Unidades: Mixtas: recuento, estado, segundos, capacidad de log y bytes por segundo

Colores por valor:

ValorColorDescripción
Blocks = 0No hay sesiones bloqueadas activas
Blocks > 0Existen bloqueos que pueden degradar la concurrencia
Failed Jobs = 0Los trabajos revisados terminaron sin error en el rango analizado
Failed Jobs > 0Hay trabajos fallidos que requieren revisar historial y pasos
SQL Version: UpdatedLa versión se considera actualizada según la referencia del dashboard
SQL Version: To CheckConviene revisar si faltan parches o actualización de rama
PLE > 3000 sLa caché de datos muestra una permanencia saludable
PLE <= 3000 sPuede existir presión de memoria o más lecturas desde disco
Log Used hasta 15 GBUso del log dentro de un margen razonable
Log Used > 15 GBEl log está creciendo y puede necesitar truncado o más espacio
AVG IO bytes/s hasta 2 MB/sLa actividad media de almacenamiento encaja con la línea base esperada
AVG IO bytes/s > 2 MB/sLa instancia muestra una carga de E/S elevada o un posible cuello de botella

Recomendación práctica: Si ves bloqueos, busca primero la sesión cabecera y reduce la duración de las transacciones; si fallan jobs, valida que SQL Server Agent siga operativo; si sube el uso del log, revisa truncado y crecimiento; y si el I/O o el PLE salen de rango, confirma si el problema es memoria, consultas costosas o almacenamiento lento.