Saltar a contenido

Grafana · Tus métricas en tus propios paneles

Nimbox SRE expone tus métricas como una fuente de datos compatible con Prometheus. Conectas tu Grafana, escribes las consultas que quieras y montas los paneles que necesites, sin pedirnos nada.

Sólo verás tus datos. Cada consulta se acota a tu empresa antes de ejecutarse, escribas lo que escribas.

Lo más rápido: los paneles incluidos

En la consola, entra en Agente y pulsa Abrir mis paneles. Se abre con tu misma sesión —sin otra contraseña— y te encuentras tres cuadros ya montados sobre tus datos:

  • Infraestructura: hosts en pie, caídos, sin reportar y en mantenimiento; CPU, memoria y disco; y el estado de tus agentes.
  • Servicios e incidencias: qué está caído ahora, cuántos servicios cayeron a la vez y las incidencias por gravedad.
  • Servicio y compromisos: si se está cumpliendo lo prometido — respuesta y resolución dentro de plazo.

Está incluido y no hay que instalar nada. Puedes editarlos y crear los tuyos.

El resto de esta página es para quien prefiera conectar su propio Grafana.

1. Obtener la credencial

En la consola, entra en Agente y baja hasta Tus métricas en tu propio Grafana. Pulsa Emitir credencial y ponle un nombre que te diga para qué es —por ejemplo, «Grafana de operaciones».

Se enseña una vez

La credencial aparece una sola vez, al emitirla. No la guardamos de forma recuperable: si la pierdes, emite otra y revoca la anterior. Empieza por mx_.

Puedes tener varias a la vez, una por herramienta, y revocar cualquiera por separado. Una credencial revocada deja de funcionar en el acto.

2. Añadir la fuente de datos en Grafana

En Grafana ve a Connections → Data sources → Add new data source y elige Prometheus.

Campo Valor
Prometheus server URL https://app.nimboxsre.com/api/prom
Authentication (ninguna: se usa una cabecera)
Custom HTTP Headers Authorization = Bearer TU_CREDENCIAL

Pulsa Save & test. Si todo está bien, Grafana confirma que la fuente responde.

Si falla

Un 401 significa que la credencial no viaja o no es válida — revisa que la cabecera diga Bearer con un espacio antes del valor. Un error de red suele ser un https:// olvidado en la URL.

3. Consultar

Son métricas de Prometheus normales. Admiten rate(), sum by (host), avg_over_time() y todo lo demás.

Qué quieres ver Consulta
Hosts arriba monit_host_up
CPU por host monit_cpu_percent
Memoria usada, en porcentaje monit_mem_percent
Disco por punto de montaje monit_disk_percent
Servicios caídos monit_service_up == 0
Incidencias activas por severidad monit_incident_count
Incidencias resueltas por el agente monit_sre_resolved_total
Respuesta dentro de compromiso monit_sre_response_sla_percent

Algunos ejemplos con más recorrido:

# Los cinco hosts con más CPU ahora mismo
topk(5, monit_cpu_percent)

# Media de memoria de la última hora, por host
avg_over_time(monit_mem_percent[1h])

# Discos por encima del 85 %
monit_disk_percent > 85

# Cuántos hosts están caídos
count(monit_host_up == 0)

No hace falta filtrar por empresa

No añadas tenant="..." a tus consultas: ya se hace por ti. Si nombras otra empresa, la consulta se rechaza con un error de conflicto en vez de devolver datos vacíos, para que quede claro qué ha pasado.

Qué puede hacer la credencial

Sólo leer, y sólo tus series. No permite escribir métricas, ni borrar nada, ni ver la configuración de tu cuenta. Si se filtra, quien la tenga puede ver tus gráficas: revócala desde la misma pantalla y emite otra.

Retención

Cuánto historial hay disponible depende de tu contrato. El nivel incluido conserva 30 días; hay niveles de 12 y 24 meses.

Desde la activación

Al ampliar la retención, el archivo empieza a acumularse desde ese momento. No se recupera hacia atrás lo que ya estaba fuera del periodo anterior.