EDB Qué significa un código de error y qué hacer con él

Todos los servicios › fleet-telemetry

107903 Prometheus no puede guardar lo que mide

observador_sin_poder_escribir

El servicio tiene este código declarado, pero todavía no lo emite.

Clase común a toda la flota (familia «dependencia»): Dependencia degradada. El fallo está en algo de lo que depende fleet-telemetry, no en la petición.

Qué ha pasado

El scrape tiene ÉXITO y el commit falla, así que up sigue en 1 y nada parece roto mientras se pierden muestras. Causas vistas: disco lleno en el nodo y corrupción del WAL que impide compactar y truncar.

Cómo se soluciona

Mirar docker logs fleet-prometheus | grep -iE "compaction|commit failed". Si dice corruption in segment, se repara REINICIANDO Prometheus: al arrancar descarta el segmento dañado. Si dice no space left, liberar disco en el nodo.

Qué hacer mientras tanto

Los datos de esa ventana no se recuperan. Anotar el hueco en cualquier acta que se apoye en ese tramo, en vez de presentarlo como continuo.

Ya costó tiempo

El WAL llevaba corrupto desde el 23-jun-2026 —más de dos meses— fallando la compactación cada dos horas sin que ninguna regla lo mirara: el sistema que vigila a la flota era el único sin vigilante. Y el 25-ago, con el disco lleno, se perdieron ~6 muestras con up en 1 todo el tiempo.

Dónde se lanza

central/prometheus/rules.yml — PrometheusCompactacionFallida, PrometheusPerdiendoMuestras

Cómo se lee el código

1
origen: Fortiseg
07
servicio: fleet-telemetry
903
clase común a toda la flota: Dependencia degradada