Todos los servicios › fleet-telemetry
107903 Prometheus no puede guardar lo que mide
observador_sin_poder_escribir
El servicio tiene este código declarado, pero todavía no lo emite.
Clase común a toda la flota (familia «dependencia»): Dependencia degradada. El fallo está en algo de lo que depende fleet-telemetry, no en la petición.
Qué ha pasado
El scrape tiene ÉXITO y el commit falla, así que up sigue en 1 y nada parece roto mientras se pierden muestras. Causas vistas: disco lleno en el nodo y corrupción del WAL que impide compactar y truncar.
Cómo se soluciona
Mirar docker logs fleet-prometheus | grep -iE "compaction|commit failed". Si dice corruption in segment, se repara REINICIANDO Prometheus: al arrancar descarta el segmento dañado. Si dice no space left, liberar disco en el nodo.
Qué hacer mientras tanto
Los datos de esa ventana no se recuperan. Anotar el hueco en cualquier acta que se apoye en ese tramo, en vez de presentarlo como continuo.
Ya costó tiempo
El WAL llevaba corrupto desde el 23-jun-2026 —más de dos meses— fallando la compactación cada dos horas sin que ninguna regla lo mirara: el sistema que vigila a la flota era el único sin vigilante. Y el 25-ago, con el disco lleno, se perdieron ~6 muestras con up en 1 todo el tiempo.
Dónde se lanza
central/prometheus/rules.yml — PrometheusCompactacionFallida, PrometheusPerdiendoMuestras
Cómo se lee el código
1- origen: Fortiseg
07- servicio: fleet-telemetry
903- clase común a toda la flota: Dependencia degradada