diff --git a/docs/backlog.md b/docs/backlog.md index 3be3af2..7870963 100644 --- a/docs/backlog.md +++ b/docs/backlog.md @@ -37,6 +37,9 @@ historia incydentów, out-of-band watchdog. PENDING zamknięty 2026-07-02: poll POTWIERDZONY reconem (obraz zbudowany po `62d6fc0`, `PROMETHEUS_URL` w `.env` i w env kontenera, zero poll failed) — patrz `docs/infra/inventory-verify-2026-07-02.md`. + ✅ END-TO-END UDOWODNIONE 2026-07-06 (Etap 0 cutoveru): tor Prometheus → + watchdog → Telegram potwierdzony w produkcji testem `AlertTestEtap0` + (firing → log polla → Telegram → rollback) — patrz `docs/sessions/2026-07-06.md`. 6. Rotacja tokenu HAOS w domowym prom (plaintext). 7. Przepięcie observer / panel `agents.okit.pl` na Prometheus jako źródło — największy znak zapytania przy cutoverze. @@ -46,6 +49,30 @@ historia incydentów, out-of-band watchdog. ## Aktywne +### Ghosty B WRÓCIŁY — hash-prefixed control-plane na VPS nieposprzątane + +**Data**: 2026-07-06 +**Źródło**: sesja 2026-07-06 (`docs/sessions/2026-07-06.md`) — snapshot panelu agents.okit.pl +**Problem**: hash-prefixed kontenery control-plane znów widoczne na VPS — +wpis „ZNIKNĘŁY (potwierdzone reconem 2026-07-02)" w Zamkniętych zdezaktualizowany. +**Fix**: ręczny `docker rm` hash-prefixed kontenerów control-plane na VPS; +przy okazji sprawdzić, skąd wróciły (fix A `3b71707` miał blokować źródło divergence). + +--- + +### elasticsearch + diskover w stanie error na PIHA — observer zna usunięte serwisy + +**Data**: 2026-07-06 +**Źródło**: sesja 2026-07-06 (`docs/sessions/2026-07-06.md`) — snapshot panelu agents.okit.pl +**Problem**: elasticsearch i diskover usunięte z PIHA w module 0 (2026-07-02), +ale observer wciąż je zna i raportuje `error` w panelu. World-state nie zapomina +serwisów, które przestały istnieć — ta sama klasa błędu co „NOMINAL przed +istnieniem" (patrz wpis z 2026-06-25). +**Fix**: wyczyścić martwe wpisy z world_state / dodać wygaszanie serwisów +nieobecnych w desired state i w dockerze. + +--- + ### Gotchas (z 2026-06-30 — migracja kapala.org → Cloudflare/wildcard) **Data**: 2026-06-30 @@ -283,6 +310,9 @@ Długoterminowo: `agent.sh new` powinien odmawiać jeśli żądana gałąź jest ### Ghost kontenery w panelu (Problem B) — ZNIKNĘŁY (potwierdzone reconem 2026-07-02) +> ⚠️ ZDEZAKTUALIZOWANE 2026-07-06: ghosty znów widoczne na VPS — patrz wpis +> „Ghosty B WRÓCIŁY" w Aktywnych (`docs/sessions/2026-07-06.md`). + **Data**: 2026-06-24 (wykryte), 2026-07-02 (zamknięte) **Źródło**: sesje 2026-06-24/25/26; recon `docs/infra/inventory-verify-2026-07-02.md` **Było**: martwe kontenery ze starych project-name'ów @@ -304,7 +334,9 @@ aktywny; diagnoza opierała się na `.env` i braku błędów. **Zamknięte**: recon potwierdził — obraz zbudowany po `62d6fc0`, `PROMETHEUS_URL` w `.env` I w env kontenera, zero `poll failed` w logach. Poll aktywny. Jednolinijkowy log startowy (`polling enabled/disabled`) pozostaje opcjonalną -kosmetyką; pełne end-to-end (firing → Telegram) potwierdzi pierwsza realna awaria. +kosmetyką. ✅ Pełne end-to-end (firing → Telegram) POTWIERDZONE 2026-07-06 +testem `AlertTestEtap0` (Etap 0 cutoveru, `docs/sessions/2026-07-06.md`) — +bez czekania na realną awarię. ---