126 plikow (md, yaml, sh, py) odwolywalo sie do sciezek sprzed migracji.
15 markdown-linkow [..](..) -> policzona sciezka WZGLEDNA wobec pliku
odsylajacego (wczesniej czesc z nich byla repo-root-relative i nie
rozwiazywala sie z katalogu, w ktorym lezala)
200 odwolan tekstowych (backticki, proza, yaml, importy w kodzie)
-> nowa sciezka repo-root-relative, zgodnie z konwencja repo
5 linkow rodzenstwa (gole nazwy plikow, np. "](DEPLOY.md)") — dzialaly
tylko w starym katalogu; przeliczone recznie
Objete m.in.: CLAUDE.md (scripts/onboard/README.md -> kb/runbooks/
node-onboarding-tool.md, docs/backlog.md -> kb/phases/backlog.md),
README.md, .claude/skills/, 20 session logow, kod jobow.
Ostatnie 5 odwolan pochodzi z tresci wciagnietej rebasem z origin/master
(session log 2026-07-31, override node-agenta na SOLARII, dwie pozycje
backlogu) — wskazywaly na docs/incidents/, docs/kb/modules/ i
services/narty27/README.md sprzed migracji.
Dodany wzajemny link miedzy kb/services/control-plane.md (stub kodu)
a kb/subsystems/control-plane.md (opis, deprecated) — dwa dokumenty o tym
samym systemie, latwe do pomylenia.
Weryfikacja na 790 plikach: 0 odwolan do starych sciezek,
0 martwych linkow markdown. Lint OKF: 190/190 plikow ZGODNE.
Co-Authored-By: Claude Opus 5 (1M context) <noreply@anthropic.com>
3.4 KiB
3.4 KiB
| okf | type | visibility | status | updated | links |
|---|---|---|---|---|---|
| 0.1 | session-log | private | active | 2026-06-30 |
Sesja 2026-06-30 — Inwentaryzacja floty + gaszenie dysku SATURN
Cel
Pełna inwentaryzacja floty (repo↔rzeczywistość) jako fundament przed dalszą architekturą dokumentów KB. Start od weryfikacji stanu faktycznego wszystkich nodów.
Zrobione
Inwentaryzacja floty (główna robota)
- CC (Sonnet 4.6) w worktree
fleet-inventoryzebrał stan faktyczny (docker ps + free/df/nproc) z 4 dostępnych nodów: PIHA, VPS, SOLARIA, SATURN. LUSTRO+CHELSTY offline (timeout :22) -> oznaczone UNREACHABLE. - Wynik:
kb/subsystems/fleet-inventory.md— 23 zpriorytetyzowane rozjazdy. - Kluczowe ustalenia:
- forgejo biega na PIHA (always-on), ale
service.yaml owner_node=saturn— rozjazd - mosquitto biega na VPS,
service.yaml owner=piha, na PIHA go nie ma - npm — dwie instancje: PIHA (LAN ingress :80/:443) + VPS (public); repo zna jedna
- homeassistant5 na PIHA (HA "ken", :8123) niedeklarowany w repo
- control-plane biega na VPS (healthy) I SATURN (control-plane-ui UNHEALTHY)
- PIHA: 40 kontenerow, ~6 w GitOps, 33 "shadow" poza repo (immich, vaultwarden, wikijs, actual, audiobookshelf, elasticsearch, grafana, prom, portainer...)
- capabilities nieaktualne: SATURN RAM 8->14GiB, dysk 64->159GB; SOLARIA CPU 24->32
- ollama zadeklarowana (owner=solaria) ale NIE biega
- forgejo biega na PIHA (always-on), ale
Gaszenie dysku SATURN (pilne — ugaszone)
- SATURN dysk 91% (15G wolne) = jedyne realne ryzyko awarii.
docker image prune -a -f-> +4.1G (k3s/k3d sprzed 4 lat, stary HA 2.3G, postgresy)journalctl --vacuum-size=200M-> +3.7Grm syslog.1 + rotacje-> +4.2G- Wynik: 91% -> 83% (27G wolne), poza strefa ryzyka.
- Bonus diagnostyczny: przyczyna
control-plane-ui UNHEALTHY= healthcheck uzywacurl, ktorego NIE MA w obrazie -> failuje w kolko -> log spam (4.2G syslog). /opt/anaconda316G = najwiekszy pojedynczy zjadacz dysku (env-y Pythona, decyzja Oskara).
safeclean.sh — 3 bugi naprawione (repo ubuntu-scripts, osobne)
- BUG #1: dry-run pokazywal reclaimable z
docker system df(bez filtra), a apply prune'owal z--filter until=168h-> dry-run obiecywal 4.8G, apply robil 0B. Fix: dry-run pokazuje teraz realny reclaim z filtrem + tip o--docker-all. - BUG #2:
dupodwojnie liczyl eCryptfs home -> warning dodany. - BUG #3: rotated rsyslog (
syslog.14.2G) byl poza zakresem -> dodana kategoria "rotated system logs" (kasuje tylko zrotowane, nigdy aktywne). - Commit
37233f0na main (ubuntu-scripts).
Nastepna sesja — naprawa 23 rozjazdow (pogrupowana)
- Grupa A (czyste docs, zero ryzyka): capabilities SATURN/SOLARIA, forgejo
owner_node->piha, mosquitto->vps, brakujace
hosts/saturn/services.yaml - Grupa B (wymaga decyzji): npm x2 (zostawic oba czy usunac PIHA?), control-plane na SATURN (dev-instance czy usunac? + healthcheck curl fix), ollama nie biega
- Grupa C (sprzatanie): postgres:18->17, anonimowy outline-postgres image, humanai/umami do repo, audyt 33 shadow kontenerow PIHA
Watek wstrzymany (z poprzedniej sesji)
Architektura dokumentow KB — decyzje zamkniete (SSO=Forgejo-OIDC, ingress LAN-only, archiwum hybryda Nextcloud-kopia/Paperless-referencja), host OTWARTY (PIHA ~0.5G wolne RAM -> Nextcloud sie nie zmiesci). Wrocic po naprawie rozjazdow — inwentaryzacja potwierdzila ze PIHA przeciazona (40 kontenerow), wiec host dokumentow wymaga decyzji.