homelab-codex-ws/docs/architecture/ai-cluster-LEGACY.md
oskar 615b6ab2a8 docs(architecture): Etap 0 changes appendix in recon; telegram-frontend pattern in legacy doc
RECON appendix summarizes the whole etap-0 cleanup (topology dormant status,
hosts reconciliation, dead-code removal, legacy decision), carries the
runbook line for the stale chelsty pending action
(rm /opt/homelab/actions/pending/redeploy-chelsty-infra-ha-diag-agent.json —
verified the only chelsty-targeted pending file 2026-07-30), and lists
discrepancies found but out of scope: lustro watchtower, stale solaria/chelsty
world-state keys, piha naming-drift duplicate keys, gokapi still down with a
stuck pending redeploy, outline/joplin/umami still lacking services/ dirs.

Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
2026-07-30 15:36:29 +02:00

2.1 KiB

ai-cluster — LEGACY, wygaszany (decyzja 2026-07-28)

Decyzja

Stack ai-cluster działający na vps (ai-cluster-openclaw-1, codex-worker, planner-worker, service-ops-worker, redis, mosquitto) jest wygaszany, nie migrowany. Podstawa (recon RECON-multiagent-2026-07-27.md, C9): bus codex/* jest martwy od 2026-06-09 — zero nowych połączeń przez ~7 tygodni, workery trzymają tylko puste długożyjące połączenia.

Konsekwencje:

  • Migracja na solarię NIE wchodzi. Branch task/ai-cluster-solaria (@ b124e54) zostaje niezmergowany — pełni rolę dokumentacji stanu prac i reconu; nie kasować.
  • ai-cluster nie ma katalogu w services/ na masterze i nie dostanie go — nie wciągamy legacy do GitOps.
  • planner-agent na solarii (ta sama rodzina) ma w hosts/solaria/services.yaml monitor: false — decyzja o jego losie osobno.
  • Kontenery na vps zostaną zatrzymane w osobnej, nadzorowanej sesji (stop stacka, obserwacja free -m, rollback = start) — poza tym taskiem; do tego czasu działają dalej pod hard mem_limitami.

Co przeżywa w subsystemie B (wzorce, nie kod)

Subsystem B (dyspozytor + KB + HA + homelab-ops; osobny projekt) dziedziczy z ai-clustra wzorce projektowe:

  • bus zadań z routingiem po polu target (role:* / AGENT_ID) i wąskim ACL,
  • podział na wyspecjalizowane workery-role (dev / planner / service-ops),
  • allowlisty kształtu komend przed wykonaniem czegokolwiek na hoście — z lekcją z reconu (A2): allowlist musi być egzekwowana i celowana (martwa stała SERVICE_NAMES + substring-match po docker ps to antywzorzec),
  • tryb preview/diagnose przed wykonaniem,
  • frontend telegramowy jako kanał operatorski (wzorzec żyje dalej w agent-system/telegram-bot na piha — ten zostaje).

Kod ai-clustra nie jest przenoszony.

Czego NIE robić

  • Nie deployować, nie restartować i nie "naprawiać" stacka ai-cluster na vps.
  • Nie mergować task/ai-cluster-solaria.
  • Nie podpinać nowych klientów pod codex/* na brokerze ai-clustra.