Rozstrzygniecie 1. Monolit mieszal cztery typy OKF. Rozbity PER TYP po
granicy sekcji `##`:
10 x decision — pozycje backlogu (w tym backlog-aktywne 28 KB
i backlog-zamkniete 12 KB, ktore zostaja calosciami)
7 x incident — bugi/awarie dotad wtopione w backlog: cutover HA ken,
checkpoint observera, ha-diag-agent node=unknown,
deploy-local ghost-kontenery, paperless-worker config,
deploy-node nie przebudowuje obrazu, ollama bez sterownika
2 x phase — HA configs-as-code, monitoring floty Prometheus
kb/phases/backlog.md zostaje jako cienki indeks (type: phase, status: active):
oryginalna preambula + wygenerowany spis linkow do wszystkich 19 elementow.
23 przychodzace odwolania zostaja przepiete na ta sciezke w grupie 7.
NIE rozbijano po `###` (38 pozycji w "Aktywne" + 13 w "Zamkniete" = 51
plikow). Rozstrzygniecie mowi "rozbij per typ", a nie per pozycja;
rozdrobnienie do 51 plikow rozerwaloby czytelnosc backlogu.
Kontrola: preambula + 19 sekcji == oryginal z HEAD (multizbior niepustych
linii). Tresc pozycji nietknieta.
Co-Authored-By: Claude Opus 5 (1M context) <noreply@anthropic.com>
1.8 KiB
| okf | type | visibility | status | updated | links | |
|---|---|---|---|---|---|---|
| 0.1 | incident | private | active | 2026-08-03 |
|
Ollama SOLARIA: brak sterownika NVIDII — ZAMKNIĘTE (2026-07-16)
Kontekst. Cutover 2026-07-15 (docs/infra/ollama-solaria-cutover-2026-07-15.md)
odkrył, że SOLARIA nie miała zainstalowanego żadnego sterownika NVIDII —
nvidia-smi nie istniał na hoście. hosts/solaria/services.yaml opisywał
ollama jako "GPU-backed" od dawna, ale to było aspiracyjne — Ollama zawsze
szła CPU-only. GPU reservation zakomentowana w
services/ollama/docker-compose.yml (f57a01a); item trafił do backlogu
jako blokujący fazę mailową embeddingów (moduł 5).
Fix (2026-07-16). Zainstalowany nvidia-driver-595-open z repo dystrybucji
(nie stary PPA graphics-drivers dla jammy — zdezaktywowany przez rename na
.disabled). RTX 4070 Ti SUPER 16GB, CUDA 13.2, nvidia-smi działa na
hoście. nvidia-container-toolkit był już obecny (doinstalowany jako
prerequisite przy cutoverze 07-15). GPU reservation przywrócona w compose.
Pomiar throughput GPU vs CPU baseline (0.79s/chunk) — patrz
jobs/documents-ingest/README.md, sekcja timing.
Status: ZAMKNIĘTE.
Follow-upy pozostawione (osobne taski):
- Batching wywołań Ollamy — przed fazą mailową (225k kopert). Sekwencyjne
wywołania
/api/embeddings(nawet na GPU) będą wąskim gardłem przy takiej skali; ocenić równoległość/batch API Ollamy. UNIQUE(envelope_id, chunk_index)bezmodelwdocument_chunk(services/kb-postgres/init/002_chunks.sql) — re-embedding innym modelem cicho no-opuje się przez istniejący constraint. Schema change do zrobienia przy fazie 3 (patrzjobs/documents-ingest/README.md, sekcja "Idempotency" kroku 6 embed).