--- okf: "0.1" type: incident visibility: private status: active updated: 2026-08-03 links: - ../phases/backlog.md --- ## Ollama SOLARIA: brak sterownika NVIDII — ZAMKNIĘTE (2026-07-16) **Kontekst.** Cutover 2026-07-15 (`kb/runbooks/ollama-solaria-cutover.md`) odkrył, że SOLARIA nie miała zainstalowanego żadnego sterownika NVIDII — `nvidia-smi` nie istniał na hoście. `hosts/solaria/services.yaml` opisywał ollama jako "GPU-backed" od dawna, ale to było aspiracyjne — Ollama zawsze szła CPU-only. GPU reservation zakomentowana w `services/ollama/docker-compose.yml` (`f57a01a`); item trafił do backlogu jako blokujący fazę mailową embeddingów (moduł 5). **Fix (2026-07-16).** Zainstalowany `nvidia-driver-595-open` z repo dystrybucji (nie stary PPA `graphics-drivers` dla jammy — zdezaktywowany przez rename na `.disabled`). RTX 4070 Ti SUPER 16GB, CUDA 13.2, `nvidia-smi` działa na hoście. `nvidia-container-toolkit` był już obecny (doinstalowany jako prerequisite przy cutoverze 07-15). GPU reservation przywrócona w compose. Pomiar throughput GPU vs CPU baseline (0.79s/chunk) — patrz `kb/phases/kb-m5-documents-ingest-fazy.md`, sekcja timing. **Status:** ZAMKNIĘTE. **Follow-upy pozostawione (osobne taski):** - **Batching wywołań Ollamy** — przed fazą mailową (225k kopert). Sekwencyjne wywołania `/api/embeddings` (nawet na GPU) będą wąskim gardłem przy takiej skali; ocenić równoległość/batch API Ollamy. - **`UNIQUE(envelope_id, chunk_index)` bez `model`** w `document_chunk` (`services/kb-postgres/init/002_chunks.sql`) — re-embedding innym modelem cicho no-opuje się przez istniejący constraint. Schema change do zrobienia przy fazie 3 (patrz `kb/phases/kb-m5-documents-ingest-fazy.md`, sekcja "Idempotency" kroku 6 embed).