Rekoncyliacja faza 5 etap 1 (homelab-codex-ws:kb/phases/kb-m5-faza5-wiki.md §4), krok 1 z 3. Obie strony skompilowane niezależnie w ~/kb-wiki-etap1-sesja-2026-08-27/ (2026-08-27, przed odkryciem tego repo na Forgejo) — czysty dodatek, zero kolizji z lipcowym proof-of-concept (który nie miał żadnej strony typu podmiot=bank ani osoba). mbank: relacja bankowa kontakt@mbank.pl 2005-2026 (wnioski kart kredytowych, preferencyjne oprocentowanie, kredyt, konto dla dziecka), 11 kopert. pawel-cesar-sanjuan-szklarz: pierwszy test entity-resolution na aliasach w tej wiki — ta sama osoba pod 6 adresami e-mail 2004-2024, 13 kopert. Linki `[[...]]` w obu stronach przepisane z konwencji sesyjnej (`[[../katalog/plik]]`, z prefiksem katalogu) na rzeczywistą konwencję tego repo (`[[plik]]`, bez katalogu — `_meta/conventions.md` "Linkowanie między stronami"); treść merytoryczna nie zmieniona. Re-weryfikacja wszystkich przypisów w bazie po przeniesieniu: patrz commit lintu osobno (raport pełny, 74/74 sources + 150/150 przypisów inline na całym repo). INDEX.md: dopisane wpisy podmioty/mbank i osoby/pawel-cesar-sanjuan-szklarz. Co-Authored-By: Claude Sonnet 5 <noreply@anthropic.com> Claude-Session: https://claude.ai/code/session_01W7AnxL6pbgySpEgcCwAfww |
||
|---|---|---|
| _meta | ||
| osoby | ||
| podmioty | ||
| sprawy | ||
| tematy | ||
| umowy | ||
| .gitignore | ||
| INDEX.md | ||
| README.md | ||
kb-wiki
Warstwa pamięci domowej bazy wiedzy (moduł 5, faza 3 — homelab-codex-ws,
docs/kb/modules/05-faza3-plan.md §8). Wzorzec: Karpathy llm-wiki
(gist karpathy/442a6bf555914893e9891c11519de94f).
Czym to jest
Dwuwarstwowa architektura KB:
- Warstwa dowodowa (
kb-postgres@PIHA, poza tym repo): RAG/pgvector na chunkach dokumentów — skala docelowa 225k+ kopert, zawsze lokalna, zawsze źródło prawdy. - Warstwa pamięci (to repo): strony-encje w Markdownie (firma, umowa, sprawa, temat), kompilowane z wyników retrievalu, nie z surowców — destylat, nie kopia.
⚠️ Treść jest kompilowana przez LLM
Każda strona w tym repo została napisana przez model językowy (Claude) na
podstawie wyników zapytań do kaskady retrievalu (streszczenia + chunki z
kb-postgres), nie przez człowieka czytającego oryginalne dokumenty.
Fakty liczbowe i identyfikujące mają przypisy [^envelope_id#chunk_id]
wskazujące źródłowy chunk — weryfikuj przypis przy każdej decyzji, która
się na tej stronie opiera (finansowej, prawnej, ubezpieczeniowej). Sprzeczne
źródła są flagowane jawnie w tekście, nie ukrywane, ale kompilacja może mimo
to pominąć niuans, którego model nie uznał za istotny.
Jak działa kompilacja
- Zapytanie po polsku trafia do kaskady retrievalu (
documents_ingest.retrieval, pakiet zhomelab-codex-ws/jobs/documents-ingest): embed (bge-m3, Ollama) → top-Ndocument_summary(modelclaude-haiku-4-5) → top-kdocument_chunkw obrębie tych kopert, zawszeWHERE excluded_reason IS NULL. - Sesja CC/API dostaje zwrócone chunki + streszczenia, pisze/aktualizuje
stronę Markdown: fakty wyłącznie ze źródeł, przypis inline przy każdym
fakcie liczbowym/identyfikującym, blok
sourceswe frontmatterze agregujący wszystkie użyte koperty. - Commit do
masterz opisemcompile: <strona> ← <envelope_ids>— historia commitów tego repo jest audytowalną historią kompilacji (inwariant 6 szkicu operatora), stąd commitowanie bezpośrednio namaster, bez task branchy (inny reżim niżhomelab-codex-ws, patrz uzasadnienie niżej).
Format stron, konwencje linkowania i zasady lintu: _meta/conventions.md.
Dlaczego osobne repo, nie katalog w homelab-codex-ws
Decyzja D7 planu fazy 3: inna klasa wrażliwości (ten wiki jest destylatem danych
osobistych — zdrowie, finanse, umowy — homelab-codex-ws to kod infry) i inny
cykl commitów (kompilator commituje często i maszynowo; w repo infry zaśmiecałoby
to historię i gryzłoby się z dyscypliną worktree tamtego repo). Git history tutaj
= darmowy audit trail kompilacji, czystszy gdy w historii są wyłącznie strony wiki.
Status
Proof-of-concept fazy 3: struktura + _meta/conventions.md + 3–5 stron-encji
skompilowanych ręcznie sesją CC z wyników retrievalu. Pełna kompilacja korpusu
(225k+ kopert, przyrostowo) i integracja stron wiki z retrievalem jako
trzeci poziom kaskady — poza zakresem tej fazy, patrz plan §8.2 i §9.