37 lines
1.5 KiB
Markdown
37 lines
1.5 KiB
Markdown
# ROADMAP
|
|
|
|
## Etap 1 — Rdzeń na PC (obecny)
|
|
Generowanie poprawnych poleceń + Piper TTS, CLI, testy. Bez STT, bez VR.
|
|
Szczegóły: `docs/SPEC.md`.
|
|
|
|
## Etap 2 — Tło mieszanej rzeczywistości (Meta Quest 3)
|
|
Passthrough + proste obiekty (np. stół, jabłko). Generator z etapu 1 przenoszony
|
|
bez zmian (sama logika treści jest niezależna od platformy). UI: natywny OpenXR.
|
|
|
|
## Etap 3 — Interakcja i ocena
|
|
STT (rozpoznanie/repetycja), ocena wykonania polecenia (czy pacjent wskazał/położył
|
|
właściwy obiekt), sesje i statystyki postępu.
|
|
|
|
## Ograniczenia platformy docelowej (do etapu 2/3)
|
|
Wartości ustalone wcześniej; do zweryfikowania na sprzęcie.
|
|
|
|
| Parametr | Wartość |
|
|
|---|---|
|
|
| Limit pamięci aplikacji (Quest 3, PSS) | ~5,75 GiB (twardy, narzucony przez system) |
|
|
| CPU | Snapdragon XR2 Gen 2: 2 rdzenie performance + 4 efficiency (brak „prime") |
|
|
| Maks. CPU level | 6 |
|
|
| Tryb dual-core | niewspierany na Quest 3 |
|
|
| GPU | Adreno 740 |
|
|
| Inferencja LLM | CPU-only (backend OpenCL llama.cpp nie jest zwalidowany na Adreno 740; GPU obciążony renderowaniem) |
|
|
| Model LLM (cel) | Qwen2.5 1.5B Q4 (GGUF, llama.cpp) |
|
|
| STT (cel) | whisper.cpp Tiny |
|
|
| TTS | Piper (głos polski) |
|
|
| Tryb | 100% offline |
|
|
|
|
Konsekwencja dla treści: leksykonowo-szablonowe generowanie z etapu 1 jest tu
|
|
przewagą — gwarantuje poprawność niezależnie od rozmiaru modelu na urządzeniu.
|
|
|
|
## Dystrybucja
|
|
Cel: sideload / App Lab. Pełne wydanie w sklepie nie jest zakładane (stałe użycie
|
|
mikrofonu w etapie 3, lokalna inferencja, charakter asystujący).
|