docs: v4-Plan (Der Lotse) — ctx-Auto, Cookbook 2.0, Verbinden, News

Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
This commit is contained in:
Hitonabi
2026-06-21 13:07:52 +02:00
parent aafc41f4b2
commit f3da24a712
2 changed files with 45 additions and 3 deletions
+8 -3
View File
@@ -90,8 +90,13 @@ rsync; **Python-Code-Änderungen brauchen den Restart**.
## Projektstatus & Roadmap ## Projektstatus & Roadmap
**v3 ist umgesetzt** (siehe `ROADMAP.md`): kompletter Redesign auf ein einheitliches Design-System, **v3 ist umgesetzt & live** (siehe `ROADMAP.md`): einheitliches Design-System, Beginner-UX
Beginner-UX (Klartext/Führung), Security-Härtung (Passwort-Leak dicht, ehrlicher Chip) und ein (Klartext/Führung), Security-Härtung (Passwort-Leak dicht, ehrlicher Chip), **Self-Update-Button**.
**Self-Update-Button**. Wir sind im **Feinschliff- und Wartungsmodus**.
**v4 ist geplant** („Der Lotse" — siehe `ROADMAP.md`): vom Modell-Manager zum geführten Berater.
Reihenfolge: (1) optimale Kontextfenster auto-ermitteln (`hw_math.max_ctx_for`) → (2) Cookbook 2.0
use-case-getrieben mit Stack-Empfehlungen → (3) „Verbinden"-Tab mit Connection-Test
(`routers/integration.py`) + Bild-/Vision-Flow → (4) News-Board (`routers/news.py`, RSS via stdlib).
Alles automatisch aus Modellen + Hardware; KISS/SoC + keine DB/neue Lib.
**Nordstern:** den Server nie wieder via SSH/Putty anfassen müssen — 100 % Automatisierung / Klicki-Bunti. **Nordstern:** den Server nie wieder via SSH/Putty anfassen müssen — 100 % Automatisierung / Klicki-Bunti.
+37
View File
@@ -4,6 +4,43 @@
--- ---
## v4 — „Der Lotse" (GEPLANT, Stand 2026-06-21)
Sprung vom Modell-*Manager* zum geführten *Berater*. Roter Faden: Das System kennt bereits Hardware
(`system.py`), Modell-Meta (`models.py`) und Fit-Mathe (`hw_math.py`) — v4 nutzt das, um den Nutzer
**aktiv zu beraten**. Alles **automatisch aus Modellen + Hardware** abgeleitet. KISS/SoC bleibt:
je Bereich ein `routers/<x>.py` + `js/panels/<x>.js` + Nav-Eintrag, keine DB, keine schwere Lib.
**Reihenfolge: 1 → 2 → 3 → 4** (Fundament zuerst).
### 1. Optimale Kontextfenster (Fundament)
- [ ] `hw_math`: `max_ctx_for(params_b, quant, ram_gb)` — Umkehrfrage „welcher ctx passt noch?"
(KV-Cache-Bedarf vs. freier Speicher).
- [ ] Pro Modell empfohlener ctx + Klartext-Begründung; Ein-Klick „optimal setzen" (nutzt `update_model`).
- [ ] Speist Cookbook (2.) + Modelle-Tab.
### 2. Cookbook 2.0 — Use-Case-getrieben
- [ ] Einstieg „Wofür?": Coding · Bilder verstehen · Allrounder/Chat · Lange Dokumente · Agenten/Tool-Use · Schnell & sparsam.
- [ ] Pro Use-Case ein kuratiertes **Setup/Stack** (mehrere Modelle/Rollen) statt Einzelmodell, mit
Hardware-**Ampel pro Setup** (via `hw_math`) + vorgeschlagenem ctx. Rezepte als Daten (`recipes.py`).
- [ ] „Komplettes Setup installieren" — download + register aller Modelle in einem Rutsch.
- [ ] Roh-Suche bleibt als „Profi-Modus".
### 3. Verbinden / Orchestrierung (neuer Tab, erweitert Guides)
- [ ] Geführter Assistent je Tool (OpenCode/Cline/Cursor/OpenWebUI) mit exakter Config.
- [ ] **„Verbindung testen"** — `routers/integration.py` `/api/integration/test` ruft llama-swap
`/v1/models` (LAN-URL) und meldet Erfolg + Modell-Liste zurück.
- [ ] Bild-Eingaben für Fehleranalyse: erkennt Vision-Modell (sonst Hinweis „Vision installieren") +
Copy-Snippet im OpenAI-Vision-Format. Auto-Swapping erklären.
### 4. News-Board (neuer Tab)
- [ ] `routers/news.py`: kuratierte RSS/Atom-Feeds (HuggingFace-Blog, r/LocalLLaMA, llama.cpp-Releases,
Ollama) via `httpx` + stdlib-`xml.etree` (kein neuer Dep), In-memory-Cache (~30 min TTL).
- [ ] `panels/news.js`: Karten (Titel/Quelle/Datum/Link), sanitisiert, LAN-only; Hardware-relevante
Releases (gfx1151/ROCm) hervorheben.
---
## v3 — Redesign + Beginner-UX + Security (Stand 2026-06-21, live) ## v3 — Redesign + Beginner-UX + Security (Stand 2026-06-21, live)
Nach der funktional kompletten v2 (unten) umgesetzt — Fokus: **schick, selbsterklärend, wasserdicht.** Nach der funktional kompletten v2 (unten) umgesetzt — Fokus: **schick, selbsterklärend, wasserdicht.**