2536d91430
Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
55 lines
3.3 KiB
Markdown
55 lines
3.3 KiB
Markdown
# Mission Control 2.0 — Bedienung (kurz & klartext)
|
|
|
|
**Öffnen:** `http://192.168.178.151:9001` (vom Windows-PC im LAN). Dark/Light-Umschalter oben rechts,
|
|
**Cmd/Strg+K** springt zu jedem Bereich.
|
|
|
|
> Im Alltag fasst du MC kaum an: `model: auto` + Auto-Swap laden Modelle selbst. Du öffnest es, um ein
|
|
> Modell zu installieren/tauschen, die Auslastung zu prüfen, Gedächtnis zu pflegen oder ein Tool zu verbinden.
|
|
|
|
## Die 6 Bereiche
|
|
- **Modelle & Routing** — installierte Modelle (mit Fähigkeiten) + neue finden/laden.
|
|
- **Routing** — zeigt `model: auto` (schnell ↔ schwer) + Schwelle.
|
|
- **System** — Live CPU/RAM/GPU/GTT/Temp, Dienste-Status, **Backup**, Updates/Restart (Wartung).
|
|
- **Gedächtnis** — geteilte Fakten/Regeln, die ALLE Tools (Hermes, IDEs) via MCP lesen/schreiben.
|
|
- **Verbinden** — fertige Konfig-Snippets für deine IDEs (zeigen auf den Gateway).
|
|
- **Hermes** — Agent-Status + „Hermes öffnen".
|
|
|
|
## Modell installieren
|
|
**Tab „Modelle & Routing" → „Modelle finden":**
|
|
- **Kuratiert:** auf einer Empfehlungs-Karte „Installieren" klicken (⭐ = beste Wahl je Kategorie).
|
|
- **Eigenes (HuggingFace):** oben **HF-URL oder `org/repo`** einfügen → „Quants laden" → Quant wählen →
|
|
„Installieren". Oder die **Suchleiste** nutzen → Treffer anklicken → Quant → Installieren.
|
|
- Der Download läuft als Job mit **Fortschrittsbalken** oben; llama-swap pflegt das Modell automatisch ein.
|
|
|
|
## LLM tauschen (z.B. anderes „fast"-Hirn)
|
|
„Modelle & Routing" → **„Installiert"**: in der Zeile des Modells im **Rollen-Dropdown**
|
|
`fast` (bzw. `heavy`/`coder`/`vision`/`scout`) wählen → der Alias wandert auf dieses Modell.
|
|
- `model: auto` nutzt ab sofort dieses Modell als schnelles/schweres Hirn — für Hermes **und** Vibe Coding.
|
|
- **Kontext** ändern: auf die Kontext-Zahl (✎) klicken. **Entfernen:** 🗑 (GGUF-Datei bleibt erhalten).
|
|
- „Auto-Swap" = llama-swap lädt automatisch, was gerade angefragt wird; du musst nichts laden/entladen.
|
|
|
|
## IDE verbinden (Vibe Coding am eigenen PC)
|
|
„Verbinden" → Tool wählen (Cline/OpenCode/Zed/Continue) → Snippet kopieren. Zeigt auf
|
|
`http://192.168.178.151:9001/v1`, Modell **`auto`**. Memory-MCP-Snippet separat einfügen → geteiltes Gedächtnis.
|
|
|
|
## Gedächtnis pflegen
|
|
„Gedächtnis": Fakt/Regel hinzufügen (Kategorie wählen), suchen/filtern, **🧹 Aufräumen** entfernt Dubletten.
|
|
Das ist die geteilte „Verfassung" für alle Tools.
|
|
|
|
## Wartung & Backup
|
|
„System" → **Wartung & Updates**: Badge (offene OS-Pakete / Engine / Modell-Upgrades), Buttons
|
|
**OS aktualisieren · Engine aktualisieren · Engine neu starten · Reboot**, Modell-Upgrade-Vorschläge
|
|
(1-Klick), **Backup jetzt** (Gedächtnis-DB + Configs), Dienste-Health.
|
|
|
|
`Engine neu starten`, Logs & Modell-Upgrades laufen sofort (NOPASSWD vorhanden). **OS-Update + Reboot**
|
|
brauchen einmalig erweiterte sudoers — `sudo visudo`, ergänze:
|
|
```
|
|
hitonabi ALL=(root) NOPASSWD: /usr/bin/apt-get, /usr/sbin/reboot
|
|
```
|
|
(Engine-Update: `MC_ENGINE_UPDATE_CMD` in der mc2-Unit setzen — Befehl, der /opt/llamacpp aktualisiert.)
|
|
Danach ist die komplette Wartung klicki-bunti, ohne Passwort.
|
|
|
|
## Wenn etwas hakt
|
|
- Modell antwortet nicht → „System" → Dienste-Health (Engine online?) + Engine-Logs-Link (llama-swap `/ui`).
|
|
- Hermes langsam/komisch → im Hermes-WebUI **neuen Chat** starten (frische Session); Details: `docs/CUTOVER.md`.
|