77b6dee02f
docs/CUTOVER.md: Box-Stack live (Modelle/Gateway/Hermes/Memory verifiziert), bekannte Tuning-Punkte (Hermes-Kontext/Tool-Thrash NICHT brain-abhaengig → Hands-on-Debug; SSH-Windows; nesquena optional), reversibler Cutover-Ablauf. STATUS aktualisiert. Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
2.9 KiB
2.9 KiB
Cutover — Stand & Anleitung
Was auf der Box LÄUFT (verifiziert)
- MC2 auf
:9001(sudo-freier User-Dienst,~/mission-control-v2). Update:deploy/deploy.sh. - Modelle:
fast= Qwen3.6-35B-A3B (21 GB, lädt in ~6 s) +heavy= Qwen3.5-122B-A10B (77 GB, lädt in ~32 s). Beide tool-fähig (--jinja). Plus die bestehenden coder/vision/scout. - Gateway (eingebaut,
:9001/v1, OpenAI-kompatibel):model: auto→ kurz/Standard =fast, lang/komplex =heavy. End-to-End verifiziert (short→fast, keyword→heavy lädt + antwortet). - Hermes: Brain =
model: autoüber den Gateway (providercustom,:9001/v1). MCP verdrahtet:mission-control-memory+mission-control-stack(mcp_mc). Antwortet. - Gedächtnis vereinheitlicht: MC2 nutzt die bestehende v1-DB (
mission-control-memory.db, 16 Einträge) — eine geteilte „Verfassung" für Cockpit, Hermes, IDEs.
Bekannte Tuning-Punkte (vor „rundem" Cutover sinnvoll, kein Blocker)
- Hermes thrasht / Kontext-Bloat (NICHT brain-abhängig): Auf simple Prompts feuert der Agent
Fehl-Tools (
vision_analyzeauf Text → „Bild nicht gefunden",search_files-Schleife → Eigen-Guard blockt) und injiziert ~124–249k Prompt-Tokens (→ 1–2 min/Antwort). Getestet: mitauto→Qwen3.6 UND mitcoder(Qwen3-Coder-30B) — gleiches Verhalten, also kein Modell-, sondern ein Hermes- Kontext/Session/Tool-Problem (vorbestehend = das „dumm/loop" aus v1). Hands-on-Debug nötig (mit dir): (a) Session zurücksetzen/frische Session-ID (akkumulierte History?), (b) unnötige Toolsets/Skills abschalten (hermesCLI / configtoolsets/platform_toolsets), v.a. Vision-Tools für reine Text-Aufgaben, (c) Kontext-/History-Limits setzen, (d) Thinking für den Agenten aus. Das Brain steht aufauto(deine Vorgabe); das ist nicht die Ursache. - SSH→Windows (voller PC-Zugriff): Windows-seitig OpenSSH-Server aktivieren + Key
id_ed25519_hermes_agentautorisieren (vom Box-Host aus). Erst dann erreicht Hermes' Shell den PC. - hermes-webui (nesquena) standalone: optional — aktuell läuft das eingebaute
hermes-dashboard. Für die reichere Oberflächedocs/HERMES_SETUP.md§3 (Port 8787, Passwort).
Cutover-Schritte (wenn v2 dir reicht)
- v2 läuft bereits auf
:9001parallel — teste alles dort:http://192.168.178.151:9001. - Vibe-Coding-Tools auf den Gateway zeigen (Verbinden-Tab liefert Snippets →
:9001/v1,model: auto). - v1 stilllegen:
systemctl --user stop hermes-dashboard(nur wenn nesquena/anderes übernimmt) und den alten Mission-Control-Dienst deaktivieren. llama-swap + hermes-gateway bleiben (von beiden genutzt). - Optional v2 auf den „Haupt"-Port legen (z.B. 9000) —
MC_PORTim Unit ändern. - Backup vorher: Cockpit → System → „Backup jetzt" (sichert Memory-DB + Configs).
v1 bleibt bis dahin unangetastet und lauffähig — Cutover ist reversibel.