- llamaswap.sammeln(): Aenderungen lesen dieselbe Config aus dem Speicher, geschrieben wird einmal am Ende, bei einem Fehler gar nicht - Radar-Tausch und Hirn-Umstellung nutzen es; Hermes wird erst nach dem Schreiben umgestellt - Test-Attrappe fuer update_brain_model: der Radar-Test faesst auf der Box nie die echte Hermes-Config an - Doku: Ziel-Modell, strukturierter Verlauf, Sammel-Schreiben Co-Authored-By: Claude Opus 5.5 <noreply@anthropic.com>
7.0 KiB
Offene Fäden — die eine Liste
Stand 24.09.2026. Neues hier rein, Erledigtes raus (die Git-Historie behält es). Entschiedenes steht in VERDIKTE.md, nicht hier. Die Liste bis 04.09.2026, samt den Lucy-Fäden, liegt im Archiv: 2026-09-04-offene-faeden-alt.md.
Fahrplan zum Homelab Orchestrator (Plan vom 24.09.2026)
Phase 1 läuft: Box-Diät, Backend, Deploy mit Prüftor und Rückweg und das Sonntags-Update als Timer sind live.
Offen sind die Oberfläche (Branch wartung/phase1d-frontend) und die Doku (Branch doku/phase1e-neuordnung).
Phase 2 hat begonnen: Teil 2a (Kern für zwei Instanzen mit Rollen box/homelab, Partner-Aufsicht,
Telegram-Zweitweg, eine Zeitzone) liegt auf main (75611be). Die Homelab-Instanz selbst wird erst in Phase 3
eingerichtet und braucht ein User-OK.
| Phase | Inhalt | Abnahme | Stand |
|---|---|---|---|
| 0 · Sofort | Nachtmeldungen sammeln und um 07:00 schicken, Dringendes sofort; Sicherung mit Lucys Gedächtnis, SOUL.md, Skills, Cron-Skripten und Box-Wart-Zustand; Token-Datei aus dem Repo; Git aufgeräumt |
Testmeldung nachts landet in der 07:00-Meldung, dringende kommt sofort; Sicherung enthält das Gedächtnis; auf Gitea nur main und Archiv-Tags |
erledigt 24.09. |
| 1 · Box-Wart 1.0 | Ballast raus (tote Routen, Module, Deploy-Dateien, Skills); Konsole, Spracherkennung, PC-Fernsteuerung, Embedding und Reranker schlafen; riskante Stellen behoben; Deploy mit Rückweg und Prüftor; Sonntags-Update als Timer; Oberfläche; Doku neu | alle Prüfläufe grün, keine toten Routen; ein absichtlich kaputter Deploy rollt sich selbst zurück; Sonntags-Update ohne Hermes-Hänger; Doku beschreibt den Box-Wart | läuft (Oberfläche, Doku offen) |
| 2 · Kern und zweite Instanz | zentrales Einstellungs-Objekt, SQLite, Worker mit Job-Engine, Adapter-Schnittstelle mit der Box als erstem Adapter; Oberfläche „Homelab Orchestrator" mit den Bereichen Box-Wart und Homelab; beide Instanzen prüfen sich gegenseitig | Box-Wart verhält sich wie vorher (Tests); ein Update-Lauf überlebt einen Neustart; stoppt eine Instanz, meldet die andere es auf Telegram | begonnen: 2a auf main (backend/kern/, /api/partner, Partner-Prüfung im Wächter, Telegram-Zweitweg) |
| 3 · Homelab sehen | Homelab-Instanz als Container auf dem Proxmox-PC (nach User-OK); Proxmox-API mit Leseschlüssel (nach User-OK); Inventar: Host, 6 Container, Arcane-VM mit Docker; offene Updates je Gerät (Host-Pakete per Proxmox-Webhook, App-Versionen, Arcane-API); Erreichbarkeit je Dienst; Anzeige „Rückweg: Snapshot oder Backup"; neue Container per Etikett | Übersicht zeigt alle 8 Geräte mit Update-Stand; ein gestoppter Dienst erzeugt einen Hinweis | offen |
| 4 · Jetzt updaten | Ausführer auf dem Proxmox-Host (nach User-OK) für Etikett community-script oder watcher, ohne watcher-aus; Knopf je Gerät: Snapshot, Update, Erreichbarkeits-Check, Erfolgsmeldung; rot → zurückrollen und melden; PBS mit Backup statt Snapshot; Host-Updates mit Warnung, Neustart getrennt; Docker über Arcane, zuerst als Probelauf |
ein Update mit absichtlich rotem Check rollt sich selbst zurück und meldet es; nach einem Host-Neustart meldet die KI-Box, dass alles wieder läuft | offen |
| 5 · Android-App | Push, Cockpit und Übersicht, Updates unterwegs freigeben, Lucy per Sprache mit Live-Modus; weckt Spracherkennung und Stimme | wird zu Beginn der Phase festgelegt | offen, eigenes Projekt |
Hintergrund zur Homelab-Technik: ARCHITEKTUR.md, Abschnitt „Ausblick".
Offene Einzelpunkte (Box-Wart)
- Session-Token des Hermes-Dashboards (nur mit User-Ja). Das Drop-in
hermes-builtin-ui.service.d/session-token.confaus der früheren Desktop-Anbindung ist weiter gesetzt;backup.shundrestore.shsichern es samt Kopiedesktop-gateway-token. Entfernen ist Security-Config. - Rote Wächter-Hinweise warten nachts bis 07:00. Der Wächter meldet mit Betreff „[Box-Problem]" ohne
-d; zwischen 00:00 und 06:59 landet das in der Morgenmeldung. Klären, ob Rot sofort raus soll. - Code verweist auf verschobene Doku:
deploy/mc2-backup.service(Documentation=aufdocs/BACKUP.md),backend/services/backup.py(docs/BACKUP.md),backend/services/maintenance.py(docs/BEDIENUNG.md, sudoers-Hinweis),backend/services/agent.py(docs/HERMES_SETUP.md),backend/services/llamaswap.py(docs/OPTIMIZATION_PLAN.md). Beim nächsten Code-Commit aufdocs/BETRIEB.md,docs/ARCHITEKTUR.mdbzw. das Archiv umstellen. - Oberfläche (Phase 1d): Updates-Seite mit Urteil und Paketliste, ehrliche Lade- und Fehlerzustände, Rückfragen, Aufträge aller Gruppen. Heute erscheinen Downloads nicht unter „Updates", obwohl die Modellsuche das ankündigt.
- Units nur auf der Box:
hermes-builtin-ui.servicesamt Drop-ins und die llama-swap-Drop-ins (darunterwarmset.conf) liegen nicht im Repo; seit 24.09. stehen sie als Kopie in jeder Sicherung. - Ungepinnte Abhängigkeiten:
backend/requirements.txtnur mit>=, jeder Deploy zieht die neueste Version. Was nachweislich zusammen lief, steht inknown-good/jeder Sicherung. - Der Wächter hält das Hirn für bereit, sobald irgendein Modell läuft (
pruefe_kern()). Ein abgestürztes Hirn neben einem geladenen Coder bliebe unbemerkt. Klären, ob gewollt. - Radar „Jetzt suchen" läuft synchron und kann Minuten dauern;
POST /api/models/{id}/loadmeldetok, egal was die Engine antwortet. - Kleinkram im Code:
mcp/mcp_mc.py(MCP aus) ruft die nie vorhandene Route/api/routing/route;hermes-postcheck.shwarnt bei jedem Lauf über den entfernten Patch-Träger;voice_service/app.pynennt faster-whisper statt Parakeet;.aiexcludegilt nur Antigravity.
Aufräumen auf der Box (nur per User-Klick)
- Modelle ohne Rolle (Modelle-Seite, „Aufräumen"): gpt-oss-120b (60 GB), Qwen3-VL-30B-A3B (19 GB), Muse-Glimmer-30B, alte Drafts. Die Originale von Hirn und Coder sind der Rückweg, Nemotron ist Reserve: beides bewusst entscheiden.
- Reste neben dem Betrieb (Prüfbericht 24.09.): rund 10 GB Test- und venv-Ordner im Home-Verzeichnis, alte Skripte in
~/.hermes/scripts(deploy.shlegt neue dazu, räumt alte nicht weg), das inaktive Pluginmc2-memory,~/.hermes/PINNED_VERSION(veraltet; Pins stehen in/srv/models/mc2-pins.json), zwei fremde Dateien im Hermes-Quellbaum, alte Worktrees unter~/.hermes/worktreesund~/projekte/mc2-referenz, abgeschaltete Alt-Units in~/.config/systemd/user.
Beobachten
- 25.09. 00:30: Radar-Neutest Ornith-1.5-35B-A3B (Hirn), jetzt mit Draft-Varianten. 01.10.: Qwen3.8-Flash-Next (Coder, passt nur knapp).
- So 27.09. 04:30: erster regulärer Sonntagslauf über den Timer; der Bericht kommt mit der Morgenmeldung um 07:00, der Verlauf steht auf der Updates-Seite.
- Daily News 07:00: Die
web_extract-Werkzeugfehler sollten mit dem Pluginmc2-web-lesenverschwunden sein (Hermes am 24.09. neu gestartet).