Files
mission-control-v2/docs/wissen/OFFENE-FAEDEN.md
T
HitonabiandClaude Opus 5.5 c08a144006 homelab: Wächter und Geräteliste sehen volle Gastplatten (AdGuard stand bei 100 %)
Der Ausfuehrer schickt die Belegung der rootfs laufender Container mit; ab 85 % gelb, ab 95 % rot, in der
Geraeteliste als eigene Spalte und auf der Lampe des Geraets. Anlass: AdGuard (2 GB) war voll, das
Abfrageprotokoll schrieb nicht mehr und die Paketsuche scheiterte, ohne dass es eine Anzeige sagte.

Co-Authored-By: Claude Opus 5.5 <noreply@anthropic.com>
2026-09-24 21:00:44 +02:00

6.6 KiB

Offene Fäden — die eine Liste

Stand 24.09.2026 abends. Neues hier rein, Erledigtes raus (die Git-Historie behält es). Entschiedenes steht in VERDIKTE.md, nicht hier. Die Liste bis 04.09.2026, samt den Lucy-Fäden, liegt im Archiv: 2026-09-04-offene-faeden-alt.md.

Fahrplan zum Homelab Orchestrator (Plan vom 24.09.2026)

Stand 24.09. abends: Phase 0 bis 4 sind live. Die Homelab-Instanz läuft in Container 107 (192.168.178.31), der Ausführer auf dem Proxmox-Host, beide Instanzen prüfen sich gegenseitig, und ein Box-Deploy zieht den Container mit. Der erste echte Lauf (Gitea 1.27.2 → 1.27.3, 24.09. abends) war grün: Snapshot, Update, Bericht, Prüfung in gut zwei Minuten, Meldung auf Telegram, der Snapshot bleibt als Rückweg liegen. Danach schreibt das Community-Script /usr/bin/update in einem neuen Format (export SCRIPT_SLUG=…); der Ausführer liest beide.

Phase Inhalt Stand
0 · Sofort Nachtmeldungen um 07:00, Sicherung mit Lucys Gedächtnis, Token-Datei raus, Git aufgeräumt erledigt 24.09.
1 · Box-Wart 1.0 Ballast raus, Box-Diät, riskante Stellen, Deploy mit Prüftor und Rückweg, Sonntags-Timer, Oberfläche, Doku erledigt 24.09.
2 · Kern und zweite Instanz Rollen box/homelab, Partner-Aufsicht, Telegram-Zweitweg, Aufträge als systemd-Einheiten, Ziel-Modell mit Box-Adapter, strukturierter Update-Verlauf, Oberfläche „Homelab Orchestrator“ erledigt 24.09.
3 · Homelab sehen Container 107, Ausführer liefert den Bericht (kein Proxmox-Schlüssel), Inventar aller Gäste mit App-Version, Paketen, Webprüfung, Rückweg; Seite „Homelab“ = alle Geräte erledigt 24.09.
4 · Jetzt updaten Snapshot → Update → Prüfung → bei Rot zurück + Meldung; Host-Pakete mit Warnung, Neustart getrennt; Docker über Arcane als Probelauf; frisch geänderte Update-Skripte erst nach 48 h Wartezeit; PBS (kein Snapshot wegen Bind-Mount) mit Sicherung per vzdump auf local, bei Rot zurückgespielt eingerichtet 24.09.; erster Lauf grün (Gitea), Rückweg bei Rot bisher nur im Test; Wartezeit und PBS-Sicherung gebaut 24.09., die Sicherung greift erst mit dem neu eingespielten Ausführer
5 · Android-App Push, Cockpit, Updates freigeben, Lucy per Sprache mit Live-Modus offen, eigenes Projekt

Technik: ARCHITEKTUR.md, Abschnitt „Der Homelab-Teil“; Einrichtung und Betrieb: BETRIEB.md.

Offene Einzelpunkte (Homelab)

  1. ‼ AdGuard (Container 100): Platte voll (24.09. abends, User-Entscheidung). 2 GB rootfs, 100 % belegt: Das Abfrageprotokoll (/opt/AdGuardHome/data/querylog.json 462 MB, dazu querylog.json.1 539 MB vom 09.08.) hat sie gefüllt; seit etwa 17:33 schreibt es nicht mehr, und die Paketsuche scheitert („No space left on device“). Wege: in AdGuard die Aufbewahrung des Abfrageprotokolls kürzen bzw. es leeren, die alte Datei vom August löschen oder die Platte vergrößern (Proxmox: Container → Ressourcen → Laufwerk → Größe ändern). Gelöscht oder vergrößert wird nur mit User-Ja. Seit 24.09. meldet der Wächter volle Gastplatten selbst.
  2. Arcane-API-Schlüssel fehlt. Ohne ihn zeigt die Arcane-Karte die Docker-Images als „unklar“. Anlegen in Arcane (Einstellungen → API-Schlüssel), dann MC_ARCANE_KEY=… in /etc/mc2/homelab.env im Container 107 und systemctl restart mc2-homelab mc2-homelab-steward. Docker-Updates bleiben Probelauf bis MC_ARCANE_ECHT=1.
  3. Feste IP für Container 107. Er hat seine Adresse per DHCP (192.168.178.31); Partner-Adresse der Box, Ausführer-Konfiguration und der Deploy-Schritt 8 hängen daran. In der Fritzbox die Adresse fest zuordnen.
  4. Die Arcane-VM (106) trägt kein Etikett. Für Arcane und Docker braucht es keins (eigene Schnittstelle); für Snapshots oder OS-Updates der VM über den Ausführer bräuchte sie watcher (heute nicht gebaut).

Offene Einzelpunkte (Box-Wart)

  1. Session-Token des Hermes-Dashboards (nur mit User-Ja). Das Drop-in hermes-builtin-ui.service.d/session-token.conf aus der früheren Desktop-Anbindung ist weiter gesetzt; backup.sh und restore.sh sichern es samt Kopie desktop-gateway-token. Entfernen ist Security-Config.
  2. Units nur auf der Box: hermes-builtin-ui.service samt Drop-ins und die llama-swap-Drop-ins (darunter warmset.conf) liegen nicht im Repo; seit 24.09. stehen sie als Kopie in jeder Sicherung.
  3. PBS-Sicherung einschalten: Units und Skript liegen seit 24.09. im Repo (deploy/pbs-backup.*), Zugang und Client sind auf der Box, der PBS ist erreichbar. Nach dem Deploy einmal von Hand einschalten (BETRIEB.md, Sicherung); danach die Zeile vom 21.08. in VERDIKTE.md nachziehen.

Aufräumen auf der Box (nur per User-Klick)

  • Modelle ohne Rolle (Modelle-Seite, „Aufräumen"): gpt-oss-120b (60 GB), Qwen3-VL-30B-A3B (19 GB), Muse-Glimmer-30B, alte Drafts. Die Originale von Hirn und Coder sind der Rückweg, Nemotron ist Reserve: beides bewusst entscheiden.
  • Reste neben dem Betrieb stehen seit 24.09. im selben Panel unter „Altreste“ (feste Liste in backend/services/aufraeumen.py, am 24.09. auf der Box gemessen, zusammen gut 11 GB): TTS-Test, alter ROCm-Build, mem0, Kanban-Arbeitsordner, alte venvs, audio.cpp-Test, Avatar, alte Worktrees, Test-Reste, fremde Dateien im Hermes-Quellbaum, alte Skripte in ~/.hermes/scripts, Plugin mc2-memory, PINNED_VERSION, abgeschaltete Alt-Units. Löschen je Eintrag per Klick.
  • Bewusst nicht in der Liste, weil nicht klar tot (bei Gelegenheit von Hand entscheiden): ~/.voice (die Spracherkennung schläft nur), ~/.cache, ~/.opencode (steht in ~/.bashrc), ~/.hermes/kanban.db (Hermes öffnet sie), die Archive profiles-archive-20260819.tar.gz, ~/archiv-aufraeumen-20260820, ~/wissens-vault, ~/.hermes/state-snapshots, der PBS-Weg, ampel-waechter.sh, night-cron-wrapper.sh und pc_path_lookup.* (aktive Skills nennen sie).
  • Die crontab ruft sonntags ~/.hermes/scripts/curator-idle-watchdog.sh auf; das Skript gibt es nicht mehr.

Beobachten

  • 25.09. 00:30: Radar-Neutest Ornith-1.5-35B-A3B (Hirn), jetzt mit Draft-Varianten. 01.10.: Qwen3.8-Flash-Next (Coder, passt nur knapp).
  • So 27.09. 04:30: erster regulärer Sonntagslauf über den Timer; der Bericht kommt mit der Morgenmeldung um 07:00, der Verlauf steht auf der Updates-Seite. Wird das Zeitfenster vorher in den Einstellungen verschoben, gilt das neue.
  • Daily News 07:00: Die web_extract-Werkzeugfehler sollten mit dem Plugin mc2-web-lesen verschwunden sein (Hermes am 24.09. neu gestartet).