Files
mission-control-v2/docs/wissen/OFFENE-FAEDEN.md
T
HitonabiandClaude Opus 5.5 903fbbfbb9 homelab: Speicherpool, NAS und Sicherungen überwachen – mit Empfehlungen, was Platz bringt
User-Wunsch 25.09.: Speicherpool im Wächter (gelb ab 80 %, rot bei 10 % frei)
samt Empfehlungen, dazu das NAS (Backup-Ziel, per NFS auf dem Proxmox-Host).
- Ausführer: Thin-Pools mit echter Belegung je Volume (lvs), ungenutzte und
  verwaiste Platten, VM-Belegung über den Gast-Agenten, Discard je VM,
  Netzlaufwerke (df mit Zeitlimit, hängender harter NFS-Mount hält nichts auf),
  Sicherungsaufträge und jüngste Sicherung je Gast.
- Homelab-Teil: services/homelab/speicher.py (Auswertung, Empfehlungen,
  Wächter pruefe_speicher, NAS-Erreichbarkeit per TCP), GET /api/homelab/speicher;
  Gast-Plattenwächter nennt jetzt auch VMs richtig.
- Oberfläche: Karte „Speicher und Sicherungen“ im Homelab-Cockpit.
- deploy.sh und ausfuehrer-einrichten.sh warten, solange im Homelab ein Update
  oder „Alle aktualisieren“ läuft (der Neustart bräche den Lauf ab).

Co-Authored-By: Claude Opus 5.5 <noreply@anthropic.com>
2026-09-25 11:15:06 +02:00

6.9 KiB

Offene Fäden — die eine Liste

Stand 25.09.2026 vormittags. Neues hier rein, Erledigtes raus (die Git-Historie behält es). Entschiedenes steht in VERDIKTE.md, nicht hier. Die Liste bis 04.09.2026, samt den Lucy-Fäden, liegt im Archiv: 2026-09-04-offene-faeden-alt.md.

Fahrplan zum Homelab Orchestrator (Plan vom 24.09.2026)

Stand 24.09. abends: Phase 0 bis 4 sind live. Die Homelab-Instanz läuft in Container 107 (192.168.178.31), der Ausführer auf dem Proxmox-Host, beide Instanzen prüfen sich gegenseitig, und ein Box-Deploy zieht den Container mit. Der erste echte Lauf (Gitea 1.27.2 → 1.27.3, 24.09. abends) war grün: Snapshot, Update, Bericht, Prüfung in gut zwei Minuten, Meldung auf Telegram, der Snapshot bleibt als Rückweg liegen. Danach schreibt das Community-Script /usr/bin/update in einem neuen Format (export SCRIPT_SLUG=…); der Ausführer liest beide.

Phase Inhalt Stand
0 · Sofort Nachtmeldungen um 07:00, Sicherung mit Lucys Gedächtnis, Token-Datei raus, Git aufgeräumt erledigt 24.09.
1 · Box-Wart 1.0 Ballast raus, Box-Diät, riskante Stellen, Deploy mit Prüftor und Rückweg, Sonntags-Timer, Oberfläche, Doku erledigt 24.09.
2 · Kern und zweite Instanz Rollen box/homelab, Partner-Aufsicht, Telegram-Zweitweg, Aufträge als systemd-Einheiten, Ziel-Modell mit Box-Adapter, strukturierter Update-Verlauf, Oberfläche „Homelab Orchestrator“ erledigt 24.09.
3 · Homelab sehen Container 107, Ausführer liefert den Bericht (kein Proxmox-Schlüssel), Inventar aller Gäste mit App-Version, Paketen, Webprüfung, Rückweg; Seite „Homelab“ = alle Geräte erledigt 24.09.
4 · Jetzt updaten Snapshot → Update → Prüfung → bei Rot zurück + Meldung; Host-Pakete mit Warnung, Neustart getrennt; Docker über Arcane (seit 25.09. echt, vorher ein Snapshot der VM); „Alle aktualisieren“ nacheinander; frisch geänderte Update-Skripte erst nach 48 h Wartezeit; PBS (kein Snapshot wegen Bind-Mount) mit Sicherung per vzdump auf local, bei Rot zurückgespielt eingerichtet 24.09.; erster Lauf grün (Gitea), Rückweg bei Rot bisher nur im Test; Wartezeit und PBS-Sicherung gebaut 24.09., die Sicherung greift erst mit dem neu eingespielten Ausführer
5 · Android-App Push, Cockpit, Updates freigeben, Lucy per Sprache mit Live-Modus offen, eigenes Projekt

Technik: ARCHITEKTUR.md, Abschnitt „Der Homelab-Teil“; Einrichtung und Betrieb: BETRIEB.md.

Offene Einzelpunkte (Homelab)

  1. AdGuard (Container 100): Aufbewahrung des Abfrageprotokolls auf 14 Tage (User, 25.09. angesagt). Am 24.09. war die 2-GB-Platte voll (Abfrageprotokoll, eingestellt: 90 Tage). Mit User-Ja wurde die alte Datei querylog.json.1 vom 09.08. (539 MB) gepackt auf den Proxmox-Host gelegt (/root/mc2-archiv/adguard-querylog-bis-2026-08-09.json.zst, 44 MB) und aus dem Container genommen. Seit dem Abend schreibt AdGuard wieder (25.09.: 485 MB seit 09.08., gut 10 MB am Tag, Platte 72 %). Weg in AdGuard: Einstellungen → Allgemeine Einstellungen → Konfiguration der Protokolle → Rotation der Abfrageprotokolle → Benutzerdefiniert, 336 Stunden → Speichern. AdGuard behält die laufende und die vorige Datei; die jetzige (ab 09.08.) wird beim ersten Rotieren zur vorigen und fällt 14 Tage später weg. Danach bleiben rund 300 MB. Volle Gastplatten meldet seit 24.09. der Wächter.

  2. Arcane-VM (106): Discard einschalten (User). Ihre Platte belegt im Speicherpool 161 GB, genutzt sind darin 35 GB (25.09.): Discard ist aus, freigegebener Platz kommt nie im Pool an. In Proxmox: VM 106 → Hardware → Festplatte → „Discard“ anhaken, VM einmal neu starten (Docker-Dienste kurz weg); danach gibt Ubuntu freien Platz wöchentlich zurück. Steht als Empfehlung in der Karte „Speicher und Sicherungen“; nötig erst, wenn der Pool knapp wird (heute 49 %).

Erledigt am 25.09.: Arcane-API-Schlüssel (vom User eingetragen, Docker-Updates echt), feste IP 192.168.178.31 für Container 107 (Fritzbox, User), Etikett watcher für die Arcane-VM 106 (User-Ja; der Ausführer legt vor echten Docker-Updates einen Snapshot an und geht bei Rot zurück). OS-Updates der VM über den Ausführer gibt es weiter nicht. Überwachung von Speicherpool, NAS und Sicherungen (User-Wunsch; Karte im Homelab-Cockpit, Hinweise ab 80 %, rot bei 10 % frei). Deploy und Ausführer-Einrichtung warten, solange im Homelab ein Update läuft.

Offene Einzelpunkte (Box-Wart)

  1. Session-Token des Hermes-Dashboards (nur mit User-Ja). Das Drop-in hermes-builtin-ui.service.d/session-token.conf aus der früheren Desktop-Anbindung ist weiter gesetzt; backup.sh und restore.sh sichern es samt Kopie desktop-gateway-token. Entfernen ist Security-Config.
  2. Units nur auf der Box: hermes-builtin-ui.service samt Drop-ins und die llama-swap-Drop-ins (darunter warmset.conf) liegen nicht im Repo; seit 24.09. stehen sie als Kopie in jeder Sicherung.

Aufräumen auf der Box (nur per User-Klick)

  • Modelle ohne Rolle (Modelle-Seite, „Aufräumen"): gpt-oss-120b (60 GB), Qwen3-VL-30B-A3B (19 GB), Muse-Glimmer-30B, alte Drafts. Die Originale von Hirn und Coder sind der Rückweg, Nemotron ist Reserve: beides bewusst entscheiden.
  • Reste neben dem Betrieb stehen seit 24.09. im selben Panel unter „Altreste“ (feste Liste in backend/services/aufraeumen.py, am 24.09. auf der Box gemessen, zusammen gut 11 GB): TTS-Test, alter ROCm-Build, mem0, Kanban-Arbeitsordner, alte venvs, audio.cpp-Test, Avatar, alte Worktrees, Test-Reste, fremde Dateien im Hermes-Quellbaum, alte Skripte in ~/.hermes/scripts, Plugin mc2-memory, PINNED_VERSION, abgeschaltete Alt-Units. Löschen je Eintrag per Klick.
  • Bewusst nicht in der Liste, weil nicht klar tot (bei Gelegenheit von Hand entscheiden): ~/.voice (die Spracherkennung schläft nur), ~/.cache, ~/.opencode (steht in ~/.bashrc), ~/.hermes/kanban.db (Hermes öffnet sie), die Archive profiles-archive-20260819.tar.gz, ~/archiv-aufraeumen-20260820, ~/wissens-vault, ~/.hermes/state-snapshots, der PBS-Weg, ampel-waechter.sh, night-cron-wrapper.sh und pc_path_lookup.* (aktive Skills nennen sie).
  • Die crontab ruft sonntags ~/.hermes/scripts/curator-idle-watchdog.sh auf; das Skript gibt es nicht mehr.

Beobachten

  • 25.09. 00:30: Radar-Neutest Ornith-1.5-35B-A3B (Hirn), jetzt mit Draft-Varianten. 01.10.: Qwen3.8-Flash-Next (Coder, passt nur knapp).
  • So 27.09. 04:30: erster regulärer Sonntagslauf über den Timer; der Bericht kommt mit der Morgenmeldung um 07:00, der Verlauf steht auf der Updates-Seite. Wird das Zeitfenster vorher in den Einstellungen verschoben, gilt das neue.
  • Daily News 07:00: Die web_extract-Werkzeugfehler sollten mit dem Plugin mc2-web-lesen verschwunden sein (Hermes am 24.09. neu gestartet).