Files
mission-control-v2/deploy/restore.sh
T
HitonabiandClaude Opus 5.5 648be33d21
Ampel / ampel (push) Successful in 26s
phase0: Nachtmeldungen kommen wieder an, Sicherung mit Lucys Gedaechtnis, Token-Datei raus
- notify.sh sammelt nachts (00-07 Uhr) wie bisher, aber jetzt liefert mc2-morgenmeldung.timer
  um 07:00 alles als eine Telegram-Nachricht aus. Seit dem 21.08. las niemand die
  Warteschlange, alle Nachtmeldungen (auch die Sonntags-Updates) gingen verloren.
  Dringendes (-d, Betreff Alarm/Notfall, Text beginnt mit KRITISCH) geht sofort raus;
  autoupdate.sh markiert seine KRITISCH-Meldungen ausdruecklich.
- backup.sh sichert zusaetzlich ~/.hermes/memories, SOUL.md, skills/, scripts/, den
  Box-Wart-Zustand (/srv/models/mc2-*.json), User-Units, llama-swap-Drop-ins und Lucys
  Stimmreferenz. restore.sh spielt Gedaechtnis und Zustand nur zurueck, wenn sie fehlen
  oder --mit-gedaechtnis gesetzt ist.
- Update-Verlauf zaehlt die Morgenmeldung nicht als eigenen Lauf.
- Waechter und Flugplan kennen den neuen Timer; deploy.sh installiert ihn.
- .claude/settings.local.json aus dem Repo genommen (lokal behalten), .gitignore ergaenzt.
- ruff wieder gruen (4x RUF100), AGENTS.md: Deploy macht git pull, Remote ist SSH.

Tests: 86 gruen (neu: Nachtruhe, Dringendes, Morgenmeldung inkl. Telegram-Ausfall).

Co-Authored-By: Claude Opus 5.5 <noreply@anthropic.com>
2026-09-24 14:42:19 +02:00

171 lines
8.8 KiB
Bash
Raw Blame History

This file contains ambiguous Unicode characters
This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.
#!/usr/bin/env bash
# Wiederherstellung eines mc2-state-Backups (siehe backup.sh).
# Stoppt die Dienste, spielt den Zustand zurück, startet neu — und macht VORHER
# automatisch ein Sicherheits-Backup des aktuellen Zustands (Restore ist reversibel).
#
# Nutzung:
# bash restore.sh --list # vorhandene Backups zeigen (lokal + Off-Box)
# bash restore.sh --dry-run <datei|latest> # nur anzeigen, was passieren würde
# bash restore.sh [--yes] <datei|latest> # wiederherstellen (--yes = ohne Rückfrage)
# bash restore.sh --mit-gedaechtnis … # Lucys Gedächtnis, SOUL, Skills, Cron-Skripte und
# # Box-Wart-Zustand auch dann zurückspielen, wenn sie da sind
# bash restore.sh --pull-offsite # Off-Box-Kopie (Proxmox) nach lokal holen
#
# Off-Box (C12): fehlt ein Backup lokal (z. B. Box-Platte neu), wird es automatisch
# vom Zweitgerät (Proxmox) geholt. Ziel/Key wie in backup.sh (überschreibbar per Env).
set -euo pipefail
MODELS_DIR="${MC_MODELS_DIR:-/srv/models}"
DEST_DIR="$MODELS_DIR/mc2-backups"
LSWAP="${MC_CONFIG_PATH:-/etc/llama-swap/config.yaml}"
HERMES="${HERMES_HOME:-$HOME/.hermes}"
SRC="${MC2_SRC:-$HOME/mission-control-v2}"
# Alle User-Dienste, die von wiederhergestellter Config abhaengen. mc2-gateway (der
# /v1-Denkpfad) und mc2-steward (Waechter) fehlten hier bis 27.08.2026 — nach einem
# Restore liefen beide mit der ALTEN llama-swap-/Hermes-Config weiter.
SERVICES="mission-control-2 mc2-gateway mc2-steward hermes-gateway"
OFFSITE="${MC_BACKUP_OFFSITE:-root@192.168.178.108:/var/lib/vz/mc2-backups}"
OFFSITE_KEY="${MC_BACKUP_OFFSITE_KEY:-$HOME/.ssh/mc2_offsite}"
OFFSITE_SSH="ssh -i $OFFSITE_KEY -o BatchMode=yes -o ConnectTimeout=10 -o StrictHostKeyChecking=accept-new"
# Off-Box-Tarballs (Dateinamen) auflisten — leer, wenn nicht erreichbar/konfiguriert.
offsite_ls() {
[ -n "$OFFSITE" ] && [ -f "$OFFSITE_KEY" ] || return 0
local host="${OFFSITE%%:*}" path="${OFFSITE#*:}"
$OFFSITE_SSH "$host" "ls -1 $path/mc2-state-*.tar.gz 2>/dev/null" 2>/dev/null | xargs -r -n1 basename || true
}
# Ein einzelnes Off-Box-Tarball nach lokal holen. $1 = Dateiname (basename).
offsite_fetch() {
[ -n "$OFFSITE" ] && [ -f "$OFFSITE_KEY" ] || return 1
mkdir -p "$DEST_DIR"
echo "→ hole $1 vom Zweitgerät ($OFFSITE)…" >&2
rsync -a -e "$OFFSITE_SSH" "$OFFSITE/$1" "$DEST_DIR/"
}
usage() { echo "Nutzung: restore.sh --list | restore.sh --pull-offsite | restore.sh [--dry-run] [--yes] [--mit-gedaechtnis] <datei|latest>"; }
list_backups() {
echo "Verfügbare Backups in $DEST_DIR:"
local found=0 f
for f in $(ls -1t "$DEST_DIR"/mc2-state-*.tar.gz 2>/dev/null || true); do
printf " %s (%s)\n" "$(basename "$f")" "$(du -h "$f" | cut -f1)"
found=1
done
[ "$found" = 1 ] || echo " (keine)"
local off; off="$(offsite_ls || true)"
if [ -n "$off" ]; then
echo "Off-Box ($OFFSITE):"
echo "$off" | sed 's/^/ /'
fi
}
[ $# -eq 0 ] && { usage; exit 1; }
DRY=0; YES=0; FULL=0; TARGET=""
for a in "$@"; do
case "$a" in
--mit-gedaechtnis) FULL=1 ;;
--list) list_backups; exit 0 ;;
--pull-offsite)
mkdir -p "$DEST_DIR"
[ -n "$OFFSITE" ] && [ -f "$OFFSITE_KEY" ] || { echo "Off-Box nicht konfiguriert."; exit 1; }
echo "→ spiegle Off-Box → lokal ($DEST_DIR)…"
rsync -a -e "$OFFSITE_SSH" --include='mc2-state-*.tar.gz' --exclude='*' "$OFFSITE/" "$DEST_DIR/"
list_backups; exit 0 ;;
--dry-run) DRY=1 ;;
--yes) YES=1 ;;
-*) usage; exit 1 ;;
*) TARGET="$a" ;;
esac
done
[ -z "$TARGET" ] && { usage; exit 1; }
# 'latest' bevorzugt lokal; fehlt lokal alles, das jüngste Off-Box-Tarball holen.
if [ "$TARGET" = "latest" ]; then
TARGET="$(ls -1t "$DEST_DIR"/mc2-state-*.tar.gz 2>/dev/null | head -1 || true)"
if [ -z "$TARGET" ]; then
latest_off="$(offsite_ls | sort | tail -1 || true)"
[ -n "$latest_off" ] && offsite_fetch "$latest_off" && TARGET="$DEST_DIR/$latest_off"
fi
fi
# Konkreten Namen zuerst lokal suchen, sonst vom Zweitgerät holen.
if [ ! -f "$TARGET" ]; then
base="$(basename "${TARGET:-}")"
if [ -f "$DEST_DIR/$base" ]; then
TARGET="$DEST_DIR/$base"
elif [ -n "$base" ] && offsite_ls | grep -qx "$base"; then
offsite_fetch "$base" && TARGET="$DEST_DIR/$base"
fi
fi
[ -f "$TARGET" ] || { echo "Backup nicht gefunden: ${TARGET:-<leer>}"; echo; list_backups; exit 1; }
echo "Restore-Quelle: $TARGET"
STAGE="$(mktemp -d)"; trap 'rm -rf "$STAGE"' EXIT
tar -xzf "$TARGET" -C "$STAGE"
echo "--- Inhalt ---"; cat "$STAGE/MANIFEST.txt" 2>/dev/null || true; echo "--------------"
if [ "$DRY" = 1 ]; then
echo "[dry-run] würde zurücksetzen:"
[ -f "$STAGE/hermes/config.yaml" ] && echo " • $HERMES/config.yaml"
[ -f "$STAGE/hermes/.env" ] && echo " • $HERMES/.env"
[ -d "$STAGE/hermes/plugins" ] && echo " • $HERMES/plugins/"
[ -f "$STAGE/llama-swap/config.yaml" ] && echo " • $LSWAP"
for teil in memories SOUL.md skills scripts; do
[ -e "$STAGE/hermes/$teil" ] || continue
if [ "$FULL" = 1 ] || [ ! -e "$HERMES/$teil" ]; then echo " • $HERMES/$teil"
else echo " $HERMES/$teil bleibt (vorhanden; --mit-gedaechtnis spielt es zurück)"; fi
done
echo " • Dienste neu starten: $SERVICES"
exit 0
fi
if [ "$YES" != 1 ]; then
echo "WARNUNG: Das überschreibt den AKTUELLEN Zustand und startet die Dienste neu."
read -r -p "Fortfahren? (tippe 'ja'): " ans
[ "$ans" = "ja" ] || { echo "Abgebrochen."; exit 1; }
fi
echo "→ Sicherheits-Backup des aktuellen Zustands…"
bash "$SRC/deploy/backup.sh" || echo " (Pre-Restore-Backup fehlgeschlagen — fahre fort)"
echo "→ Dienste stoppen…"
systemctl --user stop $SERVICES 2>/dev/null || true
# Alte Snapshots (vor 27.08.2026) tragen noch ein Gedaechtnis-Verzeichnis mit — es wird
# bewusst NICHT mehr zurueckgespielt, der zugehoerige Dienst existiert nicht mehr.
[ -f "$STAGE/hermes/config.yaml" ] && { mkdir -p "$HERMES"; cp -a "$STAGE/hermes/config.yaml" "$HERMES/"; }
[ -f "$STAGE/hermes/.env" ] && cp -a "$STAGE/hermes/.env" "$HERMES/"
[ -d "$STAGE/hermes/plugins" ] && { mkdir -p "$HERMES/plugins"; cp -a "$STAGE/hermes/plugins/." "$HERMES/plugins/"; }
[ -f "$STAGE/llama-swap/config.yaml" ] && cp -a "$STAGE/llama-swap/config.yaml" "$LSWAP" 2>/dev/null || true
# Hermes-Desktop-/Gate-Infrastruktur (Gegenstück zu backup.sh, 09.07.2026):
[ -d "$STAGE/hermes/agent-hooks" ] && { mkdir -p "$HERMES/agent-hooks"; cp -a "$STAGE/hermes/agent-hooks/." "$HERMES/agent-hooks/"; chmod +x "$HERMES/agent-hooks/"*.sh 2>/dev/null || true; }
[ -f "$STAGE/hermes/shell-hooks-allowlist.json" ] && cp -a "$STAGE/hermes/shell-hooks-allowlist.json" "$HERMES/"
[ -f "$STAGE/hermes/desktop-gateway-token" ] && { cp -a "$STAGE/hermes/desktop-gateway-token" "$HERMES/"; chmod 600 "$HERMES/desktop-gateway-token"; }
[ -f "$STAGE/hermes/pc-paths.yaml" ] && cp -a "$STAGE/hermes/pc-paths.yaml" "$HERMES/"
[ -f "$STAGE/hermes/systemd-dropins/session-token.conf" ] && { mkdir -p "$HOME/.config/systemd/user/hermes-builtin-ui.service.d"; cp -a "$STAGE/hermes/systemd-dropins/session-token.conf" "$HOME/.config/systemd/user/hermes-builtin-ui.service.d/"; chmod 600 "$HOME/.config/systemd/user/hermes-builtin-ui.service.d/session-token.conf"; systemctl --user daemon-reload 2>/dev/null || true; }
# Cron-Jobs + Radar-State (Gegenstück zu backup.sh, 10.07.2026) — der Gateway-Neustart unten
# lädt die wiederhergestellten Jobs:
[ -d "$STAGE/hermes/cron" ] && { mkdir -p "$HERMES/cron"; cp -a "$STAGE/hermes/cron/." "$HERMES/cron/"; }
[ -d "$STAGE/hermes/state" ] && { mkdir -p "$HERMES/state"; cp -a "$STAGE/hermes/state/." "$HERMES/state/"; }
# Lucys Gedächtnis, Seele, Skills, Cron-Skripte und Box-Wart-Zustand (Gegenstück zu backup.sh,
# 24.09.2026): nur zurückspielen, wenn sie fehlen (neue Platte) oder --mit-gedaechtnis gesetzt ist.
# Sonst würde ein Restore wegen einer kaputten Config Lucys neuere Erinnerungen überschreiben.
zurueck_wenn_noetig() { # $1 = Quelle im Backup, $2 = Ziel
[ -e "$1" ] || return 0
if [ "$FULL" = 1 ] || [ ! -e "$2" ]; then
mkdir -p "$(dirname "$2")"
if [ -d "$1" ]; then mkdir -p "$2"; cp -a "$1/." "$2/"; else cp -a "$1" "$2"; fi
echo " • zurückgespielt: $2"
fi
}
zurueck_wenn_noetig "$STAGE/hermes/memories" "$HERMES/memories"
zurueck_wenn_noetig "$STAGE/hermes/SOUL.md" "$HERMES/SOUL.md"
zurueck_wenn_noetig "$STAGE/hermes/skills" "$HERMES/skills"
zurueck_wenn_noetig "$STAGE/hermes/scripts" "$HERMES/scripts"
for f in "$STAGE"/box-wart/mc2-*.json; do
[ -e "$f" ] && zurueck_wenn_noetig "$f" "$MODELS_DIR/$(basename "$f")"
done
echo "→ Dienste starten…"
systemctl --user start $SERVICES 2>/dev/null || true
sleep 4
printf "→ Health: "; curl -sf http://127.0.0.1:9001/api/health && echo || echo "(Backend nicht erreichbar — Logs prüfen)"
echo "OK — Restore abgeschlossen."