Später · 22 Ausreißer ohne feste Schwellen: Normalwert je Wochenstunde

- kern/ausreisser.py: 168 Fächer je Reihe (CPU, GPU, Speicher, Temperaturen, Netz), erst genau, ab acht Werten
  gleitend; auffällig ab 4 Streuungen und Mindestabstand, erst mit drei Wochen Erfahrung; Ausreißer gekappt gelernt
- services/ausreisser.py: Wächter beider Rollen, gelber Hinweis nach zwei auffälligen Stunden mit Normalwert und
  Wochenstunde im Satz; erster Lauf lernt aus den aufbewahrten acht Tagen
- Monitoring: Zeile mit Lernwoche bzw. was gerade auffällt; GET /api/ausreisser, /api/homelab/ausreisser

Co-Authored-By: Claude Opus 5.5 <noreply@anthropic.com>
This commit is contained in:
Hitonabi
2026-09-26 10:04:30 +02:00
co-authored by Claude Opus 5.5
parent 904598031a
commit 2972cdfeca
32 changed files with 414 additions and 27 deletions
+6
View File
@@ -211,6 +211,12 @@ die der Orchestrator dort vor Updates anlegt (ein Snapshot geht beim PBS nicht).
Wie beim Monitoring der KI-Box: Zeitraum oben, darunter der Proxmox-Host (CPU, Speicher, Temperatur, Systemplatte,
Netz) und für jeden Gast CPU und Speicher. Die Werte kommen jede Minute vom Ausführer auf dem Proxmox-Host.
**Ungewöhnliches ohne feste Grenzen** (seit 26.09., auf beiden Monitoring-Seiten): Der Orchestrator lernt für jede
Stunde der Woche, was bei jedem Gerät üblich ist (CPU, Speicher, Temperatur, Netz). Liegt ein Wert zwei Stunden lang
weit darüber, kommt ein gelber Hinweis wie „Gitea braucht seit 2 Stunden ungewöhnlich viel CPU: 35 % statt sonst etwa
3 % dienstags gegen 20 Uhr“. Gemeldet wird erst mit drei Wochen Erfahrung; bis dahin steht über den Verläufen, in
welcher Lernwoche er ist. Ist es gewollt (ein Update, eine Sicherung), schalte den Hinweis 24 Stunden stumm.
## Homelab · Protokoll
Was der Homelab-Teil getan hat, neueste zuerst und nach Tagen: Aufträge an den Ausführer (Snapshot, Update, Suche …),
+11
View File
@@ -359,6 +359,17 @@ roten Hinweise per HTTP dorthin (`MC_PARTNER_URL` aus `/etc/mc2/homelab.env`).
hermes-gateway` (der Deploy startet das Gateway bewusst nicht neu). Prüfen:
`grep "homelab-orchestrator" ~/.hermes/logs/agent.log | tail -1` nennt die Zahl der Werkzeuge.
## Ausreißer ohne feste Schwellen (seit 26.09.)
`backend/kern/ausreisser.py` lernt je Messreihe (Box: `box`; Homelab: `pve`, `ct-*`, `vm-*`) und Größe (cpu, gpu, ram,
temp_cpu, temp_gpu, netz_rx, netz_tx) den Normalwert je Wochenstunde (168 Fächer, `[Anzahl, Mittel, Varianz]`, ab
acht Werten gleitend) in `<Datenordner>/mc2-normalwerte.json`. Der Wächter ruft `services/ausreisser.pruefe_ausreisser`
jede Minute; gerechnet wird jede neu abgeschlossene Stunde (beim ersten Mal die acht aufbewahrten Tage). Auffällig:
Stundenmittel ≥ 4 Streuungen UND ≥ Mindestabstand über dem Fach (CPU 15 Punkte, GPU 20, Speicher 10, Temperatur
8 °C, Netz 2 MB/s), erst ab drei Wochen im Fach; zwei Stunden hintereinander → gelber Hinweis. Ein Ausreißer geht
gekappt ins Fach ein. Stand: `curl -s http://127.0.0.1:9001/api/ausreisser` bzw. `/api/homelab/ausreisser`. Neu anfangen:
die Datei löschen und den Steward neu starten.
## Messwerte (Monitoring, seit 24.09.)
Jede Minute ein Punkt je Gerät, gelesen als letzte Stunde, letzter Tag oder letzte Woche (Aufbau in