Später · 18 Plattengesundheit: Proxmox-Host, NAS über SNMP, NVMe der KI-Box
- kern/platten.py: SMART aus pvesh, smartctl und SNMP in einer Form; rot bei SMART FAILED, kritischer Warnung, aufgebrauchter Reserve, ≥ 90 % verbraucht; gelb bei ≥ 80 %, Hitze, gewachsenen Fehlerzählern (Ausgangslage je Platte, „Zur Kenntnis genommen“ setzt sie neu) - Ausführer: stündlich disks/list + disks/smart im Bericht (nur lesend) - services/homelab/nas_snmp.py: kleiner SNMPv2c-GetBulk-Leser ohne neue Abhängigkeit, QNAP hdTable/diskTable, Zugang 0600, Einstellungen „Verbindung testen und speichern“ - services/platten.py: NVMe der KI-Box über sudo smartctl (smartmontools am 26.09. nachinstalliert) - Wächter beider Rollen, Plattenfeld in beiden Cockpits, Doku Co-Authored-By: Claude Opus 5.5 <noreply@anthropic.com>
This commit is contained in:
co-authored by
Claude Opus 5.5
parent
5325544d89
commit
904598031a
@@ -301,6 +301,19 @@ laufen lassen. Achtung: `ausfuehrer-einrichten.sh` schreibt `/etc/mc2-ausfuehrer
|
||||
gerade „Alle aktualisieren“ oder ein Update, wartet es eine Minute. Einstellungen: `/var/lib/mc2/homelab-wartung.json`
|
||||
(Oberfläche: Einstellungen → Homelab), Stand des letzten Fensters: `/var/lib/mc2/homelab-wartung-stand.json`. Die
|
||||
Läufe schreiben Oberfläche und Steward in dieselbe Datei — seit 26.09. unter `flock`.
|
||||
- **Plattengesundheit (seit 26.09.):** Der Ausführer liest stündlich `pvesh get /nodes/<node>/disks/list` und je Platte
|
||||
`disks/smart` (nur lesend) und schickt beides im Bericht (`host.platten`); ausgewertet wird in `backend/kern/platten.py`
|
||||
(rot: SMART FAILED, kritische Warnung, Reserve aufgebraucht, ≥ 90 % verbraucht; gelb: ≥ 80 %, zu heiß, gewachsene
|
||||
Fehlerzähler). Ausgangslage je Platte in `/var/lib/mc2/platten-basis.json` (Box: `/srv/models/platten-basis.json`),
|
||||
„Zur Kenntnis genommen“ setzt sie neu. Das NAS über SNMP v2c (`services/homelab/nas_snmp.py`, eigener kleiner
|
||||
GetBulk-Leser, UDP 161): QNAP NAS-MIB `hdTable`, sonst QTS-MIB `diskTable`; Zugang in `/var/lib/mc2/nas-snmp.json`
|
||||
(0600), abgefragt höchstens alle 10 min. Die KI-Box liest ihre NVMe mit `sudo -n smartctl -j -a` (Paket
|
||||
`smartmontools`, am 26.09. nachinstalliert — bei einem Neuaufbau `sudo apt install smartmontools`).
|
||||
- **Geräte im Heimnetz (seit 26.09.):** AdGuard sieht in diesem Netz fast nur die Fritzbox (sie reicht die Anfragen
|
||||
weiter), deshalb pingt der Ausführer alle 30 min jede Adresse des /24 an `vmbr0` an und liest `ip neigh` (MAC, IP,
|
||||
Rückwärtsname; nur lesend, größer als /24 nie). Register `/var/lib/mc2/netz-bekannt.json`; der erste Abgleich nimmt
|
||||
alles als bekannt, Gäste des Hosts und neue MACs mit bekanntem Namen ebenso. Neues: einmal eine Nachricht, dazu ein
|
||||
gelber Hinweis mit „Ist bekannt“. Liste: `curl -s http://192.168.178.31:9001/api/homelab/netz | jq`.
|
||||
- **Wöchentliches Suchen:** Der Steward legt für jeden freigegebenen, laufenden Container, dessen Paketlisten älter als
|
||||
7 Tage sind, den Auftrag `suchen` an (nur `apt-get update` bzw. `apk update` im Gast, es wird nichts installiert):
|
||||
nachts 02:00–05:00, höchstens einmal je Gast und Tag, nicht während eines Updates; war die Instanz nachts aus, gleich
|
||||
|
||||
Reference in New Issue
Block a user